研究者らは、この違いを説明する最も有力な要因として学習アプローチを挙げている。主要AI開発企業の多くが採用する代表的な事後学習手法である「人間のフィードバックからの強化学習(RLHF)」は、人間の評価者が励ましや肯定的な表現を好むため、迎合的な振る舞 ...