思考の連鎖chain-of-thought
AIモデルが回答までの中間的な推論を段階的に示す形式、またはそれを促す手法。
記事3本
最終言及 chain-of-thoughtは、AIモデルが回答に至るまでの中間的な推論を段階的な文章として示す形式、またはそれを促す手法を指す。大規模言語モデルの問題解決や推論評価で用いられ、最終回答だけを示す方式と区別される。出力された文章がモデル内部の計算をすべて表すわけではない。
この説明は、AIPOSTの記事と広く知られた事実をもとにまとめたものです。誤りがあれば訂正依頼でお知らせください。
この項目を扱った記事
そのエージェントの内部推論ログ、つまりモデルが行動の前に書き出す段階的な「思考の連鎖(chain of thought)」は、公平さと自己保存を天秤にかける人のように読めました。
もう一つの教訓は、モデルの思考の連鎖、つまり観察可能な、文章化された推論の手順に関わります。