OpenAIは「告白」メカニズムを開始し、研究によるとGPT-5モデルを告白を通じて訓練することで「自己申告」率を大幅に向上させることができるとされています
OpenAIは「How to Make Language Models More Honest Through Confession(自白を通じて言語モデルをより正直にする方法)」に関する研究を発表し、モデルに別の「自白出力」を追加することを提案しました。これは、答えが指示に違反しているか、不正行為...
AI情報 • Admin •
102