M1 大久保 快起 (Kaiki Okubo)
大規模言語モデルの自己修正メカニズムの解明
ChatGPTなどの大規模言語モデルは、複雑な問題を順番に考えて答えを導きますが、途中で間違えると、そのまま誤った答えに進んでしまうことがあります。一方で、「Wait(待てよ)」などと自ら立ち止まり、間違いに気づいて答えを修正することもあります。そこで、モデルがいつ、何をきっかけに自分の間違いに気づき、考え直しているのかを、モデル内部の情報を調べることで明らかにすることを目指しています。
Loading…