テストの仕組み
尋問者が人間とコンピュータの二者とテキストで会話を行います。十分な尋問を行った後、尋問者がどちらが機械であるかを確実に判別できなければ、そのコンピュータはテストに合格したとみなされます。チューリングは、2000年までに、5分間の会話の後でコンピュータが尋問者の30%を欺くことができるだろうと予測しました。彼は概ね正しく、2014年になってようやくチャットボットがそれを達成したと主張できるようになりました。
チューリングテストへの批判
哲学者のジョン・サールによる「中国語の部屋」の議論(1980年)が最も有名な批判です。サールは、中国語の記号に応答するためのルールブックを持ち、中国語を理解せずに正しく応答できる人物が部屋に閉じ込められていると想定しました。その部屋は中国語のチューリングテストに「合格」しますが、実際には何も理解していません。サールは、記号を操作すること(コンピュータが行っていること)は、理解することとは異なるのだと論じました。
AIはチューリングテストに合格したか?
2014年、ユージン・グーツマンという、13歳のウクライナ人の少年をシミュレートするチャットボットが、コンテストで審査員の33%を人間に誤認させ、「合格」したという主張を促しました。ほとんどのAI研究者はこの評価を拒絶しました。チャットボットは、知性を示すのではなく、架空の人格を利用して知識の欠如を言い訳にしたに過ぎなかったからです。現代の大規模言語モデルははるかに説得力がありますが、公式なチューリングテストの競争における合意は存在しません。
なぜ今も重要なのか
チューリングテストは、機械の知性の問題を形而上学から行動へと移行させました。「思考とは何か?」から「システムは何ができるか?」へ焦点を変えたのです。これは何十年にもわたってAI研究の指針となり、ほとんどのAI研究者が特定のドメイン向けのベンチマークへと移行した今日でも、機械の意識を巡る議論における有益な概念的アンカーであり続けています。
よくある質問
チューリングテストとは何ですか?
チューリングテスト(イミテーション・ゲーム)とは、コンピュータがテキスト会話を通じて人間を人間だと確信させることができれば、それは「思考」しているとみなされる、という提案です。1950年にアラン・チューリングによって提案されました。
AIはチューリングテストに合格したことはありますか?
2014年にチャットボットのユージン・グーツマンが審査員の33%を欺いて合格したと主張しましたが、ほとんどのAI研究者はその主張を否定しました。チャットボットは本物の知性ではなく(非母国語話者の子供を装うなどの)トリックを使用したためです。現代のLLMははるかに強力ですが、決定的なテストに正式に合格したものはありません。
中国語の部屋とは何ですか?
ジョン・サール(1980年)は、中国語の記号を操作するルールに従う人間は、中国語を理解せずに正しい回答ができるかもしれないと論じました。これはコンピュータが意味を理解せずに記号を操作するのと同じです。この議論は、記号操作が本物の理解となり得るかを問い直すものです。