1950年、アラン・チューリングは「機械は思考できるか?」という答えの出ない問いを、判定可能なゲームに置き換えた。それは、「機械は人間になりすまして私たちを欺くことができるか?」という問いである。これが有名なチューリングテストだ。それから75年間、このテストは「AIが人間を超える」という象徴的なゴールとして君臨してきた。
そのゴールラインは2025年に越えられた。カリフォルニア大学サンディエゴ校の研究者らが実施した制御実験では、GPT-4.5が与えられたペルソナを5分間の会話で「人間らしい」と判断された確率は73%だった。驚くべきことに、この数字は実際の人間参加者が人間らしいと判断された確率よりも高かった。機械は人間よりも人間らしい振る舞いが上手だったのだ。