图灵测试76年后,AI第一次真正"通过"了——但问题比答案更多

图灵测试76年后,AI第一次真正"通过"了——但问题比答案更多
图灵在1950年提出那个著名测试的时候,可能没想到76年后有人真的把它过了。
加州大学圣地亚哥分校的研究给出了一个数字:GPT-4.5在对话中被误认为人类的概率是73%,显著超过真人对照组。
73%。不是碰巧,不是作弊,是正式实验结论。
研究设置了5到15分钟的自由对话,四位裁判分别与人类和AI交谈,然后判断对面是不是人。GPT-4.5拿到了73%的"这是人类"票。相比之下,LLaMa-3.1-405B是56%,跟真人差不多。GPT-4o只有20%——比你家的ELIZA聊天机器人好不了多少。
这里有个关键细节:GPT-4.5之所以能过,是因为它被给了"提示词"。
这个提示词告诉它:模仿人类的语气,带一点幽默感,偶尔犯个小错误,不要太完美。不要像AI那样每句话都滴水不漏。