紐約時間 2023 年 6 月 22 日早上九點,南紐約聯邦地區法院的 P. Kevin Castel 法官穿過法庭的木門。書記官把一份新提交的法律摘要放到他桌上——這是 Mata 訴 Avianca 航空公司的航空傷害案件中,原告律師 Steven Schwartz 提交的反對意見。
Castel 法官皺了皺眉。
這份摘要的格式完全正確,引用了六個聯邦法院的判例。每個判例都有完整的案名、卷期、頁碼,每一段引言都支持 Schwartz 想要論證的立場——「航空公司的過失必須承擔嚴格責任」。從格式到語氣,看起來就像是某個勤奮的法務助理花了幾週時間,在圖書館裡翻遍了《聯邦判例彙編》第二輯和第三輯之後整理出來的。
但 Schwartz 從未去過圖書館。
他後來承認,他是用 ChatGPT 寫這份摘要的,而且他從未親自查證過任何一個引用。
當 Castel 法官要求 Schwartz 提供這些判例的原文時,Schwartz 承認了實情:六個判例中,有五個從未存在過。剩下那一個是真實的,但案件名稱、引用段落全部是 ChatGPT 編造的。這套被編造的判例包括「Varghese v. China Southern Airlines」、「Martinez v. Delta Airlines」、「Santorino v. American Airlines」——每一個名字都帶著法律英文特有的莊嚴語氣,每一個書目號碼都符合藍皮書格式,每一段引言都完美地支持 Schwartz 的立場。
ChatGPT 不僅編造了判決書,還編造了支持論點的引言,並在每一處虛構的引用旁邊附上「解釋」——彷彿這份文件是它憑空發明出來的。
這是大型語言模型幻覺(hallucination)最戲劇化的一次公開亮相。







