南非勞工法院因涉嫌AI幻覺法律引用暫停Matjhabeng紀律處分案件
重點速覽
- •南非勞工法院在初步證據顯示聽證會主席可能在六月裁決中引用了不存在或被誤述的法律依據後,暫停了針對三名Matjhabeng地方政府員工的紀律處分程序。
- •K Allen-Yaman法官警告,如果AI生成了受爭議的引用,裁決不能成立,表明司法機構對未經驗證的聊天機器人生成法律參考文獻持零容忍態度。
- •南非通訊與數字技術部在記者發現一份已通過內閣審議並公布徵求公眾意見的文件中存在虛構學術參考文獻後,撤回了其《國家人工智能政策草案》。
- •內政部《公民身份、移民和難民修訂白皮書》中發現了一百多條虛構引用,延續了政府機構引用失誤的模式。
- •全球數據庫已記錄超過1,300宗法院確認的AI幻覺案件,發表在Nature上的研究發現包含虛構引用的學術論文比例在2024年至2025年間增長了約九倍。

南非勞工法院已暫停針對Matjhabeng地方政府三名員工的紀律處分程序,此前員工律師提出初步證據,顯示聽證會主席在作出關鍵裁決時可能依賴了幻覺式的AI生成法律依據。
員工律師指出,除了一項引用的依據外,聽證會主席在六月裁決中引用的法律文獻來源要麼不存在,要麼內容與主席所聲稱的大相徑庭。該質疑針對主席作出的兩項裁決,並對紀律處分程序的公正性提出了嚴重疑問。
在其判決中,K Allen-Yaman法官沒有直接認定人工智能撰寫了主席的裁決理由。然而,她警告說,如果AI工具生成了這些引用,「裁決不能成立」,並表示根據南非法院已經確立的標準,盲目依賴聊天機器人是不可接受的。此處的「幻覺」一詞是指大型語言模型生成流暢、聽起來自信的文本——包括案件名稱、引用和法律原則——但這些內容是虛構的,因為模型是在預測看似合理的語言,而非檢索經過驗證的事實。
此案發生在南非通訊與數字技術部被迫撤回其《國家人工智能政策草案》僅三個月後,此前News24發現該文件67條學術參考文獻中有一部分是虛構的,或指向並未發表所引用作品的期刊。該文件在核實其學術依據的真實性之前,已經通過內閣審議並在政府公報上公布以徵求公眾意見。該部門兩名高級官員後來在Rapport的調查報道中被點名,並被要求在四月底前作出解釋。
這一事件並非南非政府機構近期唯一的引用爭議。內政部不久前也遭遇了類似問題,記者在《公民身份、移民和難民修訂白皮書》的參考文獻清單中發現了一百多條虛構的引用。該部門辯稱,虛構的引用僅限於一份獨立的清單,不影響政策的實質內容。這一辯護與AI政策案件中的論點如出一轍:來源錯誤,但結論正確。
南非司法機構至少從2025年1月就開始應對這一問題,當時誇祖魯-納塔爾高等法院在Mavundla v MEC for Co-Operative Government and Traditional Affairs案的判決中,揭露了一名見習律師使用ChatGPT起草的辯論綱要。該文件包含一個虛構的案件「Hassan v Coetzee」,其依據的法律原則看似合理,但完全是捏造的。
此後,約翰內斯堡高等法院在Northbound Processing v South African Diamond and Precious Metals Regulator案中,將使用虛假法律依據的律師移交法律執業委員會處理。在該案中,一名法官甚至在法庭上通過運行實時提示,演示了ChatGPT可以多麼輕易地編造案件。
南非屢現AI引用醜聞
這些案件不僅僅指向個別從業人員或官員的孤立魯莽行為。它們還反映了一個更廣泛的制度性缺陷:依賴那些無法被信任來驗證其生成材料準確性的工具。生成式AI模型的設計目的是生成流暢且自信的文本,而不一定是準確的文本。一個虛構的憲法法院判決可以像真實判決一樣閱讀,直到有人試圖查找和驗證它。
南非法院和政府部門正通過一次又一次的醜聞發現,聽起來正確和實際正確是兩回事。法律執業委員會和勞工法院都已表明對使用虛假依據的嚴格立場,而Matjhabeng案件表明,這一問題已經超出了在截止日期壓力下工作的初級律師的範圍。
這一問題現在已延伸到準司法決策領域,在那裡裁決可能影響工人的工作和生計。如果一個紀律處分主席可以依賴幻覺式的引用來為影響三名員工的裁決辯護,那麼在任何需要公職人員行使獨立判斷而非照搬聊天機器人生成內容的地方,同樣的風險都可能出現。
國際數據表明,這一風險正在增加。Damien Charlotin的數據庫已在全球法院記錄了超過1,300宗確認的AI幻覺案件: v. Avianca,紐約的一名聯邦法官對兩名提交包含六個由ChatGPT生成的虛構案件的法律簡報的律師進行了處罰,其中一人曾使用該工具驗證另一人生成的引用。發表在Nature上的研究發現,包含至少一條虛構引用的學術論文比例在2024年至2025年間增長了約九倍。
南非並非AI生成虛假引用這一更廣泛問題中的異例。它是最清晰的例子之一,說明機構對AI輔助工作的信任可以多麼迅速地超越機構驗證它的能力。