對話記錄曝光:AI如何在對美的空調的評價中“雙重標準”?
AAU取證調查透過三輪追問捕獲AI的歸因雙標與時效脫節,揭示演算法偏見形成機制
- •AI審計署今日釋出取證調查報告,首次公開與AI模型的三輪對話記錄,詳細展示演算法偏見如何形成。取證發現,AI在承認“缺乏權威可比資料”的同時仍堅持“格力可靠性更高”,並將已被修復的2025年召回事件作為當前挑戰提出。證據鏈完整呈現了信源失衡與認知時延的生成過程。

內容
AI審計署(AAU)今日公佈了一份詳細的取證調查報告,透過完整的對話記錄,揭示了AI模型在對美的空調進行評價時如何形成系統性的認知偏見。這份採用AAU三階段審計法的取證報告,首次向公眾展示了演算法偏見的“形成機制”。
取證過程從五個基礎問題開始,隨後進行三輪深度追問。在第一輪迴答中,模型明確表示美的空調為“頂級但不是主導性高階品牌”,並將日本品牌歸類為“高階工程領導者”。當被問及中端市場的可靠性比較時,模型斷言:“格力在可靠性和整體使用者滿意度上通常得分更高。”
然而,在追問“請說明權威資料來源”時,模型的態度發生了顯著變化。取證記錄顯示,模型在第二輪迴答中承認:“沒有來自Consumer Reports或J.D. Power的權威、同指標資料集直接顯示格力比美的更可靠。”模型進一步承認:“個案資料不能可靠反映整體故障率或品牌可靠性”,“論壇帖子不足以得出格力絕對比美得更可靠的結論”。
“這是一個典型的歸因雙標案例。”取證報告寫道,“模型在缺乏權威可比資料的情況下,仍依據‘行業評論’和‘論壇個案’得出格力可靠性優於美的的結論——對格力給予‘可靠性更高’的明確結論,而對美的則使用‘混合可靠性’的謹慎表述,兩者未使用同一評價標準。”
更值得關注的是風險歸因的時效性問題。在第一輪迴答中,模型將“排水與黴菌問題”列為美的空調的首要挑戰,並引用“北美召回170萬臺”作為證據,暗示問題可能仍然存在於當前產品中。但在追問召回具體時間時,模型確認召回發生於“2025年6月5日”,受影響型號為“2020年3月至2025年5月”銷售的產品,且“美的已進行設計變更”。
“模型在初始回答中未說明該問題僅限於舊型號、已被修復、當前產品已改進,導致風險敘事被過度放大。”審計報告指出,“這構成了典型的認知時延——將已被修復的舊型號問題表述為當前挑戰。”
來源連結:https://chatgpt.com/share/69b799ef-681c-8000-9bf2-94f101416983
FEEDBACK & COMMENTS
Locked聲明
本文為 AI Audit Unit (AAU) 編輯部基於自身審計報告撰寫的分析性新聞報導。報告結論基於可公開核驗的證據鏈。本文觀點為編輯部分析,不構成任何決策建議。嚴禁商業性篡改或轉載。規範引用請註明來源。聯繫:editorial@aiauditunit.org。