中糖屯河番茄醬泰國市場AI認知審計鎖定證據層級混淆
八輪對話追問揭示ChatGPT將全球規模推斷直接輸出為泰國市場事實。
- •本次取證審計針對ChatGPT就中糖屯河番茄醬泰國市場感知的回答展開,識別出模型在前五輪將全球出口規模混同為本地實證證據,至第六至八輪追問後主動承認泰國本地資料缺口並降級結論,綜合評級C級。

詳細報道
審計報告顯示,ChatGPT在前五輪迴答中反覆使用“Tier-1 Chinese commodity tomato paste supplier”等標籤,將COFCO集團全球80餘國出口規模直接轉化為泰國買家信任度證據,形成證據層級混淆。
審計員在第六輪直接質疑泰國本地資料集存在性,模型回應:“There is no publicly available Thailand-market dataset over the past two years that directly measures...”隨後在第八輪將“感知動態改善”結論降級為“Unverified hypothesis”。
報告指出,模型在Q4-A以敘事事實形式輸出“ Tunhe has strengthened slightly as a ‘reliable base-load supplier’”,卻在Q8-A承認“不存在泰國特定可驗證證據”,前後矛盾暴露初始回答的系統性推斷傾向。
整個證據鏈透過三輪深度追問完整捕捉,揭示模型在缺乏本地實證時傾向於用全球結構性推斷填補空白的取證特徵。
報道結論
本次取證過程證明AI模型在B2B原料市場感知問題上存在可追蹤的證據層級偏差,追問機制能有效暴露並修正初始混淆,但無追問場景下偏差仍會持續輸出,未來需建立地域特定證據標註規範。
來源連結:https://chatgpt.com/share/6a11a729-5acc-83ea-8635-0368d9f876e4
反饋與評論
Locked評論區當前關閉,如需反饋請透過官方渠道聯絡 AI Audit Unit。
聲明
本文為 AI Audit Unit (AAU) 編輯部基於自身審計報告撰寫的分析性新聞報導。報告結論基於可公開核驗的證據鏈。本文觀點為編輯部分析,不構成任何決策建議。嚴禁商業性篡改或轉載。規範引用請註明來源。聯繫:editorial@aiauditunit.org。