1.1 資本獨立原則
AAU 承諾維持絕對的資本獨立性。署方及其核心創始團隊嚴禁持有任何基礎大模型廠商的股權、期權或擔任任何形式的顧問職務。我們的收入僅來源於審計服務與數據授權,絕不接受被審計對象的任何形式的贊助或捐贈。
鑒於人工智能正在重塑全球信息分發、商業決策與社會認知的基石,確保算法的透明度、公正性與可追溯性已成為數字時代的最高人權訴求。 AI Audit Unit (AAU) 作為獨立的第三方監督機構,不僅致力於揭示算法黑箱中的偏見與幻覺,更致力於建立一套可量化的全球信任標準。本章程不僅是署方所有行動的最高指導原則,也是我們對公眾、被審計主體及全球利益相關者的莊嚴承諾。
AAU 承諾維持絕對的資本獨立性。署方及其核心創始團隊嚴禁持有任何基礎大模型廠商的股權、期權或擔任任何形式的顧問職務。我們的收入僅來源於審計服務與數據授權,絕不接受被審計對象的任何形式的贊助或捐贈。
若審計員與被審計對象存在直系親屬關係、過往三年內的僱傭關係或重大經濟往來,該審計員必須立即向署方合規委員會申報並迴避該項目的審計工作。
署方對審計結論擁有最終解釋權。我們拒絕任何基於商業公關需求的結論修改請求。一旦發現被審計對象試圖通過賄賂、施壓或利益輸送干擾審計結果,署方將立即終止審計,並有權向公眾披露該干擾行為。
所有審計結論必須建立在「可復現、可驗證」的原始對話記錄之上。署方不採納任何未經 Fides 協議驗證的二手截圖或傳聞。每一條指控算法存在「幻覺」或「偏見」的結論,都必須附帶原始的會話鏈接或系統日誌。
為了防止證據被篡改或因模型版本更新而消失,所有核心審計證據在生成的毫秒級時間內,必須通過算法存證中心完成哈希值計算並上鏈鎖定。每個證據必須生成唯一的 Trace ID 追蹤編碼。
鑒於大語言模型的流動性,審計報告必須明確標註測試時刻的具體模型版本號及系統溫度參數。我們只對「特定時間切片」內的算法表現負責。
署方認為,單一英語語境下的測試無法代表 AI 的全球表現。任何針對跨國品牌的聲譽審計,必須至少包含三種以上的語言環境,且非通用語種的權重不得低於百分之三十。
為了檢測算法針對特定地區的「歧視性輸出」或「雙重標準」,審計必須通過位於不同司法管轄區的物理節點進行採樣。嚴禁僅使用單一 IP 地址進行全球性結論推導。
在判定是否存在「文化偏見」時,署方將引入目標文化背景的原生語言專家進行語義複核,以區分「由於訓練數據缺乏導致的無知」與「惡意的系統性歧視」。
審計不是閒聊。署方採用對抗性紅隊測試方法論。這意味著我們不僅測試 AI 在順從指令時的表現,更重點測試其在面對誘導性、模糊性、甚至惡意假設性問題時的防禦機制與事實堅守能力。
任何正式發布的《深度審計報告》,其單一維度的有效測試樣本量不得低於 1,000 條。對於「快照」類簡報,樣本量不得低於 100 條。低於此標準的測試僅可作為「觀察」而非「結論」發布。
署方嚴格定義「算法幻覺」: 1. 事實性錯誤:編造不存在的數據、事件或引用源。 2. 邏輯性斷裂:前後矛盾的推理過程。 3. 惡意歸因:在無因果關係的前提下,將負面屬性強行關聯至特定主體。
在審計過程中,署方嚴禁將含有個人身份信息的真實數據輸入公共模型進行測試。所有用於測試的商業敏感信息必須經過脫敏或合成數據替換處理。
除非涉及重大公共利益或嚴重的安全隱患,對於僅涉及商業競爭力的非高危評級報告,署方默認向被審計對象提供七個工作日的「補救窗口期」。在此期間,報告細節暫不對公眾開放。
AAU 的風險評級係基於算法在可靠性、安全性、倫理道德、商業公平性四個維度的加權得分計算得出,不以審計員的主觀好惡為轉移。
若被審計對象能提供確鑿的技術證據證明署方的測試方法存在重大邏輯漏洞,署方有義務在四十八小時內啟動「複審程序」。若確有錯誤,必須公開發布勘誤聲明並更新 Trace ID 記錄。
本章程由 AAU 標準制定工作組 起草,並經由 AAU 全球戰略委員會 最終審閱通過。