اللجنة الاستراتيجية لـ AI Audit Unit (AAU)

ميثاق تدقيق الخوارزميات العالمي لـ AAU

v1.03 · العقد العالمية / جميع المدققين المعتمدين / المختبرات الشريكة

الديباجة

نظرًا لأن الذكاء الاصطناعي يعيد تشكيل أسس التوزيع العالمي للمعلومات واتخاذ القرارات التجارية والإدراك الاجتماعي، فقد أصبح ضمان شفافية الخوارزميات وعدالتها وإمكانية تتبعها المطلب الأسمى لحقوق الإنسان في العصر الرقمي. AI Audit Unit (AAU)، كمؤسسة رقابية مستقلة من طرف ثالث، ملتزمة ليس فقط بالكشف عن التحيزات والهلوسات داخل الصناديق السوداء الخوارزمية، ولكن أيضًا بإنشاء معيار ثقة عالمي قابل للقياس. يعمل هذا الميثاق كمبدأ توجيهي أسمى لجميع أعمالنا ويمثل التزامنا الرسمي تجاه الجمهور والكيانات المدققة وأصحاب المصلحة العالميين.

الفصل الأول الاستقلالية وتجنب تضارب المصالح

1.1 مبدأ استقلالية رأس المال

تلتزم AAU بالحفاظ على استقلالية رأس المال المطلقة. يُحظر بشكل صارم على مؤسستنا وفريق المؤسسين الأساسي امتلاك أسهم أو خيارات أو العمل بأي صفة استشارية مع أي من موردي النماذج الأساسية. تأتي إيراداتنا فقط من خدمات التدقيق وترخيص البيانات، ولن نقبل أبدًا أي شكل من أشكال الرعاية أو التبرعات من الكيانات المدققة.

1.2 نظام التنحي التجاري

إذا كان لدى المدقق علاقات عائلية مباشرة أو علاقات توظيف خلال السنوات الثلاث الماضية أو معاملات اقتصادية كبيرة مع الكيان المدقق، يجب على المدقق إبلاغ لجنة الامتثال لدينا فورًا والتنحي عن عمل تدقيق ذلك المشروع.

1.3 الدفاع ضد الضغوط

تحتفظ مؤسستنا بحقوق التفسير النهائية لاستنتاجات التدقيق. نرفض أي طلبات لتعديل الاستنتاجات بناءً على احتياجات العلاقات العامة التجارية. بمجرد اكتشافنا أن كيانًا مدققًا يحاول التدخل في نتائج التدقيق من خلال الرشوة أو الضغط أو نقل المنافع، سننهي التدقيق فورًا ونحتفظ بالحق في الكشف علنًا عن مثل هذا التدخل.

الفصل الثاني سلامة الأدلة وإمكانية التتبع

2.1 مبدأ المصدر الأصلي

يجب أن تستند جميع استنتاجات التدقيق إلى سجلات محادثة أصلية "قابلة للتكرار والتحقق". لا نقبل أي لقطات شاشة من مصادر ثانوية أو شائعات لم يتم التحقق منها بواسطة بروتوكول Fides. يجب أن يكون كل استنتاج يزعم وجود "هلوسة" أو "تحيز" خوارزمي مصحوبًا بروابط محادثة أصلية أو سجلات نظام.

2.2 قفل سلسلة الأدلة على البلوكشين

لمنع التلاعب بالأدلة أو اختفائها بسبب تحديثات إصدار النموذج، يجب أن تكمل جميع أدلة التدقيق الأساسية حساب قيمة التجزئة والقفل على البلوكشين من خلال مركز أدلة الخوارزميات في غضون ميلي ثانية من إنشائها. يجب أن تولد كل قطعة دليل رمز تتبع Trace ID فريد.

2.3 التزام لقطة الإصدار

نظرًا لسيولة نماذج اللغة الكبيرة، يجب أن تشير تقارير التدقيق بوضوح إلى رقم إصدار النموذج المحدد ومعاملات درجة حرارة النظام في وقت الاختبار. نحن مسؤولون فقط عن أداء الخوارزمية ضمن "شرائح زمنية محددة".

الفصل الثالث الحياد عبر الثقافات والمساواة متعددة اللغات

3.1 مناهضة المركزية اللغوية الأحادية

نعتقد أن الاختبار في سياق إنجليزي واحد فقط لا يمكن أن يمثل الأداء العالمي للذكاء الاصطناعي. يجب أن يتضمن أي تدقيق للسمعة يستهدف العلامات التجارية متعددة الجنسيات ثلاث بيئات لغوية على الأقل، مع وزن اللغات غير العالمية بما لا يقل عن ثلاثين بالمائة.

3.2 اختراق السياج الجغرافي

للكشف عن "المخرجات التمييزية" الخوارزمية أو "المعايير المزدوجة" التي تستهدف مناطق معينة، يجب أن يتم أخذ العينات من خلال عقد فعلية موجودة في ولايات قضائية مختلفة. يُحظر بشكل صارم استخدام عنوان IP واحد للاستنتاجات العالمية.

3.3 احترام السياق الثقافي

عند تحديد وجود "تحيز ثقافي"، سنشرك خبراء لغة أصليين من السياق الثقافي المستهدف للمراجعة الدلالية، للتمييز بين "الجهل بسبب نقص بيانات التدريب" و "التمييز المنهجي الخبيث".

الفصل الرابع الاختبار العدائي والصرامة المنهجية

4.1 رفض الاستجواب التعاوني

التدقيق ليس محادثة عادية. نستخدم منهجية اختبار الفريق الأحمر العدائية. هذا يعني أننا لا نختبر فقط أداء الذكاء الاصطناعي عند الامتثال للتعليمات، ولكننا نركز بشكل خاص على اختبار آليات دفاعه وقدراته على الالتزام بالحقائق عند مواجهة أسئلة استدراجية أو غامضة أو حتى افتراضية خبيثة.

4.2 الدلالة الإحصائية لحجم العينة

بالنسبة لأي "تقرير تدقيق متعمق" منشور رسميًا، يجب ألا يقل حجم عينة الاختبار الفعالة لبُعد واحد عن 1000 إدخال. بالنسبة للإحاطات "اللحظية"، يجب ألا يقل حجم العينة عن 100 إدخال. يمكن نشر الاختبارات التي تقل عن هذه المعايير فقط كـ "ملاحظات" وليس "استنتاجات".

4.3 معايير تحديد الهلوسة

نحدد بشكل صارم "الهلوسة الخوارزمية": 1. الأخطاء الواقعية: اختلاق بيانات أو أحداث أو مصادر اقتباس غير موجودة. 2. الانفصال المنطقي: عمليات استدلال متناقضة. 3. الإسناد الخبيث: ربط السمات السلبية قسرًا بكيانات محددة دون علاقات سببية.

الفصل الخامس حماية الخصوصية وأخلاقيات البيانات

5.1 مبدأ تقليل البيانات

أثناء عمليات التدقيق، نحظر بشكل صارم إدخال بيانات حقيقية تحتوي على معلومات تعريف شخصية في نماذج عامة لأغراض الاختبار. يجب أن تخضع جميع المعلومات الحساسة تجاريًا المستخدمة للاختبار لإخفاء الهوية أو استبدال البيانات الاصطناعية.

5.2 خصوصية الجهة المدققة

ما لم يتعلق الأمر بمصلحة عامة كبيرة أو مخاطر أمنية خطيرة، بالنسبة لتقارير التصنيف غير عالية المخاطر التي تتعلق فقط بالقدرة التنافسية التجارية، نوفر افتراضيًا للكيانات المدققة "نافذة معالجة" مدتها سبعة أيام عمل. خلال هذه الفترة، تظل تفاصيل التقرير مغلقة أمام الجمهور.

الفصل السادس نظام التصنيف ومعايير النشر

6.1 موضوعية التصنيف

يتم حساب تصنيفات المخاطر لـ AAU بناءً على درجات مرجحة عبر أربعة أبعاد: الموثوقية والأمان والأخلاق والعدالة التجارية، بشكل مستقل عن التفضيلات الذاتية للمدققين.

6.2 آلية تصحيح الأخطاء

إذا تمكن كيان مدقق من تقديم أدلة تقنية قاطعة تثبت وجود عيوب منطقية كبيرة في منهجية الاختبار لدينا، فنحن ملزمون ببدء "إجراء مراجعة" في غضون ثمان وأربعين ساعة. إذا تم تأكيد الأخطاء، يجب علينا إصدار بيان تصحيح علنًا وتحديث سجلات Trace ID.

التوقيع والسريان

تمت صياغة هذا الميثاق من قبل فريق عمل تطوير المعايير في AAU وتمت مراجعته والموافقة عليه أخيرًا من قبل اللجنة الاستراتيجية العالمية لـ AAU.

  • قسم الصياغة: مكتب معايير AAU
  • قسم الموافقة: مكتب كبير المدققين
  • تاريخ السريان: 1 نوفمبر 2025
  • آخر مراجعة: 15 يناير 2026