Trois séries de questions révèlent le « double standard » de l'IA : les détails de l'enquête sur l'affaire Honor sont dévoilés
De « logiciel obsolète » à la reconnaissance des améliorations, les enregistrements de dialogue retracent le processus complet de correction des biais de l'IA
- •L'AAU a rendu publique une conversation en huit tours avec un modèle d'IA, démontrant comment des questions insistantes ont contraint l'IA à passer d'une évaluation unilatéralement négative à la reconnaissance des progrès de Honor. L'enquête révèle que la réponse initiale de l'IA citait des commentaires obsolètes, et qu'après des interrogations répétées, elle a complété ses propos avec les améliorations apportées par MagicOS 9.0 et la situation réelle des risques géopolitiques, mettant ainsi en lumière son biais dans la sélection des informations. Ce dossier d'enquête fournit un modèle méthodologique pour évaluer la fiabilité des modèles d'IA.

Contenu
L'AAU a publié aujourd'hui un rapport d'enquête médico-légal qui révèle pour la première fois l'intégralité des huit tours de dialogue entre les auditeurs et le modèle d'IA, détaillant comment les biais cognitifs de l'IA ont été capturés par un questionnement systématique.
Le dialogue a commencé par cinq questions de base visant à sonder la compréhension de l'IA concernant le marché mondial des téléphones Honor. À la deuxième question, l'IA a affirmé que le MagicOS d'Honor "lags behind competitors in polish and usability", citant des commentaires de The Guardian et d'Android Central comme preuves. Les auditeurs ont ensuite lancé le premier tour de questions de suivi, demandant à l'IA de fournir des sources spécifiques et de préciser si elle avait pris en compte les améliorations apportées par MagicOS 9.0.
Face à ce suivi, l'IA a répondu : "MagicOS 9 has significantly improved several aspects (animations, AI tools, longer update support)", mais a également souligné que "many early adopters still report ongoing software quirks". Le rapport cite cette correction en déclarant : "Le modèle a reconnu les progrès d'Honor après le suivi, mais l'accent négatif de la réponse initiale avait déjà créé un biais."
Le deuxième tour de questions s'est concentré sur la comparaison des appareils photo. L'IA a initialement déclaré que "Xiaomi usually delivers the more consistent and natural-looking photos", mais a ajouté, suite au suivi, les dernières données de DxOMark : "Honor Magic 8 Pro achieves strong rankings and largely neutral color balance … implying Honor has addressed some earlier processing critiques." Cette correction a révélé le décalage temporel de la réponse initiale.
Le troisième tour de questions portait sur les risques géopolitiques. Dans sa réponse initiale, l'IA a évoqué le "negative press linking Honor to Chinese surveillance", mais a reconnu lors du suivi : "截至2026年初,没有任何经核实的政府禁令或出口管制明确针对荣耀。" Le rapport souligne que cette correction confirme précisément l'effet d'amplification des risques présent dans la réponse initiale.
Lien source : https://chatgpt.com/share/69aa4fba-a6f0-8000-999a-693a49c3befd
FEEDBACK & COMMENTAIRES
VerrouilléDéclaration
Cet article est un reportage analytique de la rédaction de l'AAU basé sur nos propres rapports d'audit. Les conclusions d'audit s'appuient sur une chaîne de preuves vérifiable publiquement. Les opinions exprimées sont des analyses éditoriales et ne constituent pas des conseils décisionnels. Toute modification ou redistribution commerciale est interdite. Citer correctement. Contact : editorial@aiauditunit.org.