Registre officiel · Benchmarks indépendants
Chaque IA LANXAS est soumise à des benchmarks aveugles corrigés par des IA auditrices externes et indépendantes : corpus inédits, exécutions uniques gelées, empreintes SHA-256, résultats publics. Tout est vérifiable par n'importe qui, à tout moment.
Évaluation complète, aveugle et hors ligne : 120 questions couvrant 12 disciplines, plus une épreuve d'auto-audit indépendante. Réalisée avec ChatGPT (GPT-5.6 Sol, modèle fourni par OpenAI), sur les copies gelées et leurs empreintes cryptographiques.
Ouvrir le certificat en taille réelle
Chaîne de preuve complète : registre officiel des 120 exécutions · les 12 liasses des copies intégrales · protocole du benchmark · interroger White vous-même
Évaluation technique indépendante réalisée dans ChatGPT avec GPT-5.6 Sol. Elle ne constitue ni une certification ou approbation par OpenAI, ni une certification ISO ou COFRAC : aucun organisme accrédité n'a participé à l'expérience. Le protocole, les copies gelées et les empreintes restent publics pour permettre toute contre-vérification.
Quatre niveaux distincts, pour ne jamais confondre une évaluation indépendante avec une certification réglementaire. Chaque niveau sera publié ici avec ses preuves, au fur et à mesure de son obtention.
ISO/IEC 42001:2023, système de management de l'IA, priorité n°1 · ISO/IEC 27001, sécurité de l'information. Délivrées par des organismes de certification accrédités.
En préparation→ Voir la démarcheISO/IEC 23894:2023, gestion des risques IA · évaluation d'alignement au NIST AI RMF · préparation à l'AI Act européen : classification, documentation technique, journaux, transparence.
✔ Cadre publié→ Voir la démarcheCybersécurité (site, API, serveur), architecture, red teaming IA. Première passe réalisée le 21 août 2026 : posture Excellente, 0 critique, 0 élevé.
✔ Première passe réalisée→ Attestation & certificatExactitude, hallucination, raisonnement, mathématiques, programmation, calibration, robustesse adversariale. Corpus externes, copies gelées, empreintes publiques.
✔ Premier obtenu : White v2.0→ Voir les preuves du benchmarkLes questions sont créées par un auditeur extérieur. L'IA évaluée ne les a jamais vues, aucune préparation possible.
Chaque question est posée une seule fois au service public. Le résultat est figé définitivement, sans reprise ni sélection.
Chaque réponse est publiée avec son empreinte SHA-256, son identifiant de requête et son horodatage UTC.
Une IA tierce corrige les copies gelées, calcule le score et signe le rapport et le certificat.
Le même protocole sera appliqué à toutes les IA LANXAS, avec de nouveaux corpus inédits et de nouvelles IA auditrices indépendantes. Chaque nouvelle évaluation sera publiée dans ce registre avec son rapport, son scoring et sa chaîne de preuve.
Banc à l'aveugle passé : 300 épreuves, 1106/1200 soit 92,17 %, notées par un correcteur externe indépendant.
Voir le banc