Chaque intelligence artificielle LANXAS passe des épreuves inédites, exécutées une seule fois, puis figées pour toujours. Les questions, les réponses brutes, les horodatages et les empreintes cryptographiques sont publiés et vérifiables par tous, ouverts aux audits indépendants. La transparence n'est pas une promesse chez LANXAS, c'est une preuve.
Choisissez une intelligence artificielle pour consulter l'intégralité de ses épreuves : questions posées, réponses brutes non retouchées, empreintes cryptographiques et attestations techniques.
L'assistant souverain de LANXAS, qui achemine chaque demande vers le moteur le plus performant. White a passé l'intégralité du Blind Benchmark v2.0 : 120 épreuves inédites de mathématiques, logique, algorithmique, sécurité, systèmes distribués et anti-hallucination. Chaque réponse est horodatée et scellée par une empreinte SHA-256 recalculable. Questions et réponses intégrales publiées.
L'intelligence artificielle 100 % locale et souveraine de LANXAS, contrôlée par la porte assertionnelle AXIOM et le moteur de décision RuleCore. AI ONE a subi une campagne de 300 épreuves techniques en aveugle, notée par un correcteur externe indépendant : 1106/1200, soit 92,17 %, avec 235 réponses parfaites et une intégrité cryptographique vérifiée. Questions et réponses intégrales publiées.
La version renforcée de l'assistant LANXAS, dotée d'un niveau d'expertise supérieur pour les recherches approfondies, les dossiers longs et les analyses techniques. Blue a subi une campagne de 300 épreuves techniques en aveugle, notée par un correcteur externe indépendant : 1163/1200, soit 96,92 %, avec 289 réponses parfaites et une intégrité cryptographique vérifiée. Questions et réponses intégrales publiées.
La version ultra-puissante de LANXAS, qui orchestre les meilleurs moteurs d'IA pour le code complexe, le raisonnement technique et les livrables professionnels. Black a subi une campagne de 300 épreuves inédites de niveau maximal, à l'aveugle, corrigé scellé et exécution unique sans rejeu, notée par un correcteur externe indépendant : 1135/1200, soit 94,58 %, avec 261 réponses parfaites et une intégrité cryptographique vérifiée. Questions et réponses intégrales publiées.
L'agent de développement de bureau, multi-modèles. Son Niveau 1 a passé un benchmark à l'aveugle de 10 épreuves (correction de bugs, algorithmes, web, SQL, mathématiques, recherche documentaire avec liens, respect des consignes), jouées 3 fois. Questions figées et horodatées (OpenTimestamps / Bitcoin) avant exécution : 97,9 % de score moyen, 30/30 de réussite fonctionnelle, latence médiane 4,1 s, intégrité cryptographique vérifiée. Questions et réponses intégrales publiées.
Le registre central de toutes nos preuves : identifiants uniques, horodatages, empreintes cryptographiques, attestations de conformité et certificats techniques. Chaque pièce est recalculable par un tiers et le registre reste ouvert aux audits indépendants.
Des questions expertes conçues pour dejouer l'invention et l'hallucination, jamais communiquées à l'avance aux modèles évalués.
Chaque IA repond une seule fois, dans des conditions identiques, sans reprise ni retouche des réponses.
Chaque réponse est horodatée et scellee par une empreinte cryptographique : impossible de la modifier après coup sans que la preuve le révèle.
Les copies sont anonymisées puis notées par des correcteurs indépendants, y compris des IA externes concurrentes, sans connaitre l'identité du candidat.
Chaque preuve est reproductible. Recalculez l'empreinte SHA-256 d'une réponse et comparez-la à celle publiée : elles doivent etre strictement identiques.