v40 prof3 : 136,5/200, soit 68,2 %, contre Stockfish 16 skill 0 / depth 4. Le delta annoncé face à la baseline prof2 est de +40 points, soit +10,5σ selon le rapport.
INSTITUT IA INC. · FRÉDÉRIC TABARY · ORCID 0009-0004-5562-7385
Zoran Échecs —
journée de clôture.
Une campagne de bancs déterministes, de falsifications mémoire et de réplication adverse. Le résultat principal n’est pas « Zoran bat Stockfish » : c’est une cartographie expérimentale précise de ce qui fonctionne, de ce qui échoue et du domaine dans lequel chaque conclusion est recevable.
28,5/30, soit 95 %, dans une arène où la politique adverse est déterministe et publiée. Ce résultat ne s’étend pas automatiquement à un adversaire inconnu ou bruité.
C1–C5, puis arène v37 assainie : mémoire massive, sélective, fautive, gelée et mémoire par position restent nulles ou négatives. Le signal v35 à 53,6 % ne se réplique pas.
Stockfish pleine force à 100 ms/coup contre Zoran : 0/16. La prédiction préalable « 0–10 % » est cohérente avec cette limite, mais l’échantillon reste court.
Un résultat n’existe
qu’avec son adversaire.
Les niveaux Stockfish sont explicitement bridés dans les campagnes locales. R44 constitue une réplication indépendante utile, mais elle utilise Stockfish 18 Lite WASM à 32 nœuds par coup. Aucun score ci-dessous ne doit être transformé en Elo officiel.
Le passé stocké
ne suffit pas.
Cinq organes de mémoire par position exacte ont été mesurés. Le résultat n’est pas une absence d’apprentissage générale : c’est une borne sur cette représentation.
La mémoire massive C2 tombe à 24,2 % contre 29,5 % pour C1. La mémoire sélective C3 atteint 30,6 %, mais avec seulement 10 déviations. C4 et C5 restent nulles. C6, par motifs grossiers, sur-généralise et interdit trop de coups.
29,5 %→C2
24,2 % · FAIL→C3–C5
NUL→C6
SUR-TIR→C7
REPRÉSENTATION À TROUVER
Conclusion : la position exacte est trop rare ; le motif grossier est trop général. Le prochain organe doit être prédictif de la défaite et généralisable, avec un critère pré-enregistré.
Calculer le futur connu
plutôt que stocker le passé.
L’agent prophète simule les dix demi-coups futurs selon la politique exacte de l’adversaire. Dans son domaine déclaré — adversaire déterministe et connu — il obtient 28,5/30. Contre un adversaire bruité, le résultat reste à mesurer.
La prédiction prospective d’une politique déterministe connue peut être plus utile que la mémoire brute de positions passées.
Apprendre ou estimer une politique adverse inconnue sans réintroduire le bruit que le protocole cherche à mesurer.
FEN canonique, injectivité, aller-retour, perft, déterminisme, symétrie d’évaluation.
Sur les campagnes rapportées et les 1 400 parties R44.
Bug FEN, pic C4, chevauchement de graines, indices zombies, mémoire TT non conforme.
Les essais négatifs, les corrections et les limites restent dans le registre.
SHA-256 · ad3c43afe11e84d0455bf051f9755f98dd870cc21bad12fce74311ea89dd39aaSHA-256 · 7769132ccc0d3a508b1896f55fe7f57d6ad587a5d6725e65bbbfb5f2c1a29e40SHA-256 · 47045d4a5b45f16b2866ccb652a90b7764dbd70124a5a8fdd5f44432a12f055fLes rapports complets, codes, résultats JSON, drivers, classiques et manifestes sont conservés dans les archives. Les sources externes citées dans le rapport incluent Stockfish, chessgames.com, Wikipedia EN et le banc R44 indépendant. Les conclusions restent limitées aux protocoles, versions, adversaires et tailles d’échantillon indiqués.