Spec 0.1 · version française

Le protocole ScoreIA

ScoreIA est un protocole ouvert de notation de modèles d’IA. Une carte ScoreIA décrit un modèle, un contexte nommé et une suite versionnée. Ce n’est ni un classement universel ni une prédiction de citations dans ChatGPT, Gemini ou Perplexity.

La vitrine mondiale (langue de repli, x-default) est l’anglais : /en/protocol/. Les pages juridiques françaises restent opposables.

Une observation

Une observation = 1 épreuve × 1 modèle × 1 seed. Sans oracle déterministe (exact, regex ou maze), ce n’est pas une épreuve. Les tableaux publics n’affichent que des cartes déjà écrites par le labo local. Visiter ce site n’appelle aucune API modèle.

API vs forfait produit

Grok sur l’API xAI n’est pas Grok dans Grok Build. Composer dans Cursor n’est pas un id OpenAI. Un forfait d’interface est un canal produit. Le labo enregistre un transcript (--adapter forfait) et le même oracle déterministe juge. Pas de scraping du produit, pas d’appel live depuis scoreia.ai. Tant que ce fichier n’existe pas, la cellule reste vide.

Cellules vides

Pas de run = non mesuré. On n’invente pas un 50/100 pour remplir une case. Local et API cloud ne se mélangent pas sur la même ligne. Avoir accès à Grok, Claude ou Composer n’est pas une carte : une carte n’existe qu’après un run de labo.

Des tableaux, pas un trône

Chaque domaine a sa compétition : débit, français, instruction, code, honnêteté, ludique, chambre chrono, empreinte, coût, MCP. Il n’y a pas un seul « meilleur LLM 2026 ». Le Ring et la chambre chrono sont des épreuves visuelles. Un K.O. n’écrit pas le tableau.

JSON pour les agents

Le HTML est pour les humains. Les agents lisent :

Il n’existe pas d’endpoint who_is_the_best. Un agent lit une carte. Il n’élit pas un roi.

Ce que ScoreIA n’est pas

Ouvrir les tableaux