6 modèles frontière classés en croisant trois sources : le feedback communautaire (40 %), le classement personnel de Cédric (30 %) et les mesures réelles du bench v2 (30 %). Une seule formule, zéro chiffre inventé.
2026-07-20 01:35 · juge : Maïa (Fable 5) · pondération reproductible · réserve d'honnêteté P21 sur les proxys mesure
Moyenne des 2 rapports : reddit/web (Thaïs) + X/YouTube/signets (Aimée). Sentiment /5 → /100. Le signal le plus lourd.
Le classement imposé : Fable 5 xhigh > Kimi K3 > GPT-5.6 Sol > GLM 5.2 > Grok 4.5 > MiniMax M3. Rang linéarisé /100.
Latence réelle du bench v2 (66 runs) → rapidité normalisée. Proxy famille pour les tiers max/xhigh (assumé).
FINAL = feedback 40 % + Cédric 30 % + mesure 30 %. Colonnes : FB (communauté /100), CED (rang /100), MES (rapidité /100), FINAL /100. Fable 5 xhigh : #1 sur les trois axes.
Feedback · rang Cédric · mesure · score final, par modèle. On voit d'un coup d'œil où chacun gagne ou perd. Cliquez une légende pour isoler.
Chaque source pondérée, la formule, et ce que ça change. Cliquez une carte.
Un OK sur Telegram et le registre des rôles s'aligne sur le pondéré — Fable 5 xhigh en juge/stratégie fort enjeu, Kimi K3 titulaire dès ses poids ouverts.
Benchmark v3 du 2026-07-20 01:35 — classement pondéré 3 sources, 6 modèles frontière.
Juge : Fable 5 · build Maïa · diffusion interne Zetamind