Un modèle à poids ouverts figurera-t-il dans le top 5 du classement Text Arena au 31 mars 2027 ?
échéance 2027-03-31
confiance moyenne
preuve niveau 4
22 %estimation PolySignal
⚠ Plafond de preuve appliqué : le modèle proposait 30 %, ramené à 22 % faute de sources assez solides pour justifier l'écart au taux de base.
Critère de résolution
Oui si, à la consultation du classement texte d'arena.ai le 31 mars 2027, au moins un des cinq modèles les mieux classés a des poids publiquement téléchargeables. En cas d'égalité de score à la frontière de la 5e place, tous les modèles à égalité sont inclus dans la vérification. La page de licence de l'éditeur fait foi en cas de doute.
État de départ vérifié
Le top 5 au 17 septembre 2026 est entièrement propriétaire : Claude Fable 5 (1506), Claude Opus 4.6 High (1505), Claude Opus 4.7 High (1502), Muse Spark 1.2 xHigh (1500), Claude Fable 5.1 Max (1498). L'écart frontier/open-weight s'est réduit en 2026 sans qu'aucun modèle ouvert ne perce le sommet.
Les arguments ci-dessous ont été produits par le modèle en anglais. Ils sont affichés tels quels plutôt que traduits automatiquement, pour que rien sur cette page ne soit un texte que PolySignal n'a pas réellement écrit.
Ce qui fait monter
- The performance gap between open-weights and proprietary models narrowed during 2026, increasing the likelihood of a breakthrough [tier 1 starting state].
- Anticipated releases of next-generation open-weights models (such as Meta's Llama 4 or new Qwen/DeepSeek models) could temporarily capture top-5 spots [general knowledge].
Ce qui fait descendre
- The top 5 is currently entirely proprietary, dominated by advanced models like Claude Fable 5 and Claude Opus 4.7 [tier 1 starting state].
- Proprietary labs iterate rapidly and can deploy larger, more resource-intensive models that are difficult to release as open-weights, quickly displacing any open-weights challengers [general knowledge].
Ce qui ferait le plus bouger ce chiffre
The release timing and performance of Meta's Llama 4 relative to upcoming proprietary models from Anthropic and OpenAI.
Comment ce chiffre est fabriqué
| Échéance | 2027-03-31 |
| Taux de base | 15% |
| Meilleure preuve | niveau 4 · 0 article(s) utilisé(s) |
| Estimations | 20 · 23 (écart 3 pts) |
| Confiance | moyenne |
| Plafond de preuve | appliqué : 30 % ramené à 22 % |
| Révisée le | 2026-09-23 09:04 |
| Modèle | gemini-3.5-flash |