Banc d’essai d’intelligence
AA Intelligence Index
Instantané indicatif inspiré du coût par tâche de l’Artificial Analysis Intelligence Index : réponse, raisonnement, écriture en cache, lecture du cache et entrée. Les totaux correspondent aux chiffres publiés lorsqu’ils sont indiqués ; la ventilation est approximative pour les besoins du graphique. Il ne s’agit pas de mesures OpenCodex en direct.
| Modèle | Niveau | Score | Coût par tâche | Score par dollar | Cas d’usage |
|---|---|---|---|---|---|
| claude-fable-5 | max | 60 | $3.25 | 18.5 | Planification, Pointe |
| gpt-5.6-sol | max | 59 | $1.04 | 56.7 | Pointe, Planification |
| gpt-5.6-sol | xhigh | 58 | $0.88 | 65.9 | Pointe, Polyvalent |
| claude-opus-4.8 | max | 57 | $1.78 | 32.0 | Pointe, Planification |
| gpt-5.5 | xhigh | 56 | $0.99 | 56.6 | Pointe, Polyvalent |
| gpt-5.6-terra | max | 55 | $0.55 | 100.0 | Polyvalent |
| gpt-5.6-luna | max | 51 | $0.21 | 242.9 | Polyvalent, Sous-agent économique |
| gemini-3.1-pro | preview | 46 | $0.32 | 143.8 | Pointe, Rapide |
| deepseek-v4-proMeilleur rapport qualité-prix | max | 44 | $0.04 | 1100.0 | Sous-agent économique, Polyvalent |
| grok-4.3 | high | 48 | $0.28 | 171.4 | Polyvalent, Rapide |
| glm-5.2 | max | 42 | $0.12 | 350.0 | Polyvalent, Sous-agent économique |
| claude-sonnet-4.6 | max | 49 | $1.15 | 42.6 | Polyvalent |

