Bancs d’essai
Il s’agit d’instantanés statiques de classements publics, actualisés manuellement, et non de mesures OpenCodex en direct. Chaque tableau indique sa source, sa date de capture et sa note de licence. Les classements par score et par dollar n’apparaissent que dans les tableaux où chaque ligne comporte un coût par tâche mesuré à la source.
Les tableaux sont regroupés par domaine de tâches :
- Programmation — DeepSWE, AA Coding Agent, FrontierCode, FrontierSWE, Program Bench, SWE Marathon
- Frontend — Frontend Code Arena
- Terminal — Terminal Bench 2.1
- Sécurité — Cybench
- Intelligence — AA Intelligence Index

