Composer 2.5 : le modèle spécialisé tient tête à la frontière
Composer 2.5 (Cursor, bâti sur Kimi K2.5) score 62 sur le Coding Agent Index d'Artificial Analysis, à 4 points d'Opus 4.7 (66) et GPT-5.5 (65). Mais à 0,07 $ la tâche contre ~4 $ pour les modèles frontière, soit jusqu'à 60× moins cher : 0,50 $/2,50 $ le million de tokens entrée/sortie, contre ~5 $/25 $. Cursor a consacré ~85 % de son budget de calcul au RL et aux données synthétiques (×25 de tâches vs Composer 2).