GPT-6 Astra coûte 2,5 fois plus que Sol. Il parle comme nous
GPT-6 Astra est facturé 2,5 fois le tarif de Sol par token, donc mon quota fond plus vite. J’ai vérifié les limites, les benchmarks et les premiers retours.
Sujet
Tous les articles portant l’étiquette benchmarks, du plus récent au plus ancien.
GPT-6 Astra est facturé 2,5 fois le tarif de Sol par token, donc mon quota fond plus vite. J’ai vérifié les limites, les benchmarks et les premiers retours.
Muse Spark 1.3 a obtenu 62 sur Artificial Analysis, devant GPT-6 Astra, puis il est tombé neuvième après un recalcul. J’ai cherché d’où venait ce score.
Fable 5.1 bat Fable 5 sur les longues tâches d’agents. Opus 5 reste proche, avec des tarifs de base réduits de moitié. J’ai vérifié les benchmarks et les avis.
V4 Flash coûte 0,14 $ en entrée et 0,28 $ en sortie par million de tokens. J'ai vérifié si cette remise de 97 à 99 % rend ses neuf défaites acceptables.
DeepSWE place Luna Max à 2,2 points de Sol High pour près d’un sixième du coût. J’explique pourquoi leur façon de travailler reste très différente.
J'ai comparé Sol, Terra, Opus 5 et Fable 5 sur des benchmarks de code. Le gagnant change selon la tâche, le niveau d'effort, l'agent et le budget.
Kimi K3 égale GPT-5.6 medium, mais prend 4,6 fois plus de temps. GLM-5.2 coûte peu par token, mais cher par tâche. J’ai vérifié où chacun excelle.
Opus 5 égale Fable 5 sur les benchmarks pour un prix par token réduit de moitié, mais le superviser reste pénible. Voici pourquoi Fable garde sa place.