GPT-6 Astra: 2,5-mal so teuer wie Sol, klingt wie ein Mensch
OpenAI rechnet GPT-6 Astra mit dem 2,5-fachen Satz von Sol ab, und im Gespräch wirkt es menschlicher. Ich habe Limits, Benchmarks und erste Reaktionen geprüft.
Thema
Alle Beiträge mit dem Tag benchmarks, neueste zuerst.
OpenAI rechnet GPT-6 Astra mit dem 2,5-fachen Satz von Sol ab, und im Gespräch wirkt es menschlicher. Ich habe Limits, Benchmarks und erste Reaktionen geprüft.
Muse Spark 1.3 erreichte bei Artificial Analysis 62 Punkte, mehr als GPT-6 Astra, und fiel nach der Neuwertung auf Platz neun. Ich zeige, woher die Zahl kam.
Fable 5.1 liegt bei langen Agent-Aufgaben vor Fable 5, doch Opus 5 bleibt bei halbem Basispreis nah dran. Ich habe Benchmarks und erste Berichte geprüft.
V4 Flash kostet 0,14 Dollar für Input und 0,28 Dollar für Output. Ich prüfe, ob 97 bis 99 Prozent Rabatt die neun Niederlagen gegen Opus aufwiegen.
Bei DeepSWE liegt Luna Max 2,2 Punkte hinter Sol High, doch Luna braucht fast dreimal so viele Schritte. Ich zeige, warum das in Repositorys zählt.
Ich vergleiche Sol, Terra, Opus 5 und Fable 5 in Coding-Benchmarks. Je nach Aufgabe, Effort, Agenten-Setup und Budget gewinnt ein anderes Modell.
Kimi K3 erreicht GPT-5.6 medium, braucht aber 4,6-mal so lange. GLM-5.2 ist pro Token billig, doch pro Aufgabe teuer. Ich prüfe, wo beide gewinnen.
Opus 5 erreicht Fable 5 in Benchmarks zum halben Tokenpreis, ist aber mühsam zu führen. Ich zeige, warum Fable trotzdem seinen Platz verdient.