DeepSeek V4.1 Flash: Günstige API, riesige offene Gewichte
DeepSeek V4.1 Flash nutzt 8B aktive Parameter beim Einlesen, doch die Gewichte sind riesig. Ich erkläre API-Preise, Coding-Scores und den Hardwarebedarf.
Thema
Alle Beiträge mit dem Tag coding-agents, neueste zuerst.
DeepSeek V4.1 Flash nutzt 8B aktive Parameter beim Einlesen, doch die Gewichte sind riesig. Ich erkläre API-Preise, Coding-Scores und den Hardwarebedarf.
Fable 5.1 liegt bei langen Agent-Aufgaben vor Fable 5, doch Opus 5 bleibt bei halbem Basispreis nah dran. Ich habe Benchmarks und erste Berichte geprüft.
Codex lässt mich länger arbeiten, liefert bessere Frontends und hat die angenehmere App. Claude bringt große Multi-Agent-Features in wenigen Stunden ans Ziel.
Nach fünf Wochen täglicher Nutzung halte ich Opus 5 für viel besser als sein Ruf. Klare Pläne und begrenzte Aufgaben zeigen seine Stärke beim Coding.
Cursors Agents Window kann zuerst erscheinen, doch Editor Window bleibt erhalten. Ich zeige dir die Befehle und Einstellungen für den Weg zurück.
Bei DeepSWE liegt Luna Max 2,2 Punkte hinter Sol High, doch Luna braucht fast dreimal so viele Schritte. Ich zeige, warum das in Repositorys zählt.
Ich führe Coding-Agents mit vier Ebenen zu aktuellen Fakten im Repo. Das spart Kontext, doch veraltete Dokumentation bleibt das eigentliche Problem.
Ich vergleiche Sol, Terra, Opus 5 und Fable 5 in Coding-Benchmarks. Je nach Aufgabe, Effort, Agenten-Setup und Budget gewinnt ein anderes Modell.
Kimi K3 erreicht GPT-5.6 medium, braucht aber 4,6-mal so lange. GLM-5.2 ist pro Token billig, doch pro Aufgabe teuer. Ich prüfe, wo beide gewinnen.