DeepSeek V4.1 Flash: API barata, pesos abiertos enormes
DeepSeek V4.1 Flash usa 8.000 millones de parámetros al leer, pero sus pesos son enormes. Comparo precios de API, benchmarks y requisitos del servidor.
Tema
Todos los artículos con la etiqueta coding-agents, del más reciente al más antiguo.
DeepSeek V4.1 Flash usa 8.000 millones de parámetros al leer, pero sus pesos son enormes. Comparo precios de API, benchmarks y requisitos del servidor.
Fable 5.1 mejora a su antecesor en tareas largas con agentes, pero Opus 5 se mantiene cerca y cuesta la mitad. Revisé benchmarks e informes iniciales.
Codex me da más margen de uso, mejores interfaces y una aplicación más cómoda. Claude aún termina mis grandes cambios multiagente en horas, no en todo el día.
Tras cinco semanas de uso diario, Opus 5 me parece mejor que su reputación en internet. Con planes claros y tareas pequeñas, es un buen modelo para programar.
Agents Window puede abrirse primero, pero Editor Window sigue disponible. Te muestro los comandos y el ajuste que devuelven el código al primer plano.
DeepSWE sitúa a Luna Max 2,2 puntos por detrás de Sol High con casi una sexta parte del coste. Explico por qué se sienten distintos en un repositorio.
Creé un sistema de cuatro capas que dirige a mis agentes de programación hacia los datos vigentes. Funciona, pero mantener el mapa al día sigue siendo difícil.
Comparé Sol, Terra, Opus 5 y Fable 5 en benchmarks de código. El ganador cambia según la tarea, el nivel de esfuerzo, el agente y el presupuesto.
Kimi K3 iguala a GPT-5.6 medium, pero tarda 4,6 veces más. GLM-5.2 es barato por token y caro por tarea. Compruebo en qué sigue destacando cada uno.