DeepSeek V4.1 Flash: API barata, pesos abiertos enormes
DeepSeek V4.1 Flash usa 8.000 millones de parámetros al leer, pero sus pesos son enormes. Comparo precios de API, benchmarks y requisitos del servidor.
releases
Cuando un laboratorio lanza un modelo: qué cambia de verdad para quienes desarrollan software.
DeepSeek V4.1 Flash usa 8.000 millones de parámetros al leer, pero sus pesos son enormes. Comparo precios de API, benchmarks y requisitos del servidor.
OpenAI aloja el ciclo de Codex para tu aplicación. Explico qué cambia frente al Agents SDK, cómo persisten las sesiones y qué costes siguen a tu cargo.
GPT-6 Astra gasta tu cuota 2,5 veces más rápido por token que Sol. Revisé los límites de cada plan, los benchmarks y las primeras reacciones de la comunidad.
Fable 5.1 mejora a su antecesor en tareas largas con agentes, pero Opus 5 se mantiene cerca y cuesta la mitad. Revisé benchmarks e informes iniciales.
El límite de cinco horas de OpenAI puede interrumpir una sesión de Codex aunque quede cuota semanal. Limita cuándo puedes trabajar, no necesariamente cuánto.
Claude marcará sus textos con las palabras que elige, no con caracteres ocultos. La razón es la Ley de IA de la UE, no la guerra por la destilación.
OpenAI confirmó Astra como su próximo gran modelo y frenó parte del trabajo por riesgo cibernético. La fecha de GPT-6 salió de una filtración retirada.
OpenAI reinició el uso de Codex cinco veces en diez días mientras Sol agotaba los límites. Creo que las recargas gratis ocultaron el problema real.
V4 Flash cuesta 0,14 dólares de entrada y 0,28 de salida por millón de tokens. Analizo si el descuento del 97 al 99 % compensa sus nueve derrotas.
Opus 5 iguala a Fable 5 en benchmarks a mitad de precio por token, pero supervisarlo puede ser agotador. Explico cuándo Fable aún merece su lugar.