DeepSeek V4.1 Flash: API barata, pesos abertos enormes
O DeepSeek V4.1 Flash ativa 8B parâmetros na entrada, mas os pesos são enormes. Explico preços da API, resultados de programação e requisitos de hardware.
releases
Quando um laboratório lança um modelo: o que muda de facto para quem desenvolve software.
O DeepSeek V4.1 Flash ativa 8B parâmetros na entrada, mas os pesos são enormes. Explico preços da API, resultados de programação e requisitos de hardware.
A OpenAI aloja o ciclo do Codex para a sua aplicação. Explico as diferenças face ao SDK, a persistência das sessões e os custos que continuam a existir.
O GPT-6 Astra da OpenAI consome créditos a 2,5 vezes a tarifa do Sol e conversa de forma mais humana. Analisei os limites, os benchmarks e os relatos iniciais.
Fable 5.1 supera o antecessor em tarefas longas de agentes, mas o Opus 5 mantém-se próximo e custa metade do preço base. Analisei benchmarks e relatos iniciais.
O limite de cinco horas pode interromper trabalho no Codex apesar da quota semanal. Limita quando você pode usar o Plus, não necessariamente a utilização total.
Os modelos Claude vão marcar o texto pelas palavras que escolhem, não com caracteres ocultos. A razão é o AI Act da UE, não a guerra da destilação.
A OpenAI confirmou o Astra e abrandou o trabalho por risco cibernético. A data do GPT-6 veio de uma alegação retirada no dia seguinte e de uma piada do Codex.
A OpenAI repôs a utilização do Codex 5 vezes em dez dias enquanto o Sol consumia os limites depressa demais. Para mim, os reforços esconderam o problema real.
O V4 Flash custa 0,14 dólares à entrada e 0,28 à saída por milhão de tokens. Verifiquei se o desconto de 97 a 99% compensa perder os benchmarks.
O Opus 5 iguala o Fable 5 nos benchmarks por metade do preço por token, mas é difícil de supervisionar. Explico quando cada modelo compensa.