Fable 5.1 supera o Fable 5. O Opus continua difícil de substituir
Fable 5.1 supera o antecessor em tarefas longas de agentes, mas o Opus 5 mantém-se próximo e custa metade do preço base. Analisei benchmarks e relatos iniciais.
Tema
Todos os artigos com a tag fable-5, do mais recente para o mais antigo.
Fable 5.1 supera o antecessor em tarefas longas de agentes, mas o Opus 5 mantém-se próximo e custa metade do preço base. Analisei benchmarks e relatos iniciais.
O Codex dá-me mais utilização, melhor frontend e uma aplicação mais simples. Mas o Claude conclui grandes funcionalidades multiagente muito mais depressa.
Após cinco semanas de uso diário, acho o Opus 5 muito melhor do que a reputação online sugere. Planos claros e tarefas menores revelam um excelente modelo.
Comparei Sol, Terra, Opus 5 e Fable 5 em benchmarks de programação. O vencedor muda conforme a tarefa, o esforço, a configuração do agente e o orçamento.
Na minha auditoria, o GPT-5.6 Sol encontrou quase seis vezes mais problemas possíveis do que o Fable 5. A maioria falhou na triagem, por isso mudei de método.
O Opus 5 iguala o Fable 5 nos benchmarks por metade do preço por token, mas é difícil de supervisionar. Explico quando cada modelo compensa.