<?xml version="1.0" encoding="UTF-8"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:media="http://search.yahoo.com/mrss/"><channel><title>awaited.dev · Notas práticas sobre IA e desenvolvimento de software</title><description>Lançamentos de modelos, benchmarks, experimentos e guias para quem programa com IA todos os dias. Escrito a partir do uso real, com fontes para cada afirmação.</description><link>https://awaited.dev/pt/</link><language>pt</language><atom:link href="https://awaited.dev/pt/rss.xml" rel="self" type="application/rss+xml"/><lastBuildDate>Sat, 01 Aug 2026 00:00:00 GMT</lastBuildDate><dc:creator>A.M.</dc:creator><generator>Astro</generator><docs>https://www.rssboard.org/rss-specification</docs><item><title>Uma pontuação de benchmark não é uma avaliação do modelo</title><link>https://awaited.dev/pt/benchmarks/why-ai-benchmarks-miss-model-quality/</link><guid isPermaLink="true">https://awaited.dev/pt/benchmarks/why-ai-benchmarks-miss-model-quality/</guid><description>O DeepSWE põe Luna Max dois pontos atrás de Sol High por cerca de um sexto do custo. Explico por que este resultado não descreve o uso real dos modelos.</description><pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate><dc:creator>A.M.</dc:creator><media:content url="https://awaited.dev/og/pt/benchmarks/why-ai-benchmarks-miss-model-quality.png" medium="image" type="image/png" width="1200" height="630"/><category>benchmarks</category><category>benchmarks</category><category>coding-agents</category><category>model-evaluation</category><category>gpt-5-6</category></item><item><title>Cada sessão começa do zero. O meu agente recebe um mapa</title><link>https://awaited.dev/pt/guides/context-management-for-coding-agents/</link><guid isPermaLink="true">https://awaited.dev/pt/guides/context-management-for-coding-agents/</guid><description>Os agentes de IA esquecem o meu repositório entre sessões. O meu mapa de quatro camadas conduz aos factos atuais. Explico como funciona e quanto custa.</description><pubDate>Thu, 30 Jul 2026 00:00:00 GMT</pubDate><dc:creator>A.M.</dc:creator><media:content url="https://awaited.dev/og/pt/guides/context-management-for-coding-agents.png" medium="image" type="image/png" width="1200" height="630"/><category>guides</category><category>context-management</category><category>coding-agents</category><category>claude-code</category><category>agents-md</category><category>documentation</category><category>vibe-coding</category></item><item><title>Kimi K3 iguala o GPT-5.6, mas demora 4,6 vezes mais</title><link>https://awaited.dev/pt/benchmarks/kimi-k3-glm-5-2-hype-check/</link><guid isPermaLink="true">https://awaited.dev/pt/benchmarks/kimi-k3-glm-5-2-hype-check/</guid><description>O Kimi K3 iguala o GPT-5.6 no Coding Agent Index, mas demora 4,6 vezes mais. Avalio se o Kimi ou o GLM-5.2 reduz mesmo o custo de uma tarefa.</description><pubDate>Thu, 30 Jul 2026 00:00:00 GMT</pubDate><dc:creator>A.M.</dc:creator><media:content url="https://awaited.dev/og/pt/benchmarks/kimi-k3-glm-5-2-hype-check.png" medium="image" type="image/png" width="1200" height="630"/><category>benchmarks</category><category>kimi-k3</category><category>glm-5-2</category><category>benchmarks</category><category>coding-agents</category><category>open-weights</category><category>pricing</category></item><item><title>Opus 5 empata com Sol, Terra iguala Fable por um quarto</title><link>https://awaited.dev/pt/benchmarks/gpt-5-6-vs-claude-5-benchmarks/</link><guid isPermaLink="true">https://awaited.dev/pt/benchmarks/gpt-5-6-vs-claude-5-benchmarks/</guid><description>Comparo Sol, Terra, Opus 5 e Fable 5 em benchmarks de programação para mostrar por que razão pontuação, custo e esforço ideal raramente coincidem.</description><pubDate>Thu, 30 Jul 2026 00:00:00 GMT</pubDate><dc:creator>A.M.</dc:creator><media:content url="https://awaited.dev/og/pt/benchmarks/gpt-5-6-vs-claude-5-benchmarks.png" medium="image" type="image/png" width="1200" height="630"/><category>benchmarks</category><category>gpt-5-6</category><category>opus-5</category><category>fable-5</category><category>benchmarks</category><category>coding-agents</category><category>reasoning-effort</category></item><item><title>Comparei o Convex com oito alternativas. O Convex fica</title><link>https://awaited.dev/pt/guides/convex-alternatives/</link><guid isPermaLink="true">https://awaited.dev/pt/guides/convex-alternatives/</guid><description>A maioria dos meus projetos com IA usa o Convex. Comparei-o com oito alternativas, verifiquei os preços e encontrei um custo escondido para a UE.</description><pubDate>Wed, 29 Jul 2026 00:00:00 GMT</pubDate><dc:creator>A.M.</dc:creator><media:content url="https://awaited.dev/og/pt/guides/convex-alternatives.png" medium="image" type="image/png" width="1200" height="630"/><category>guides</category><category>convex</category><category>supabase</category><category>appwrite</category><category>insforge</category><category>backend</category><category>vibe-coding</category></item><item><title>O GPT-5.6 Sol encontra tudo. O problema é esse</title><link>https://awaited.dev/pt/experiments/gpt-5-6-sol-overengineering/</link><guid isPermaLink="true">https://awaited.dev/pt/experiments/gpt-5-6-sol-overengineering/</guid><description>O GPT-5.6 Sol encontrou quase seis vezes mais problemas do que o Fable 5, mas a maioria falhou na triagem. Assim uso a sua persistência sem perder o controlo.</description><pubDate>Wed, 29 Jul 2026 00:00:00 GMT</pubDate><dc:creator>A.M.</dc:creator><media:content url="https://awaited.dev/og/pt/experiments/gpt-5-6-sol-overengineering.png" medium="image" type="image/png" width="1200" height="630"/><category>experiments</category><category>gpt-5-6</category><category>sol</category><category>openai</category><category>codex</category><category>fable-5</category><category>multi-agent</category></item><item><title>Opus 5: ótimo funcionário, chefe frustrante</title><link>https://awaited.dev/pt/releases/opus-5-great-employee-bad-boss/</link><guid isPermaLink="true">https://awaited.dev/pt/releases/opus-5-great-employee-bad-boss/</guid><description>O Opus 5 iguala o Fable 5 nos benchmarks por metade do preço. Explico porque continua a frustrar muitos utilizadores e quando precisa de um modelo mais capaz.</description><pubDate>Wed, 29 Jul 2026 00:00:00 GMT</pubDate><dc:creator>A.M.</dc:creator><media:content url="https://awaited.dev/og/pt/releases/opus-5-great-employee-bad-boss.png" medium="image" type="image/png" width="1200" height="630"/><category>releases</category><category>opus-5</category><category>fable-5</category><category>anthropic</category><category>benchmarks</category><category>claude-code</category></item></channel></rss>