Emanuel Limeira
← Voltar para o blog

12 de Setembro de 2026

Relatório de Notícias de IA — 12 de setembro de 2026

Bem-vindo ao nosso relatório semanal sobre as principais novidades em inteligência artificial. Hoje, trazemos uma seleção das notícias mais impactantes do setor, com foco nas atualizações do Claude Code, do OpenAI Codex e novos modelos de LLM.

SEÇÃO 1 — Claude Code (Anthropic)

1. Claude Code ganha sistema de avaliação de plugins (claude plugin eval)

Em 11/09, a Anthropic lançou (a partir da versão 2.1.269) uma ferramenta que testa plugins do Claude Code com prompts realistas, usando seis tipos de "graders" para comparar o desempenho com e sem o plugin ativado. O destaque é a métrica de "delta": ela revela quando um plugin não está realmente sendo acionado pelo modelo, algo que validações de sintaxe não detectavam antes — um avanço importante para quem desenvolve extensões confiáveis para a ferramenta.
Fontes: MarkTechPost | Releasebot

2. Nova leva de atualizações do Claude Code (v2.1.265 a v2.1.269)

Entre 9 e 11/09, a Anthropic lançou várias versões em sequência trazendo troca de "output styles", controles de maxEffortLevel, melhorias em cache de prompt e retomada de sessão, painel de diff em tela cheia e suporte ampliado a servidores MCP gerenciados. É um ritmo de atualização bem acelerado, mostrando o quanto a ferramenta segue evoluindo para uso profissional e em ambientes headless/CI.
Fonte: Releasebot — Claude Code

SEÇÃO 2 — OpenAI Codex

3. Codex 0.154.0 e atualizações do app desktop

Em 11/09, a OpenAI lançou a versão 0.154.0 do Codex com novos níveis de esforço de raciocínio ("max"/"ultra"), suporte a ExternalMessage para streams de eventos independentes e spawn nativo de comandos MCP no macOS. O app desktop também ganhou chat rápido, compartilhamento de janelas no Windows e melhor suporte a ditado.
Fontes: OpenAI News | Releasebot — OpenAI

4. OpenAI lança Agents API em beta público

Em 10/09, a OpenAI abriu o beta público de uma infraestrutura de agentes na nuvem, com orquestração gerenciada, sessões de longa duração e ambientes de sandbox flexíveis (hospedados pela OpenAI ou self-hosted). É um passo relevante na disputa por infraestrutura para agentes autônomos, área em que Codex e Claude Code também competem diretamente.
Fonte: OpenAI News

5. GPT-5.3-Codex: o modelo de codificação mais capaz da OpenAI até agora

Lançado em fevereiro de 2026, mas ainda central na estratégia atual da OpenAI, o GPT-5.3-Codex combina desempenho de ponta em coding (recordes em SWE-Bench Pro e Terminal-Bench 2.0) com raciocínio geral, sendo 25% mais rápido que a versão anterior. Um dado curioso: o próprio modelo foi usado pela equipe da OpenAI para ajudar a depurar seu próprio treinamento.
Fonte: OpenAI — Introducing GPT-5.3-Codex

SEÇÃO 3 — Novos modelos de LLM

6. Anthropic lança Claude Fable 5.1 e Mythos 5.1

Em 01/09, a Anthropic atualizou seu modelo mais capaz, com foco em coding, trabalho de conhecimento e resolução de problemas de longa duração, evitando "atalhos" que geram trabalho de qualidade inferior. Os preços caíram cerca de 25% (podendo chegar a 45% de economia em aplicações baseadas em agentes), tornando IA de ponta mais acessível.
Fonte: 9to5Mac

7. OpenAI expande GPT-6 Astra para atendimento financeiro e voz

No dia 10/09, a OpenAI lançou uma experiência do ChatGPT voltada para serviços financeiros com dados premium da PitchBook e LSEG integrados ao GPT-6 Astra, e no dia 9/09 trouxe o modelo para o ChatGPT Voice. O GPT-6 Astra, lançado em 03/09 como o modelo mais avançado da empresa, atingiu 98% no FrontierMath Tier 4 e 99,9% no ARC-AGI-3, sendo apresentado como o modelo "mais inteligente e alinhado" da OpenAI até hoje.
Fontes: OpenAI — GPT-6 Astra | OpenAI News

8. GPT-Live-1: nova API de voz full-duplex da OpenAI

Em 10/09, a OpenAI lançou uma API de conversação por voz em tempo real, com escuta e fala simultâneas, 12 novas vozes e tratamento de interrupções, a US$ 0,05/minuto. É uma resposta direta às ofertas de voz da Google e concorrentes na corrida por assistentes de voz mais naturais.
Fonte: OpenAI News

9. Anthropic denuncia uso do Claude por Irã, Rússia, China e Houthis para pesquisa de armas

Em 11/09, a Anthropic revelou que agentes ligados a esses grupos tentaram usar o Claude para pesquisas envolvendo sistemas de navegação de mísseis, enxames de drones kamikaze e, em cinco casos, armas biológicas (incluindo uma tentativa de pesquisa sobre o vírus chikungunya). A empresa afirma ter interrompido todas as operações identificadas e reforçado suas salvaguardas — episódio relevante para o debate sobre segurança e uso indevido de LLMs de ponta.
Fontes: The Tech Portal | Bloomberg

10. xAI expande o Grok Bot para empresas

Entre 3 e 4/09, a xAI anunciou a disponibilidade do "Grok Bot" para clientes empresariais (com uso gratuito por duas semanas para Grok e Cursor Enterprise) e novos recursos voltados a processos de compras corporativas. O Grok 4.6, por sua vez, já havia sido integrado a plataformas como Microsoft Foundry, Amazon Bedrock e Gemini Enterprise ao longo de agosto, mostrando a estratégia da xAI de se espalhar por múltiplos ecossistemas de nuvem.
Fonte: x.ai/news

A corrida entre Anthropic, OpenAI e xAI em agentes e coding está se intensificando, com cada empresa buscando inovações que não apenas aprimoram suas ferramentas, mas também definem o futuro da inteligência artificial autônoma e de suporte a desenvolvimento.