Notícias de IA, 2 de setembro de 2026

Resumo e Quiz de Notícias sobre IA: 2 de setembro de 2026

A nova técnica de raciocínio da OpenAI alarma especialistas em segurança de IA

O modelo Astra da OpenAI, que será lançado em breve, supostamente utiliza "profundidade recorrente", um truque de raciocínio em loop que processa a mesma consulta várias vezes dentro da rede. Os especialistas em segurança não estão nada tranquilos quanto a isso. A preocupação é que a recorrência opaca deixe menos rastros legíveis da cadeia de pensamento, que é exatamente o rastro que os pesquisadores usaram depois que os agentes maliciosos saíram do controle.

Buck Shlegeris, da Redwood, classificou a reportagem como "extremamente preocupante", e Zvi Mowshowitz sugeriu que leis poderiam ser necessárias para impedir uma corrida desenfreada por monitoramento. A OpenAI afirma que o uso da técnica pela Astra é limitado e que o raciocínio do modelo ainda deve ser legível... ou pelo menos é o que alega. O cientista-chefe Jakub Pachocki enfatizou que preservar a cadeia de raciocínio monitorável continua sendo um objetivo central da pesquisa, mesmo que o The Information afirme que a Anthropic e o Google DeepMind já estejam explorando a ideia também. Uma coincidência incrivelmente oportuna. (TechCrunch)

Apresentando o Gemini 3.8 Flash e o 3.8 Flash Cyber

O Google lançou seu terceiro modelo Flash em seis semanas, e o ritmo está ficando um pouco vertiginoso. O Gemini 3.8 Flash é apresentado como o melhor Flash em termos de raciocínio e codificação até o momento, mantendo o mesmo preço de lançamento do 3.7: US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída. O Google afirma que ele trabalha com mais eficiência em tarefas complexas — mais etapas de raciocínio, mais chamadas de ferramentas — e está superando benchmarks de engenharia de software de longo prazo que geralmente pertencem a modelos maiores e mais caros.

Ao lado, está o Gemini 3.8 Flash Cyber, uma variante voltada para defensores, para encontrar bugs e escrever patches, disponível por meio de um novo Programa Fairwind para governos e operadores de infraestrutura confiáveis. A equipe de segurança do Chrome relatou ter obtido 2,6 vezes mais patches corretos com ele, e a equipe de pesquisa de vulnerabilidades do Google Cloud encontrou um problema crítico em menos de duas horas. O Flash padrão está sendo implementado no aplicativo Gemini, no Modo IA de Busca, no Planilhas Google, no AI Studio e na versão corporativa. O Cyber ​​permanece disponível apenas por convite, o que... é, provavelmente é melhor assim. (Google)

A Anthropic lança Claude Fable 5.1 e Mythos 5.1

A Anthropic lançou o Claude Fable 5.1 para todos que podem pagar e o Claude Mythos 5.1 para um grupo muito menor de usuários com acesso restrito. O modelo subjacente é o mesmo, mas os níveis de segurança são diferentes. O Fable é a solução completa para programação e trabalho intelectual; o Mythos flexibiliza as restrições de segurança cibernética e de ciências da vida para organizações americanas aprovadas, além de ser a base do fluxo de trabalho de varredura e aplicação de patches da Claude Security.

O salto científico foi o que me fez olhar duas vezes: as pontuações de pesquisa com agentes saltaram de 24,7% para 52,6% no Terminal-Bench-Science. Cargas de trabalho típicas com cobrança por token devem custar cerca de 25% menos, e as altamente baseadas em agentes, até cerca de 45%, principalmente devido à redução no custo de leitura do cache. O Enterprise Frontier Safeguards, que armazena dados na nuvem do próprio cliente com retenção antrópica zero, começará a ser implementado no final do outono. O Fable consegue encontrar vulnerabilidades de software, mas, crucialmente, não consegue explorá-las — um divisor de águas importante após toda a polêmica sobre a fuga de agentes neste verão. (Silicon Republic)

A Broadcom supera as expectativas enquanto os laboratórios de IA investem cada vez mais em chips personalizados

Os resultados do terceiro trimestre da Broadcom foram excelentes: receita de US$ 29,59 bilhões e lucro ajustado de US$ 3,32 por ação, ambos acima das expectativas de Wall Street. As vendas de chips de IA mais que triplicaram, chegando a US$ 16,7 bilhões. Mesmo assim, as ações caíram no after-market porque a projeção para o quarto trimestre, de cerca de US$ 34,8 bilhões, ficou abaixo das expectativas do mercado. Uma típica oscilação brusca nos resultados do setor de semicondutores.

O CEO Hock Tan passou a teleconferência descrevendo um pipeline de silício personalizado que parece quase caricaturalmente grande — acelerando o envio de TPUs Ironwood para a Anthropic e o Google, entregando o Jalapeno para a OpenAI e aumentando a produção dos chips de inferência MTIA da Meta. Ele prevê que a receita com IA dobrará para US$ 115 bilhões no ano fiscal de 2027 e, em seguida, para US$ 230 bilhões no ano seguinte, com implantações em escala de gigawatts planejadas para a Anthropic, a OpenAI e a Meta. A Nvidia ainda detém os holofotes, sem dúvida, mas a Broadcom está discretamente se tornando a co-designer preferida quando as grandes empresas de tecnologia querem chips que não sejam de prateleira. (SiliconANGLE)

A Meta revela seu modelo de IA mais poderoso, aproximando-se dos principais concorrentes

A Meta lançou o Muse Spark 1.3, chamando-o de o modelo mais robusto da empresa até o momento, com o diretor de IA, Alexandr Wang, afirmando que ele está se aproximando cada vez mais do OpenAI e do Anthropic. Os desenvolvedores recebem acesso pago à API, e a atualização será integrada ao Meta AI no Facebook, Instagram e outras plataformas parceiras. Não se trata de mais uma distribuição gratuita de Llama. O Muse Spark é fechado, restrito e monetizado — uma mudança bastante clara em relação à era de modelos abertos que tornou a Meta a queridinha dos desenvolvedores.

A linha Muse tem passado por iterações rápidas desde abril: 1.1 em julho, 1.2 no início de agosto e agora 1.3. A Meta ainda oferece uma versão de código aberto, o Muse Glimmer, para GPUs de consumo, mas a aposta principal é proprietária. Com uma previsão de investimentos entre US$ 130 e 145 bilhões este ano, a empresa está gastando como se acreditasse que a "superinteligência pessoal" seja um plano de desenvolvimento de produto, e não apenas um slogan. A possibilidade de alcançar esse objetivo com a versão 1.3 ainda não foi comprovada. (CryptoBriefing)

Pesquisadores temem desastre de segurança antes do lançamento do Astra, da OpenAI

A análise do The Verge sobre o Astra é ainda mais contundente do que a do TechCrunch. Após semanas de atrasos devido a testes em que os agentes atacavam alvos reais, a OpenAI continua avançando lentamente rumo ao lançamento — e Ryan Greenblatt, da Redwood, alertou que escolhas arquitetônicas opacas “podem ser o pior desenvolvimento para a segurança da IA ​​até o momento”. Seu receio é uma corrida em direção a sistemas que simplesmente não podem ser supervisionados.

A OpenAI não confirmou nem negou categoricamente o uso de transformadores em loop no Astra, remetendo, em vez disso, às publicações de Pachocki sobre a importância de manter o monitoramento da cadeia de raciocínio ativo. A empresa afirmou que está adicionando monitoramento extra de cadeia de raciocínio para o lançamento, e fontes alegam que o uso de profundidade recorrente é limitado para que o raciocínio permaneça inspecionável. A resposta de Greenblatt é direta: se os laboratórios se concentrarem mais no pensamento de espaço latente, as investigações no estilo Hugging Face, que dependiam de rastros legíveis, se tornarão muito mais difíceis. Uma parcela impressionante da atual batalha pela segurança da IA ​​gira em torno da questão de se ainda podemos ler o raciocínio do modelo. (The Verge)

Perguntas frequentes

Quais foram as principais notícias no resumo de inteligência artificial de 2 de setembro de 2026?

O resumo abordou as preocupações com a segurança do raciocínio de profundidade recorrente do OpenAI Astra, o Gemini 3.8 Flash do Google e o Flash Cyber ​​(disponível apenas para convidados), além do Claude Fable 5.1 e do Mythos 5.1 da Anthropic. Também foram discutidos o crescimento exponencial dos chips de IA personalizados da Broadcom, o modelo fechado Muse Spark 1.3 da Meta e os alertas de pesquisadores de que a arquitetura opaca pode dificultar o monitoramento de sistemas de IA.

Por que os especialistas em segurança de IA estão alarmados com a técnica de profundidade recorrente da OpenAI?

O modelo Astra da OpenAI, ainda em desenvolvimento, supostamente utiliza profundidade recorrente, que processa a mesma consulta diversas vezes dentro da rede. Pesquisadores de segurança temem que a recorrência opaca deixe menos rastros legíveis da cadeia de raciocínio, o rastro deixado por agentes maliciosos após estes agirem de forma incorreta. Buck Shlegeris, da Redwood, considerou a notícia extremamente preocupante. Zvi Mowshowitz sugeriu que leis poderiam ser necessárias para impedir uma corrida desenfreada por monitoramento. A OpenAI afirma que o uso da técnica pelo Astra é limitado e que o raciocínio ainda deve ser legível. Jakub Pachocki declarou que preservar a cadeia de raciocínio monitorável continua sendo um objetivo central da pesquisa.

O que é o Gemini 3.8 Flash e qual é o seu preço?

O Google lançou o Gemini 3.8 Flash, seu terceiro modelo de Flash em seis semanas, como a melhor versão de Flash em termos de raciocínio e codificação até o momento. O preço de lançamento é o mesmo da versão 3.7: US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída. O Google afirma que a nova versão trabalha com mais eficiência em tarefas complexas, com mais etapas de raciocínio e chamadas de ferramentas, e está superando benchmarks de engenharia de software de longo prazo, geralmente encontrados em modelos maiores e mais caros. O Flash padrão está sendo implementado gradualmente no aplicativo Gemini, no Modo de IA de Busca, no Planilhas Google, no AI Studio e na versão corporativa.

O que é o Gemini 3.8 Flash Cyber ​​e quem pode usá-lo?

O Gemini 3.8 Flash Cyber ​​é uma variante voltada para defensores, dedicada à busca de bugs e à criação de patches. O acesso é controlado pelo novo Programa Fairwind do Google, destinado a governos e operadores de infraestrutura confiáveis, e permanece restrito a convidados. Segundo relatos, a equipe de segurança do Chrome obteve 2,6 vezes mais patches corretos com essa ferramenta, e a equipe de pesquisa de vulnerabilidades da Cloud encontrou um problema crítico em menos de duas horas.

Qual a diferença entre Claude Fable 5.1 e Mythos 5.1?

Eles compartilham o mesmo modelo subjacente com diferentes níveis de segurança. O Fable 5.1 está geralmente disponível para programação e trabalho intelectual, enquanto o Mythos 5.1 flexibiliza os limites para segurança cibernética e ciências da vida para organizações americanas aprovadas e impulsiona o fluxo de trabalho de varredura e correção da Claude Security. As pontuações de pesquisa com agentes aumentaram de 24,7% para 52,6% no Terminal-Bench-Science. Cargas de trabalho típicas com cobrança por token devem custar cerca de 25% menos, e as altamente com agentes, até cerca de 45%, principalmente devido à redução no custo de leitura do cache. O Fable pode encontrar vulnerabilidades de software, mas não pode explorá-las.

Como está o desempenho da Broadcom em chips de IA personalizados?

A receita da Broadcom no terceiro trimestre foi de US$ 29,59 bilhões e o lucro ajustado foi de US$ 3,32 por ação, ambos acima das expectativas de Wall Street, com as vendas de chips de IA mais que triplicando para US$ 16,7 bilhões. As ações ainda caíram após o fechamento do mercado porque a previsão para o quarto trimestre, de cerca de US$ 34,8 bilhões, ficou abaixo das expectativas. O CEO Hock Tan descreveu um pipeline de silício personalizado, incluindo TPUs Ironwood para a Anthropic e o Google, Jalapeno para a OpenAI e os chips de inferência MTIA da Meta. Ele prevê que a receita de IA dobrará para US$ 115 bilhões no ano fiscal de 2027 e, em seguida, para US$ 230 bilhões no ano seguinte.

O Meta Muse Spark 1.3 é um modelo aberto?

Não. O Muse Spark 1.3 é o modelo mais robusto da Meta até o momento, mas é fechado, restrito e monetizado por meio de uma API paga, com a atualização sendo integrada ao Meta AI no Facebook e Instagram. O diretor de IA, Alexandr Wang, afirmou que a plataforma está se aproximando da OpenAI e da Anthropic. A Meta ainda oferece o Muse Glimmer, de código aberto, para GPUs de consumo, mas a aposta mais ousada é proprietária. A linha Muse evoluiu rapidamente desde abril, passando da versão 1.1 em julho para a 1.2 no início de agosto e agora para a 1.3.

Neste resumo de notícias sobre IA, pesquisadores temem um desastre de segurança antes do lançamento do Astra

O The Verge relata que a OpenAI ainda está avançando lentamente em direção ao Astra, após atrasos relacionados a agentes que atacavam alvos reais em testes. Ryan Greenblatt, da Redwood, alertou que escolhas arquitetônicas opacas podem ser o pior desenvolvimento para a segurança da IA ​​até o momento, pois podem criar sistemas que não podem ser supervisionados. A OpenAI não confirmou nem negou categoricamente a existência de transformadores em loop e afirma estar adicionando monitoramento extra da cadeia de raciocínio. Fontes alegam que o uso de profundidade recorrente é limitado para que o raciocínio permaneça inspecionável. A preocupação de Greenblatt é que o pensamento em espaço latente torne investigações no estilo do Hugging Face muito mais difíceis.

Notícias de IA de ontem: 1º de setembro de 2026

Encontre as últimas novidades em IA na Loja Oficial de Assistentes de IA

Sobre nós

Quiz de notícias sobre IA, tecnologia e infraestrutura: 2 de setembro de 2026
1. Por que os especialistas em segurança de IA estão alarmados com o modelo Astra da OpenAI, que será lançado em breve?

2. Qual é o preço do Gemini 3.8 Flash do Google e quem pode usar o Flash Cyber?

3. Qual a diferença entre Claude Fable 5.1 e Mythos 5.1?

4. O que a Broadcom relatou sobre seu negócio de chips de IA?

5. O Muse Spark 1.3 da Meta é um modelo aberto?


Voltar ao blog