Os primeiros resultados da Jalapeño demonstram velocidade e eficiência líderes do setor em inferência de IA ↗
A OpenAI publicou os primeiros resultados de desempenho do Jalapeño, seu chip de inferência personalizado. Segundo a empresa, no GPT-OSS 120B, o chip apresentou um aumento de aproximadamente 1,9 vezes na taxa de transferência máxima por quilowatt e uma latência de ponta a ponta cerca de 1,7 vezes menor do que o sistema de comparação.
Os ganhos foram observados também no DeepSeek R1 e no Kimi K2.5. A OpenAI planeja implantar o Jalapeño em sua própria infraestrutura de computação, enquanto projetos de segunda e terceira geração já estão em andamento... então sim, a OpenAI está se tornando cada vez mais uma empresa de chips também, de certa forma. (OpenAI)
Claude Cowork finalmente se lembra do que você disse ao aplicativo no chat ↗
A Anthropic unificou a memória de Claude entre o chat normal e o Cowork. As informações aprendidas durante as conversas agora podem acompanhar os usuários em tarefas interativas, eliminando aquele ritual um tanto irritante de explicar o mesmo projeto repetidamente.
Os usuários podem inspecionar, editar e excluir tópicos salvos, e as memórias são atualizadas conforme as conversas continuam. O recurso está ativado por padrão nos planos Free, Pro e Max. (TechCrunch)
O Google Cloud lança o Gemini Enterprise para o setor jurídico ↗
O Google Cloud apresentou um pacote Gemini Enterprise desenvolvido especificamente para advogados, ampliando o alcance de seus agentes além do chat genérico, para incluir revisão de contratos, pesquisa jurídica, monitoramento regulatório, solicitações de privacidade e elaboração de documentos.
Inclui conectores para plataformas como Harvey, iManage, DocuSign, RelativityOne e Thomson Reuters, preservando os controles de acesso e as barreiras éticas existentes das empresas. A corrida por agentes de IA chegou ao departamento jurídico... como era de se esperar, mas ainda assim muito rápido. (Google Cloud Press Corner)
O Google Cloud lança o Gemini Enterprise para serviços financeiros ↗
O Google também lançou uma oferta Gemini Enterprise específica para o setor financeiro, incluindo um agente de pesquisa financeira gerenciado, mais de 50 habilidades especializadas e 13 conectores para sistemas de dados financeiros e de mercado.
A plataforma visa fluxos de trabalho que incluem avaliação de risco de crédito, monitoramento de portfólio, pesquisa KYC e análise de mercado. O CME Group e o Deutsche Bank estão entre as organizações já envolvidas — os agentes corporativos estão se tornando cada vez mais especializados, quase como um software vestindo um terno. (Google Cloud Press Corner)
A NVIDIA anuncia o computador robótico Jetson Orin Nano 2 para redefinir a inteligência artificial de ponta de nível básico ↗
A Nvidia apresentou o Jetson Orin Nano 2, um computador compacto voltado para robôs, drones e outros sistemas de IA física. Ele oferece 78 trilhões de operações por segundo, 8 GB de memória e uma CPU Arm de oito núcleos.
A Nvidia afirma que o desempenho de inferência dobrou em comparação com o Nano Super anterior, enquanto que igualar esse desempenho pode exigir 40% menos energia. O interessante aqui é que modelos menores estão se tornando realmente capazes em hardware compacto — a IA não precisa mais recorrer constantemente ao gigantesco centro de dados. (Sala de Imprensa da NVIDIA)
A Perplexity se une à Nvidia para lançar o Portable Computer, um agente de IA totalmente local com custo zero em tokens ↗
A Perplexity lançou o Portable Computer, levando sua experiência de computação com agentes para hardware local com tecnologia Nvidia. Modelos, arquivos e a execução de agentes podem permanecer na máquina do usuário, e o trabalho concluído localmente não consome créditos de faturamento na nuvem.
As tarefas começam localmente e o sistema pede permissão antes de avançar para um modelo de nuvem de ponta. Ele é executado em sistemas Nvidia DGX Spark e Linux com GPUs RTX suficientemente potentes — privacidade e custo passam a fazer parte da proposta de vendas da IA local, e não apenas a velocidade. (Venturebeat)
A Anthropologie deverá informar aos investidores que prevê um potencial de receita superior a US$ 30 trilhões, segundo reportagem do WSJ ↗
A Anthropic estaria se preparando para informar aos investidores que seu mercado endereçável total poderia ultrapassar US$ 30 trilhões. Uma distinção importante: trata-se da oportunidade anual teórica caso a IA capturasse o trabalho relevante, e não de uma previsão da Anthropic de que chegará a gerar US$ 30 trilhões. (Reuters)
O valor enorme ajuda a contextualizar os gastos da Anthropic com infraestrutura, sua competição com a OpenAI e o Google, e a história mais ampla dos investidores. É um número espetacularmente grande... mesmo para os padrões da indústria de IA. (Reuters)
Perguntas frequentes
O que os resultados do chip Jalapeño da OpenAI significam para a inferência em IA?
A OpenAI afirma que o Jalapeño apresentou maior taxa de transferência máxima por quilowatt e menor latência de ponta a ponta do que o sistema de comparação ao executar o GPT-OSS 120B. Ganhos semelhantes foram relatados com o DeepSeek R1 e o Kimi K2.5. Os resultados sugerem que a OpenAI está cada vez mais projetando hardware com foco nas demandas específicas de eficiência e velocidade da inferência de IA em larga escala.
Como funciona a memória compartilhada de Claude no chat e no ambiente de coworking?
Agora, Claude consegue transferir informações aprendidas em conversas regulares para tarefas do Cowork, reduzindo a necessidade de explicar o mesmo projeto ou contexto repetidamente. Os usuários podem inspecionar, editar e excluir tópicos memorizados, e essas memórias continuam sendo atualizadas conforme as conversas se desenvolvem. De acordo com o anúncio mencionado no artigo, o recurso está ativado por padrão nos planos Free, Pro e Max.
O que a Gemini Enterprise para Serviços Jurídicos e Financeiros pode fazer?
As ofertas especializadas do Gemini Enterprise do Google Cloud são voltadas para fluxos de trabalho específicos do setor, em vez de bate-papo genérico com IA. O pacote jurídico abrange áreas como revisão de contratos, pesquisa, monitoramento regulatório, solicitações de privacidade e redação, enquanto a versão para serviços financeiros oferece suporte a fluxos de trabalho que incluem avaliação de risco de crédito, monitoramento de portfólio, pesquisa KYC e análise de mercado. Ambos também podem se conectar a sistemas de software e dados profissionais existentes.
Por que a inferência local em IA está se tornando mais importante?
A inferência de IA local pode fortalecer a privacidade, reduzir a dependência da infraestrutura em nuvem e potencialmente diminuir os custos de uso contínuo. O Jetson Orin Nano 2 da Nvidia é voltado para robôs, drones e outros sistemas de borda, enquanto o Portable Computer da Perplexity mantém modelos, arquivos e execução de agentes em hardware local compatível. Em muitos fluxos de trabalho, os modelos em nuvem podem então ser reservados para tarefas que exigem capacidade adicional.
Como o computador portátil Perplexity decide quando usar IA na nuvem?
As tarefas são projetadas para serem iniciadas no hardware local do usuário com placa de vídeo Nvidia, mantendo a execução do modelo e os arquivos compatíveis na máquina. Se uma etapa exigir um modelo de nuvem de última geração, o sistema solicitará permissão ao usuário antes de escalá-la. O trabalho concluído localmente não consome créditos de faturamento da nuvem, tornando essa abordagem relevante para usuários preocupados com a privacidade e com os custos recorrentes de inferência.
O que significa a estimativa de mercado de IA de US$ 30 trilhões divulgada pela Anthropic?
O valor apresentado refere-se à visão da Anthropic sobre o potencial total de mercado endereçável para IA, e não a uma previsão de que a própria Anthropic irá gerar US$ 30 trilhões em receita anual. Representa o valor teórico do trabalho que a IA poderia potencialmente realizar em toda a economia. A estimativa também ajuda a explicar por que as principais empresas de IA estão investindo tanto em infraestrutura e recursos corporativos.