Arquivo editorial
Lançamentos & Modelos
Notícias, testes e análises para entender o que mudou, o que é hype e o que sua empresa já pode usar.
RUMOR: OpenAI prepara segundo modelo com arquitetura em loop para o DevDay de 29 de setembro
Um post isolado no X afirma que a OpenAI vai lançar, no DevDay de 29 de setembro, um segundo modelo com arquitetura de profundidade…

CONFIRMADO: Anthropic lança o Claude Marketplace com mais de 2 mil conectores
CONFIRMADO: a Anthropic lançou o Claude Marketplace, reunindo mais de 2 mil conectores, produtos parceiros e consultorias num único catálogo. A novidade simplifica a…

CONFIRMADO: Alibaba lança chip Zhenwu V900 e mira 10 trilhões de parâmetros no Qwen4
CONFIRMADO: na Apsara Conference de 22 de setembro, a Alibaba anunciou o chip de IA Zhenwu V900, com o triplo do desempenho do modelo…

CONFIRMADO: Intrinsic, do Google, abre o código do núcleo de sua plataforma de robótica industrial
CONFIRMADO: a Intrinsic, unidade de robótica da Alphabet, liberou em 22 de setembro o Intrinsic Core sob licença Apache 2.0, com controle em tempo…
CONFIRMADO: Anthropic lança Claude Opus 5.5 com mais capacidade e custo menor
CONFIRMADO: além de mais capacidade e custo 40% menor em cargas típicas, a documentação do Claude Opus 5.5 revela mudanças de integração que podem…
CONFIRMADO: Mistral Small 4 chega ao Firefox Smart Window e leva escolha de modelos ao navegador
Mozilla e Mistral confirmaram uma parceria que coloca o Mistral Small 4 no Smart Window do Firefox, amplia o beta para a França e…
SINAL FORTE: código vazado mostra OpenAI construindo Managed Agents antes da DevDay
A TestingCatalog encontrou dentro da plataforma da OpenAI telas inacabadas de um produto chamado Managed Agents, que hospedaria agente e ambiente de execução do…
RUMOR: vazamento aponta que a OpenAI já teria treinado o "Bel", pré-treino gigante sucessor do "Doug"
Uma conta única no X afirma que a OpenAI concluiu o pré-treino de um modelo chamado Bel, com mais de 10 trilhões de parâmetros,…
CONFIRMADO: Kimi K3, modelo aberto de 2,8T da Moonshot AI, chega ao Amazon Bedrock em disponibilidade geral
A AWS confirmou em 18 de setembro de 2026 que o Kimi K3, modelo de peso aberto de 2,8 trilhões de parâmetros da Moonshot…
CONFIRMADO: Alibaba lança Qwen3.8-Omni-Flash, primeiro modelo omnimodal agentic da Qwen a preço de Flash
A Alibaba lançou em 18 de setembro de 2026 o Qwen3.8-Omni-Flash, primeiro modelo da linha Qwen a juntar texto, imagem, áudio e vídeo com…
GLM-5.3-FlashX: Z.ai lança modelo de código a 200 tokens por segundo
SINAL FORTE: a Z.ai lançou o GLM-5.3-FlashX, variante paga e mais rápida do GLM-5.3-Flash que chega a 200 tokens/s, documentada oficialmente e confirmada na…
Claude Code 2.1.278 acaba com a cobrança oculta do classificador de modo automático
CONFIRMADO: a Anthropic publicou o Claude Code 2.1.278 mudando o modo automático para rodar o classificador de segurança no servidor sem cobrar pela sobrecarga,…
CONFIRMADO: Google transforma o CC em agente compartilhado para famílias
O Google ampliou o CC, seu agente experimental, para famílias e grupos de até seis pessoas. A novidade dá ao agente uma conta Google…
Claude Code 2.1.277 amplia instruções de projeto e endurece agentes
CONFIRMADO: a Anthropic publicou o Claude Code 2.1.277 com suporte a AGENTS.md, novas opções para gateways por proxy e uma longa rodada de correções…
RUMOR: Slug claude-opus-5-2 aparece no Microsoft Foundry e acende aposta em novo Opus da Anthropic
Um identificador claude-opus-5-2 teria aparecido no catálogo do Microsoft AI Foundry, e um único relato no X descreve roteamento silencioso dentro do Claude Code.…
CONFIRMADO: Google lança Gemini 3.8 Live com raciocínio em segundo plano na voz
O Google lançou Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, modelos de voz que executam ferramentas e raciocinam em segundo plano sem…
CONFIRMADO: Musk diz que o Grok 4.8 termina o treino e entra em RL nesta semana
Elon Musk afirmou que o Grok 4.8 termina o pré-treino e entra em aprendizado por reforço nesta semana, mas a xAI não anunciou endpoint…
CONFIRMADO: GPT-5.5 sai do ChatGPT em 14 de outubro, mas continua na API
A OpenAI confirmou que o GPT-5.5 será retirado do ChatGPT, do ChatGPT Work e do Codex com autenticação por plano em 14 de outubro,…
Claude Code 2.1.273 melhora gateways, MCP e sessões remotas
CONFIRMADO: a Anthropic publicou o Claude Code 2.1.273 com melhorias para gateways, reconexão de MCP, controle remoto, permissões e entrega de resultados de agentes.
RUMOR: Anthropic prepararia um Claude Fable 5.2 para responder ao GPT 6 Astra
Um único leaker com histórico de acertos diz que a Anthropic fechou um novo ciclo de pré-treino e prepara um modelo maior que o…
Claude Code 2.1.270 corrige regressão que pedia permissão para comandos Git seguros
CONFIRMADO: o Claude Code 2.1.270 corrige uma regressão da versão 2.1.269 que fazia comandos Git somente leitura no Bash pedirem permissão depois de uma…
OpenAI revela como o Habitat passou a sustentar 1 bilhão de usuários do ChatGPT
CONFIRMADO: a OpenAI descreveu como evoluiu o Habitat, de uma biblioteca Python para uma plataforma global de armazenamento que atende 1 bilhão de usuários…
Navier Stokes vira caso de disputa: matemático acusa OpenAI de usar seu trabalho e ameaçar carreira
A alegação de que a OpenAI resolveu o problema do milênio de Navier Stokes virou disputa pública depois que o matemático Tristan Buckmaster acusou…
Claude Code 2.1.268 mira o custo dos gateways e fecha brechas em agentes
CONFIRMADO: o Claude Code 2.1.268 adiciona sincronização de preços em gateways gerenciados, melhora controles de segurança e corrige falhas que afetavam endpoints compatíveis, sessões,…
CONFIRMADO: DeepSeek lança V4.1 Flash com visão nativa e derruba o preço da API
A DeepSeek confirmou o lançamento do V4.1 Flash, menor modelo da nova arquitetura da empresa, com compreensão visual nativa, janela de 1 milhão de…
SINAL FORTE: Alexandr Wang confirma o codinome Watermelon, o próximo modelo de fronteira da Meta
Dias depois de lançar o Muse Spark 1.3 e afirmar que alcançou paridade com Fable 5.1 e Opus 5 em benchmarks independentes, o chefe…
SINAL FORTE: código de três motores de inferência já roda o "qwen4_exp", pista real de que o Qwen4 sai do papel
Selo: SINAL FORTE. Um pull request aberto no vLLM, outro no SGLang e commits em dois projetos independentes de serving para Apple Silicon já…
Meta apresenta o Muse, agente pessoal que quer agir por você
A Meta apresentou o Muse, agente pessoal que navega, preenche formulários e continua trabalhando após o usuário fechar o app. O rollout começa nos…
GPT Image 2.5 ganha suporte oficial no SDK Python da OpenAI
CONFIRMADO: a versão 3.10.0 do SDK Python da OpenAI adicionou os modelos GPT Image 2.5 e suas opções de imagem, transformando o lançamento visual…
RUMOR: DeepSeek V5 seria construído do zero para rivalizar com o Claude Mythos
Um post no X do rastreador de vazamentos Mr_Salio, replicado em 7 de setembro de 2026, afirma que a DeepSeek está construindo o V5…
iFlytek lança o Spark X2.5, modelo de 293B treinado do início ao fim em chip chinês
A iFlytek lançou oficialmente nesta segunda o Spark X2.5, um modelo MoE de 293 bilhões de parâmetros focado em código e agentes, treinado e…
CONFIRMADO: OpenAI lança GPT-6 Sol e GPT-6 Luna, 50% mais baratos que a geração anterior
O rumor virou lançamento. Em 22 de setembro a OpenAI anunciou oficialmente GPT-6 Sol e GPT-6 Luna, expandindo o universo GPT-6 abaixo do Astra,…
Claude prova o Último Teorema de Fermat em Lean, com verificação automática
A Anthropic confirmou que seu modelo Claude, orquestrado pela plataforma Prove2Me, produziu a primeira prova completa e verificada por máquina do Último Teorema de…
RUMOR: strings vazadas "Marshmallow" e "Melon" insinuam Claude Opus 5.1 e Sonnet 5.1
Dois identificadores de acesso antecipado, claude-marshmallow-eap e claude-melon-eap, apareceram em ferramentas de desenvolvedores no fim de agosto, no mesmo padrão de nome que precedeu…
CONFIRMADO: Anthropic lança Claude Fable 5.1 e Claude Mythos 5.1 com preço menor e novos limites
A Anthropic lançou Claude Fable 5.1 para disponibilidade geral e Claude Mythos 5.1 para programas de acesso confiável. O mesmo modelo combina cache mais…
Institute of Foundation Models lança K2 Horizon, a maior leva de modelos de IA totalmente abertos
O Institute of Foundation Models, ligado à MBZUAI, lançou em 3 de setembro de 2026 o K2 Horizon, uma família de seis modelos de…
Microsoft lança VibeVoice-ASR-Streaming para transcrever e identificar falantes ao vivo
CONFIRMADO: Microsoft lança VibeVoice-ASR-Streaming, modelo aberto que une transcrição ao vivo e atribuição de falante em dez idiomas, incluindo português.
Meta lança o Muse Spark 1.3 e vende o salto em código e agente
A Meta colocou o Muse Spark 1.3 no Muse Code e na API, com o mesmo preço do 1.2. Zuckerberg chama de o maior…
Multiverse lança o Quasar 438B e vende o título de líder europeu
A espanhola Multiverse Computing publicou o Quasar 438B, um modelo de 438 bilhões de parâmetros para agentes e código. A Artificial Analysis mede 43…
Gemini liga leitura agentic de vídeo
O Google ligou a leitura agentic de vídeo no Gemini 3.7, 3.6 Flash e 3.5 Flash-Lite. Número deles: até 88% menos tokens e 66%…
CONFIRMADO: xAI lança Grok 4.7 com foco em tarefas longas e preço de US$ 2 por milhão de tokens
A xAI anunciou o Grok 4.7 em 21 de setembro, com base maior, treinamento por reforço mais longo e foco em programação e trabalho…
Qwen3.8-Max-0902 ganha confirmação independente e chega à OpenRouter
CONFIRMADO: o Qwen3.8-Max-0902 mantém preço e contexto, recebeu validação independente no Code Arena WebDev e passa a ser o snapshot programado para a rota…
DeepSeek abre o V4-Flash-Vision-Exp, o primeiro olho da família V4
A DeepSeek publicou no Hugging Face o DeepSeek-V4-Flash-Vision-Exp, o primeiro modelo multimodal experimental da família V4, com 305B de parâmetros e licença MIT. O…
ChatGPT passa a conectar prontuário Epic e bases oficiais de saúde
Em 1º de setembro de 2026 a OpenAI lançou integração de EHR do Epic e o plugin Healthcare Public Data no ChatGPT for Healthcare,…
Google lança o Gemini 3.8 Flash e reserva o Cyber para defesa
O Google confirmou o Gemini 3.8 Flash com o mesmo preço introdutório do 3.7 e soltou o 3.8 Flash Cyber só no Fairwind. O…
Meta lança Muse Voice Transcribe, o primeiro ouvido em tempo real da Superintelligence Labs
A Meta Superintelligence Labs lançou em 1º de setembro de 2026 o Muse Voice Transcribe, primeiro modelo de percepção de áudio em tempo real…
Claude Fable 5.1 atualiza agentes longos, ciência e economia do contexto
A Anthropic atualizou Fable 5.1 e Mythos 5.1 com cache 75% mais barato, novos controles para agentes e avanços científicos, mas a migração quebra…
Nvidia lança o primeiro CPU feito para agentes de IA, e a SpaceXAI já vai usá-lo até em órbita
A Nvidia anunciou em 24 de agosto de 2026 que a SpaceXAI vai implantar o Vera, seu primeiro CPU projetado especificamente para agentes de…
Mistral monta coalizão de empresas europeias para bancar até 1 gigawatt de computação soberana até 2030
A Mistral AI anunciou em 11 de agosto de 2026 três novidades voltadas à soberania digital europeia: endpoints de inferência regional que deixam o…
Nvidia paga US$ 6 bilhões à Poolside para construir um modelo de IA aberto rival da OpenAI e da Anthropic
A Nvidia fechou um acordo de licenciamento de US$ 6 bilhões com a startup Poolside para usar sua tecnologia de construção de modelos, o…
AWS amplia acesso aos modelos GPT-5.6 da OpenAI com inferência entre regiões e modelos de cibersegurança
A AWS passou a oferecer, em 17 de agosto de 2026, inferência entre regiões para os modelos GPT-5.6 Sol, Terra e Luna, da OpenAI,…
OpenAI lança ChatGPT for Teens com proteções ativadas por padrão e controle parental
A OpenAI começou, em 18 de agosto de 2026, a distribuir globalmente o ChatGPT for Teens, versão do produto voltada a usuários entre 13…
Cerebras lança CS-4, sistema que promete até 30 vezes mais velocidade de inferência que GPUs
A Cerebras Systems anunciou em 19 de agosto de 2026 o CS-4, primeiro sistema em rack que combina três wafers WSE-3 Turbo, novo chip…
xAI leva o Grok 4.6 ao GitHub Copilot em oito ambientes de desenvolvimento diferentes
Dois dias depois de lançar o Grok 4.6, em 12 de agosto de 2026, a xAI anunciou em 14 de agosto sua chegada ao…
Google lança Gemini 3.7 Flash, modelo barato para código e agentes de IA
O Google lançou em 13 de agosto de 2026 o Gemini 3.7 Flash, modelo cavalo de batalha voltado a engenharia de software, agentes de…
Google lança Pixel 11 com chip Tensor G6 e Gemini capaz de agir em mais de 40 aplicativos
O Google apresentou em 12 de agosto de 2026 a linha Pixel 11, com o chip Tensor G6 de 2 nanômetros e a Gemini…
DeepSeek tira o V4 Pro da fase de testes e mira agentes de IA
A DeepSeek lançou em 12 de agosto de 2026 a versão de produção do V4 Pro, batizada 0813, encerrando quase quatro meses de fase…
Microsoft prepara lançamento do chip de IA Maia 300 para o outono, mirando menos dependência da Nvidia
A Microsoft planeja revelar publicamente o Maia 300, seu novo chip acelerador de inteligência artificial, ainda neste outono do hemisfério norte, possivelmente já em…
Zuckerberg publica manifesto sobre superinteligência e Meta lança Muse Glimmer em código aberto
Em 10 de agosto de 2026, Mark Zuckerberg publicou o ensaio 'The Future is for Everyone', com cerca de 6.500 palavras, defendendo que a…
xAI aposenta grok-imagine-image-quality e migra chamadas para o Image 2.0
CONFIRMADO: a xAI aposentará o identificador grok-imagine-image-quality em 2 de novembro de 2026. As chamadas continuarão respondendo, mas serão atendidas pelo grok-imagine-image-2.0 em qualidade…
Meta lança Muse Code, seu primeiro agente de codificação com IA
A Meta lançou em 5 de agosto de 2026 o Muse Code, seu primeiro agente de codificação com IA, em beta público para macOS…
Grok 4.6: xAI lança novo modelo e já prepara o Grok 4.7
A xAI lançou o Grok 4.6 em 7 de agosto de 2026, cumprindo o prazo anunciado por Elon Musk. O novo modelo mantém a…
OpenAI abre ChatGPT de graça para 100 mil pesquisadores acadêmicos até 2027
A OpenAI anunciou em 29 de julho de 2026 um programa que vai dar a 100 mil pesquisadores acadêmicos acesso gratuito aos seus modelos…
Microsoft lança MAI-Cyber-1-Flash, modelo de IA que bate rivais em cibersegurança pela metade do preço
A Microsoft lançou em 27 de julho de 2026 o MAI-Cyber-1-Flash, seu primeiro modelo de IA especializado em cibersegurança, junto com a plataforma Project…
Kimi K3 vira o maior modelo de IA de peso aberto do mundo com pesos liberados de graça
A Moonshot AI liberou em 27 de julho de 2026 os pesos abertos do Kimi K3, modelo de 2,8 trilhões de parâmetros que se…
Mistral confirma nova família de modelos abertos "gorda mas esparsa" com acesso antecipado em julho
O CEO da Mistral AI, Arthur Mensch, confirmou uma nova família de modelos de peso aberto com arquitetura de mistura de especialistas que ele…
OpenAI libera o ChatGPT Health para todos os adultos dos EUA um dia depois de processo pedir bloqueio
A OpenAI abriu o ChatGPT Health para todos os adultos dos Estados Unidos em 23 de julho de 2026, um dia depois que um…
Anthropic lança Claude Opus 5 com mesmo preço da geração anterior e desempenho perto do Fable 5
A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026, um modelo mais econômico para tarefas do dia a dia que…
CONFIRMADO: Google admite que Gemini 4 já está em pós-treinamento e promete lançamento ainda em 2026
Koray Kavukcuoglu, novo chefe do Google DeepMind, confirmou publicamente que o Gemini 4 está em pós-treinamento e deve chegar bem antes do fim de…
Musk anuncia Grok 4.6 com 2 trilhões de parâmetros pra responder ao Kimi K3
Em 18 de julho de 2026, Elon Musk revelou que a xAI treina o Grok 4.6, modelo de 2 trilhões de parâmetros que deve…
Alibaba mostra o Qwen3.8-Max e diz que o modelo fica atrás só do Claude Fable 5
Em 19 de julho de 2026, durante a WAIC em Xangai, a Alibaba mostrou o Qwen3.8-Max-Preview, modelo multimodal de 2,4 trilhões de parâmetros que…

ZTE lança o NaviX Ultra, primeiro smartphone do mundo com agente de IA embutido no sistema
A ZTE apresentou na WAIC, em Xangai, o NaviX Ultra, telefone da submarca Nubia que roda o assistente Doubao, da ByteDance, e promete executar…
Google atrasa Gemini 3.5 Pro por meses após novo retrabalho no treinamento
O Google adiou pela segunda vez o lançamento amplo do Gemini 3.5 Pro, prometido para junho de 2026 pelo CEO da Alphabet, Sundar Pichai,…
Mira Murati lança o Inkling, primeiro modelo aberto da Thinking Machines, e admite que não é o mais forte do mercado
A Thinking Machines, startup de Mira Murati avaliada em US$ 12 bilhões, lançou em 15 de julho de 2026 o Inkling, modelo aberto de…
Kimi K3, da Moonshot AI, chega como o modelo aberto mais avançado do mundo e custa fração do preço
A Moonshot AI lançou em 16 de julho de 2026 o Kimi K3, modelo de 2,8 trilhões de parâmetros que ficou em quarto lugar…
SpaceXAI anuncia Grok 4.5, modelo "classe Opus" mais barato que a concorrência
Em 8 de julho de 2026, a SpaceXAI (antiga xAI) anunciou o Grok 4.5, modelo que a empresa descreve como de classe comparável ao…

Anthropic lança Claude Sonnet 5 com foco em agentes e preço mais baixo
A Anthropic lançou o Claude Sonnet 5 em 30 de junho de 2026, agora modelo padrão nos planos Free e Pro, com 1 milhão…

Anthropic lança Claude Fable 5 e Mythos 5
A Anthropic lançou dois modelos de fronteira em 9 de junho: Fable 5, versão pública com camada de segurança reforçada, e Mythos 5, que…

xAI lança Grok V9-Medium, modelo focado em programação
O Grok V9-Medium, com 1,5 trilhão de parâmetros e treinado com dados reais de sessões do Cursor, chegou ao Grok e ao SuperGrok em…

OpenAI mostra prévia do GPT-5.6 com acesso restrito
A OpenAI anunciou em 26 de junho uma prévia limitada da família GPT-5.6 (Sol, Terra e Luna), disponível hoje só a cerca de 20…

LangChain lança Deep Agents e atualiza LangGraph para a versão 1.2.4
A LangChain lançou o Deep Agents em março, framework de mais alto nível construído sobre o LangGraph, que por sua vez chegou à versão…