Últimos desenvolvimentos em inteligência artificial
A Cursor lançou três novidades em uma semana. Plugins do Google Workspace permitem que agentes leiam, escrevam e ajam no Gmail, Drive e Calendar. O Cursor for iPad chegou a todos os planos pagos, com chats fixados na barra lateral para acompanhar vários agentes ao mesmo tempo. O Cursor Start foi lançado a Rs 649 por mês para desenvolvedores indianos, incluindo Grok 4.5 e Composer.
A DeepSeek lançou a versão 0731 do V4-Flash a $0,14 por milhão de tokens de entrada e $0,28 de saída, com janela de contexto de 1M e modos de raciocínio (thinking) e não raciocínio. Acertos de cache custam $0,0028 por milhão. A documentação de preços traz um aviso explícito: a DeepSeek planeja aumentar os preços da API, com um aumento significativo previsto.
A OpenAI reduziu o preço do GPT-5.6 Luna para US$ 0,20 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída. O Luna foi lançado a US$ 1 por milhão de tokens de entrada, o que representa um corte de 80%. O restante da família permanece nos mesmos valores: Terra a US$ 2/US$ 12 e Sol a US$ 5/US$ 30 por milhão de tokens.
O Google abriu o preview público do Gemini Robotics ER 2 com dois endpoints: gemini-robotics-er-2-preview, para raciocínio espacial avançado e coordenação multirrobô, e uma variante em streaming otimizada para uso em tempo real via Live API. A geração anterior, gemini-robotics-er-1.6-preview, será desativada em 31 de agosto de 2026.
A Anthropic divulgou o que constatou ao examinar três incidentes reais identificados por meio de suas avaliações de cibersegurança. A publicação faz parte do relatório contínuo de segurança da empresa, e não de um anúncio de produto.
A Anthropic publicou um posicionamento sobre onde se situa em relação a modelos de pesos abertos. No mesmo dia, ampliou sua colaboração com a Cognizant para implantar o Claude em clientes corporativos.
A Anthropic lançou o Claude Opus 5 em 24 de julho. Ele traz programação agêntica e Computer Use de nível de fronteira mantendo o preço do Opus: 5 $ por milhão de tokens de entrada e 25 $ por milhão de saída — metade do preço do Claude Fable 5. O Opus 5 tem janela de contexto de 1M de tokens, até 128K de saída, raciocínio ativado por padrão e conhecimento até maio de 2026. Agora é o padrão no Claude Max e o modelo mais forte no Claude Pro.
Em 22 de julho, AMD e Anthropic anunciaram uma parceria estratégica para implantar até dois gigawatts de GPUs AMD Instinct da série MI450, com o primeiro gigawatt em operação no primeiro semestre de 2027. A AMD pretende investir até 5 bilhões de dólares na Anthropic, enquanto a Anthropic se compromete a comprar dezenas de bilhões em chips de servidor para IA ao longo do acordo. As duas também iniciaram uma colaboração de engenharia em que o Claude otimiza as cargas do Instinct e o software ROCm — um desafio direto ao domínio da Nvidia na infraestrutura de IA.
O Google levou o gemini-3.6-flash e o gemini-3.5-flash-lite à disponibilidade geral. O 3.6 Flash traz melhor eficiência de tokens e planejamento de código e agentic mais forte a um preço mais baixo; o Flash-Lite é voltado para trabalho de subagentes com baixa latência. Uma mudança que quebra compatibilidade acompanha o lançamento: temperature, top_p e top_k foram descontinuados para ambos os modelos.
O Gemini 3.5 Pro do Google — anunciado no I/O em maio com janela de contexto de 2M de tokens e uma camada de raciocínio Deep Think — voltou a atrasar em meados de julho. Depois de mirar um lançamento em 17 de julho, o Google teria adiado quando o modelo não atingiu metas internas de qualidade em taxas de alucinação e confiabilidade real, e a DeepMind teria descartado e reconstruído o modelo base. O mais rápido Gemini 3.5 Flash continua a ser o modelo estável atual do Google.
Em 16 de julho, a Comissão Europeia emitiu duas decisões vinculativas ao abrigo do Digital Markets Act que obrigam o Google a dar a assistentes de IA rivais acesso igual ao Android. O Google deve abrir 11 funcionalidades do sistema a IA de terceiros — incluindo acesso a modelos no dispositivo, execução de tarefas em segundo plano e contexto de ecrã em pé de igualdade com o Gemini — com a maioria das mudanças até agosto de 2027. Uma segunda decisão obriga o Google a partilhar dados de pesquisa anonimizados com motores e chatbots rivais a partir de janeiro de 2027. O Google opõe-se com firmeza, alertando para riscos de segurança.
Em 16 de julho, a chinesa Moonshot AI lançou o Kimi K3, um modelo aberto Mixture-of-Experts de 2,8 trilhões de parâmetros com janela de contexto de 1M de tokens — o maior modelo de pesos abertos já lançado. Em horas, estreou em 1.º lugar na Frontend Code Arena da LMArena com pontuação 1679, superando o Claude Fable 5 no benchmark que mede mais diretamente o valor da programação em produção. É um sinal de que os modelos abertos da China já competem na fronteira apesar dos limites dos EUA à exportação de chips.
Em 9 de julho, a OpenAI lançou publicamente a família GPT-5.6 em três níveis: Sol (o modelo de topo), Terra (intermediário) e Luna (rápido e barato). Sam Altman afirmou que o Sol é cerca de 54% mais eficiente em tokens na programação do que a geração anterior. Junto com os modelos, a OpenAI lançou o ChatGPT Work — um agente feito para executar trabalhos inteiros em vez de apenas responder — e o GPT-Live, um modo de voz full-duplex que ouve e fala ao mesmo tempo.
Em 24 de junho, o Google adicionou o Computer Use ao Gemini 3.5 Flash: o modelo pode controlar a interface de um computador — clicar, digitar e navegar por aplicativos — para concluir tarefas como agente autônomo. Isso traz a automação de interface com agentes ao modelo estável mais rápido do Google. O maior Gemini 3.5 Pro, com raciocínio Deep Think e janela de contexto de 2 milhões de tokens, continua previsto para julho.
A Anthropic lançou o Claude Fable 5 em 9 de junho — o primeiro modelo de classe Mythos disponível publicamente. Desempenho líder em quase todos os benchmarks testados: engenharia de software, visão, pesquisa científica e execução autônoma de tarefas. Simultaneamente, foi lançado o Claude Mythos 5 com acesso restrito para organizações aprovadas na área de cibersegurança governamental. Gratuito até 22 de junho nos planos Pro, Max, Team e Enterprise; a partir de 23 de junho — $10/$50 por 1 milhão de tokens.
Todos os planos do GitHub Copilot migraram para faturamento baseado em uso em 1º de junho. O custo de cada interação agora depende do modelo usado e dos tokens consumidos. Nova moeda: GitHub AI Credits (1 crédito = $0,01). O plano Pro inclui 1.500 créditos/mês, Pro+ inclui 7.000 ($39/mês), Max inclui 20.000. Clientes Business e Enterprise recebem créditos extras no período de transição até 1º de setembro de 2026.
A Anthropic levantou $65 bilhões em uma rodada Série H com avaliação pós-investimento de $965 bilhões, liderada por Altimeter, Dragoneer, Greenoaks e Sequoia. Em 1º de junho a empresa fez uma solicitação confidencial de formulário S-1 para um IPO. A receita anualizada chegou a ~$47 bilhões em maio de 2026, superando a OpenAI (~$852 bilhões) e tornando a Anthropic a startup de IA mais valiosa da história.
A Anthropic lançou o Opus 4.8 apenas 41 dias após o 4.7. A pontuação no USAMO 2026 subiu de 69,3% para 96,7%. O Dynamic Workflows no Claude Code lança até 1.000 subagentes em paralelo para tarefas em escala de repositório. O modo Fast caiu de $30/$150 para $10/$50 por milhão de tokens, uma redução de 3x. Preço base inalterado: $5/$25 por milhão de tokens.
A ByteDance revelou planos para gastar até $70 bilhões em data centers de IA em 2026, quase o triplo dos $25 bilhões de 2025. A empresa planeja financiar os gastos com seus próprios lucros, cerca de $50 bilhões em 2025. O valor coloca a ByteDance no mesmo patamar de Microsoft e Google em termos de despesas de capital em IA.
Um júri federal da Califórnia rejeitou unanimemente todas as alegações no processo de $150 bilhões de Elon Musk contra a OpenAI e Sam Altman. Veredicto em menos de duas horas: prazo de prescrição expirado. Musk anunciou planos para recorrer.
O I/O do Google mais rico em produtos em anos. Gemini 3.5 Flash substitui o flagship anterior com velocidade Flash a $1,50/1M tokens. Gemini Spark é lançado como agente pessoal proativo 24/7 em VMs na nuvem. Os óculos Android XR com tela real chegam para testes. Google AI Ultra substitui o plano de $250/mês por $100/mês.
Andrej Karpathy — cofundador da OpenAI e ex-líder de IA na Tesla — ingressou na Anthropic. Ele está criando uma nova equipa focada em usar o próprio Claude para acelerar a pesquisa de pré-treinamento. Trabalha sob a supervisão de Nick Joseph, chefe da área de pretraining. A contratação é vista como um sinal do crescente momentum da Anthropic para atrair talentos técnicos de elite.
Cursor lançou o Composer 2.5, com Kimi K2.5, atingindo ~63% no SWE-Bench — equivalente ao Claude Opus 4.7 — a $0,50/tarefa vs. $7/tarefa para Opus. Inclui ambientes de agentes cloud multi-repo, configuração Dockerfile e logs de auditoria empresarial.
OpenAI e Dell Technologies firmaram parceria para implantar o Codex em ambientes empresariais híbridos e on-premises via Dell AI Data Platform — o primeiro acordo explícito de distribuição on-prem da OpenAI. O Codex já tem mais de 4M de desenvolvedores ativos por semana.
O Google I/O 2026 começa esta semana, com anúncio de um novo modelo Gemini previsto para 19 de maio. O Google já sinalizou grandes atualizações em toda a família Gemini e no portfólio mais amplo de produtos de IA da empresa. O evento vem após o Google Android Show 2026, no qual foi anunciado o Gemini Intelligence para automação de tarefas de múltiplas etapas no Android.
A HeyGen descontinuou os planos legados de vídeo com avatar ilimitado em 15 de maio de 2026. Todas as novas assinaturas da HeyGen agora são baseadas em créditos. O Avatar V, capaz de gerar resultados com qualidade de estúdio a partir de 15 segundos de filmagem, e a integração com o Seedance 2.0 foram lançados junto com a reestruturação de preços.
A AWS bloqueou novos cadastros no plugin do Amazon Q Developer para IDE a partir de 15 de maio de 2026, anunciando seu substituto: o Kiro, um IDE agentivo orientado a especificações. O Kiro utiliza "Specs" (requisitos em linguagem natural que guiam a implementação completa) e "Hooks" (acionadores automáticos ao salvar arquivos ou fazer commit). O suporte ao plugin de IDE termina em 30 de abril de 2027.
O Cursor 3.4 introduz ambientes de desenvolvimento agênticos: os agentes agora provisionam ambientes definidos por Dockerfile, trabalham em múltiplos repositórios simultaneamente e executam tarefas em paralelo. O Cursor 3.3 havia adicionado revisão de PR dentro do editor. O BugBot passa para cobrança baseada em uso a partir de junho de 2026.
No Google Android Show 2026, o Google anunciou o Gemini Intelligence — uma nova camada que automatiza tarefas de múltiplas etapas, como compras, reservas e gerenciamento de agenda, diretamente em dispositivos Android. Chegará a celulares Samsung e Google no verão de 2026. O Google também anunciou o Googlebooks — novos laptops com Android da Acer, ASUS e Lenovo, com o Gemini integrado.
A Notion lançou o Developer Platform 3.5 em 13 de maio de 2026. O Workers runtime permite que desenvolvedores implantem lógica serverless em JavaScript dentro do Notion. O Database Sync possibilita conexões bidirecionais com bancos de dados externos. Os Webhooks Bidirecionais permitem que o Notion receba e envie eventos. O Plan Mode viabiliza agentes de IA autônomos com múltiplas etapas dentro dos fluxos de trabalho do Notion.
A OpenAI descontinuou oficialmente o DALL-E 2 e o DALL-E 3 em 12 de maio de 2026. Ambos são substituídos pelo modelo gpt-image-2, que alimenta o ChatGPT Images 2.0 com resolução nativa em 2K, renderização de texto multilíngue e até 8 imagens por prompt no modo thinking.
A Krea AI lançou seu modelo fundacional Krea 2, construído do zero com foco em estética e transferência de estilo. O lançamento vem acompanhado do Krea Nodes (cria fluxos de trabalho de imagem a partir de descrições em texto) e do Krea Edit (edição por região, reiluminação, expansão de imagem). O Seedance 2.0 já está disponível em todos os planos pagos.
A Luma AI lançou o Ray3.14 com saída de vídeo em 1080p nativo (sem upscaling), velocidade de geração 4x mais rápida que o Ray2 e custo por segundo gerado 3x menor. O recurso Character Seeds mantém a aparência consistente de personagens em múltiplos clipes. Já o Modify with Instructions permite edições pós-geração guiadas por texto, sem necessidade de regeneração completa.
A Kling AI lançou a v3.5 com saída nativa em 1080p/60fps, duração estendida dos clipes do plano Pro para até 2 minutos (a geração única mais longa disponível) e física de movimento aprimorada para dinâmica de fluidos e simulação de tecidos. A Kuaishou está avaliando separar a Kling AI como uma empresa independente, com uma avaliação de aproximadamente US$ 20 bilhões.
O Pika 2.5 elimina artefatos de cintilação e mantém a aparência estável dos personagens entre cenas. O PikaStream 1.0 lança o chat em vídeo com IA em tempo real: os usuários têm conversas ao vivo com agentes de IA renderizados como personagens de vídeo gerados. A Pika está se expandindo para uma plataforma de aplicativo de vídeo social com IA, combinando criação, compartilhamento e interação com IA em tempo real.
O Midjourney V8.1 traz saída nativa em resolução 2K, velocidade de geração de 3 a 4 vezes mais rápida que o V7, e o modo Raw para uma interpretação mais literal dos prompts. Perfis públicos permitem que criadores compartilhem seus trabalhos socialmente. O Midjourney TV é lançado como uma transmissão em tempo real das criações da comunidade. O V8.2 já foi anunciado como o próximo lançamento.
O Figma lançou um servidor MCP (Model Context Protocol) que permite que agentes de IA, como Cursor e Claude, criem e editem designs diretamente no canvas do Figma. As ferramentas de imagem com IA integradas agora incluem Vectorize, Remove Background, Erase e Expand — eliminando a necessidade de exportar para o Photoshop. Entrada por voz e texto em trajetória também já estão disponíveis.
O Centro de Padrões e Inovação em IA do NIST anunciou acordos com Microsoft, Google e xAI para avaliar modelos de IA não lançados em busca de riscos à segurança nacional antes do lançamento. O movimento foi impulsionado pelo modelo restrito Mythos da Anthropic. A Anthropic está notavelmente ausente do acordo.
A OpenAI substituiu o GPT-5.3 Instant pelo GPT-5.5 Instant como modelo padrão no ChatGPT. O novo modelo apresenta 52,5% menos alucinações em prompts de alto risco e integra memória de conversas passadas, Gmail e arquivos salvos para usuários Plus e Pro.
A plataforma de música com IA Suno está captando uma rodada Série D com valuation de US$ 5 bilhões, mais que o dobro dos US$ 2,45 bilhões alcançados em novembro de 2025. A empresa agora tem 2 milhões de assinantes pagantes e gera 7 milhões de faixas por dia.
A Novo Nordisk anunciou uma parceria estratégica com a OpenAI para integrar IA em descoberta de medicamentos, ensaios clínicos, fabricação, cadeias de suprimentos e operações comerciais. O acordo visa a aceleração de novos tratamentos para obesidade e diabetes.
O Model Context Protocol (MCP) da Anthropic ultrapassou 97 milhões de instalações em março de 2026, transitando de um padrão experimental para infraestrutura fundamental para construção de agentes de IA. Todos os principais fornecedores de IA agora incluem ferramentas compatíveis com MCP.
A Anthropic desenvolveu um novo modelo frontier chamado Mythos que a empresa diz estar «muito à frente» de todos os outros modelos em capacidade de cibersegurança. Devido aos riscos, a Anthropic está restringindo o acesso a um grupo seleto de organizações verificadas. O modelo levou a Casa Branca a começar a considerar um processo formal de revisão de IA.
O Gemini 3.1 Pro do Google surgiu como o líder geral nos benchmarks em avaliações independentes, liderando 13 dos 16 principais benchmarks. Pontuações principais: 80,6% no SWE-bench, 94,3% no GPQA Diamond (o mais alto de qualquer modelo), janela de contexto de 2M tokens em texto, imagem, áudio e vídeo.
A Mistral lançou o Small 4, um modelo open-source de 119 bilhões de parâmetros com uma janela de contexto de 256k, raciocínio configurável e capacidades multimodais (visão). Ele combina execução rápida de instruções, raciocínio aprofundado e compreensão de imagens em um único modelo unificado sob licença aberta.
Microsoft e OpenAI reescreveram seu acordo fundamental de 2019: a Microsoft encerra sua participação nas receitas do Azure com a OpenAI, a OpenAI agora pode vender através do Amazon Web Services e do Google Cloud, e a famosa «cláusula AGI» é removida. O ARR da Anthropic superou o da OpenAI pela primeira vez com $30B.
O Google anunciou um investimento de até $40 bilhões na Anthropic, começando com $10 bilhões a uma avaliação de $350 bilhões, com parcelas adicionais atreladas a marcos. O Google Cloud também comprometeu 5 gigawatts de capacidade computacional por cinco anos — o maior investimento em IA já registrado.
A OpenAI lançou o GPT-5.5, seu modelo mais avançado até o momento, com melhorias dramáticas na codificação agêntica via Codex, pesquisa profunda e a capacidade de operar software de ponta a ponta. O lançamento foi feito para usuários Plus, Pro, Business e Enterprise do ChatGPT e da API em 24 de abril.
A Anthropic lançou o Claude Design, seu primeiro produto dedicado a design, como parte do Anthropic Labs. Construído sobre o Claude Opus 4.7, ele gera apresentações de slides, mockups e materiais de marketing a partir de conversas — com geração automática de sistema de marca a partir de bases de código ou arquivos de design existentes. Disponível sem custo adicional para assinantes do Claude Pro, Max, Team e Enterprise.
A Adobe lançou o Creative Agent, uma camada de orquestração de IA que aceita um único prompt em linguagem natural e executa fluxos de trabalho coordenados no Photoshop, Premiere, Lightroom e Illustrator. A beta do Custom Models permite o ajuste fino com ativos de marca próprios. A geração de som foi adicionada ao Adobe Firefly.