Los últimos avances en inteligencia artificial
Cursor lanzó tres cambios en una semana. Los plugins de Google Workspace permiten a los agentes leer, escribir y actuar en Gmail, Drive y Calendar. Cursor for iPad llegó a todos los planes de pago con chats fijados en la barra lateral para seguir a varios agentes a la vez. Cursor Start se lanzó a Rs 649 al mes para desarrolladores indios, incluyendo Grok 4.5 y Composer.
DeepSeek lanzó la versión 0731 de V4-Flash a $0.14 por millón de tokens de entrada y $0.28 de salida, con una ventana de contexto de 1M y modos de pensamiento y sin pensamiento. Los aciertos de caché cuestan $0.0028 por millón. La documentación de precios incluye un aviso explícito: DeepSeek planea subir los precios de la API, con un aumento significativo previsto.
OpenAI bajó el precio de GPT-5.6 Luna a 0,20 $ por millón de tokens de entrada y 1,20 $ por millón de tokens de salida. Luna se lanzó a 1 $ por millón de tokens de entrada, por lo que se trata de una rebaja del 80%. El resto de la familia se mantiene en Terra 2 $/12 $ y Sol 5 $/30 $ por millón de tokens.
Anthropic reveló lo que descubrió al examinar tres incidentes reales detectados a través de sus evaluaciones de ciberseguridad. La publicación forma parte de los informes de seguridad habituales de la empresa y no de un anuncio de producto.
Google abrió la vista previa pública de Gemini Robotics ER 2 con dos endpoints: gemini-robotics-er-2-preview para razonamiento espacial avanzado y coordinación multi-robot, y una variante en streaming optimizada para uso en tiempo real a través de la Live API. La generación anterior, gemini-robotics-er-1.6-preview, se cerrará el 31 de agosto de 2026.
Anthropic publicó una declaración en la que expone su posición respecto a los modelos de pesos abiertos. El mismo día, amplió su colaboración con Cognizant para desplegar Claude entre clientes empresariales.
Anthropic lanzó Claude Opus 5 el 24 de julio. Ofrece programación agéntica y Computer Use de nivel frontera manteniendo el precio de Opus: 5 $ por millón de tokens de entrada y 25 $ por millón de salida — la mitad que Claude Fable 5. Opus 5 tiene una ventana de contexto de 1M de tokens, hasta 128K de salida, razonamiento activado por defecto y conocimiento hasta mayo de 2026. Ahora es el modelo por defecto en Claude Max y el más potente en Claude Pro.
El 22 de julio, AMD y Anthropic anunciaron una alianza estratégica para desplegar hasta dos gigavatios de GPU AMD Instinct de la serie MI450, con el primer gigavatio operativo en la primera mitad de 2027. AMD prevé invertir hasta 5.000 millones de dólares en Anthropic, mientras que Anthropic se compromete a comprar decenas de miles de millones en chips para servidores de IA. Ambas lanzaron además una colaboración de ingeniería en la que Claude optimiza las cargas de Instinct y el software ROCm — un desafío directo al dominio de Nvidia en infraestructura de IA.
Google llevó gemini-3.6-flash y gemini-3.5-flash-lite a disponibilidad general. 3.6 Flash aporta mayor eficiencia de tokens y una planificación de código y agentes más sólida a un precio más bajo; Flash-Lite está pensado para tareas de subagentes de baja latencia. Ambos llegan con un cambio disruptivo: temperature, top_p y top_k quedan obsoletos para los dos modelos.
El Gemini 3.5 Pro de Google — presentado en el I/O de mayo con ventana de contexto de 2M de tokens y una capa de razonamiento Deep Think — volvió a retrasarse a mediados de julio. Tras apuntar a un lanzamiento el 17 de julio, Google lo habría aplazado al no alcanzar el modelo sus objetivos internos de calidad en tasas de alucinación y fiabilidad real, y DeepMind habría desechado y reconstruido el modelo base. El más rápido Gemini 3.5 Flash sigue siendo el modelo estable actual de Google.
El 16 de julio, la china Moonshot AI lanzó Kimi K3, un modelo abierto Mixture-of-Experts de 2,8 billones de parámetros con ventana de contexto de 1M de tokens — el mayor modelo de pesos abiertos jamás publicado. En horas debutó en el puesto n.º 1 de la Frontend Code Arena de LMArena con 1679 puntos, superando a Claude Fable 5 en el benchmark que mejor mide el valor real de programar. Es señal de que los modelos abiertos de China ya compiten en la frontera pese a los límites de EE. UU. a la exportación de chips.
El 16 de julio, la Comisión Europea emitió dos decisiones vinculantes bajo la Ley de Mercados Digitales que obligan a Google a dar a los asistentes de IA rivales igual acceso a Android. Google debe abrir 11 funciones del sistema a la IA de terceros — incluido el acceso a modelos en el dispositivo, la ejecución de tareas en segundo plano y el contexto de pantalla a la par de Gemini — con la mayoría de los cambios para agosto de 2027. Una segunda decisión obliga a Google a compartir datos de búsqueda anonimizados con buscadores y chatbots rivales desde enero de 2027. Google se opone con firmeza y advierte de riesgos de seguridad.
El 9 de julio OpenAI lanzó públicamente su familia GPT-5.6 en tres niveles: Sol (el modelo tope), Terra (gama media) y Luna (rápido y barato). Sam Altman afirmó que Sol es un 54% más eficiente en tokens al programar que la generación anterior. Junto con los modelos, OpenAI presentó ChatGPT Work — un agente diseñado para realizar trabajos completos en lugar de solo responder — y GPT-Live, un modo de voz full-duplex que escucha y habla a la vez.
El 24 de junio, Google añadió Computer Use a Gemini 3.5 Flash: el modelo puede controlar la interfaz de un ordenador —hacer clic, escribir y navegar por aplicaciones— para completar tareas como agente autónomo. Lleva la automatización de interfaz con agentes al modelo estable más rápido de Google. El mayor Gemini 3.5 Pro, con razonamiento Deep Think y ventana de contexto de 2 millones de tokens, sigue previsto para julio.
Anthropic lanzó Claude Fable 5 el 9 de junio — el primer modelo de clase Mythos disponible públicamente. Rendimiento líder en casi todos los benchmarks evaluados: programación, visión, investigación científica y ejecución autónoma de tareas. Simultáneamente, lanzó Claude Mythos 5 con acceso restringido para organizaciones aprobadas en ciberseguridad gubernamental. Gratuito hasta el 22 de junio para planes Pro, Max, Team y Enterprise; desde el 23 de junio — $10/$50 por millón de tokens.
Anthropic recaudó 65.000 millones de dólares en una ronda Serie H a una valoración post-money de 965.000 millones, liderada por Altimeter, Dragoneer, Greenoaks y Sequoia. El 1 de junio la empresa presentó confidencialmente un formulario S-1 para una OPI. Los ingresos anualizados alcanzaron ~47.000 millones en mayo de 2026, superando a OpenAI (~852.000 millones) y convirtiendo a Anthropic en el startup de IA más valioso de la historia.
Todos los planes de GitHub Copilot pasaron a una facturación basada en el uso el 1 de junio. El costo de cada interacción depende ahora del modelo utilizado y los tokens consumidos. Nueva moneda: GitHub AI Credits (1 crédito = $0,01). El plan Pro incluye 1.500 créditos al mes, Pro+ incluye 7.000 ($39/mes), Max incluye 20.000. Los clientes Business y Enterprise reciben créditos adicionales en el período de transición hasta el 1 de septiembre de 2026.
Anthropic lanzó Opus 4.8 solo 41 días después de 4.7. La puntuación en USAMO 2026 subió de 69.3% a 96.7%. Dynamic Workflows en Claude Code lanza hasta 1.000 subagentes en paralelo para tareas a escala de repositorio. El modo Fast bajó de $30/$150 a $10/$50 por millón de tokens — una reducción de 3x. Precio base sin cambios: $5/$25 por millón de tokens.
ByteDance reveló planes para gastar hasta $70.000 millones en centros de datos de AI en 2026, casi el triple de los $25.000 millones de 2025. La empresa planea financiar el gasto con sus propias ganancias, cerca de $50.000 millones en 2025. La cifra sitúa a ByteDance en el mismo nivel que Microsoft y Google en gasto de capital en AI.
El I/O de Google más cargado de productos en años. Gemini 3.5 Flash reemplaza al flagship anterior a velocidad Flash por $1,50/1M tokens. Gemini Spark se lanza como agente personal proactivo 24/7 en VMs en la nube. Las gafas Android XR con pantalla real llegan a pruebas. Google AI Ultra reemplaza el plan de $250/mes por $100/mes.
Andrej Karpathy — cofundador de OpenAI y exlíder de AI en Tesla — se ha unido a Anthropic. Liderará un nuevo equipo enfocado en usar Claude para acelerar la investigación de preentrenamiento. Trabajará bajo Nick Joseph, responsable del área de pretraining. El fichaje es visto como una señal del impulso de Anthropic para atraer talento técnico de élite.
Un jurado federal de California desestimó por unanimidad todas las demandas en el pleito de $150.000 millones de Elon Musk contra OpenAI y Sam Altman. Veredicto en menos de dos horas: el plazo de prescripción había expirado. Musk anunció planes para apelar.
Cursor lanzó Composer 2.5, impulsado por Kimi K2.5, alcanzando ~63% en SWE-Bench — igual que Claude Opus 4.7 — a $0,50/tarea vs. $7/tarea para Opus. También incluye entornos de agentes cloud multi-repo, configuración basada en Dockerfile y registros de auditoría empresarial.
OpenAI y Dell Technologies se asociaron para desplegar Codex en entornos empresariales híbridos y on-premises a través de Dell AI Data Platform — el primer acuerdo explícito de distribución on-prem de OpenAI. Codex ya tiene más de 4M de desarrolladores activos semanales.
Google I/O 2026 arranca esta semana y se espera el anuncio de un nuevo modelo Gemini el 19 de mayo. Google ha señalado importantes actualizaciones en toda la familia Gemini y en el portafolio más amplio de productos de IA de Google. El evento llega después del Google Android Show 2026, donde se presentó Gemini Intelligence para la automatización de tareas de varios pasos en Android.
AWS bloqueó los nuevos registros del plugin Amazon Q Developer IDE a partir del 15 de mayo de 2026, anunciando su reemplazo: Kiro, un IDE agéntico basado en especificaciones. Kiro utiliza "Specs" (requisitos en lenguaje natural que impulsan la implementación completa) y "Hooks" (activadores automáticos al guardar un archivo o hacer un commit). El soporte del plugin para IDE finaliza el 30 de abril de 2027.
HeyGen descontinuó los planes ilimitados heredados de video con avatares el 15 de mayo de 2026. Todas las nuevas suscripciones de HeyGen ahora funcionan por créditos. Junto con la reestructuración de precios, se lanzaron Avatar V, capaz de generar resultados de calidad de estudio a partir de 15 segundos de grabación, y la integración de video Seedance 2.0.
Notion lanzó Developer Platform 3.5 el 13 de mayo de 2026. El entorno Workers permite a los desarrolladores implementar lógica serverless en JavaScript dentro de Notion. Database Sync habilita conexiones bidireccionales con bases de datos externas. Bidirectional Webhooks permite que Notion reciba y envíe eventos. Plan Mode habilita agentes de IA autónomos de múltiples pasos dentro de los flujos de trabajo de Notion.
Cursor 3.4 introduce entornos de desarrollo agénticos: los agentes ahora aprovisionan entornos definidos mediante Dockerfile, trabajan simultáneamente en múltiples repositorios y se ejecutan en paralelo. Cursor 3.3 había añadido la revisión de PR dentro del editor. BugBot pasará a facturación basada en uso a partir de junio de 2026.
En el Google Android Show 2026, Google presentó Gemini Intelligence, una nueva capa que automatiza tareas de varios pasos, como compras, reservas y gestión de calendario, directamente en dispositivos Android. Llegará a teléfonos Samsung y Google en el verano de 2026. Google también anunció Googlebooks, nuevas laptops con Android de Acer, ASUS y Lenovo con Gemini integrado.
OpenAI retiró oficialmente DALL-E 2 y DALL-E 3 el 12 de mayo de 2026. Ambos son reemplazados por el modelo gpt-image-2, que impulsa ChatGPT Images 2.0 con resolución nativa de 2K, renderizado de texto multilingüe y hasta 8 imágenes por solicitud en modo de razonamiento.
Krea AI presentó su modelo fundacional Krea 2, desarrollado desde cero con énfasis en la estética y la transferencia de estilo. El lanzamiento se acompaña de Krea Nodes (creación de flujos de trabajo de imágenes a partir de descripciones de texto) y Krea Edit (edición por regiones, reiluminación, expansión de imágenes). Seedance 2.0 ya está disponible en todos los planes de pago.
Midjourney V8.1 ofrece salida en resolución nativa 2K, una velocidad de generación de 3 a 4 veces más rápida que V7, y el modo Raw para una interpretación más literal de los prompts. Los perfiles públicos permiten a los creadores compartir su trabajo socialmente. Midjourney TV se lanza como una transmisión en tiempo real de las creaciones de la comunidad. Se ha anunciado V8.2 como la próxima versión.
Figma lanzó un servidor MCP (Model Context Protocol) que permite que agentes de IA como Cursor y Claude creen y editen diseños directamente en el lienzo de Figma. Las herramientas de IA para imágenes integradas ahora incluyen Vectorize, Remove Background, Erase y Expand, eliminando la necesidad de exportar a Photoshop. También están disponibles la entrada por voz y el texto sobre trayectoria.
Luma AI lanzó Ray3.14 con salida de video en 1080p nativo (sin escalado), una velocidad de generación 4 veces más rápida que Ray2 y un costo 3 veces menor por segundo generado. Character Seeds mantiene una apariencia de personaje consistente en múltiples clips. Modify with Instructions permite realizar ediciones guiadas por texto después de la generación sin necesidad de regenerar todo el contenido.
Kling AI lanzó la v3.5 con salida nativa en 1080p/60fps, duración de clip Pro ampliada hasta 2 minutos (la generación individual más larga disponible) y física de movimiento mejorada para dinámica de fluidos y simulación de telas. Kuaishou está evaluando escindir Kling AI como empresa independiente con una valoración aproximada de 20 mil millones de dólares.
Pika 2.5 elimina los artefactos de parpadeo y logra una apariencia estable de los personajes a lo largo de las escenas. PikaStream 1.0 lanza el chat de video con IA en tiempo real: los usuarios mantienen conversaciones en vivo con agentes de IA representados como personajes de video generados. Pika se está expandiendo hacia una plataforma de aplicación de video social con IA que combina creación, compartición e interacción con IA en tiempo real.
OpenAI reemplazó a GPT-5.3 Instant por GPT-5.5 Instant como modelo predeterminado en ChatGPT. El nuevo modelo presenta un 52.5% menos de alucinaciones en consultas de alto riesgo e integra memoria de conversaciones pasadas, Gmail y archivos guardados para los usuarios Plus y Pro.
El Centro de Estándares e Innovación de IA del NIST anunció acuerdos con Microsoft, Google y xAI para evaluar modelos de IA no lanzados en busca de riesgos de seguridad nacional antes del lanzamiento. La iniciativa fue impulsada por el modelo restringido Mythos de Anthropic. Anthropic está notablemente ausente del acuerdo.
La plataforma de música con IA Suno está levantando una ronda Serie D con una valoración de 5.000 millones de dólares, más del doble de su valoración de noviembre de 2025, que era de 2.450 millones de dólares. La empresa cuenta ahora con 2 millones de suscriptores de pago y genera 7 millones de pistas al día.
Novo Nordisk anunció una asociación estratégica con OpenAI para integrar la IA en el descubrimiento de fármacos, ensayos clínicos, fabricación, cadenas de suministro y operaciones comerciales. El acuerdo apunta a la aceleración de nuevos tratamientos para la obesidad y la diabetes.
Anthropic ha desarrollado un nuevo modelo frontera llamado Mythos que la empresa dice está «muy por delante» de todos los demás modelos en capacidad de ciberseguridad. Debido a los riesgos, Anthropic está restringiendo el acceso a un grupo selecto de organizaciones verificadas. El modelo llevó a la Casa Blanca a comenzar a evaluar un proceso formal de revisión de IA.
El Model Context Protocol (MCP) de Anthropic superó los 97 millones de instalaciones en marzo de 2026, pasando de un estándar experimental a infraestructura fundamental para construir agentes de IA. Todos los principales proveedores de IA incluyen ahora herramientas compatibles con MCP.
Gemini 3.1 Pro de Google ha emergido como el líder general en benchmarks en evaluaciones independientes, encabezando 13 de 16 benchmarks principales. Puntuaciones clave: 80,6% en SWE-bench, 94,3% en GPQA Diamond (el más alto de cualquier modelo), ventana de contexto de 2M tokens en texto, imagen, audio y video.
Mistral presentó Small 4, un modelo de código abierto de 119.000 millones de parámetros con ventana de contexto de 256k, razonamiento configurable y capacidades multimodales (visión). Combina seguimiento rápido de instrucciones, razonamiento profundo y comprensión visual en un único modelo.
Microsoft y OpenAI reescribieron su acuerdo fundacional de 2019: Microsoft termina su participación en ingresos de Azure con OpenAI, OpenAI ahora puede vender a través de Amazon Web Services y Google Cloud, y la famosa «cláusula AGI» es eliminada. Los ingresos de Anthropic han superado a los de OpenAI por primera vez con $30B, lo que pudo haber acelerado la renegociación.
Google anunció una inversión de hasta 40.000 millones de dólares en Anthropic, comenzando con 10.000 millones a una valoración de 350.000 millones. Google Cloud también se compromete a 5 gigavatios de capacidad de cómputo durante cinco años.
OpenAI presentó GPT-5.5 con mejoras significativas en codificación agéntica mediante Codex, investigación profunda y la capacidad de operar software de extremo a extremo de forma autónoma. Disponible para suscriptores Plus, Pro, Business y Enterprise.
Anthropic presentó Claude Design, su primer producto dedicado al diseño, como parte de Anthropic Labs. Construido sobre Claude Opus 4.7, genera presentaciones de diapositivas, mockups y materiales de marketing a partir de una conversación, con generación automática de sistemas de marca a partir de bases de código o archivos de diseño existentes. Está disponible sin costo adicional para los suscriptores de Claude Pro, Max, Team y Enterprise.
Adobe lanzó Creative Agent, una capa de orquestación de IA que acepta un único prompt en lenguaje natural y ejecuta flujos de trabajo coordinados en Photoshop, Premiere, Lightroom e Illustrator. La beta de Custom Models permite el ajuste fino de la generación con activos de marca propios. La generación de sonido se añadió a Adobe Firefly, extendiendo la plataforma a la creación de audio.