SECCIÓN · 34 noticias
Lanzamientos y Modelos
Releases, nuevos modelos e integraciones — y qué cambia para quien opera.
Nvidia lanza el primer CPU hecho para agentes de IA, y SpaceXAI ya lo usará hasta en órbita
Nvidia anunció el 24 de agosto de 2026 que SpaceXAI implementará Vera, su primer CPU diseñado específicamente para agentes de inteligencia artificial, para acelerar su próxima generación de cargas de trabajo agenticas, según un comunicado oficial de Nvidia distribuido también vía GlobeNewswire y confirmado por StorageReview, WCCFTech, Seeking Alpha y StockTitan. SpaceXAI también está ampliando la infraestructura de IA de Grok con la plataforma Nvidia Vera Rubin, rumbo a gigavatios de capacidad computacional, y planea llevar la tecnología hasta el espacio: el satélite de inteligencia artificial Starmind, de primera generación, se basará en un sistema Vera Rubin NVL72 optimizado para órbita. Según Nvidia, Vera completa tareas hasta 1,8 veces más rápido que las CPU x86 en cargas de IA agentica, aprendizaje por refuerzo y procesamiento de datos.
Mistral arma una coalición de empresas europeas para financiar hasta 1 gigavatio de cómputo soberano hacia 2030
Mistral AI anunció el 11 de agosto de 2026 tres novedades orientadas a la soberanía digital europea: endpoints de inferencia regional que permiten al cliente elegir si sus datos se procesan en Europa o en Estados Unidos, un Priority Tier en vista previa pública con garantía de disponibilidad del 99,5% para cargas críticas, y una coalición de empresas europeas que asumen compromisos plurianuales de compra de capacidad para financiar hasta 1 gigavatio de infraestructura de cómputo en Europa hacia 2030, según un comunicado oficial de la empresa confirmado por VentureBeat, eWeek y otros medios. Empresas como Amadeus, ASML, Capgemini, Caisse des Dépôts y CMA CGM ya firmaron compromisos, que sostendrían 200 megavatios de capacidad hacia fines de 2027. Mistral también comienza a alojar modelos abiertos de terceros en su plataforma, empezando por el GLM-5.2 de Z.ai.
Nvidia paga US$6.000 millones a Poolside para construir un modelo de IA abierto rival de OpenAI y Anthropic
Nvidia cerró un acuerdo de licencia de US$6.000 millones con la startup Poolside para usar su tecnología de construcción de modelos, llamada Model Factory, además de invertir otros US$1.000 millones en la empresa, valorada en US$12.000 millones antes del aporte, según un reportaje de Bloomberg publicado el 20 de agosto de 2026 y confirmado por Benzinga, PYMNTS, Yahoo Finance y Forbes. Más de 100 empleados de Poolside, incluidos ingenieros, se unirían a Nvidia para trabajar en su proyecto de IA abierta Nemotron, mientras Poolside sigue operando de forma independiente bajo sus tres cofundadores. La empresa afirma que el objetivo es avanzar hacia una inteligencia artificial general abierta, y no controlada por pocas empresas, un movimiento dirigido directamente a rivales como OpenAI, Anthropic, DeepSeek y Kimi.
AWS amplía el acceso a los modelos GPT-5.6 de OpenAI con inferencia entre regiones y modelos de ciberseguridad
AWS comenzó a ofrecer, el 17 de agosto de 2026, inferencia entre regiones para los modelos GPT-5.6 Sol, Terra y Luna de OpenAI dentro de Amazon Bedrock, según un comunicado oficial de AWS confirmado por TechTarget. La función enruta automáticamente las solicitudes entre múltiples regiones de AWS para ganar más capacidad de procesamiento y reducir el costo de inferencia, con soporte para las API Responses, Converse y Chat Completions. El anuncio llega una semana después de que AWS habilitara dos modelos de ciberseguridad de OpenAI en Bedrock, llamados Daybreak Red y Daybreak Blue, y semanas después de recortar hasta un 80% el precio del modelo más liviano de la familia GPT-5.6.
Todas las publicaciones
34OpenAI lanza ChatGPT for Teens con protecciones activadas por defecto y control parental
OpenAI comenzó a distribuir globalmente ChatGPT for Teens el 18 de agosto de 2026, una versión del producto pensada para usuarios de entre 13 y 17 años con protecciones de contenido activadas por defecto, restricciones reforzadas en conversaciones sobre autolesión, suicidio y temas románticos o sexuales, y un nuevo modo de estudio llamado Study Mode. Según el blog oficial de la empresa y reportes de TechCrunch y Technology.org, los padres pueden vincular cuentas, definir horarios de silencio y decidir si el Study Mode está activo por defecto, pero no tienen acceso al contenido de las conversaciones de sus hijos, salvo en situaciones raras de riesgo grave para la seguridad.
Cerebras lanza CS-4, un sistema que promete hasta 30 veces más velocidad de inferencia que las GPU
Cerebras Systems anunció el 19 de agosto de 2026 el CS-4, su primer sistema en rack que combina tres obleas WSE-3 Turbo en paralelo, funcionando a 2,8 GHz, el doble de la velocidad de reloj de la WSE-3 original. Según el comunicado oficial de la empresa y la cobertura de The Next Platform y ServeTheHome, el CS-4 entrega hasta 30 veces más tokens por segundo por usuario que las soluciones basadas en GPU y hasta 10 veces más rendimiento por vatio que el CS-3, su predecesor, usando un 50% menos de componentes en el rack. Las primeras unidades deberían enviarse en el tercer trimestre de 2026.
xAI lleva Grok 4.6 a GitHub Copilot en ocho entornos de desarrollo distintos
Dos días después de lanzar Grok 4.6, el 12 de agosto de 2026, xAI anunció el 14 de agosto su llegada a GitHub Copilot, disponible para seleccionar en el selector de modelos en ocho entornos: VS Code, Visual Studio, Copilot CLI, el agente en la nube de Copilot, la aplicación Copilot, los IDE de JetBrains, Xcode y Eclipse. El modelo, pensado para codificación agente y tareas de múltiples pasos, llega a los planes Pro, Pro+, Max, Business y Enterprise de Copilot, aunque en los niveles corporativos viene desactivado por defecto y depende de un administrador para habilitarlo.
Google lanza Gemini 3.7 Flash, un modelo barato para código y agentes
Google lanzó el 13 de agosto de 2026 Gemini 3.7 Flash, un modelo caballo de batalla orientado a ingeniería de software, agentes de IA y ejecución de tareas en múltiples pasos. Según el blog oficial de Google y SiliconANGLE, el modelo obtuvo 65,3% en el benchmark DeepSWE v1.1, frente al 49,0% de Gemini 3.6 Flash. El precio de lanzamiento de US$0,75 por millón de tokens de entrada y US$3,75 por millón de tokens de salida rige hasta el 31 de diciembre de 2026, con una ventana de contexto de aproximadamente 1,05 millones de tokens. Según Bloomberg, el lanzamiento llega mientras el modelo insignia de próxima generación de Google sigue retrasado.
Google lanza el Pixel 11 con chip Tensor G6 y Gemini capaz de actuar en más de 40 aplicaciones
Google presentó el 12 de agosto de 2026 la línea Pixel 11, con el chip Tensor G6 de 2 nanómetros y Gemini Intelligence ejecutando tareas de varios pasos en más de 40 aplicaciones, como pedir comida o reservar un viaje de forma autónoma. Según el blog oficial de Google, TechTimes y 9to5Google, los precios parten de US$899, con un aumento atribuido al mayor costo de los chips, y la venta al público comienza el 20 de agosto.
DeepSeek saca a V4 Pro de la fase de pruebas y apunta a los agentes de IA
DeepSeek lanzó el 12 de agosto de 2026 la versión de producción de V4 Pro, denominada 0813, poniendo fin a casi cuatro meses de fase de pruebas. Según Unite.AI y Tech Times, el modelo chino, con 1,6 billones de parámetros totales y 49.000 millones activos por token, se enfoca en capacidades de agente, con saltos importantes en benchmarks como DeepSWE y Terminal Bench, manteniendo por ahora el precio de la etapa de pruebas.
Microsoft prepara el lanzamiento del chip de IA Maia 300 para el otoño, apuntando a reducir la dependencia de Nvidia
Microsoft planea revelar públicamente el Maia 300, su nuevo chip acelerador de inteligencia artificial, ya este otoño del hemisferio norte, posiblemente en septiembre de 2026, según reportes de Benzinga, TechStartups y AI Weekly publicados el 10 de agosto. La empresa ya discutió con la fabricante taiwanesa TSMC la reserva de capacidad para más de 300 mil unidades del chip con entrega prevista para 2027, con la ambición de alcanzar más de 1 millón de unidades en total, un movimiento que señala el esfuerzo de Microsoft por reducir su dependencia de las GPU de Nvidia.
Zuckerberg publica manifiesto sobre la superinteligencia y Meta lanza Muse Glimmer en código abierto
El 10 de agosto de 2026, Mark Zuckerberg publicó el ensayo 'The Future is for Everyone', de cerca de 6.500 palabras, en el que sostiene que la superinteligencia no debe concentrarse en pocos laboratorios, gobiernos o empresas. El mismo día, Meta lanzó Muse Glimmer, un modelo liviano bajo licencia abierta permisiva, y amplió el acceso a Muse Spark 1.2. La noticia fue confirmada por CBS News, Axios, ABC News/AP, Las Vegas Sun, PYMNTS, AOL y The Washington Post.
xAI lanza Grok Imagine Image 2.0 con edición por región y hasta cinco imágenes de referencia
xAI lanzó el 7 de agosto de 2026 Grok Imagine Image 2.0 como Quality Mode en grok.com/imagine y en sus apps de iOS y Android. La actualización trae edición por región con una herramienta tipo varita mágica, eliminación de fondo con exportación transparente y composición a partir de hasta cinco imágenes de referencia en una sola generación. Según la propia xAI y coberturas independientes de Unite.AI y TestingCatalog, el modelo ocupa el segundo lugar en los rankings Arena de generación y edición de imagen, detrás de gpt-image-2 de OpenAI.
Meta lanza Muse Code, su primer agente de codificación con IA
Meta lanzó Muse Code, su primer agente de codificación con IA, en beta pública el 5 de agosto de 2026, para macOS y Linux. Basada en el nuevo modelo Muse Spark 1.2, la herramienta funciona desde la terminal y planifica, escribe y revisa tareas de ingeniería completas, con precios por uso y un nivel contribuidor más barato a cambio de datos de entrenamiento. El lanzamiento pone a Meta en competencia directa con Claude Code, de Anthropic, y Codex, de OpenAI.
Grok 4.6: xAI lanza nuevo modelo y ya prepara el Grok 4.7
xAI lanzó Grok 4.6 el 7 de agosto de 2026, cumpliendo el plazo anunciado por Elon Musk. El nuevo modelo mantiene la base de 1,5 billones de parámetros de Grok 4.5, pero suma avances importantes en ajuste fino supervisado y aprendizaje por refuerzo. La empresa ya anticipa el Grok 4.7, con una base de 2,1 billones de parámetros, para las próximas semanas.
OpenAI abre ChatGPT gratis a 100.000 investigadores académicos hasta 2027
OpenAI anunció el 29 de julio de 2026 un programa que dará a 100.000 investigadores académicos acceso gratuito a sus modelos más avanzados hasta 2027, comenzando con 10.000 investigadores este verano boreal. El paquete incluye un espacio de trabajo dedicado en ChatGPT, un nivel de uso equivalente al plan Pro de US$200 al mes, y forma parte de una inversión de más de US$250 millones en investigación científica externa.
Microsoft lanza MAI-Cyber-1-Flash, un modelo de IA que supera a sus rivales en ciberseguridad a mitad de precio
Microsoft lanzó el 27 de julio de 2026 el MAI-Cyber-1-Flash, su primer modelo de IA especializado en ciberseguridad, junto con la plataforma Project Perception. Ejecutándose dentro de MDASH, el modelo obtuvo 95,95% en el benchmark CyberGym, superando a Anthropic, Google y OpenAI, a la mitad del costo de los líderes del mercado.
Kimi K3 se convierte en el mayor modelo de IA de peso abierto del mundo al liberarse gratis
Moonshot AI liberó el 27 de julio de 2026 los pesos abiertos de Kimi K3, un modelo de 2,8 billones de parámetros que se convierte en el mayor modelo de peso abierto jamás publicado. Con licencia MIT modificada y acceso alojado inmediato vía Together AI y Modal, el lanzamiento llega en medio de tensión política en Estados Unidos sobre los modelos abiertos de origen chino.
Mistral confirma una nueva familia de modelos abiertos "gorda pero dispersa", con acceso anticipado en julio
El CEO de Mistral AI, Arthur Mensch, confirmó una nueva familia de modelos de peso abierto con arquitectura de mezcla de expertos que describe como "gorda pero dispersa", con acceso anticipado abierto en julio de 2026 para socios de investigación, gobierno e industria. La empresa aún no reveló el número de parámetros, resultados de benchmarks ni términos de licencia, pero los ingresos anuales recurrentes de Mistral ya superan los 400 millones de dólares.
OpenAI abre ChatGPT Health a todos los adultos de EE. UU. un día después de que una demanda pidiera bloquearlo
OpenAI abrió ChatGPT Health a todos los adultos de Estados Unidos el 23 de julio de 2026, un día después de que un expastor de Florida pidiera a un tribunal de California que bloqueara la función. Más de 300 millones de personas ya le hacen preguntas de salud a ChatGPT cada semana, y la función ahora usa historiales médicos conectados y datos de Apple Health durante las conversaciones, con permiso. Es la segunda demanda en tres meses que acusa al chatbot de dar consejos médicos peligrosos.
Anthropic lanza Claude Opus 5 al mismo precio que la generación anterior y con rendimiento cercano al de Fable 5
Anthropic lanzó Claude Opus 5 el 24 de julio de 2026, un modelo más económico para tareas cotidianas que mantiene el mismo precio que Claude Opus 4.8 mientras se acerca, y en varios benchmarks supera, el rendimiento de Claude Fable 5. Es el cuarto lanzamiento de la generación Claude 5 en menos de dos meses, lo que confirma un giro hacia actualizaciones incrementales frecuentes en lugar de lanzamientos raros.
Google lanza un trío de modelos Gemini Flash mientras el 3.5 Pro sigue desaparecido y comienza el entrenamiento de Gemini 4
El 21 de julio de 2026, Google lanzó Gemini 3.6 Flash, Gemini 3.5 Flash-Lite y Gemini 3.5 Flash Cyber, mientras confirmaba que Gemini 3.5 Pro sigue sin fecha de lanzamiento amplio y revelaba que comenzó a entrenar Gemini 4, según TechCrunch y Google.
Musk anuncia el Grok 4.6 con 2 billones de parámetros para responder al Kimi K3
El 18 de julio de 2026, Elon Musk reveló que xAI entrena el Grok 4.6, un modelo de 2 billones de parámetros que debería terminar su primer ciclo de entrenamiento esta semana. El anuncio llega dos días después de que el Kimi K3, de la china Moonshot AI, tomara la cima de un ranking de código y presionara en costo a los modelos occidentales.
Alibaba presenta el Qwen3.8-Max y dice que el modelo queda solo detrás de Claude Fable 5
El 19 de julio de 2026, durante la WAIC en Shanghái, Alibaba presentó el Qwen3.8-Max-Preview, un modelo multimodal de 2,4 billones de parámetros que la empresa posiciona como el segundo más fuerte del mundo, solo detrás de Claude Fable 5 de Anthropic. El acceso ya está disponible vía Token Plan al 10% del precio estándar, pero todavía sin tabla de benchmarks, ficha técnica ni licencia publicadas.
ZTE lanza el NaviX Ultra, el primer smartphone del mundo con un agente de IA integrado en el sistema
ZTE presentó en la WAIC de Shanghái el NaviX Ultra, un teléfono de la submarca Nubia que corre el asistente Doubao, de ByteDance, y promete completar tareas en varias aplicaciones por su cuenta. El primer lote de 30.000 unidades se agotó rápido y ya duplicó su precio en el mercado de reventa.
Google retrasa meses el lanzamiento de Gemini 3.5 Pro tras un reentrenamiento fallido
Google volvió a retrasar el lanzamiento amplio de Gemini 3.5 Pro, prometido para junio de 2026 por el CEO de Alphabet, Sundar Pichai, en el Google I/O. Según Bloomberg, citada por 9to5Google el 16 de julio de 2026, un reentrenamiento de datos realizado a fines de junio no logró corregir las fallas del modelo en programación y razonamiento complejo.
Mira Murati lanza Inkling, el primer modelo abierto de Thinking Machines, y admite que no es el más fuerte del mercado
Thinking Machines, la startup de Mira Murati valorada en US$ 12.000 millones, lanzó Inkling el 15 de julio de 2026, un modelo abierto de 975.000 millones de parámetros que la propia empresa dice que no es el más fuerte del mercado.
Kimi K3, de Moonshot AI, llega como el modelo abierto más avanzado del mundo y cuesta una fracción del precio
Moonshot AI lanzó Kimi K3 el 16 de julio de 2026, un modelo de 2,8 billones de parámetros que quedó en cuarto lugar en el ranking Artificial Analysis Intelligence Index, con precio muy por debajo de la competencia occidental y pesos abiertos previstos para el 27 de julio.
SpaceXAI anuncia Grok 4.5, modelo "clase Opus" más barato que la competencia
El 8 de julio de 2026, SpaceXAI (antes xAI) anunció Grok 4.5, un modelo que la empresa describe como de clase comparable a Claude Opus 4.7, con disponibilidad pública prevista para el 9 de julio. El modelo cuesta US$ 2 por millón de tokens de entrada y US$ 6 por millón de tokens de salida, por debajo del precio de la competencia.
Anthropic lanza Claude Sonnet 5, enfocado en agentes y con precio más bajo
Anthropic lanzó Claude Sonnet 5 el 30 de junio de 2026, ahora modelo predeterminado en los planes Free y Pro, con 1 millón de tokens de contexto y precio promocional hasta agosto.
LangChain lanza Deep Agents y actualiza LangGraph a la versión 1.2.4
LangChain lanzó Deep Agents en marzo, un framework de más alto nivel construido sobre LangGraph, que a su vez llegó a la versión 1.2.4 el 2 de junio.
OpenAI muestra una vista previa de GPT-5.6 con acceso restringido
OpenAI anunció el 26 de junio una vista previa limitada de la familia GPT-5.6 (Sol, Terra y Luna), disponible hoy solo para unas 20 empresas aprobadas por el gobierno de EE. UU.
xAI lanza Grok V9-Medium, un modelo enfocado en programación
Grok V9-Medium, con 1,5 billones de parámetros y entrenado con datos reales de sesiones de Cursor, llegó a Grok y SuperGrok el 16 de junio.
Anthropic lanza Claude Fable 5 y Mythos 5
Anthropic lanzó dos modelos de frontera el 9 de junio: Fable 5, la versión pública con una capa de seguridad reforzada, y Mythos 5, que comparte los mismos pesos.