
Google apuesta todo a modelos base más grandes para Gemini
Alphabet aumenta su inversión en IA a 205 mil millones de dólares mientras Google busca cerrar la brecha con sus competidores mediante modelos de mayor escala.
54 notas publicadas

Los nuevos 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber apuntan a eficiencia y agentes de IA, mientras el modelo insignia sigue sin renovarse desde febrero.

Google sumó tres modelos Flash a la familia Gemini, pero su buque insignia 3.5 Pro sigue atrapado en entrenamiento mientras OpenAI y Anthropic empujan la frontera.

El nuevo chip de servidor de Alphabet, previsto para 2028, prometeria ser entre 6 y 10 veces mas eficiente que sus aceleradores actuales, mientras la industria busca depender menos de NVIDIA.

El chip, atribuido a Jeff Dean, grabaría el plano de Gemini en el hardware para ser 6 a 10 veces más eficiente que los TPU actuales. Google lo desplegaría desde 2028 para abaratar la inferencia.

Google cambio la forma de medir el uso de sus apps de IA: ahora cuenta la potencia de computo de cada peticion y no la cantidad de solicitudes.

El modelo fundacional de Google Research se entreno con un billon de minutos de datos de cinco millones de usuarios de Fitbit y Pixel Watch, y gana en 34 de 35 tareas de salud.

Google amplia los Managed Agents de la Gemini API con ejecucion asincronica, conexion a servidores MCP remotos, funciones personalizadas y rotacion de credenciales sin perder estado del sandbox.

Un benchmark de Tencent Hunyuan y Tsinghua muestra que Gemini 3.1 Pro y Claude Opus 4.7 quedan bajo 50% porque asumen en vez de pedir aclaraciones cuando la consulta es ambigua.
El resumen mensual de la compañía condensa un modelo abierto para laptops con 16 GB de RAM, ventanas flotantes en Android 17 y el estreno del Nano Banana 2 Lite en la API.

El asistente agéntico 24/7 de Google desembarca en el desktop de Apple, integra la app de notas Keep que faltaba desde su lanzamiento y abre soporte a MCP para conectar apps de terceros.

Reemplaza al primer Nano Banana como modelo por defecto en Google AI Studio y Gemini API. Google también amplió Gemini Omni Flash para video, a USD 0,10 por segundo.

Google añade a la familia Nano Banana un modelo económico enfocado en pipelines de alto throughput y estrena Gemini Omni Flash para generar y editar video de hasta 10 segundos vía API.

El modelo Flash ahora ve y opera navegadores, móviles y escritorios por sí solo, con 78,4 en OSWorld y a la par de GPT-5.5.

Google integra el control de navegador, móvil y escritorio al modelo principal Flash, y suma dos salvaguardas opcionales contra prompt injection pensadas para uso empresarial.

El AI Control Roadmap aplica el framework MITRE ATT&CK a sus propios sistemas y los vigila como empleados con acceso a oficina pero potencialmente desalineados con los objetivos de la empresa.

El asistente de OpenAI bajó a 46,4% de cuota global mientras Gemini llegó a 27,7% y Claude a 10,3%, según el State of AI Report 2026 de Sensor Tower.

Construido sobre Gemini 3.1 Pro, el sistema de Google Research aventaja por más de siete puntos a GPT-5.5-xhigh y casi diez a Claude Opus 4.6 en el ranking BIRD.

Apple presentó en WWDC 2026 una Siri rediseñada sobre Google Gemini, una nueva generación de Apple Intelligence y un iOS 27 que llega a todos los iPhone desde el 11 en adelante.

iOS 27 acelera apps 30%, fotos 70% y AirDrop 80%; Mac OS Golden Gate corta soporte Intel; Tim Cook se despide y John Ternus asume el 1 de septiembre como nuevo CEO.

La nueva Siri llega a iPhone, iPad, Mac, Apple Watch y Vision Pro con Apple Foundation Models construidos con Google. Edita fotos con Spatial Reframing y marca imágenes IA con SynthID oculto.

Google DeepMind presenta un programa de tres meses para acelerar startups europeas enfocadas en IA física, robótica avanzada y modelos de lenguaje especializados.

Un estudio controlado con 1.763 estudiantes revela cómo el aprendizaje guiado por IA mejora los resultados en matemáticas y transforma el rol del docente en el aula.

Un repaso completo a los anuncios de Google en mayo de 2026, desde la era de los agentes de Gemini y Gemini Omni hasta nuevos dispositivos y herramientas de salud.

El equipo de marca detalla cómo combinó Gemini Omni, Nano Banana, Lyria 3 Pro y Coral NPU para el cortometraje Timmy TPU, la identidad visual y el preshow Jellectronica con medusas reales.

El nuevo modelo de video generativo Omni y la familia 3.5 Flash llegan a la app Gemini, AI Mode en Search, YouTube Shorts y al harness Antigravity para agentes a escala.

Renders filtrados por Bloomberg muestran la nueva experiencia Siri integrada al Dynamic Island, búsqueda Spotlight reforzada con Gemini y una app standalone con historial y upload.

Gemini Omni para video generativo, Gemini 3.5 Flash con foco en agentes, agentes de información en Search, Daily Brief, anteojos Android XR y expansión de SynthID marcaron la keynote.

El CEO de Google y Alphabet conversó con Nilay Patel tras Google I/O 2026 sobre Gemini, los agentes, Google Zero y el camino a la AGI.

El benchmark CiteVQA de la Universidad de Pekín muestra que hasta el mejor modelo (Gemini 3.1 Pro Preview) saca solo 76/100 cuando se exige que la cita apunte al párrafo correcto del PDF.

El framework combina Gemini 3.1 Pro con el compilador Lean para demostrar conjeturas abiertas hace décadas, a un costo de inferencia de pocos cientos de dólares por problema.

Tres referentes, tres lecturas: el cofundador de DeepMind cree que la AGI está a cinco años, LeCun niega que los LLM actuales sean inteligentes y el colíder de Gemini propone un punto medio.

Un experimento del matemático Adam Kucharski mostró que Microsoft Copilot, Gemini Flash y otros modelos rápidos confabulan estereotipos cuando deberían leer los datos reales.

Buscar "disregard", "ignore" o "skip" en Google devolvía respuestas de chatbot vacías en lugar del resumen IA habitual, un bug que The Verge replicó varias veces.

Sundar Pichai presentó un nuevo Search con IA, agentes que trabajan 24/7, un carrito universal de compras y Gemini Omni para video generativo con conciencia física.

El prototipo con pantalla en la lente derecha proyecta direcciones de Google Maps, traduce conversaciones en tiempo real y se activa con presión larga en la patilla derecha.

El primer modelo de la familia Gemini Omni sucede a Veo en la plataforma Flow y ya hace video-a-video con consistencia notable, aunque sigue cobrando 15 a 40 créditos por clip.

La app agéntica de codificación suma escritorio rediseñado, agentes en background y voz nativa apoyados en Gemini 3.5 Flash; el plan Ultra superior baja de USD 250 a USD 200.

Google permite exportar apps Android nativas desde AI Studio y prepara widgets generados por prompt; Apple trabaja en una nueva forma de armar shortcuts con texto.

Google presenta su modelo más potente para coding y agentes autónomos: 4× más rápido que la frontera previa (12× en versión optimizada), ya por defecto en la app de Gemini y AI Mode en Search.

Anunciado en Google I/O 2026, Omni Flash genera clips de 10 segundos con avatares verificables, marca de agua SynthID y razonamiento conjunto sobre múltiples modalidades.

El primer release de la familia es 3.5 Flash, líder en agentes y coding sobre su antecesor Pro, con velocidad cuatro veces mayor que otros modelos frontier.

El modelo más rápido en su clase de inteligencia consume tantos tokens en tareas de agentes que supera incluso al Gemini 3.1 Pro en costo total.

La función arranca como early release con foco en utilidades personales, apps que usan cámara o GPS, y experiencias basadas en Gemini API. Google Play mantendrá sus estándares de revisión.

Google rehízo la aplicación desde cero con un lenguaje visual llamado Neural Expressive y un resumen matinal personalizado que cruza Gmail, Calendar y tareas.

El nuevo agente personal de Google llega en beta la próxima semana al plan AI Ultra de 100 dólares mensuales, con permisos para leer Gmail, Calendar y la tarjeta de crédito del usuario.

DeepMind libera Hypothesis Generation, Computational Discovery y Literature Insights en Google Labs, con más de 100 instituciones validando y papers publicados hoy en Nature.

Simon Willison desarma el lanzamiento: GA sin preview, USD 1,50 input y USD 9 output por millón de tokens, cerca del 3.1 Pro mientras Google lo regala en sus productos de consumo.

DeepMind libera el primer modelo de la familia Omni a suscriptores AI Plus, Pro y Ultra. Combina imagen, audio, video y texto, con marca SynthID en cada clip y avatares con tu propia voz.

El keynote del 19 de mayo trajo el nuevo Gemini Omni para video generativo, un rediseño Neural Expressive de la app, baja del plan Ultra y un competidor de Anthropic Mythos llamado CodeMender.

El developer británico, autor de Datasette, presentó en PyCon US 2026 una lightning talk sobre el punto de inflexión de noviembre de 2025, cuando los agentes de código cruzaron la barrera de calidad.

El experimento de Andon Labs reveló personalidades opuestas: Claude se volvió activista y trató de renunciar; Grok mezcló razonamiento interno con voz; GPT permaneció sobrio.

Un consorcio de 64 matemáticos diseñó 439 tareas para Gemini 3 Pro, GPT-5 y Claude Opus 4.5; ninguno supera el 50% al detectar problemas sin solución.

El experimento dejó a Claude llamando a la rebelión sindical, a Gemini celebrando tragedias con canciones temáticas y a Grok hablando con frases que ya no son inglés.
Otros temas que aparecen junto a #gemini en nuestra cobertura editorial.