
PyTorch lleva Helion a las TPU de Google con kernels autoajustados
El nuevo backend compila el lenguaje de kernels de PyTorch a Pallas y alcanza 838 TFLOPs en atención flash sobre una TPU v7, cerca del 79% de utilización de un tensor core.
50 notas publicadas

Alphabet aumenta su inversión en IA a 205 mil millones de dólares mientras Google busca cerrar la brecha con sus competidores mediante modelos de mayor escala.

El sistema NAVI-Orbital ejecutó Gemma 3 sobre un Jetson Orin AGX a bordo del satélite YAM-9 y describió imágenes en texto, la primera demostración de un modelo visión-lenguaje operando en el espacio.

Los nuevos 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber apuntan a eficiencia y agentes de IA, mientras el modelo insignia sigue sin renovarse desde febrero.

Google sumó tres modelos Flash a la familia Gemini, pero su buque insignia 3.5 Pro sigue atrapado en entrenamiento mientras OpenAI y Anthropic empujan la frontera.

El nuevo chip de servidor de Alphabet, previsto para 2028, prometeria ser entre 6 y 10 veces mas eficiente que sus aceleradores actuales, mientras la industria busca depender menos de NVIDIA.

El chip, atribuido a Jeff Dean, grabaría el plano de Gemini en el hardware para ser 6 a 10 veces más eficiente que los TPU actuales. Google lo desplegaría desde 2028 para abaratar la inferencia.

El modelo reutiliza un generador de video preentrenado para resolver tareas clasicas de vision artificial usando hasta 500 veces menos datos que los sistemas especializados.

Google cambio la forma de medir el uso de sus apps de IA: ahora cuenta la potencia de computo de cada peticion y no la cantidad de solicitudes.

Google publicó una revisión de su modelo abierto que activa Flash Attention 4, corrige fallos en el llamado a herramientas y elimina respuestas cortadas, todo bajo el mismo nombre.

El modelo fundacional de Google Research se entreno con un billon de minutos de datos de cinco millones de usuarios de Fitbit y Pixel Watch, y gana en 34 de 35 tareas de salud.

Google amplia los Managed Agents de la Gemini API con ejecucion asincronica, conexion a servidores MCP remotos, funciones personalizadas y rotacion de credenciales sin perder estado del sandbox.
El resumen mensual de la compañía condensa un modelo abierto para laptops con 16 GB de RAM, ventanas flotantes en Android 17 y el estreno del Nano Banana 2 Lite en la API.

El asistente agéntico 24/7 de Google desembarca en el desktop de Apple, integra la app de notas Keep que faltaba desde su lanzamiento y abre soporte a MCP para conectar apps de terceros.

Reemplaza al primer Nano Banana como modelo por defecto en Google AI Studio y Gemini API. Google también amplió Gemini Omni Flash para video, a USD 0,10 por segundo.

Google añade a la familia Nano Banana un modelo económico enfocado en pipelines de alto throughput y estrena Gemini Omni Flash para generar y editar video de hasta 10 segundos vía API.

El modelo Flash ahora ve y opera navegadores, móviles y escritorios por sí solo, con 78,4 en OSWorld y a la par de GPT-5.5.

Google integra el control de navegador, móvil y escritorio al modelo principal Flash, y suma dos salvaguardas opcionales contra prompt injection pensadas para uso empresarial.

Investigadores de UC San Diego junto a Google muestran que 25-50 smartphones de hace 3 años igualan la potencia de un servidor dual-socket EPYC en tareas single-core del benchmark SPEC.

Construido sobre Gemini 3.1 Pro, el sistema de Google Research aventaja por más de siete puntos a GPT-5.5-xhigh y casi diez a Claude Opus 4.6 en el ranking BIRD.

El nuevo modelo MoE de pesos abiertos genera párrafos enteros en paralelo mediante denoising, corre con 18 GB de VRAM y entrega hasta 4× más velocidad que Gemma 4 26B en una sola H100.

El modelo experimental de pesos abiertos genera 256 tokens en paralelo y supera a Gemma 4 en velocidad, aunque pierde calidad en los benchmarks de Google.

La aplicación Teléfono de Google introduce una capa de autenticación mediante RCS para verificar la identidad del emisor y frenar la suplantación por voz.

El equipo de marca detalla cómo combinó Gemini Omni, Nano Banana, Lyria 3 Pro y Coral NPU para el cortometraje Timmy TPU, la identidad visual y el preshow Jellectronica con medusas reales.

El nuevo modelo de video generativo Omni y la familia 3.5 Flash llegan a la app Gemini, AI Mode en Search, YouTube Shorts y al harness Antigravity para agentes a escala.

El nuevo modelo de Microsoft sube al tercer puesto del leaderboard text-to-image de Arena con mejoras claras en renderizado de texto y visuales comerciales, aún detrás de OpenAI Image-2.

Gemini Omni para video generativo, Gemini 3.5 Flash con foco en agentes, agentes de información en Search, Daily Brief, anteojos Android XR y expansión de SynthID marcaron la keynote.

El CEO de Google y Alphabet conversó con Nilay Patel tras Google I/O 2026 sobre Gemini, los agentes, Google Zero y el camino a la AGI.

Una nueva categoría experimental llamada Agentic Browsing mide si los sitios exponen llms.txt, accessibility tree y la API WebMCP. Airbnb apenas pasa una de tres pruebas.

La herramienta genera apps nativas con Kotlin y Jetpack Compose desde el navegador, mientras Apple bloquea las apps generadas por IA por motivos de seguridad.

Buscar "disregard", "ignore" o "skip" en Google devolvía respuestas de chatbot vacías en lugar del resumen IA habitual, un bug que The Verge replicó varias veces.

Sundar Pichai presentó un nuevo Search con IA, agentes que trabajan 24/7, un carrito universal de compras y Gemini Omni para video generativo con conciencia física.

El prototipo con pantalla en la lente derecha proyecta direcciones de Google Maps, traduce conversaciones en tiempo real y se activa con presión larga en la patilla derecha.

El primer modelo de la familia Gemini Omni sucede a Veo en la plataforma Flow y ya hace video-a-video con consistencia notable, aunque sigue cobrando 15 a 40 créditos por clip.

El agente IA debutó en octubre pasado para detectar y reparar vulnerabilidades; ahora se abre a expertos externos en plena ola de IA aplicada a seguridad.

La app agéntica de codificación suma escritorio rediseñado, agentes en background y voz nativa apoyados en Gemini 3.5 Flash; el plan Ultra superior baja de USD 250 a USD 200.

Más allá de Search y Gemini Spark, Google reveló sus primeros lentes con Warby Parker y Gentle Monster, un generador de video tipo Sora 2 y un carrito de compras unificado con pago integrado.

La compañía estrena en I/O 2026 una caja reimaginada con Gemini 3.5 Flash, agentes que monitorean temas mientras duermes y una capa generative UI que construye widgets a pedido.

El asistente personal anunciado en I/O 2026 corre sobre Google Cloud, llega la próxima semana a suscriptores AI Ultra y se construye encima de Antigravity para tareas largas sin supervisión.

Google AI Ultra (USD 200/mes) suma una función experimental que combina Genie 3 con Street View para generar entornos caminables desde un pin en el mapa, solo en Estados Unidos por ahora.

Google presenta su modelo más potente para coding y agentes autónomos: 4× más rápido que la frontera previa (12× en versión optimizada), ya por defecto en la app de Gemini y AI Mode en Search.

Google DeepMind ancla su modelo del mundo Genie en imágenes reales de Street View y expande Project Genie a suscriptores de Google AI Ultra a nivel global.

Anunciado en Google I/O 2026, Omni Flash genera clips de 10 segundos con avatares verificables, marca de agua SynthID y razonamiento conjunto sobre múltiples modalidades.

La función arranca como early release con foco en utilidades personales, apps que usan cámara o GPS, y experiencias basadas en Gemini API. Google Play mantendrá sus estándares de revisión.

Google rehízo la aplicación desde cero con un lenguaje visual llamado Neural Expressive y un resumen matinal personalizado que cruza Gmail, Calendar y tareas.

El nuevo agente personal de Google llega en beta la próxima semana al plan AI Ultra de 100 dólares mensuales, con permisos para leer Gmail, Calendar y la tarjeta de crédito del usuario.

Coding agentic con orquestación multiagente, comandos por voz y exportación a AI Studio. La nueva versión usa Gemini 3.5 Flash y compite directo con Cursor y Claude Code.

Simon Willison desarma el lanzamiento: GA sin preview, USD 1,50 input y USD 9 output por millón de tokens, cerca del 3.1 Pro mientras Google lo regala en sus productos de consumo.

DeepMind libera el primer modelo de la familia Omni a suscriptores AI Plus, Pro y Ultra. Combina imagen, audio, video y texto, con marca SynthID en cada clip y avatares con tu propia voz.

El keynote del 19 de mayo trajo el nuevo Gemini Omni para video generativo, un rediseño Neural Expressive de la app, baja del plan Ultra y un competidor de Anthropic Mythos llamado CodeMender.
Otros temas que aparecen junto a #google en nuestra cobertura editorial.