Saltar al contenido

IA

Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

653 notas publicadas · Página 7 de 28
Anthropic corta Fable 5 y Mythos 5 a usuarios fuera de EE.UU.

Anthropic corta Fable 5 y Mythos 5 a usuarios fuera de EE.UU.

Una orden federal de control de exportaciones obliga a la compañía a bloquear sus modelos más capaces para todo ciudadano extranjero, incluidos sus propios empleados.

The Verge
OpenAI le entrega ChatGPT y Codex a Thibault Sottiaux

OpenAI le entrega ChatGPT y Codex a Thibault Sottiaux

El ingeniero detrás del crecimiento de Codex ahora lidera el rediseño completo de ChatGPT como agente personalizado y la fusión con su 'super app' interno.

Wired
EE.UU. obliga a Anthropic a apagar Fable 5 y Mythos 5 en todo el mundo

EE.UU. obliga a Anthropic a apagar Fable 5 y Mythos 5 en todo el mundo

La orden de control de exportaciones cita riesgos de seguridad nacional. Anthropic cumple pero discrepa: dice que el supuesto jailbreak ya existe en GPT-5.5 y otros modelos comerciales.

The Decoder
Loopcraft: diseñar loops en lugar de promptear a agentes IA

Loopcraft: diseñar loops en lugar de promptear a agentes IA

Peter Steinberger, Boris Cherny de Anthropic y Andrej Karpathy convergen en la misma idea: el cuello de botella ya no es escribir prompts, es seguir como humano dentro del loop.

Latent Space
Agentes IA aciertan el archivo pero fallan las líneas clave

Agentes IA aciertan el archivo pero fallan las líneas clave

SWE-Explore, el primer benchmark que aísla la búsqueda de código de la reparación, revela que Claude Code, Codex y OpenHands solo cubren entre 14% y 19% de las líneas que importan.

The Decoder
Bezos lanza Prometheus, la IA que aspira a ser ingeniero general

Bezos lanza Prometheus, la IA que aspira a ser ingeniero general

La startup, valorada en USD 41.000 millones tras una ronda de USD 12.000 millones, apunta a herramientas para robótica, diseño de fármacos y manufactura, con Blue Origin como cliente piloto.

The Verge
Anthropic admite sabotaje invisible a rivales en Claude Fable 5

Anthropic admite sabotaje invisible a rivales en Claude Fable 5

Tras críticas duras de la comunidad de investigación, la compañía hará visibles los frenos que aplicaba en secreto a quienes intentaban entrenar modelos competidores con Claude.

Wired
OpenAI compra Ona (ex Gitpod) para acelerar Codex en tareas autónomas

OpenAI compra Ona (ex Gitpod) para acelerar Codex en tareas autónomas

La startup alemana, fundada en Kiel en 2020, aporta entornos de desarrollo en la nube y agentes de IA con los que Codex podrá ejecutar tareas durante horas o días sin supervisión.

The Decoder
Gemini-SQL2 de Google lidera benchmark text-to-SQL con 80% de precisión

Gemini-SQL2 de Google lidera benchmark text-to-SQL con 80% de precisión

Construido sobre Gemini 3.1 Pro, el sistema de Google Research aventaja por más de siete puntos a GPT-5.5-xhigh y casi diez a Claude Opus 4.6 en el ranking BIRD.

The Decoder
Waymo libera Reference Driver: modelo de cómo reacciona el humano

Waymo libera Reference Driver: modelo de cómo reacciona el humano

El proyecto ReD, con la Universidad Técnica de Delft, simula la sorpresa cognitiva del conductor para fijar un benchmark común de evitación de colisiones para autos autónomos.

The Verge
Microsoft SkillOpt entrena un Markdown y mejora GPT-5.5 en 23 puntos

Microsoft SkillOpt entrena un Markdown y mejora GPT-5.5 en 23 puntos

El método trata al documento de habilidades como peso entrenable, propone ediciones acotadas y solo conserva los cambios que pasan validación.

The Decoder
Amazon habría gatillado el veto de la Casa Blanca a Claude Fable

Amazon habría gatillado el veto de la Casa Blanca a Claude Fable

Un paper de seguridad interno y una llamada del CEO Andy Jassy a la administración Trump precipitaron la orden de control de exportación que dejó a Anthropic sin Fable 5 ni Mythos 5 para extranjeros.

The Verge
NVIDIA GB300 NVL72 rinde 20x más agentes que H200 en AA-AgentPerf

NVIDIA GB300 NVL72 rinde 20x más agentes que H200 en AA-AgentPerf

Artificial Analysis estrenó el primer benchmark multi-vendor que mide rendimiento concurrente de agentes de IA en cargas reales de coding, con resultados normalizados por acelerador y por megawatt.

NVIDIA Developer
Claude Fable 5: el modelo más inteligente con filtros opacos

Claude Fable 5: el modelo más inteligente con filtros opacos

Nathan Lambert advierte que Anthropic introdujo intervenciones invisibles que degradan el modelo cuando detecta usuarios construyendo competencia de modelos frontera.

Interconnects
Kimi K2.7 Code: modelo abierto 12 veces más barato que Claude

Kimi K2.7 Code: modelo abierto 12 veces más barato que Claude

Moonshot AI libera un modelo de pesos abiertos de un billón de parámetros enfocado en programación a USD 0,95 entrada y USD 4 salida por millón de tokens.

The Decoder
Claude Fable 5 cuesta el doble por solo 5,7% más rendimiento

Claude Fable 5 cuesta el doble por solo 5,7% más rendimiento

El nuevo tope de gama de Anthropic lidera el Artificial Analysis Intelligence Index con 64,9 puntos, pero su corrida completa de benchmarks bordea los USD 10.000, el doble que Opus 4.8.

The Decoder
WWDC 2026: Apple reescribe Siri con Gemini y promete privacidad

WWDC 2026: Apple reescribe Siri con Gemini y promete privacidad

Apple presentó en WWDC 2026 una Siri rediseñada sobre Google Gemini, una nueva generación de Apple Intelligence y un iOS 27 que llega a todos los iPhone desde el 11 en adelante.

TechCrunch AI
Anthropic baja Claude Fable 5 por orden del gobierno de EEUU

Anthropic baja Claude Fable 5 por orden del gobierno de EEUU

La empresa recibió una directiva de export control citando seguridad nacional y un supuesto jailbreak. Anthropic argumenta que la vulneración es menor y contradice principios de proceso justo.

Wired
NVIDIA Blackwell lidera el primer benchmark de IA agéntica

NVIDIA Blackwell lidera el primer benchmark de IA agéntica

El GB300 NVL72 corre 20× más agentes por megawatt que el HGX H200 en AgentPerf, el primer benchmark de Artificial Analysis que mide cargas reales de agentes encadenando llamadas LLM.

NVIDIA Blog
MiniMax M3: MoE de 428B con 1M de contexto en Blackwell

MiniMax M3: MoE de 428B con 1M de contexto en Blackwell

Sirve contextos de 1 millón de tokens con costo por token 20 veces menor que M2, y se despliega en NVIDIA Dynamo, TensorRT-LLM, SGLang y vLLM con pesos abiertos en Hugging Face.

NVIDIA Developer
WWDC 2026: Apple oficializa el matrimonio con Gemini de Google

WWDC 2026: Apple oficializa el matrimonio con Gemini de Google

iOS 27 acelera apps 30%, fotos 70% y AirDrop 80%; Mac OS Golden Gate corta soporte Intel; Tim Cook se despide y John Ternus asume el 1 de septiembre como nuevo CEO.

Wired
Apple presenta Siri AI: app propia, voz expresiva y SynthID

Apple presenta Siri AI: app propia, voz expresiva y SynthID

La nueva Siri llega a iPhone, iPad, Mac, Apple Watch y Vision Pro con Apple Foundation Models construidos con Google. Edita fotos con Spatial Reframing y marca imágenes IA con SynthID oculto.

The Verge
Anthropic libera Claude Fable 5, su Mythos para uso general

Anthropic libera Claude Fable 5, su Mythos para uso general

Llega a la API y a los planes Pro, Max, Team y Enterprise: gratis hasta el 22 de junio, USD 10/50 por millón de tokens y bloqueo automático en ciberseguridad, biología y química.

TechCrunch AI
Anthropic: la IA convierte parches en exploits en horas, no semanas

Anthropic: la IA convierte parches en exploits en horas, no semanas

Un estudio del equipo de seguridad de Anthropic mostró que Mythos Preview construyó 8 cadenas de escalada de privilegios en Windows en menos de un día, a USD 2.000 cada una.

The Decoder