Hoy, Meta ha presentado Muse, un agente de IA personal que toma acciones en lugar de limitarse a responder preguntas. Muse puede enviar correos electrónicos, reservar viajes, negociar facturas y perseguir objetivos a largo plazo. El agente sigue trabajando incluso después de cerrar la aplicación y solo regresa cuando requiere aprobación. La noticia más relevante para los desarrolladores de IA es de carácter arquitectónico: cada usuario obtiene una máquina virtual en la nube dedicada, llamada Muse Secure VM, donde residen el agente, su navegador y todas las credenciales de forma aislada. ¿Es desplegable? Muse es un servicio de consumo que se está lanzando actualmente en EE. UU. para iOS, Android y muse.ai, con un nivel gratuito y planes de pago. Los desarrolladores no pueden alojar Muse por cuenta propia, pero su modelo subyacente, Muse Spark 1.3, está disponible hoy a través de la API de modelos de Meta y Muse Code, con una liberación de pesos abiertos en la hoja de ruta de la compañía.
¿Qué hace exactamente Muse en el día a día?
Muse está construido en torno a la mensajería. Los usuarios describen una tarea o un objetivo, y el agente planifica y ejecuta. Puede abrir su navegador, completar formularios y negociar en nombre de una persona. Los ejemplos de Meta incluyen vender un auto a mejor precio, reducir una factura y adaptar un plan de entrenamiento. Muse también recuerda el contexto entre conversaciones. Puede convertir un reel de recetas guardado en Instagram en una lista de compras y recordar las restricciones dietéticas de los amigos. Los pasos sensibles, como enviar un correo electrónico o completar una compra, siempre se pausan para la aprobación del usuario. Un registro de auditoría completo muestra todo lo que el agente ha hecho y planea hacer.
El modelo: Muse Spark 1.3
Muse funciona con Muse Spark 1.3, lanzado la semana pasada por Meta Superintelligence Labs. El modelo apunta al trabajo agente de largo plazo: llamadas a herramientas CLI zero-shot, hilos de trabajo múltiples y autocorrección a través de fuentes desordenadas. En comparaciones internas realizadas por ingenieros de Meta, el modelo utilizó aproximadamente un 20% menos de llamadas a herramientas y un 25% menos de tokens que Muse Spark 1.2. Meta afirma que el modelo está cerca del estado del arte en resistencia a la inyección de prompts. Los desarrolladores pueden utilizarlo ahora en Muse Code y la API de modelos de Meta en dev.meta.ai.
Muse Secure VM y el Sentinel
El diseño de seguridad es la parte técnicamente más interesante de este lanzamiento. El arnés del agente se ejecuta dentro de una celda de tiempo de ejecución systemd-nspawn con llamadas al sistema filtradas y capacidades de kernel limitadas. Los servicios críticos de seguridad se sitúan fuera de esa celda, en la misma VM. Un agente Sentinel separado aprueba cada acción del conector y cada solicitud de red, tanto en la capa 4 como en la capa 7. Muse propone; solo Sentinel permite. Las credenciales se manejan mediante suplantación (surrogation). El agente solo ve tokens de marcador de posición, y Sentinel inyecta secretos reales en el límite de la red. Esto hace que la exfiltración de credenciales mediante inyección de prompts sea estructuralmente inútil, ya que no hay nada real que robar. El rastreo de contaminación eBPF a nivel de kernel distingue las solicitudes limpias de aquellas que tocaron datos del usuario, regulando las aprobaciones en consecuencia. El subagente del navegador ve un árbol de accesibilidad, no el DOM crudo, y no puede ejecutar JavaScript. El conector de correo electrónico incluso filtra los códigos de acceso de un solo uso y los enlaces de restablecimiento de contraseña de forma predeterminada.
¿Cómo se valida una acción en Muse?
La siguiente explicación interactiva recorre el pipeline de aprobación en 5 etapas, utilizando el tema azul de Meta. Incluye 2 escenarios: una compra normal y un intento de inyección de prompt bloqueado.
Puntos clave de la arquitectura
- Muse es un agente personal proactivo, utilizable en su propia aplicación o directamente dentro de WhatsApp.
- El agente de cada usuario se ejecuta en una VM en la nube aislada por usuario con un navegador real.
- Un agente Sentinel separado es la única autoridad para la salida de red y las acciones de los conectores.
- El agente nunca ve credenciales reales; los tokens sustitutos se intercambian en el límite de la red.
Consulte Muse Spark 1.3, Cómo Meta integró la seguridad en Muse y Muse en X. Además, siéntase libre de seguirnos en Twitter y no olvide unirse a nuestro SubReddit de 150k+ ML y suscribirse a nuestro boletín. ¡Espere! ¿Está en Telegram? ahora también puede unirse a nosotros en Telegram.
¿Necesita asociarse con nosotros para promocionar su repositorio de GitHub, página de Hugging Face, lanzamiento de producto o seminario web? Contáctenos. Vía MarkTechPost.




