Nota del editor: El 8 de septiembre, Meta lanzó su agente de IA personal Muse. Tras su lanzamiento, sus descargas aumentaron de forma constante: en menos de una semana superó a ChatGPT y se colocó en la cima de la lista gratuita de la App Store de EE. UU.; para el 21 de septiembre, las descargas en iOS y Android habían alcanzado aproximadamente 1.5 millones y 1.1 millones, respectivamente, y posteriormente se lanzó una versión para Mac.
Pero surgieron problemas. En el día 12 después del lanzamiento, Amazon prohibió a Muse comprar en su marketplace, alegando que Meta no había dado un aviso previo, que Muse no se identificaba como una IA al navegar por la web y que podría almacenar las credenciales de inicio de sesión de los usuarios. La idea de "dejar que la IA haga pedidos por las personas" chocó de frente con una plataforma importante por primera vez.
Mientras tanto, sus rivales están acelerando el paso. Grok Bot, de Musk, se lanzó en agosto y también proporciona a cada agente un ordenador en la nube. Según un informe de The Information del 21 de septiembre, OpenAI está preparando un producto cuyo nombre provisional es «Codex Bot», basado en el agente de código abierto OpenClaw y más parecido a Grok Bot. Un producto dirigido directamente a Muse sigue en conversaciones internas, lideradas por el fundador de OpenClaw, Peter Steinberger. La batalla por los agentes personales de IA ha pasado de la fase conceptual a la confrontación directa. A continuación, el texto original traducido:
El 8 de septiembre, hora local de Estados Unidos, Meta lanzó lo que denomina «el primer agente personal de IA del mundo»: Muse. Está disponible para usuarios de 18 años o más en Estados Unidos a través de iOS, Android, muse.ai y WhatsApp, y más adelante llegará a las gafas de IA de Meta.
La mayor diferencia entre Muse y los chatbots comunes es que puede encargarse directamente de tareas para los usuarios. Estos le indican un objetivo y Muse puede abrir un navegador, buscar en la web, rellenar formularios, enviar correos, reservar viajes, comprar productos y seguir procesando tareas incluso después de que el usuario cierre la aplicación.
Meta proporciona a cada instancia de Muse un ordenador virtual independiente en la nube, con su propio navegador, sistema de archivos y terminal. Puede acceder a servicios como el correo electrónico, el calendario y las aplicaciones de actividad física que el usuario haya autorizado, y recordar lo que le importa a partir de conversaciones a largo plazo.
Además, Muse puede recordar proactivamente cosas a los usuarios, desglosar objetivos a largo plazo, seguir avanzando con tareas en segundo plano y generar páginas web, archivos PDF, documentos y herramientas interactivas.
En otras palabras, Meta quiere que la gente común pueda utilizar agentes de IA directamente y que la experiencia sea, siempre que sea posible, tan sencilla como chatear.
01 La IA pasa de asistente a ejecutora
Lo más destacable de Muse es que ya ha empezado a encargarse de tareas completas, de principio a fin.
Mona Sarantakos, responsable de producto de Meta, contó que durante las pruebas del producto le pidió a Muse que organizara los preparativos para la vuelta al colegio de su hijo. Muse revisó continuamente los correos de la escuela y los sitios web del distrito escolar, añadió fechas importantes al calendario familiar, organizó la lista de útiles escolares que había que comprar, la ayudó a encontrar la sudadera con capucha que quería su hijo y descubrió un descuento. También reservó la cena del primer día de clases.
Un detalle de todo aquello hizo que confiara en las capacidades del agente.
Un correo de la escuela incluía información sobre las pruebas deportivas en las que su hijo iba a participar, y faltaban solo 12 horas para que venciera el plazo. Muse lo detectó de forma proactiva y le envió un recordatorio antes de que subiera a un avión. Entonces se puso en contacto con su marido y completaron la inscripción 4 horas antes de la fecha límite.
Este tipo de cosas son difíciles de lograr en una sola conversación. Muse necesita supervisar la información continuamente, saber qué contenido merece atención y decidir cuándo recordárselo al usuario. Por eso, Meta también diseñó capacidades de trabajo en segundo plano para Muse. Una vez que el usuario le asigna una tarea, Muse puede seguir procesándola aunque se cierre la aplicación. Solo vuelve a avisar cuando descubre resultados nuevos importantes o necesita que el usuario apruebe el siguiente paso.
Los usuarios también pueden asignarle varias tareas al mismo tiempo, sin tener que esperar a que Muse termine una antes de continuar.
Para que estas tareas en segundo plano sean visibles, Meta añadió un registro de actividad. Al tocar el avatar de Muse, los usuarios pueden ver qué está haciendo en ese momento, qué ha hecho ya y qué permisos se han aprobado anteriormente.
Para los asuntos que requieren más tiempo, Muse también tiene una página independiente de Objetivos. Puede dividir un objetivo relativamente grande en varios pasos y hacer un seguimiento continuo del progreso.
Estas decisiones de diseño indican que Meta busca resolver la cuestión de «cómo lograr que la IA siga haciendo cosas por los usuarios».
Roberto Nickson, uno de los primeros usuarios de Muse en los ámbitos tecnológico y creativo, cree que durante mucho tiempo los agentes personales de IA no han logrado un verdadero ajuste entre producto y mercado, y que la ventaja de Muse reside en la enorme cantidad de datos de relaciones sociales y aplicaciones de Meta.
Confía especialmente en el rendimiento de Muse en las compras en línea y las recomendaciones locales. Sin embargo, también señaló que aún no está claro si Muse se convertirá de inmediato en el agente al que recurrirá a diario.
02 Darle un ordenador a la IA
Muse puede conectarse al correo electrónico, los calendarios y las aplicaciones de actividad física, así como a servicios propios de Meta, como Instagram y Facebook.
En la web, puede buscar información, navegar por sitios, rellenar formularios y completar reservas y compras.
Por ejemplo, en un video de demostración de Meta, Muse detectó que el precio de un billete de avión había bajado 40 dólares y le preguntó al usuario si quería volver a reservar. También recuerda proactivamente a los usuarios las próximas horas de salida para jugar al golf y les indica cuál es el hoyo más difícil del campo.
En situaciones de compra, Muse puede encontrar productos por su cuenta, comparar opciones y consultar al usuario antes de realizar el pago final.
Si un usuario ha guardado una receta de Instagram, Muse también puede organizarla en una lista de compras, planificar un menú para una reunión, recordar las restricciones alimentarias de sus amigos y ayudarle a enviar invitaciones.
Las tareas más complejas dependen del sistema de archivos y los programas de terminal propios de Muse.
A partir de esto, puede escribir su propio código y crear las herramientas necesarias para completar tareas. También puede generar archivos PDF, páginas web y otros «Artefactos». Por ejemplo, si un usuario quiere hacer un seguimiento de sus gastos, puede pedirle a Muse que cree una herramienta de control de gastos que se actualice continuamente; si va a ponerse a estudiar, puede pedirle que cree guías de estudio interactivas.
Al diseñar Muse, el equipo de producto de Meta también añadió una función llamada Ideas. En las primeras pruebas se descubrió que Muse podía hacer demasiadas cosas y que algunos usuarios no sabían por dónde empezar.
Por eso, el sistema sugiere de forma proactiva cosas que hacer basándose en los objetivos de los usuarios, sus conversaciones a largo plazo y los hábitos que detecta.
También se ajustó el modelo de interacción de Muse. Utiliza una única conversación principal de larga duración, en la que los usuarios pueden intervenir en cualquier momento o asignarle varias tareas en secuencia. Para los proyectos que requieren un contexto aparte, Meta añadió chats secundarios.
El analista de IA @kimmonismus considera que Muse está más orientado a ofrecer a los usuarios comunes una forma sencilla de empezar a usar un agente personal de IA. Cuenta con su propio ordenador y navegador, y también se puede acceder a él mediante WhatsApp.
Para los usuarios que ya forman parte del ecosistema de Meta, puede ser más fácil empezar a usar este tipo de servicio que agentes de IA que requieren aprender operaciones complejas.
03 ¿Confiarle permisos a la IA?
Permitir que la IA gestione directamente el correo electrónico, las compras y los pagos plantea un problema importante. Si un agente puede abrir páginas web, rellenar formularios, enviar correos e incluso comprar en tu nombre, sus errores pueden tener consecuencias más graves que los de un chatbot común.
Para abordar este problema, Meta diseñó una arquitectura de seguridad independiente para Muse. Cada usuario tiene su propia Muse Secure VM, una máquina virtual independiente en la nube. Muse y los datos del usuario se almacenan en su interior, y los agentes de otros usuarios no pueden acceder a ella.
Dentro de esta máquina virtual también hay un agente independiente llamado Sentinel. Cuando Muse quiere acceder a internet, Sentinel debe aprobarlo. Si se presentan situaciones que requieren una decisión del usuario, el sistema también se la consultará.
Las contraseñas y la información de pago tampoco se muestran directamente a Muse.
Cuando los usuarios conectan servicios, las credenciales se guardan en un almacenamiento seguro. Muse puede utilizarlas, pero no ver las contraseñas reales. Meta también afirma que Muse no podrá ver las contraseñas que los usuarios escriban directamente en el navegador. Para operaciones delicadas, como enviar correos o hacer compras, Muse solicitará la confirmación del usuario.
Meta también ofrece a los usuarios controles de permisos. Por ejemplo, se puede configurar el correo electrónico para que Muse solo pueda leerlo o para que pueda redactar y responder correos en nombre del usuario.
Muse también ofrece un registro completo de actividad, que permite a los usuarios ver qué ha hecho y qué tiene previsto hacer.
Meta afirma que los usuarios pueden optar por que los datos de interacción con Muse no se utilicen para entrenar los modelos de IA de Meta. Las conversaciones y los datos de la máquina virtual de Muse tampoco se proporcionarán a los sistemas publicitarios de Meta.
Más adelante este año, Meta también planea lanzar Muse Confidential VM. Para entonces, toda la máquina virtual, incluidos los datos del usuario y las conversaciones con Muse, estará cifrada con claves que solo tendrán los propios usuarios, de modo que ni siquiera Meta podrá acceder a ella.
Además de las medidas de seguridad, Meta ya ha puesto en marcha un programa público de recompensas por errores. Anteriormente, la empresa había buscado problemas mediante pruebas en situaciones reales, ejercicios de red teaming con agentes y un programa privado de recompensas por errores.
04 La apuesta por una puerta de entrada para mil millones de usuarios
El objetivo de Muse no es crear un asistente de IA más potente, sino poner un agente personal de IA —el «Jarvis» de las películas de Iron Man— al alcance de los usuarios de los servicios de Meta.
Wang Tao, director de IA de Meta, afirmó que hacer que el producto sea sencillo y fácil de usar es uno de los principios de diseño de Muse. No requiere que los usuarios tengan experiencia técnica; al contrario, busca que la gente común pueda utilizar agentes de IA directamente mediante una interacción similar a un chat.
El precio también refleja este posicionamiento.
La mayoría de las funciones de Muse son gratuitas, y los usuarios que necesiten más capacidad de procesamiento pueden elegir planes de suscripción de 20 o 100 dólares al mes. Meta espera que la mayoría de los usuarios se quede con la versión gratuita.
Esta es también una de las diferencias entre Meta y muchos de los productos de agentes de IA actuales. Los casos de uso de estos últimos siguen concentrándose sobre todo en la programación y las tareas empresariales, y aún no se ha consolidado un modelo de producto maduro en el mercado de consumo.
Meta espera que Muse se centre desde el principio en la vida cotidiana y que presente un agente personal de IA como un producto de consumo que los usuarios comunes puedan entender y utilizar.
Otra ventaja de Meta son sus enormes puntos de acceso a aplicaciones. Muse ya puede conectarse a Instagram y WhatsApp, así como a servicios como Gmail, Google Calendar, Google Drive, Ticketmaster y OpenTable.
Para otros servicios que cuentan con API, los usuarios también pueden pedirle a Muse que cree conectores personalizados. Para Meta, esto significa que Muse no necesita crear por sí solo un escenario de uso completamente nuevo: puede integrarse directamente en las aplicaciones y los servicios que los usuarios ya utilizan.
Esto coincide estrechamente con la visión sobre la IA personal que Mark Zuckerberg había expresado anteriormente. Ha dicho que, en el futuro, todo el mundo tendrá un agente personal muy capaz que comprenderá sus objetivos e intereses. Muse es el primer intento de Meta de llevar esa visión al mercado como producto de consumo.
El analista tecnológico Kyle Reidhead cree que los agentes de IA para consumidores se están convirtiendo en la próxima gran tendencia de la industria de la IA. Después de Grok, Meta lanzó Muse, y también se espera que Apple y Google sigan incorporando capacidades similares a sus teléfonos y sistemas. Concluye que el uso generalizado de agentes seguirá aumentando la demanda de capacidad de cómputo y que, una vez que los agentes digitales se extiendan, la IA física, como los robots, necesitará aún más capacidad de cómputo.
Sin embargo, la propia Meta reconoce que aún es pronto.
Muse necesita suficientes permisos para acceder a las aplicaciones y ser realmente útil; y cuantos más permisos tenga, mayores serán las exigencias de los usuarios en materia de privacidad y seguridad. Por ahora, Meta ha optado por hacer que el acceso sea lo más sencillo posible y, después, contener los riesgos mediante máquinas virtuales, controles de permisos, Sentinel y mecanismos de confirmación por parte de las personas.
Si los usuarios están dispuestos a delegar más asuntos cotidianos en Muse, los agentes personales de IA tendrán la oportunidad de evolucionar de una función novedosa a una herramienta de uso diario.
El primer usuario de prueba @alanchen, en X, cree que la cualidad más destacada de Muse es su capacidad para trabajar de verdad de forma continua en torno a los objetivos del usuario, con la seguridad y la privacidad como pilares del producto.
Esta también es la cuestión más importante que habrá que observar en la próxima etapa de Muse. Desde el punto de vista técnico, ya puede encargarse de muchas tareas que antes los usuarios debían realizar por sí mismos; en cuanto al producto, Meta también está trabajando para reducir las dificultades de uso. Pero que los agentes personales de IA lleguen a convertirse en herramientas de uso frecuente dependerá de que los usuarios estén dispuestos a utilizarlos a largo plazo y a confiarles gradualmente más asuntos de su vida real.
Por tanto, el valor de Muse para Meta no consiste simplemente en añadir otro producto de IA.
Se parece más a una prueba de acceso dirigida a miles de millones de usuarios: si los agentes personales de IA logran integrarse en las aplicaciones cotidianas, Meta tendrá la oportunidad de llevar la IA más allá de la ventana de chat y acercarla a la vida diaria de los usuarios.
Enlace original
Únete a la comunidad oficial de Coincamps:
X: https://x.com/coincamps
Telegram: https://t.me/coin_camps