Nota do editor: Em 8 de setembro, a Meta lançou seu agente de IA pessoal, o Muse. Após o lançamento, as descargas subiram de forma constante: em menos de uma semana ele ultrapassou o ChatGPT e liderou o ranking gratuito da App Store dos EUA; até 21 de setembro, os downloads no iOS e no Android haviam chegado a cerca de 1,5 milhão e 1,1 milhão, respectivamente, e posteriormente foi lançada uma versão para Mac.
Mas os problemas começaram a seguir. No 12º dia após o lançamento, a Amazon baniu o Muse de fazer compras em seu marketplace, alegando que a Meta não havia dado aviso prévio, que o Muse não se identificava como IA ao navegar na web e que poderia armazenar as credenciais de login dos usuários. A ideia de “deixar a IA fazer pedidos pelas pessoas” chocou-se de frente, pela primeira vez, com uma grande plataforma.
Enquanto isso, os concorrentes estão acelerando. O Grok Bot, de Musk, foi lançado em agosto e também oferece a cada agente um computador na nuvem. Segundo uma reportagem do The Information de 21 de setembro, a OpenAI está preparando um produto provisoriamente chamado “Codex Bot”, baseado no agente de código aberto OpenClaw e mais próximo do Grok Bot. Um produto que concorra diretamente com o Muse ainda está em discussão interna, liderada pelo fundador do OpenClaw, Peter Steinberger. A disputa pelos agentes pessoais de IA deixou de ser conceitual e passou ao confronto direto. A seguir, o texto original traduzido:
No dia 8 de setembro, no horário local dos EUA, a Meta lançou o que chama de “primeiro agente pessoal de IA do mundo”: o Muse, disponível para usuários nos EUA com 18 anos ou mais. Ele pode ser acessado por iOS, Android, muse.ai e WhatsApp e, mais adiante, chegará aos óculos de IA da Meta.
A maior diferença entre o Muse e os chatbots comuns é que ele pode executar tarefas diretamente para os usuários. Eles informam um objetivo, e o Muse pode abrir um navegador, pesquisar na web, preencher formulários, enviar e-mails, reservar viagens, comprar produtos e continuar processando tarefas mesmo depois que o usuário fecha o aplicativo.
A Meta fornece a cada Muse um computador virtual independente na nuvem, com navegador, sistema de arquivos e terminal próprios. Ele pode acessar serviços como os aplicativos de e-mail, calendário e condicionamento físico autorizados pelo usuário e, com base em conversas de longo prazo, lembrar-se do que é importante para ele.
Além disso, o Muse pode lembrar os usuários proativamente, dividir objetivos de longo prazo em etapas, dar continuidade a tarefas em segundo plano e também gerar páginas da web, PDFs, documentos e ferramentas interativas.
Em outras palavras, a Meta quer permitir que pessoas comuns usem agentes de IA diretamente e tornar a experiência tão simples quanto conversar, sempre que possível.
01 A IA passa de assistente a executora
O aspecto mais notável do Muse é que ele já começou a cuidar de tarefas inteiras, do início ao fim.
Mona Sarantakos, líder de produto da Meta, contou que, durante os testes do produto, pediu ao Muse que cuidasse dos preparativos para a volta às aulas de seu filho. O Muse verificou continuamente os e-mails da escola e os sites do distrito escolar, adicionou datas importantes ao calendário da família, organizou a lista de materiais escolares que precisavam ser comprados, ajudou a encontrar o moletom que o filho queria e descobriu um desconto. Também reservou o jantar para o primeiro dia de aula.
Um detalhe dessa experiência a fez confiar nas capacidades do agente.
O e-mail da escola incluía informações sobre os testes para a equipe esportiva dos quais seu filho participaria, e o prazo terminaria em apenas 12 horas. O Muse percebeu isso proativamente e enviou uma mensagem para lembrá-la antes de ela embarcar em um voo. Em seguida, ela entrou em contato com o marido e concluiu a inscrição quatro horas antes do prazo.
É difícil realizar esse tipo de tarefa em uma única conversa. O Muse precisa monitorar informações continuamente, saber quais conteúdos merecem atenção e decidir quando lembrar o usuário. Por isso, a Meta também projetou recursos para o Muse trabalhar em segundo plano. Depois que o usuário atribui uma tarefa, o Muse pode continuar a processá-la mesmo que o aplicativo seja fechado. Ele só voltará a avisar o usuário quando encontrar resultados novos e importantes ou precisar de sua aprovação para a próxima etapa.
Os usuários também podem atribuir várias tarefas ao mesmo tempo, sem precisar esperar que o Muse termine uma para começar outra.
Para tornar visíveis essas tarefas em segundo plano, a Meta adicionou um registro de atividades. Ao clicar no avatar do Muse, os usuários podem ver o que ele está fazendo, o que já fez e quais permissões foram aprovadas anteriormente.
Para tarefas de longa duração, o Muse também tem uma página separada de Objetivos. Ele pode dividir um objetivo relativamente grande em várias etapas e acompanhar o progresso continuamente.
Essas escolhas de design indicam que o objetivo da Meta é resolver a questão de “como permitir que a IA continue realizando tarefas para os usuários”.
Roberto Nickson, um dos primeiros usuários do setor de tecnologia e criação a obter acesso antecipado ao Muse, acredita que há muito tempo os agentes pessoais de IA não conseguem encontrar um verdadeiro encaixe entre produto e mercado, e que a vantagem do Muse está no vasto conjunto de dados da Meta sobre relações sociais e aplicativos.
Ele está particularmente otimista quanto ao desempenho do Muse em compras online e recomendações locais. No entanto, também observou que ainda não se sabe se o Muse se tornará imediatamente o agente que ele usará todos os dias.
02 Dando um computador à IA
O Muse pode se conectar a e-mails, calendários e aplicativos de condicionamento físico, além de serviços da própria Meta, como Instagram e Facebook.
Na web, ele pode pesquisar informações, navegar por sites, preencher formulários e concluir reservas e compras.
Por exemplo, no vídeo de demonstração da Meta, o Muse percebeu que o preço de uma passagem aérea havia caído US$ 40 e perguntou ao usuário se deveria fazer uma nova reserva. Ele também lembra proativamente os usuários dos próximos horários de saída para jogar golfe e informa qual buraco do campo é o mais difícil.
Em situações de compra, o Muse pode encontrar produtos por conta própria, comparar opções e consultar o usuário antes de efetuar o pagamento final.
Se um usuário salvou uma receita do Instagram, o Muse também pode organizá-la em uma lista de compras, planejar um menu para uma reunião, lembrar-se das restrições alimentares dos amigos e ajudar a enviar convites.
Tarefas mais complexas dependem do sistema de arquivos e dos programas de terminal próprios do Muse.
Com base nessas informações, ele pode escrever o próprio código e criar as ferramentas necessárias para concluir tarefas. Também pode gerar PDFs, páginas da web e outros “Artifacts”. Por exemplo, se um usuário quiser acompanhar seus gastos, poderá pedir ao Muse que crie uma ferramenta de controle de despesas atualizada continuamente; na hora de estudar, poderá pedir que crie guias de estudo interativos.
Ao projetar o Muse, a equipe de produto da Meta também adicionou o recurso Ideias. Os primeiros testes mostraram que o Muse podia fazer coisas demais, e alguns usuários não sabiam por onde começar.
Por isso, o sistema sugere proativamente atividades com base nos objetivos dos usuários, nas conversas de longo prazo e nos hábitos que identifica.
O modelo de interação do Muse também foi ajustado. Ele usa uma única conversa principal, de longa duração, na qual os usuários podem interromper a qualquer momento ou atribuir várias tarefas em sequência. Para projetos que precisam de um contexto separado, a Meta adicionou conversas paralelas.
O analista de IA @kimmonismus acredita que o Muse está mais voltado a oferecer aos usuários comuns um ponto de entrada acessível para um agente pessoal de IA. Ele tem computador e navegador próprios e também pode ser acessado pelo WhatsApp.
Para usuários que já estão ativos no ecossistema da Meta, esse tipo de acesso pode ser mais fácil de começar a usar do que agentes de IA que exigem aprender operações complexas.
03 Confiar permissões à IA?
Permitir que a IA opere diretamente e-mails, compras e pagamentos traz um grande problema. Se um agente puder abrir páginas da web, preencher formulários, enviar e-mails e até fazer compras em seu nome, os impactos de seus erros serão maiores do que os de um chatbot comum.
Para lidar com isso, a Meta projetou uma arquitetura de segurança separada para o Muse. Cada usuário tem sua própria Muse Secure VM, uma máquina virtual independente na nuvem. O Muse e os dados do usuário ficam armazenados nela, e os agentes de outros usuários não podem acessá-la.
Dentro dessa máquina virtual também há um agente Sentinel independente. Quando o Muse quer acessar a internet, precisa da aprovação do Sentinel. Quando surgem situações que exigem uma decisão do usuário, o sistema também pede sua opinião.
As senhas e as informações de pagamento também não são expostas diretamente ao Muse.
Depois que os usuários conectam serviços, as credenciais são armazenadas em um local seguro. O Muse pode utilizá-las, mas não consegue ver as senhas propriamente ditas. A Meta também afirma que as senhas digitadas pelos próprios usuários no navegador não ficam visíveis para o Muse. Para operações sensíveis, como enviar e-mails e fazer compras, o Muse solicitará a confirmação do usuário.
A Meta também oferece aos usuários controles de permissão. Por exemplo, é possível configurar o e-mail para que o Muse só possa lê-lo ou permitir que ele redija e responda mensagens em nome do usuário.
O Muse também disponibiliza um registro completo de atividades, para que os usuários vejam o que ele fez e o que planeja fazer.
A Meta afirma que os usuários podem optar por não permitir que os dados de interação com o Muse sejam usados para treinar os modelos de IA da empresa. As conversas e os dados da máquina virtual do Muse também não serão fornecidos aos sistemas de publicidade da Meta.
Ainda este ano, a Meta também planeja lançar a Muse Confidential VM. Nela, toda a máquina virtual, incluindo os dados do usuário e as conversas com o Muse, será criptografada com chaves que somente os próprios usuários terão. Nem mesmo a Meta poderá acessá-las.
Além da segurança, a Meta já lançou um programa público de recompensas por bugs. Antes disso, a empresa procurava problemas internamente por meio de testes em situações reais, exercícios de red teaming com agentes e um programa privado de recompensas por bugs.
04 Apostando em um ponto de entrada para bilhões de usuários
O objetivo do Muse não é criar um assistente de IA mais poderoso, mas levar aos usuários dos serviços da Meta um agente pessoal de IA — o “Jarvis” dos filmes do Homem de Ferro.
Wang Tao, diretor de IA da Meta, afirmou que tornar o produto simples e fácil de usar é um dos princípios de design do Muse. Os usuários não precisam ter experiência técnica; a ideia é permitir que pessoas comuns usem agentes de IA diretamente, por meio de uma experiência semelhante a uma conversa.
O preço também reflete esse posicionamento.
A maioria dos recursos do Muse é gratuita, e usuários com necessidades maiores de processamento podem escolher planos de assinatura de US$ 20 ou US$ 100 por mês. A Meta espera que a maioria dos usuários permaneça na versão gratuita.
Esse também é um aspecto que diferencia a Meta de muitos produtos atuais de agentes de IA. Os casos de uso destes últimos ainda se concentram mais em programação e tarefas empresariais, e um modelo de produto maduro ainda não se consolidou no mercado de consumo.
A Meta espera que o Muse seja voltado para a vida cotidiana desde o início, apresentando um agente pessoal de IA como um produto de consumo que usuários comuns possam entender e usar.
Outra vantagem da Meta são seus enormes pontos de acesso por meio de aplicativos. O Muse já pode se conectar ao Instagram e ao WhatsApp, além de serviços como Gmail, Google Calendar, Google Drive, Ticketmaster e OpenTable.
Para outros serviços que têm APIs, os usuários também podem pedir ao Muse que crie conectores personalizados. Para a Meta, isso significa que o Muse não precisa desenvolver sozinho um cenário de uso inteiramente novo: pode se integrar diretamente aos aplicativos e serviços que as pessoas já usam.
Isso está muito alinhado com a visão de IA pessoal que Mark Zuckerberg já havia apresentado. Ele afirmou que, no futuro, todos terão um agente pessoal altamente capaz, que compreenderá seus objetivos e interesses. O Muse é a primeira tentativa da Meta de transformar essa visão em um produto de consumo.
O analista de tecnologia Kyle Reidhead acredita que os agentes de IA para consumidores estão se tornando a próxima grande tendência do setor. Depois do Grok, a Meta lançou o Muse, e espera-se que Apple e Google também continuem incorporando recursos semelhantes a seus celulares e sistemas. Ele conclui que o uso de agentes em larga escala continuará aumentando a demanda por capacidade de processamento e que, quando os agentes digitais se tornarem comuns, a IA física, como os robôs, exigirá ainda mais processamento.
No entanto, a própria Meta reconhece que ainda é cedo.
O Muse precisa obter permissões suficientes dos aplicativos para ser realmente eficaz; e, quanto mais permissões tiver, maiores serão as exigências dos usuários em relação à privacidade e à segurança. No momento, a Meta está optando por tornar o acesso o mais simples possível e, em seguida, conter os riscos com máquinas virtuais, controles de permissão, o Sentinel e mecanismos de confirmação humana.
Se os usuários estiverem dispostos a confiar mais tarefas do dia a dia ao Muse, os agentes pessoais de IA terão a chance de evoluir de um novo recurso para uma ferramenta usada diariamente.
O primeiro testador @alanchen, no X, acredita que a característica mais marcante do Muse é sua capacidade de trabalhar de forma contínua em torno dos objetivos dos usuários, tendo a segurança e a privacidade como pilares do produto.
Essa também é a área mais importante a acompanhar na próxima fase do Muse. Do ponto de vista técnico, ele já é capaz de realizar muitas tarefas que antes exigiam a atuação dos próprios usuários; no produto, a Meta também está trabalhando para reduzir as barreiras de uso. Mas a possibilidade de os agentes pessoais de IA se tornarem ferramentas usadas com frequência dependerá de os usuários estarem dispostos a utilizá-los a longo prazo e, aos poucos, confiar a eles mais aspectos da vida real.
Para a Meta, portanto, o valor do Muse não está apenas em acrescentar mais um produto de IA.
Ele se parece mais com um teste de ponto de entrada voltado a bilhões de usuários: se os agentes pessoais de IA conseguirem chegar aos aplicativos do dia a dia, a Meta terá a oportunidade de levar a IA para além da janela de conversa e inseri-la ainda mais na vida cotidiana das pessoas.
Link original
Participe da comunidade oficial Coincamps:
X: https://x.com/coincamps
Telegram: https://t.me/coin_camps