La fiabilité de l’usage d’un proxy informatique ne tient pas tant à cliquer à chaque fois sur des coordonnées à l’écran, mais à comprendre ce que l’utilisateur veut réellement, dans son esprit.

Voici une sélection de « AI on Air », extraite d’une émission récente de la rubrique Latent.Space. L’interlocutrice principale est Danielle Perszyk, chercheuse au laboratoire Amazon AGI.

▷ L’idée, il y a deux ans, consistait d’abord à rendre stables des opérations atomiques comme le clic et le défilement, puis à permettre aux développeurs d’enchaîner ces opérations en un processus pour traiter les tâches répétitives : à l’époque, cela avait constitué une percée importante.

▷ Pointer des boutons et des coordonnées est sans doute désormais proche d’être résolu, mais cela ne signifie pas pour autant que ce soit fiable. Pour réserver un billet, on hésite encore entre correspondance et vol direct : le choix lui-même change la façon de penser, et l’objectif est de déplier progressivement l’intention en interaction — puis de la corriger.

▷ La différence entre une assistante administrative compétente et un agent d’IA tient au fait que la première comprend l’état d’esprit de l’utilisateur : elle ne décompose pas uniquement des tâches, mais aussi des préférences et des intentions. La fiabilité, c’est surtout modéliser les intentions de l’utilisateur. Cette transformation redéfinit ce que nous construisons. 🪁