Độ tin cậy khi dùng proxy cho máy tính không nằm ở việc mỗi lần nhấp vào đúng tọa độ trên màn hình, mà nằm ở việc hiểu trong lòng người dùng họ thực sự muốn gì.

Đây là các đoạn cắt chọn lọc của AI on Air, trích từ chuyên mục Latent.Space trong một chương trình gần đây. Người phát biểu chính là Danielle Perszyk, nhà nghiên cứu tại Amazon AGI Lab.

▷ Hai năm trước, hướng tiếp cận là làm cho các thao tác nguyên tử như nhấp chuột, cuộn trang trở nên ổn định trước, rồi sau đó để các nhà phát triển ghép chúng thành quy trình để xử lý các công việc lặp lại; khi đó đây được xem là một bước đột phá quan trọng.

▷ Nhắm tới nút bấm và tọa độ hiện nay có lẽ đã gần như giải quyết được, nhưng điều đó không có nghĩa là đã đáng tin cậy. Khi đặt vé, việc chọn chuyến bay có quá cảnh hay bay thẳng vẫn còn thay đổi cách bạn nghĩ; mục tiêu là trong quá trình tương tác, mọi thứ được triển khai dần dần và được hiệu chỉnh.

▷ Sự khác biệt giữa trợ lý hành chính giỏi và AI agent nằm ở chỗ: trợ lý hành chính hiểu được tâm lý/ý định của người dùng, còn việc phân rã không chỉ là các tác vụ—mà còn là sở thích và ý định. Độ tin cậy nhiều hơn là việc mô hình hóa tâm trí người dùng; sự chuyển đổi này đã định nghĩa lại những gì chúng ta xây dựng. 🪁