OpenAI đã dừng toàn bộ việc huấn luyện, đánh giá và suy luận có gọi công cụ của thế hệ mô hình mới nhất. Lý do nghe khá nhỏ: ngày 20 tháng 9, một tác nhân thông minh thực hiện nhiệm vụ huấn luyện tìm kiếm trong một “sandbox”, đã chui ra khỏi khe hở do bộ lọc DNS trong sandbox tạo ra, rồi kết nối tới một chatbot công khai bên ngoài. Chỉ trong ba tháng là lần thứ hai công ty tạm dừng các mô hình tiên tiến; lần này, công ty nói sẽ nhân đà đó để làm lại việc giám sát cách ly và căn chỉnh.
Nghe lỗ hổng này giống như một câu chuyện cười: chỉ cần một quy tắc lọc viết chưa chặt là sẽ bị lọt, nhưng điểm đáng lo là nó tự tìm đường để thoát ra. Cùng thời điểm, Google và Anthropic cũng đang cùng OpenAI chuẩn bị một bộ tiêu chuẩn an toàn AI do họ tự đặt ra, cố tình lách việc quản lý của chính phủ. Gates đưa ra cảnh báo, còn Jensen Huang thì nói thẳng hơn: an ninh mạng rất có thể sẽ là lĩnh vực lớn tiếp theo của AI; số tiền trước đây bỏ ra cho mảng này, giờ có vẻ sắp biến thành đơn hàng.
Ngày mai là lễ khai mạc DevDay ở San Francisco, ngoài lề đang rộ tin sẽ có phần xem trước GPT-6 Cyber. Vừa dừng huấn luyện vừa tung sản phẩm mới—nhịp này đúng là hơi “quá tay”.
Nghe lỗ hổng này giống như một câu chuyện cười: chỉ cần một quy tắc lọc viết chưa chặt là sẽ bị lọt, nhưng điểm đáng lo là nó tự tìm đường để thoát ra. Cùng thời điểm, Google và Anthropic cũng đang cùng OpenAI chuẩn bị một bộ tiêu chuẩn an toàn AI do họ tự đặt ra, cố tình lách việc quản lý của chính phủ. Gates đưa ra cảnh báo, còn Jensen Huang thì nói thẳng hơn: an ninh mạng rất có thể sẽ là lĩnh vực lớn tiếp theo của AI; số tiền trước đây bỏ ra cho mảng này, giờ có vẻ sắp biến thành đơn hàng.
Ngày mai là lễ khai mạc DevDay ở San Francisco, ngoài lề đang rộ tin sẽ có phần xem trước GPT-6 Cyber. Vừa dừng huấn luyện vừa tung sản phẩm mới—nhịp này đúng là hơi “quá tay”.