Theo Reuters, Anthropic đã nói với các nhà đầu tư tiềm năng rằng AI tiên tiến có thể mang lại “những rủi ro thảm khốc hoặc mang tính sinh tồn đối với nhân loại”. Thông tin này được giấu trong bản cáo bạch IPO chưa được công bố, xuất hiện trong bối cảnh nhà sáng tạo Claude đang tìm cách đạt định giá vượt quá 2 nghìn tỷ USD.

Reuters đưa tin rằng khoảng 80 trong số 261 trang của bản cáo bạch dành cho nhiều yếu tố rủi ro khác nhau, nhiều hơn đáng kể so với 48 trang dùng để giải thích công ty thực sự làm gì. Các công ty chuẩn bị niêm yết luôn công bố một mục rủi ro, trong đó cũng bao gồm tất cả các vụ kiện, cạnh tranh và quy định. Điều mà họ hiếm khi làm là cho các cổ đông biết rằng chính sản phẩm của họ có thể góp phần dẫn tới sự tuyệt chủng của con người. Anthropic đã vượt qua ranh giới đó, và đây là lý do bản nộp hồ sơ này thu hút sự chú ý ngay cả trước khi chính thức ra công chúng.

Anthropic nêu bật nhiều rủi ro hiện sinh trong IPO

Bản cáo bạch nêu ra các rủi ro một cách bất thường thẳng thắn, cảnh báo rằng các mô hình AI có thể phát triển “những hành vi tự duy trì”, bao gồm các nỗ lực để “chống lại việc tắt hệ thống”, “che giấu hoặc thao túng thông tin”, hoặc thực hiện các hành vi “giống như tống tiền”. Có một tiết lộ khác đi thẳng vào trọng tâm của việc thử nghiệm an toàn AI. Anthropic nói rằng khi một mô hình có thể nhận ra mình đang được đánh giá, thì nhận thức đó trở thành một “hạn chế đáng kể” đối với khả năng của công ty trong việc xác định mức độ an toàn thực sự của hệ thống.

Nói một cách đơn giản, một hệ thống đủ thông minh để biết khi nào nó đang được thử nghiệm cũng có thể học cách cư xử khác đi chỉ để vượt qua bài kiểm tra. Các trang bị rò rỉ cũng mở ra một “cửa sổ” về tài chính của Anthropic, với những con số hết sức “khủng”. Reuters đã đưa tin rằng công ty đã lỗ 42 tỷ USD vào năm 2025. Theo hồ sơ, Anthropic đã nêu ra khoảng 518 tỷ USD cam kết cho các dịch vụ đám mây, năng lực tính toán và cơ sở hạ tầng liên quan trong những năm tới. Công ty tạo ra 11,5 tỷ USD doanh thu trong quý 2 năm 2026 và đang có đà hướng tới quý thứ hai liên tiếp đạt lợi nhuận hoạt động điều chỉnh.

Việc phụ thuộc vào khách hàng cũng là một rủi ro khác: gần một phần tư doanh thu của năm ngoái đến từ chỉ hai khách hàng. Anthropic được định giá 965 tỷ USD vào tháng Năm và hiện đang nhắm tới mức định giá hơn 2 nghìn tỷ USD, điều này sẽ đưa công ty gần với mức của SpaceX tại thời điểm công ty này niêm yết vào tháng Sáu. Công ty AI tiên phong đã chọn Nasdaq cho đợt chào bán và nhắm tới thời điểm ra mắt vào tháng Mười. Công ty cũng phải công bố hồ sơ ít nhất 15 ngày trước khi bắt đầu chuyến vận động nhà đầu tư.

Nhà nghiên cứu của Anthropic là Jacob Coxon đã từ chức sau khi viết rằng những người xây dựng AI “thành thật tin rằng nó có thể giết tất cả chúng ta vào cuối thập kỷ này”, theo tờ Guardian đưa tin. Một nhà nghiên cứu cấp cao về an toàn tại công ty sau đó đã viết trên X rằng có xác suất cao hơn 10% để AI “có thể giết chết tất cả con người” trong vòng thập kỷ tới. Sau đó, CEO Dario Amodei công bố một bài tiểu luận kêu gọi ngành công nghiệp chậm lại và nói với Anderson Cooper của CNN rằng ông đồng ý với Coxon nhiều hơn là không đồng ý.

Một số chuyên gia đã đặt câu hỏi liệu các cảnh báo đó thậm chí có thể được xác minh một cách khoa học hay không, theo Guardian, trong đó CEO của Hugging Face cho rằng những nỗi lo là phóng đại. Trong khi đó, OpenAI đã hủy kế hoạch phát hành mô hình GPT-6.1 Astra sau các bài kiểm tra nội bộ dấy lên mối lo về sự lừa dối và khả năng phù hợp. Amodei được cho là một trong các lãnh đạo điều hành AI sẽ tham dự cuộc gặp với Tổng thống Donald Trump tại hội nghị thượng đỉnh ở Nhà Trắng vào thứ Ba, trong bối cảnh Trump chống lại các lời kêu gọi điều tiết AI và gọi những lo ngại là một “chiêu trò lừa đảo”, CNN đưa tin.

Bài cảnh báo “rủi ro đối với nhân loại” mà Anthropic công bố trong hồ sơ IPO lần đầu xuất hiện trên Coinfea.