📰 Anthropic đã giảm chi phí suy luận của Haiku 5.5 xuống còn một phần mười so với thế hệ trước: với các yêu cầu ngắn, giá là 0,1 USD cho mỗi triệu token đầu vào và 0,5 USD cho mỗi triệu token đầu ra. “Mức giá rẻ” vốn được các mô hình lớn của Trung Quốc giữ vững đã bị các mô hình Mỹ phá vỡ chỉ sau một đêm.

🔥 Đây cũng là lý do cổ phiếu Hồng Kông của Zhipu và MiniMax được chú ý. Trong biểu đồ phân tán về chi phí và hiệu quả hồi tháng 6, nhóm có chi phí thấp nhất gần như do Xiaomi MiMo, DeepSeek, MiniMax và Zhipu chiếm lĩnh; đến ngày 8 tháng 10, vị trí dẫn đầu đã chuyển sang Anthropic và OpenAI.

Nói thật, trong hai năm qua, các mô hình Trung Quốc đã thu hút các nhà phát triển trên toàn cầu nhờ mã nguồn mở và giá thấp. DeepSeek V2 từng hạ giá đầu vào xuống còn 1 nhân dân tệ cho mỗi triệu token; giá đầu ra của DeepSeek-R1 cũng chỉ là 2,19 USD cho mỗi triệu token, trong khi OpenAI o1 khi đó có giá 60 USD. Giá rẻ quả thực có thể làm thay đổi lựa chọn của thị trường.

💡 Nhưng vấn đề cũng rất thực tế: được sử dụng nhiều không có nghĩa là kiếm được nhiều tiền. Báo cáo của Mozilla cho thấy các mô hình mở từng chiếm gần 20% lượng sử dụng trên OpenRouter, nhưng chỉ thu về khoảng 4% doanh thu ở cấp độ mô hình. Trong nửa đầu năm, doanh thu từ nền tảng mở và API chiếm 86,5% doanh thu của Zhipu; biên lợi nhuận gộp của mảng này tăng lên 24,6%, nhưng toàn công ty vẫn lỗ ròng khoảng 2,072 tỷ nhân dân tệ.

👀 Cuộc chiến giá cả này giờ đây giống như đã chuyển từ “mô hình Trung Quốc ép giá mô hình nước ngoài” sang “mọi mô hình tiếp tục ép giá lẫn nhau” hơn. Các nhà phát triển đương nhiên vui mừng, nhưng các công ty mô hình chưa chắc đã dễ thở. Bạn nghĩ vòng tiếp theo sẽ là cuộc đua về giá, hay cuộc đua xem ai thực sự kiếm được tiền trước?

#人工智能 #大模型 #DeepSeek #智谱