Trên bảng xếp hạng sân chơi cạnh tranh mã nguồn front-end, Kimi K3 của Trung Quốc đứng vị trí số 1, vượt qua Claude Fable 5. Mặc dù năng lực tổng hợp cụ thể không bằng gpt 5.6sol và fable5.
Dự kiến phía sau mức cạnh tranh sẽ gia tăng → toàn bộ hệ sinh thái AI mở rộng (logic cốt lõi nhất), năng lực mô hình được nâng lên + giá giảm sẽ khiến nhiều doanh nghiệp và nhà phát triển thực sự triển khai sử dụng (từ các tập đoàn lớn đến doanh nghiệp vừa và nhỏ, và cả các nhà phát triển cá nhân).
Việc sinh mã front-end là tình huống sử dụng tần suất cao, nhu cầu thiết yếu. Chỉ cần tỷ lệ chi phí/hiệu quả đủ tốt, nó sẽ thay thế/hỗ trợ phát triển thủ công trên quy mô lớn, khiến lượng token tiêu thụ tăng vọt. Vì vậy, dù từng mô hình có rẻ hơn, tổng nhu cầu tính toán (tổng lực tính toán) vẫn sẽ tăng (nhiều người dùng hơn, dùng thường xuyên hơn, và dùng với các workflow agent phức tạp hơn).
Mô hình có mạnh đến đâu, rẻ đến đâu thì khi chạy vẫn cần GPU/HBM/máy chủ/module quang/nguồn điện/trung tâm dữ liệu. Trong nhóm cổ phiếu AI ở thị trường Mỹ, các công ty thuần mô hình/phần mềm (định giá cao phụ thuộc vào “hào lũy” từ mô hình) về trung và dài hạn có thể chịu áp lực.
Tin không mấy tích cực: Nếu thị trường diễn giải rằng “hào lũy mô hình của Mỹ” bị suy yếu, ngắn hạn có thể gây áp lực lên một số cổ phiếu phần mềm/ứng dụng AI được định giá cao.
Hãy để tôi ước tính chi phí triển khai K3. Trước đây, với mô hình 1t, để chạy đủ mượt thì cần một cụm khoảng 4 cụm Mac Studio. Hiện tại là 2.8t, và cần xử lý nhiều ngữ cảnh và bộ nhớ hơn. Ước khoảng cần 21–32 cái ít nhất,
Có lẽ phải đạt quy mô 64+ GPU: tổng chi phí phần cứng 2 triệu–10 triệu USD+ (riêng GPU có thể đã vài triệu USD).
#KIMI3