Elon Musk cho biết SpaceXAI sẽ phát hành Grok 4.6 vào khoảng ngày 7 tháng 8 và vài tuần sau đó sẽ ra mắt Grok 4.7, một mô hình lớn hơn với 2,1 nghìn tỷ tham số.
Điểm chính:
Musk đặt mục tiêu cho Grok 4.6 vào khoảng ngày 7 tháng 8, còn Grok 4.7 chậm hơn vài tuần.
Ông mô tả bản kế tiếp là một mô hình 2,1 nghìn tỷ tham số trả lời chậm hơn nhưng sử dụng ít token hơn.
Lịch trình này đến vài ngày sau khi trọng số Kimi K3 được công bố công khai và Anthropic đã phát hành Claude Opus 5.
Ngày ra mắt Grok 4.6 rơi vào đầu tháng 8
Musk đã vạch ra lịch trình trên X vào hôm thứ Ba, mô tả Grok 4.6 là một bản phát triển với việc tinh chỉnh giám sát và học tăng cường nặng nề hơn đáng kể so với mô hình mà nó thay thế.
Ông dự tính nó sẽ đến vào khoảng 7/8. Grok 4.7 sẽ ra muộn hơn vài tuần, và ông mô tả hệ thống lớn hơn như một bản nâng cấp về mọi mặt trừ tốc độ nó trả lời.
Ông lập luận rằng mô hình chậm hơn vẫn sẽ hoàn thành cùng công việc với ít token hơn, đây là lập luận về hiệu quả mà SpaceXAI theo đuổi kể từ mùa xuân.
Con số 2,1 nghìn tỷ tham số cũng trông không khớp với bản tường thuật trước đó của chính ông, khi ông cho biết Grok 4.6 có 2 nghìn tỷ tham số vào thời điểm xác nhận lịch huấn luyện của nó vào ngày 18/7.
Cũng đọc: Các cuộc tấn công bằng “cần cẩu crypto” đạt 52 vụ trong sáu tháng, phần lớn ở Pháp
Benchmark Kimi K3 tạo khung cho phép so sánh với Grok
Thời điểm rất quan trọng. Moonshot AI đã công bố toàn bộ trọng số của Kimi K3—một mô hình với 2,8 nghìn tỷ tham số—vào thứ Hai, và Anthropic đã phát hành Claude Opus 5 ba ngày trước đó. Artificial Analysis chấm Kimi K3 ở mức 57 trên thang chỉ số trí tuệ, so với 54 cho Grok 4.5, dù mô hình Grok nhỏ hơn vẫn hoàn thành cùng các tác vụ với chi phí khoảng 0,31 USD mỗi lần so với 0,94 USD.
Guillermo Rauch, giám đốc điều hành của Vercel, cho biết các bài kiểm tra nội bộ mới nhất của công ty xếp Grok 4.5 đứng đầu về hiệu quả giá trong lĩnh vực an ninh mạng, đạt kết quả gần với Kimi K3, trong khi chạy tốn kém chỉ bằng vài lần so với Claude Opus 5. Ông vẫn đặt mô hình Sol của OpenAI ở vị trí dẫn đầu, bất chấp vậy, vẫn vượt trước bản phát hành của Anthropic.
Khoảng cách giữa giá và hạng chính là toàn bộ “bài pitch” SpaceXAI, và Grok 4.5 đã đăng tải khoảng một phần tư số token đầu ra mà Claude Opus 4.8 đã tiêu tốn để giải quyết cùng một nhóm bài toán kỹ thuật phần mềm.
Musk tuyên bố Grok được chuyển dịch đến thời điểm giữa tháng 7
Bài đăng hôm thứ Ba kết lại một tháng liên tục thay đổi mục tiêu. SpaceXAI đã phát hành Grok 4.5 vào ngày 8/7 với giá 2 USD cho mỗi một triệu token đầu vào và 6 USD cho mỗi một triệu token đầu ra—ít hơn chưa tới một nửa so với mức phí mà Anthropic tính cho Opus 4.8.
Musk cho rằng mô hình này tương đương khoảng một năm tuổi của Claude, rồi nói với người theo dõi vào ngày 24/7 rằng Grok 4.6 chỉ còn hai tuần nữa và Grok 4.7 là bốn.
Mỗi tuyên bố trong số đó đều xuất hiện trên X chứ không phải trong thẻ mô hình, và công ty chưa công bố bất kỳ thông số kỹ thuật, giá cả, cửa sổ ngữ cảnh hay kết quả benchmark nào cho cả hai mô hình chưa phát hành. Musk đã từng bỏ lỡ các mốc thời hạn AI mà chính ông đưa ra, và cả hai bản phát hành này hiện vẫn chưa có trang ra mắt chính thức.
Đọc tiếp: Dự báo ngắn hạn của XRP đạt đỉnh ở mức 1,25 USD trước quyết định của Fed