Alexander Wei, một thành viên của nhóm nghiên cứu Mô hình Ngôn ngữ Lớn (LLM) và lý luận của Openai, đã báo cáo rằng một mô hình lý luận AI thử nghiệm thế hệ tiếp theo đã đạt được hiệu suất ở mức huy chương vàng tại Olympiad Toán học Quốc tế (IMO). Giám đốc điều hành Openai Sam Altman nhấn mạnh rằng điều này là một phần trong nỗ lực của họ để thúc đẩy trí tuệ tổng quát.

Mô hình AI thử nghiệm của Openai nhận huy chương vàng tại Olympiad Toán học Quốc tế
Openai, một công ty hàng đầu trong lĩnh vực trí tuệ nhân tạo, đã đạt được một cột mốc mới với một mô hình đa mục đích. Một mô hình lý luận thử nghiệm cho trí tuệ tổng quát đã đạt được hiệu suất ở mức huy chương vàng tại Olympiad Toán học Quốc tế (IMO), một trong những cuộc thi toán học lâu đời và danh giá nhất trên thế giới.
Alexander Wei, một nhà nghiên cứu trong nhóm lý luận của Openai, đã báo cáo rằng mô hình thử nghiệm đã đối mặt với những điều kiện giống như bất kỳ con người nào tham gia bài kiểm tra, không có internet hoặc công cụ để giải sáu bài toán trong khoảng thời gian hai phiên 4.5 giờ.
Mô hình thử nghiệm của Openai đã thành công giải quyết 5 trong số 6 bài toán được trình bày tại IMO 2025, cung cấp các chứng minh bằng ngôn ngữ tự nhiên. Wei giải thích rằng sau khi được đánh giá bởi ba cựu vô địch IMO, mô hình đã đạt 35 trên tổng số 42 điểm, đủ để đạt được trạng thái huy chương vàng.
Nhấn mạnh sự liên quan của kết quả này, Wei đã nhấn mạnh:
Chúng tôi đạt được cấp độ khả năng này không thông qua phương pháp hẹp, cụ thể cho nhiệm vụ, mà bằng cách mở ra những lối đi mới trong việc học tăng cường đa mục đích và quy mô tính toán tại thời điểm kiểm tra.
Sam Altman cũng đã đưa ra ý kiến về vấn đề này, nhấn mạnh rằng mục tiêu đã đạt được bằng cách sử dụng một mô hình tổng quát chứ không phải là một mô hình được đào tạo cho mục đích toán học. “Đó là một phần trong nỗ lực chính của chúng tôi hướng tới trí tuệ tổng quát,” ông nói thêm.
Altman lưu ý rằng thành tựu này là một “dấu mốc quan trọng cho thấy AI đã tiến xa như thế nào trong thập kỷ qua.”
Tuy nhiên, đừng kỳ vọng rằng một mô hình lý luận tiên tiến như vậy sẽ được phát hành cho công chúng trong thời gian sắp tới. Altman đã khẳng định rằng trong khi phiên bản 5 của mô hình đặc trưng của công ty, ChatGPT, sẽ được phát hành sớm, nó sẽ không thể lý luận theo cách tương tự như mô hình thử nghiệm chưa được đặt tên này. “Chúng tôi nghĩ bạn sẽ yêu thích GPT-5, nhưng chúng tôi không có kế hoạch phát hành một mô hình với khả năng ở mức huy chương vàng IMO trong nhiều tháng tới,” ông kết luận.
