Claude Opus 4.8 ra mắt với cú sốc: Vượt trội trong lập trình và nhiệm vụ Agent so với GPT-5.5
Anthropic chính thức phát hành Claude Opus 4.8, đạt được bước tiến lớn trong lĩnh vực lập trình, nhiệm vụ Agent và công việc chuyên môn. Phiên bản mới hỗ trợ người dùng điều chỉnh effort, tính năng workflow động Claude Code, tốc độ ở chế độ nhanh tăng 2.5 lần và giá giảm 3 lần.
Trong bài kiểm tra Super-Agent, Opus 4.8 là mô hình duy nhất hoàn thành mọi trường hợp từ đầu đến cuối, vượt trội so với GPT-5.5. Trong nhiều bài kiểm tra chuyên môn như CursorBench, Legal Agent Benchmark, đã thiết lập điểm số cao nhất lịch sử. Những người thử nghiệm sớm đánh giá rằng nó "cải thiện đáng kể khả năng phán đoán", "gọi công cụ hiệu quả hơn", "độ trung thực cải thiện rõ rệt".
Tại sao điều này quan trọng: Điều này đánh dấu một bước ngoặt trong việc lập trình AI và công việc chuyên môn, trực tiếp nâng cao năng suất của lập trình viên và chất lượng ứng dụng AI doanh nghiệp.
#Claude #AI #人工智能 #Anthropic #大模型
Anthropic chính thức phát hành Claude Opus 4.8, đạt được bước tiến lớn trong lĩnh vực lập trình, nhiệm vụ Agent và công việc chuyên môn. Phiên bản mới hỗ trợ người dùng điều chỉnh effort, tính năng workflow động Claude Code, tốc độ ở chế độ nhanh tăng 2.5 lần và giá giảm 3 lần.
Trong bài kiểm tra Super-Agent, Opus 4.8 là mô hình duy nhất hoàn thành mọi trường hợp từ đầu đến cuối, vượt trội so với GPT-5.5. Trong nhiều bài kiểm tra chuyên môn như CursorBench, Legal Agent Benchmark, đã thiết lập điểm số cao nhất lịch sử. Những người thử nghiệm sớm đánh giá rằng nó "cải thiện đáng kể khả năng phán đoán", "gọi công cụ hiệu quả hơn", "độ trung thực cải thiện rõ rệt".
Tại sao điều này quan trọng: Điều này đánh dấu một bước ngoặt trong việc lập trình AI và công việc chuyên môn, trực tiếp nâng cao năng suất của lập trình viên và chất lượng ứng dụng AI doanh nghiệp.
#Claude #AI #人工智能 #Anthropic #大模型