Mô hình AI mới nhất của Anthropic giải được lỗi phần mềm tồn tại nhiều năm và cắt giảm mạnh chi phí cho các tác vụ lập trình dài hơi.
Ngày 1/9, Anthropic ra mắt Claude Fable 5.1 và Claude Mythos 5.1, bản nâng cấp của bộ đôi mô hình AI mạnh nhất hãng từng phát hành cách đây gần ba tháng. Đây là lần đầu tiên dòng Fable, vốn có hành trình ra mắt đầy sóng gió với lệnh cấm xuất khẩu hồi tháng 6 và chính sách chia hạn mức gây tranh cãi hồi tháng 7, quay lại với một bản cập nhật thay vì một cuộc khủng hoảng mới.
Fable 5.1 và Mythos 5.1 vẫn là cùng một model, chỉ khác mức độ giới hạn an toàn, giống cách Fable 5 và Mythos 5 từng vận hành. Fable 5.1 mở cho tất cả người dùng, còn Mythos 5.1 chỉ dành cho tổ chức được xác minh trong lĩnh vực an ninh mạng và khoa học sự sống.
Giao diện chọn mô hình Claude Fable 5.1 trên Claude.ai
Theo Damien, Giám đốc danh mục đầu tư cấp cao tại quỹ Millennium, đội kỹ sư công ty này từng bó tay suốt 4-5 năm trước một lỗi crash hiếm gặp, chỉ xảy ra khoảng một lần trong một triệu lượt chạy. Fable 5.1 là model đầu tiên tìm ra nguyên nhân: nó tự dịch ngược một thư viện phần mềm của bên thứ ba, đối chiếu với dữ liệu core dump và xác định chính xác đoạn mã gây lỗi. Walden Yan, đồng sáng lập kiêm giám đốc sản phẩm của Cognition, công ty đứng sau trợ lý lập trình Devin, cho biết sẽ chuyển toàn bộ lưu lượng đang chạy trên Opus 5 sang Fable 5.1 ngay ngày ra mắt nhờ hiệu năng tương đương hoặc nhỉnh hơn với chi phí thấp hơn.
Anthropic công bố loạt benchmark so sánh Fable 5.1 với chính Fable 5, Opus 5 và GPT-5.6 Sol của OpenAI:
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 (nghiên cứu khoa học) | 52,6% | 24,7% | 29,0% | 22,4% |
| Terminal-Bench 4.0 (lập trình agentic) | 55,8% | 42,0% | 52,3% | 37,3% |
| Humanity's Last Exam (không dùng công cụ) | 60,9% | 57,8% | 56,6% | - |
| AutomationBench (quy trình doanh nghiệp) | 31,4% | 17,1% | 26,9% | 19,6% |
| CursorBench 3.2.0 (lập trình) | 73,4% | 70,5% | 70,0% | 67,2% |
Anthropic lưu ý các con số này đo khi lớp bảo vệ an toàn đang bật, tức một số tác vụ bị chặn và tính điểm 0, nên có thể thấp hơn năng lực thực tế của model.
Biểu đồ so sánh điểm benchmark giữa Fable 5.1, Fable 5, Opus 5 và GPT-5.6 Sol
Về giá, Fable 5.1 giữ nguyên mức của Fable 5: 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra, tương đương khoảng 263.000 đồng và 1,31 triệu đồng theo tỷ giá hiện tại. Thay đổi nằm ở giá đọc cache: từ 1 USD/triệu token (khoảng 26.300 đồng) giảm còn 0,25 USD/triệu token (khoảng 6.600 đồng), tức giảm 75%. Anthropic ước tính mức giá mới giúp chi phí sử dụng thông thường giảm khoảng 25%, còn với các tác vụ agentic phức tạp chạy nhiều bước, mức giảm có thể lên tới 45%.
Fable 5.1 có mặt trên Claude.ai, Claude Platform cùng ba nền tảng đám mây AWS, Google Cloud và Microsoft Azure, với mã model dành cho lập trình viên là claude-fable-5-1. Theo Decrypt, cách phân bổ hạn mức tiếp tục theo chính sách Anthropic áp dụng cho Fable 5 hồi tháng 7: gói Pro và Team tiêu chuẩn không có sẵn Fable 5.1 trong hạn mức tuần mà phải trả thêm qua usage credit theo giá API, còn gói Max và Team/Enterprise cao cấp được dùng Fable 5.1 trong tối đa 50% hạn mức tuần.
Về an toàn, số lần hệ thống can thiệp nhầm vào câu hỏi an ninh mạng vô hại giảm khoảng 60% so với Fable 5, và Fable 5.1 hiện được phép dùng để phát hiện lỗ hổng phần mềm, dù chưa được dùng để viết mã khai thác. Với chủ đề sinh học, các lớp bảo vệ giảm 85% số lần chặn nhầm câu hỏi y tế và sinh học phổ thông, trong khi câu hỏi liên quan nghiên cứu chuyên sâu vẫn được chuyển sang xử lý bằng model Opus. Anthropic cũng giới thiệu hệ thống Enterprise Frontier Safeguards, cho phép doanh nghiệp lưu dữ liệu trên hạ tầng đám mây do chính họ kiểm soát, đạt mức riêng tư tương đương chính sách không lưu dữ liệu nhưng vẫn giữ khả năng phát hiện lạm dụng. Hệ thống này triển khai theo giai đoạn từ mùa thu năm nay.
Một thay đổi kỹ thuật đáng chú ý khác: từ ngày 1/9, các tài khoản API mới không còn chỉnh sửa được phần suy luận của Claude trong hội thoại nhiều lượt mà vẫn giữ nguyên bản ghi, chặn một kỹ thuật distillation từng bị lợi dụng để trích xuất trái phép quá trình suy luận của model. Đây cũng là cách Anthropic từng cáo buộc Moonshot AI, hãng đứng sau Kimi K3, sử dụng 3,4 triệu cuộc hội thoại với Claude để huấn luyện model cạnh tranh hồi tháng 2.
Ở mảng khoa học, Fable 5.1 huấn luyện một mạng nơ-ron tạo bản đồ độ cao độ phân giải cao cho khoảng một phần ba bề mặt sao Kim, dựa trên ảnh radar từ tàu Magellan của NASA chụp hơn 30 năm trước. Bản đồ mới cho chi tiết địa hình ở độ phân giải 2-3 km thay vì 10-20 km như trước, đo độ cao chính xác hơn tới 25%, và được Anthropic công bố miễn phí theo giấy phép Creative Commons trước thềm hai sứ mệnh khảo sát sao Kim của NASA và Cơ quan Vũ trụ châu Âu.
Bản đồ địa hình sao Kim độ phân giải cao do Fable 5.1 tạo ra từ dữ liệu radar Magellan
Với Mythos 5.1, Anthropic thử nghiệm khả năng thiết kế phân tử liên kết ái lực cao dùng trong phát triển thuốc. Trên 3 mục tiêu thử nghiệm, thiết kế của Mythos 5.1 có ái lực liên kết cao gấp 10 lần thiết kế tốt nhất từng đạt tại cuộc thi thiết kế protein của Adaptyv Bio, với tỷ lệ thành công gần 50% trên 12 mục tiêu, trong khi tỷ lệ thông thường của ngành chỉ khoảng 10-15%. Mythos 5.1 cũng tự viết lại các đoạn mã GPU để tăng tốc 7 model học sâu mã nguồn mở dùng trong nghiên cứu gene, giúp chạy nhanh hơn tới 2,5 lần trên chip Nvidia H100 mà không đổi kết quả, tiết kiệm 30-60% chi phí GPU cho các phân tích quy mô lớn.
Người muốn tiếp cận Mythos 5.1 phải đăng ký qua Cyber Verification Program dành cho chuyên gia an ninh mạng hoặc Life Sciences Verification Program dành cho nhà khoa học, hiện chỉ mở cho một số tổ chức tại Mỹ.