Anthropic Ra Mắt Claude Fable 5.1 Với Chi Phí Tác Tử Thấp Hơn và Biến Thể Mythos Bị Hạn Chế
Claude Fable 5.1 bổ sung hiệu năng tác tử mạnh hơn, chi phí đọc cache rẻ hơn 75% và các biện pháp bảo vệ được điều chỉnh, trong khi Mythos 5.1 vẫn bị hạn chế.
Mục lục · 12
- 1. Fable 5.1 Hướng Đến Công Việc Tác Tử Dài Hạn
- 2. Anthropic Báo Cáo Cải Thiện Trên Diện Rộng Ở Các Benchmark
- 3. Fable và Mythos Chia Sẻ Năng Lực Nhưng Không Chia Sẻ Quyền Truy Cập
- 4. Các Biện Pháp Bảo Vệ Hiện Tạo Ra Ít Dương Tính Giả Hơn
- 5. Giá Cache và Kiểm Soát Dữ Liệu Doanh Nghiệp Thay Đổi Kinh Tế Triển Khai
- Câu hỏi thường gặp
- Claude Fable 5.1 có được cung cấp rộng rãi không?
- Claude Mythos 5.1 có phải là một mô hình khác không?
- Fable 5.1 có giá bao nhiêu qua API?
- Giới hạn ngữ cảnh và đầu ra là gì?
- Fable 5.1 có thể thực hiện kiểm thử xâm nhập không?
- Tham khảo nguồn
Anthropic đã phát hành Claude Fable 5.1 vào ngày 1 tháng 9 với tư cách là mô hình được cung cấp rộng rãi có năng lực cao nhất của hãng dành cho các tác tử lập trình, nghiên cứu và công việc tri thức chạy dài hạn. Đồng thời, công ty giới thiệu Claude Mythos 5.1, một phiên bản chỉ dành cho người được mời của cùng mô hình nền tảng, với các biện pháp bảo vệ cởi mở hơn cho những tổ chức an ninh mạng và khoa học sự sống đã được phê duyệt.
Fable 5.1 giữ nguyên giá API cơ bản của thế hệ trước: $10 cho mỗi triệu token đầu vào và $50 cho mỗi triệu token đầu ra. Thay đổi giá đáng chú ý là giảm 75% chi phí đọc cache, từ $1 xuống $0.25 cho mỗi triệu token. Anthropic ước tính điều này làm giảm tổng chi phí của các khối lượng công việc Fable thông thường khoảng 25% và các khối lượng công việc có tính tác tử cao tới 45%.
Bản phát hành cũng điều chỉnh các biện pháp bảo vệ từng khiến Fable 5 ban đầu khó sử dụng cho một số tác vụ sinh học và bảo mật hợp pháp. Fable 5.1 hiện có thể xác định lỗ hổng trong mã nguồn, trong khi kiểm thử xâm nhập, tạo mã khai thác, quét lỗ hổng nhị phân và nghiên cứu khoa học sự sống nâng cao vẫn chịu hạn chế hoặc được chuyển sang các mô hình kém năng lực hơn.
1. Fable 5.1 Hướng Đến Công Việc Tác Tử Dài Hạn
Fable 5.1 kế nhiệm Fable 5, mẫu mà Anthropic giới thiệu vào ngày 9 tháng 6 năm 2026 cho các tác vụ phức tạp có thể chạy bất đồng bộ trong nhiều ngày. Mô hình mới vẫn giữ trọng tâm đó nhưng cải thiện hiệu năng về lập trình, sử dụng máy tính, nghiên cứu khoa học, quy trình kinh doanh và suy luận liên ngành.
Định danh mô hình API là claude-fable-5-1. Mô hình nhận văn bản và hình ảnh, tạo ra văn bản, với cửa sổ ngữ cảnh một triệu token và đầu ra tối đa 128,000 token. Tư duy thích ứng luôn được bật, còn các mốc giới hạn kiến thức đáng tin cậy và dữ liệu huấn luyện được công bố là tháng 6 năm 2026.
Anthropic mô tả Fable 5.1 là lựa chọn cho các tác tử suy luận khắt khe và dài hạn, thay vì lựa chọn mặc định cho mọi ứng dụng. Hướng dẫn chọn mô hình của hãng khuyến nghị bắt đầu hầu hết khối lượng công việc bằng Claude Opus 5 rẻ hơn và chuyển sang Fable 5.1 khi các đánh giá ở mức nỗ lực Opus cao hơn vẫn chưa đủ.
Mô hình được cung cấp qua các gói Claude Pro, Max, Team và Enterprise. Nhà phát triển có thể truy cập qua Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud và Microsoft Foundry. Anthropic cũng cung cấp suy luận chỉ tại Mỹ với mức giá đầu vào và đầu ra bằng 1.1 lần giá tiêu chuẩn.
Fable 5.1 mặc định dùng mức nỗ lực cao trong Claude Code nhưng mức nỗ lực trung bình trong Claude Cowork và Claude.ai. Anthropic cho biết các thiết lập nỗ lực thấp hơn có thể tiệm cận hoặc vượt hiệu năng của Fable 5 với chi phí thấp hơn, mang lại cho nhà phát triển thêm một cơ chế kiểm soát độ trễ và mức tiêu thụ token.
2. Anthropic Báo Cáo Cải Thiện Trên Diện Rộng Ở Các Benchmark
Các đánh giá được Anthropic công bố cho thấy Fable 5.1 cải thiện so với Fable 5 trên mọi benchmark trong phần so sánh ra mắt của hãng. Đây là các kết quả do nhà cung cấp tự báo cáo, và một số sử dụng các bài kiểm tra mới được chỉnh sửa hoặc cấu hình đánh giá riêng của Anthropic.
Trên Terminal-Bench-Science 0.1, benchmark đo lường công việc khoa học mang tính tác tử trong môi trường terminal, Fable 5.1 đạt 52.6%, so với 24.7% của Fable 5, 29.0% của Opus 5 và 22.4% của GPT-5.6 Sol. Anthropic báo cáo sai số chuẩn từ 3.5 đến 4.5 điểm phần trăm cho mỗi mô hình.
Fable 5.1 đạt 55.8% trên Terminal-Bench 4.0 dành cho lập trình tác tử. Mythos 5.1 đạt 60.9% trên cùng bài kiểm tra, trong khi Fable 5 đạt 42.0%, Opus 5 đạt 52.3% và GPT-5.6 Sol đạt 37.3%. Vì Fable và Mythos dùng cùng mô hình nền tảng, Anthropic quy khoảng cách giữa kết quả của chúng cho các tác vụ mà biện pháp bảo vệ bảo mật của Fable đã can thiệp.
Trên CursorBench 3.2.0, Fable 5.1 đạt 73.4%, vượt Fable 5 với 70.5%, Opus 5 với 70.0% và GPT-5.6 Sol với 67.2%. Điểm AutomationBench của mô hình tăng lên 31.4%, từ 17.1% của Fable 5. Mô hình cũng đạt 65.0% trên Humanity’s Last Exam khi bật công cụ, so với 63.8% của Fable 5 và 63.6% của Opus 5.
Anthropic đánh giá Fable 5.1 khi các biện pháp bảo vệ sản xuất của hãng đang hoạt động. Hãng ghi nhận 0 điểm ở một số tác vụ OSWorld khi các biện pháp bảo vệ đó can thiệp, trong khi một số tác vụ an ninh mạng và sinh học bị gắn cờ khác được hoàn thành bởi các mô hình Opus dự phòng. Vì vậy, công ty lưu ý rằng kết quả công bố phản ánh cả mô hình nền tảng lẫn hệ thống định tuyến đang triển khai.
3. Fable và Mythos Chia Sẻ Năng Lực Nhưng Không Chia Sẻ Quyền Truy Cập
Claude Mythos 5.1 không phải là mô hình cơ sở mạnh hơn Fable 5.1. Anthropic cho biết hai mô hình giống hệt nhau ở cấp độ mô hình; điểm khác biệt là Mythos áp dụng các biện pháp bảo vệ cởi mở hơn cho những tổ chức đã được thẩm định mà công việc chuyên môn của họ lẽ ra sẽ kích hoạt các hạn chế của Fable.
Mythos 5.1 có cùng cửa sổ ngữ cảnh một triệu token, đầu ra tối đa 128,000 token, tư duy thích ứng và mức giá $10 cho mỗi triệu token đầu vào cùng $50 cho mỗi triệu token đầu ra. Định danh API của nó là claude-mythos-5-1, nhưng quyền truy cập chỉ dành cho người được mời và hiện giới hạn ở các tổ chức Mỹ được chọn.
Quyền truy cập khoa học sự sống đang được tổ chức thông qua Life Sciences Verification Program, được phát triển cùng chính phủ Mỹ. Anthropic đã tiếp nhận một nhóm ban đầu và cho biết đang lên kế hoạch mở rộng việc tiếp nhận. Chương trình nới lỏng các hạn chế sinh học cho nghiên cứu và phát triển được phê duyệt, đồng thời duy trì các biện pháp bảo vệ khác của mô hình.
Cyber Verification Program hiện cho các bên phòng thủ đủ điều kiện quyền truy cập vào một số mô hình thuộc lớp Opus và Sonnet với các hạn chế an ninh mạng được giảm bớt. Anthropic cho biết quyền truy cập lớp Mythos sẽ được bổ sung trong tương lai gần. Claude Security, sản phẩm quét codebase của công ty, đã chạy trên Mythos 5.1.
Việc triển khai hai tầng này cho phép Anthropic phân phối rộng rãi năng lực lập trình và suy luận tổng quát của mô hình, đồng thời giữ các năng lực an ninh mạng và sinh học ít bị hạn chế nhất phía sau bước xác minh tổ chức. Điều đó cũng có nghĩa là kết quả benchmark của Mythos không thể tự động được coi là kết quả sẵn có cho người dùng Fable thông thường.
4. Các Biện Pháp Bảo Vệ Hiện Tạo Ra Ít Dương Tính Giả Hơn
Fable 5 đã giới thiệu các bộ phân loại hạn chế bất thường cho sinh học và an ninh mạng. Khi một yêu cầu kích hoạt chúng, Claude có thể chuyển sang mô hình Opus thay vì hoàn thành tác vụ bằng Fable. Anthropic thừa nhận rằng cách triển khai ban đầu đã chặn nhiều yêu cầu lành tính về y tế, giáo dục và bảo mật phòng thủ.
Các biện pháp bảo vệ sinh học được cập nhật can thiệp ít hơn khoảng 85% đối với các prompt sinh học cơ bản và y tế lành tính so với những bộ phân loại được phát hành cùng Fable 5. Vì thế, các câu hỏi sức khỏe thường ngày, hỗ trợ lâm sàng và giáo dục sinh học sẽ gặp ít lần thay thế mô hình hơn. Nghiên cứu liên quan đến những lĩnh vực như virus học, độc chất học hoặc thiết kế phân tử vẫn có thể được chuyển sang Opus trừ khi người dùng đủ điều kiện truy cập Mythos.
Trong an ninh mạng, người dùng Claude Code dự kiến sẽ gặp ít hơn khoảng 60% số lần can thiệp của biện pháp bảo vệ trong mỗi phiên. Fable 5.1 có thể kiểm tra mã nguồn để xác định lỗ hổng, nhưng vẫn chuyển hướng kiểm thử xâm nhập, phát triển mã khai thác và quét lỗ hổng dựa trên tệp nhị phân.
Axios đã đưa tin độc lập rằng các can thiệp này đã trở thành một mối lo ngại thực tế của khách hàng, khi một số nhà phát triển tìm cách giảm phụ thuộc vào Claude vì công việc hợp pháp bị gián đoạn. Do đó, các thay đổi tác động nhiều hơn tỷ lệ từ chối: ít phương án dự phòng bất ngờ hơn sẽ giúp hành vi của tác tử lập trình và ước tính chi phí dễ dự đoán hơn.
Anthropic cũng đã bổ sung các hạn chế chống chưng cất. Các tài khoản API mới không còn có thể chỉnh sửa ngữ cảnh trước đó của Claude trong khi vẫn giữ lại bản ghi tư duy trước đó của mô hình. Các tài khoản hiện tại ban đầu được miễn trừ, nhưng Anthropic cho biết hạn chế này sẽ áp dụng cho mọi người dùng với các bản phát hành mô hình trong tương lai, có khả năng yêu cầu thay đổi ở các tích hợp viết lại lịch sử hội thoại.
5. Giá Cache và Kiểm Soát Dữ Liệu Doanh Nghiệp Thay Đổi Kinh Tế Triển Khai
Mức giá đầu vào và đầu ra tiêu chuẩn không giảm, nhưng việc đọc cache đặc biệt quan trọng với các tác tử thường xuyên tái sử dụng hướng dẫn dài, ngữ cảnh kho mã, kết quả công cụ hoặc lịch sử tác vụ tích lũy. Việc giảm giá đó xuống $0.25 cho mỗi triệu token đem lại lợi ích không tương xứng cho các phiên dài, trong đó ngữ cảnh được cache chiếm phần lớn mức tiêu thụ token.
Anthropic đã tính toán các ước tính tiết kiệm 25% cho khối lượng công việc thông thường và 45% cho khối lượng công việc có tính tác tử cao từ bốn tuần sử dụng thực tế trong tháng 8 năm 2026. Mức tiết kiệm thực tế sẽ phụ thuộc vào tần suất một ứng dụng tái sử dụng ngữ cảnh cache; các khối lượng công việc chủ yếu gồm đầu vào mới hoặc đầu ra được tạo sẽ giảm ít hơn.
Lưu giữ dữ liệu vẫn là một ràng buộc triển khai khác. Fable và Mythos mặc định yêu cầu lưu giữ 30 ngày để giám sát an toàn. Anthropic cho biết hoạt động giám sát này nhằm phát hiện các mẫu lạm dụng trải rộng qua nhiều phiên hoặc tài khoản, chứ không nhằm huấn luyện mô hình trên dữ liệu doanh nghiệp khi chưa có sự cho phép.
Một hệ thống Enterprise Frontier Safeguards mới nhằm dung hòa việc giám sát đó với các yêu cầu không lưu giữ dữ liệu. Theo EFS, dữ liệu hoạt động có thể nằm trong hạ tầng đám mây do khách hàng kiểm soát, sử dụng khóa mã hóa, chính sách truy cập và nhật ký kiểm toán của khách hàng. Hoạt động giám sát tự động có thể gắn cờ các mẫu đáng ngờ, trong khi việc đánh giá bởi con người mặc định do khách hàng thực hiện thay vì Anthropic.
EFS được thiết kế cùng hơn 100 tổ chức và dự kiến triển khai theo từng giai đoạn, bắt đầu vào mùa thu năm 2026. Khách hàng đủ điều kiện có thể sử dụng Fable 5 và Fable 5.1 theo điều khoản không lưu giữ dữ liệu cho đến khi hệ thống sẵn có. Anthropic không thu phí riêng cho EFS, mặc dù khách hàng vẫn chịu trách nhiệm về chi phí lưu trữ đám mây và truyền dữ liệu.
Fable 5.1 và Mythos 5.1 cũng giới thiệu tính năng đóng dấu chìm văn bản vô hình để tuân thủ các quy định minh bạch của Liên minh châu Âu dành cho các mô hình phát hành sau ngày 2 tháng 8 năm 2026. Anthropic cho biết dấu chìm này thay đổi tính ngẫu nhiên khi chọn token mà không thêm ký tự ẩn, token bổ sung hoặc dữ liệu nhận dạng người dùng. Việc phát hiện ban đầu được cung cấp qua API xem trước riêng tư cho các tổ chức đủ điều kiện.
Câu hỏi thường gặp
Claude Fable 5.1 có được cung cấp rộng rãi không?
Có. Mô hình có sẵn qua các gói Claude trả phí, Claude API và các nền tảng đám mây được hỗ trợ. Định danh mô hình API là claude-fable-5-1.
Claude Mythos 5.1 có phải là một mô hình khác không?
Không. Anthropic cho biết Fable 5.1 và Mythos 5.1 dùng cùng mô hình nền tảng. Mythos có các biện pháp bảo vệ cởi mở hơn và bị giới hạn cho các tổ chức đã được thẩm định.
Fable 5.1 có giá bao nhiêu qua API?
Giá tiêu chuẩn là $10 cho mỗi triệu token đầu vào và $50 cho mỗi triệu token đầu ra. Đọc cache có giá $0.25 cho mỗi triệu token.
Giới hạn ngữ cảnh và đầu ra là gì?
Fable 5.1 hỗ trợ cửa sổ ngữ cảnh một triệu token và tối đa 128,000 token đầu ra cho mỗi yêu cầu.
Fable 5.1 có thể thực hiện kiểm thử xâm nhập không?
Các biện pháp bảo vệ của nó vẫn chuyển hướng kiểm thử xâm nhập, tạo mã khai thác và quét lỗ hổng dựa trên tệp nhị phân. Mô hình có thể xác định lỗ hổng trong mã nguồn cho mục đích phòng thủ.
Tham khảo nguồn
- Bài đăng thông báo gốc của Mike Krieger trên X
- Anthropic: Giới thiệu Claude Fable 5.1 và Claude Mythos 5.1
- Tài liệu Claude Platform: Claude Fable 5.1
- Anthropic: Chi tiết về sản phẩm và khả dụng của Claude Fable
- Anthropic: Chi tiết về quyền truy cập và biện pháp bảo vệ của Claude Mythos
- Anthropic: Phát triển Enterprise Frontier Safeguards cùng khách hàng
- Anthropic: Cách hoạt động của dấu chìm văn bản Claude
- Axios: Anthropic phát hành các mô hình, cấu trúc chi phí và biện pháp bảo vệ mới
Share