Vũ Nguyễn✔
Writer
Vào ngày 1 tháng 9, theo giờ Mỹ, Anthropic đồng thời phát hành Claude Fable 5.1 và Claude Mythos 5.1. Cả hai mô hình đều sử dụng cùng một kiến trúc nền tảng nhưng có các hạn chế bảo mật khác nhau. Fable 5.1 được cung cấp rộng rãi cho người dùng Pro, Max, Team và Enterprise, và được cung cấp thông qua API của Claude và các nền tảng đám mây lớn. Mythos 5.1 chỉ dành cho một số lượng hạn chế các chuyên gia an ninh mạng và khoa học đời sống thông qua cơ chế xét duyệt, và quyền truy cập hiện tại rất hạn chế.

Giá đầu vào và đầu ra của Fable 5.1 vẫn không thay đổi, nhưng giá đọc bộ nhớ cache thì... giảm 75%. Theo tính toán của Anthropic, tổng chi phí cho một khối lượng công việc điển hình giảm khoảng 25% so với Fable 5, và chi phí cho việc lập trình phức tạp và các tác vụ được xử lý trung gian có thể giảm tới khoảng 45%.
Anthropic cũng đã ra mắt Enterprise Frontier Safeguards ( EFS). Điều này cho phép các doanh nghiệp lưu trữ dữ liệu liên quan trong cơ sở hạ tầng đám mây dưới sự kiểm soát của chính họ. Đối với các khách hàng đủ điều kiện, chế độ không lưu giữ dữ liệu của Fable 5.1 cũng có thể được sử dụng trước khi EFS chính thức ra mắt.
Về khả năng của mô hình, Fable 5.1 đã vượt trội hơn Fable 5 trong các bài kiểm tra bao gồm lập trình, nghiên cứu khoa học, công việc trí thức và tự động hóa kinh doanh. Anthropic cũng đã trình bày các trường hợp sử dụng thực tế từ những khách hàng đầu tiên, bao gồm các tác vụ học máy kéo dài, khắc phục sự cố phần mềm và các tác vụ của trình duyệt.
Kết quả thử nghiệm do chính Anthropic công bố cho thấy rằng, trong Terminal-Bench... Trong bài kiểm tra Khoa học 0.1, Fable 5.1 đạt 52,6%, cao hơn gấp đôi so với GPT-5.6 Sol (22,4%), Fable 5 đạt 24,7% và Opus 5 đạt 29,0%. Bài kiểm tra này đánh giá khả năng của các tác nhân AI trong việc thực hiện các nhiệm vụ nghiên cứu khoa học, yêu cầu mô hình phải hoàn thành công việc nghiên cứu liên tục trong môi trường thiết bị đầu cuối.

Trong Terminal-Bench 4.0, Fable 5.1 đạt 55,8%, cao hơn Fable 5 (42,0%) và Opus 5 (52,3%). Nếu nới lỏng các hạn chế bảo mật, Mythos 5.1, sử dụng cùng một mô hình cơ bản, đã cải thiện điểm số hơn nữa lên 60,9%, trở thành phiên bản đạt điểm cao nhất trong bài kiểm tra này.
Những cải tiến tương tự cũng đã xuất hiện trong các công việc trí thức và các tác vụ tự động hóa kinh doanh. Fable 5.1 trong GDPval-AA v2Nó đạt được 1853 điểm, cao hơn Opus 5 (1824 điểm) và Fable 5 (1723 điểm) trong AutomationBench .Nó đạt được 31,4% trong [chuẩn mực thông thường], 17,1% trong Fable 5 và 26,9% trong Opus 5; và đạt 73,4% trong CursorBench 3.2.0.

Kết quả thử nghiệm này phản ánh những thay đổi cho phép mô hình duy trì hoạt động hiệu quả trong các chuỗi tác vụ dài hơn. Các nghiên cứu trường hợp khách hàng ban đầu của Anthropic minh họa thêm điểm này.
Công ty đầu tư Millennium gặp phải sự cố phần mềm hiếm gặp, xảy ra khoảng một lần mỗi triệu lần chạy. Vấn đề này đã gây khó khăn cho nhóm trong bốn hoặc năm năm, và họ không thể tìm ra nguyên nhân, kể cả với các mô hình đã sử dụng trước đó. Cuối cùng, Fable 5.1 đã phân tích thư viện phần mềm của nhà cung cấp bên ngoài và so sánh kết quả với tệp kết xuất lõi còn lại sau khi hệ thống gặp sự cố, cuối cùng xác định được vấn đề là do lỗi trong thư viện phần mềm.

Bài kiểm tra Ramp là một tác vụ học máy chạy liên tục. Fable 5.1 đã chạy tự động trong 38 giờ, và sau khi xem xét các kết quả trước đó, người ta xác định rằng có lỗi do nhãn gây ra, và sáu thí nghiệm nữa đã được khởi chạy. Sau khi chạy các thí nghiệm qua đêm, mô hình đã trả về các kết quả mới và đề xuất cho các bước tiếp theo.
Một số tác vụ gần gũi hơn với các trường hợp sử dụng thường ngày trong doanh nghiệp. Browserbase đã cho Fable 5.1 thực hiện các tác vụ của trình duyệt, đạt tỷ lệ hoàn thành 82% trong bài kiểm tra khó khăn nhất, cao hơn so với Opus 5 (74%) và Fable 5 (57%). Jane Street Capital cho biết trong các thử nghiệm nội bộ, Fable 5.1 đã giải quyết được nhiều vấn đề lập trình hơn Fable 5 và Opus 5, và kết quả đầu ra của nó vẫn tương đối dễ hiểu ngay cả trong các tác vụ dài, nhiều bước.
Những trường hợp này cho thấy Fable 5.1 cần xử lý nhiều hơn một câu hỏi với một câu trả lời duy nhất. Một tác vụ có thể bắt đầu bằng việc đọc dữ liệu, sau đó tiến hành phân tích mã, gọi công cụ, xác minh thực nghiệm và cuối cùng đánh giá lại kết quả ban đầu để đưa ra kết quả cuối cùng.
Nghiên cứu khoa học là một loại ứng dụng khác mà Anthropic đang giới thiệu.
Trong số đó, thiết kế protein đặc biệt đáng chú ý. Trong phát triển thuốc hiện đại, nhiều loại thuốc cần phải xác định trước các protein có thể liên kết với các mục tiêu cụ thể trong cơ thể người. Anthropic đã sử dụng Mythos 5.1 cùng với các công cụ thiết kế và gấp protein mã nguồn mở để hoàn thành thiết kế, sau đó gửi kết quả mô hình tạo ra cho hai tổ chức bên ngoài để kiểm chứng thực nghiệm.

Trong số 12 mục tiêu, gần 50% các thiết kế được tạo ra bởi Mythos 5.1 cuối cùng đã được xác nhận là chất liên kết hiệu quả. Anthropic cho biết tỷ lệ thành công điển hình trong thiết kế protein hiện nay vào khoảng 10% đến 15%.
Đối với ba trong số các mục tiêu, chất liên kết được thiết kế theo mô hình đã đạt được khả năng liên kết gấp 10 lần so với thiết kế tốt nhất trong cuộc thi thiết kế protein Adaptyv Bio trước đó.
Ý nghĩa của thử nghiệm này nằm ở chỗ mô hình đã thực hiện giai đoạn thiết kế trước khi tiến hành thí nghiệm. Nó có thể tạo ra một sơ đồ dựa trên mục tiêu, sau đó sử dụng các công cụ thiết kế và gấp nếp protein hiện có để tính toán, và cuối cùng cung cấp các kết quả khả thi cho người thực hiện thí nghiệm để kiểm chứng.
Anthropic cũng trình bày một nghiên cứu trường hợp mô hình hóa tính toán. Fable 5.1 đã sử dụng hình ảnh radar được thu thập hơn 30 năm trước bởi sứ mệnh Magellan của NASA, cùng với các bản đồ hiện có bao phủ khoảng một phần năm sao Kim, để huấn luyện một mạng nơ-ron và tái tạo một bản đồ độ cao độ phân giải cao bao phủ khoảng một phần ba sao Kim.


Bản đồ mới hiển thị chi tiết ở tỷ lệ khoảng 2 đến 3 km, so với độ phân giải của bản đồ gốc là khoảng 10 đến 20 km, đồng thời cải thiện độ chính xác đo độ cao lên đến 25%. Anthropic dự định phát hành bản đồ theo giấy phép Creative Commons trước khi bắt đầu công việc tiếp theo cho sứ mệnh VERITAS của NASA và sứ mệnh EnVision của ESA.
Trong sinh học tính toán, Mythos 5.1 tập trung vào hiệu quả tính toán.
Các nhà nghiên cứu thường cần chạy đi chạy lại các mô hình học máy chuyên dụng trên GPU, và tốc độ tính toán ảnh hưởng trực tiếp đến tiến độ thí nghiệm. Mythos 5.1 cải thiện tốc độ suy luận của bảy mô hình học sâu mã nguồn mở lên đến 2,5 lần bằng cách viết các nhân GPU tùy chỉnh và lưu trữ kết quả trung gian, đồng thời duy trì đầu ra nhất quán.

Các mô hình này bao gồm ChromBPNet, Flashzoi, Enformer, Profluent-E1, ProGen2 và Evo2 ở nhiều quy mô khác nhau. Theo ước tính của Anthropic, các mô hình được tối ưu hóa có thể giảm chi phí GPU từ 30% đến 60% trong các phân tích toàn bộ hệ gen.
Anthropic cho biết rằng những tối ưu hóa như vậy thường yêu cầu các nhóm kỹ thuật hiệu năng phải mất nhiều tuần để hoàn thành, trong khi Mythos 5.1 đã đạt được điều này chỉ trong vài ngày, chỉ sử dụng mã nguồn công khai. Kế hoạch tối ưu hóa sẽ được công khai mã nguồn sau này.
Fable 5.1 hiện có sẵn trên tất cả các nền tảng, bao gồm AWS, Google Cloud và Microsoft Azure. Các nhà phát triển cũng có thể gọi claude-fable-5-1 thông qua API của Claude.
Về chiến lược an ninh, Anthropic tập trung vào việc điều chỉnh các hạn chế trong lĩnh vực an ninh mạng và khoa học sự sống.
Về mặt an ninh mạng, Fable 5.1 giờ đây có thể giúp người dùng phát hiện các lỗ hổng phần mềm để phục vụ cho các nỗ lực bảo mật phòng thủ. Anthropic cho biết, so với các biện pháp bảo vệ an ninh mạng được sử dụng trước đây trong Fable 5, cơ chế bảo vệ mới này giảm số lần can thiệp trung bình vào Claude Code khoảng 60%.
Lĩnh vực khoa học sự sống tiếp tục áp dụng một phương pháp nghiêm ngặt hơn. Người dùng thông thường tham gia vào các nhiệm vụ nghiên cứu và phát triển khoa học sự sống vẫn sẽ được hướng dẫn sử dụng mô hình Opus, trong khi các chuyên gia có thể đăng ký quyền truy cập vào Mythos 5.1 thông qua Chương trình Thẩm định Khoa học Sự sống. Chương trình này đã hợp tác với chính phủ Hoa Kỳ và đã có những người tham gia đầu tiên.
Mythos 5.1 cũng sẽ được cung cấp cho các chuyên gia an ninh mạng đã được kiểm duyệt thông qua một chương trình xác minh an ninh mạng. Claude Security hiện đã sử dụng Mythos 5.1 để quét mã nguồn tìm lỗ hổng và đề xuất các giải pháp khắc phục để người dùng xem xét.
Đồng thời, Anthropic cũng đã tăng cường các cơ chế bảo mật dữ liệu và an ninh doanh nghiệp của mình.
Tính năng Enterprise Frontier Safeguards (EFS) mới cho phép các doanh nghiệp lưu trữ dữ liệu trong cơ sở hạ tầng đám mây riêng của họ, thay vì trong hệ thống của Anthropic. Theo mặc định, mọi quy trình xem xét thủ công cũng do chính doanh nghiệp xử lý. EFS sẽ được triển khai theo từng giai đoạn bắt đầu từ mùa thu này, và các doanh nghiệp đủ điều kiện có thể sử dụng chế độ không lưu giữ dữ liệu của Fable 5.1 cho đến khi được hỗ trợ đầy đủ.
Anthropic cho biết EFS được phát triển với sự hợp tác của hơn 100 công ty thuộc nhiều lĩnh vực khác nhau, bao gồm tài chính, chăm sóc sức khỏe, sản xuất, viễn thông, pháp luật, bán lẻ và khu vực công.
Dựa trên bản phát hành này, các nâng cấp trong Fable 5.1 tập trung vào một số lĩnh vực rất cụ thể: khả năng xử lý mã mạnh mẽ hơn, độ ổn định cao hơn cho các tác vụ dài, ứng dụng thực tế trong các nhiệm vụ nghiên cứu, chi phí đọc bộ nhớ cache thấp hơn và khả năng kiểm soát dữ liệu rõ ràng hơn cho doanh nghiệp.
Đối với người dùng thông thường, thay đổi trực tiếp nhất có lẽ là mô hình có thể hoàn thành các tác vụ dễ dàng và nhất quán hơn khi xử lý các vấn đề phức tạp; đối với doanh nghiệp, việc giảm chi phí và các cơ chế lưu trữ dữ liệu giúp giảm rào cản sử dụng lâu dài. Anthropic cũng cung cấp các khả năng an ninh mạng và khoa học đời sống được nâng cao cho người dùng chuyên nghiệp đã được kiểm duyệt thông qua Mythos 5.1.
Như vậy, Fable 5.1 đã trở thành một trong những mô hình chính của Anthropic dành cho môi trường sản xuất, trong khi các kịch bản nghiên cứu và chuyên nghiệp có rủi ro cao được đặt riêng trong hệ thống truy cập được kiểm soát của Mythos 5.1.
Anthropic vẫn giữ nguyên mức giá API tiêu chuẩn trước đây của Fable 5: 10 đô la cho mỗi triệu token đầu vào và 50 đô la cho mỗi triệu token đầu ra, mà không trực tiếp giảm giá cơ bản. Tuy nhiên, giá đọc bộ nhớ cache đã giảm từ 1 đô la cho mỗi triệu token xuống còn 0,25 đô la, giảm 75%.

Theo ước tính của Anthropic, dựa trên dữ liệu sử dụng thực tế tính đến tháng 8 năm 2026, tổng chi phí cho một khối lượng công việc điển hình có thể giảm khoảng 25%. Đối với các tác vụ được điều khiển bởi tác nhân (agent) với tỷ lệ đọc bộ nhớ cache cao, mức giảm chi phí thậm chí còn lớn hơn.
Tuy nhiên, các thử nghiệm do tổ chức kiểm thử bên thứ ba Artificial Analysis thực hiện cho thấy rằng việc giảm giá bộ nhớ đệm không nhất thiết có nghĩa là giảm chi phí thực tế cho mỗi tác vụ. Dữ liệu của họ cho thấy rằng ở mức độ suy luận cao nhất, chi phí trung bình để hoàn thành một tác vụ Chỉ số Trí tuệ với Fable 5.1 là 3,76 đô la, cao hơn 20% so với Fable 5. Lý do chính là Fable 5.1 sử dụng số lượng token đầu ra nhiều hơn khoảng 1,7 lần so với Fable 5.
Việc giảm giá dịch vụ bộ nhớ đệm vẫn mang lại khoản tiết kiệm chi phí đáng kể. Phân tích nhân tạo ước tính rằng việc giảm giá dịch vụ đọc bộ nhớ đệm giúp tiết kiệm trung bình khoảng 1,40 đô la cho mỗi tác vụ. Sự thay đổi này chủ yếu được phản ánh trong quá trình thử nghiệm tác nhân, vì các tác vụ này liên tục đọc lại ngữ cảnh đã được xử lý trước đó.
Nếu cường độ suy luận được điều chỉnh từ mức cao nhất xuống mức rất cao, Fable 5.1 đạt điểm Chỉ số Thông minh là 65, và chi phí cho mỗi tác vụ giảm xuống còn 2,72 đô la, thấp hơn 1,04 đô la so với cường độ cao nhất. Tuy nhiên, chi phí này vẫn cao hơn mức 2,34 đô la của Opus 5 ở cường độ suy luận cao nhất.
Do đó, những thay đổi về chi phí trong Fable 5.1 không chỉ đơn thuần là "giảm giá". Anthropic đã giảm chi phí đọc bộ nhớ cache, nhưng mô hình tiêu thụ nhiều token đầu ra hơn trong các tác vụ phức tạp, và cuối cùng chi phí cho mỗi tác vụ phụ thuộc vào phương thức gọi cụ thể và cường độ suy luận.
Hơn nữa, Fable 5.1 hỗ trợ xử lý theo lô. Đối với các tác vụ bất đồng bộ, giá đầu vào và đầu ra có thể được giảm xuống còn 5 đô la và 25 đô la cho mỗi triệu token tương ứng. Hệ số nhân giá cho suy luận chuyên dụng tại Hoa Kỳ là 1,1x, tìm kiếm trên web có giá 10 đô la cho mỗi 1000 lượt tìm kiếm, và việc thu thập dữ liệu web không bị tính phí riêng.

Anthropic cũng cung cấp bảng so sánh giá giữa các mẫu khác nhau. Opus 5 có giá 5 đô la cho đầu vào và 25 đô la cho đầu ra, với chi phí đọc bộ nhớ đệm là 0,50 đô la; Sonnet 5 có giá lần lượt là 2 đô la, 10 đô la và 0,20 đô la.
Giá đầu vào và đầu ra thông thường của Fable 5.1 vẫn cao hơn hai mẫu kia, nhưng giá đọc bộ nhớ cache của nó thấp hơn Opus 5, chỉ cao hơn Sonnet 5 0,05 đô la.

Giá đầu vào và đầu ra của Fable 5.1 vẫn không thay đổi, nhưng giá đọc bộ nhớ cache thì... giảm 75%. Theo tính toán của Anthropic, tổng chi phí cho một khối lượng công việc điển hình giảm khoảng 25% so với Fable 5, và chi phí cho việc lập trình phức tạp và các tác vụ được xử lý trung gian có thể giảm tới khoảng 45%.
Anthropic cũng đã ra mắt Enterprise Frontier Safeguards ( EFS). Điều này cho phép các doanh nghiệp lưu trữ dữ liệu liên quan trong cơ sở hạ tầng đám mây dưới sự kiểm soát của chính họ. Đối với các khách hàng đủ điều kiện, chế độ không lưu giữ dữ liệu của Fable 5.1 cũng có thể được sử dụng trước khi EFS chính thức ra mắt.
Về khả năng của mô hình, Fable 5.1 đã vượt trội hơn Fable 5 trong các bài kiểm tra bao gồm lập trình, nghiên cứu khoa học, công việc trí thức và tự động hóa kinh doanh. Anthropic cũng đã trình bày các trường hợp sử dụng thực tế từ những khách hàng đầu tiên, bao gồm các tác vụ học máy kéo dài, khắc phục sự cố phần mềm và các tác vụ của trình duyệt.
Một thử nghiệm của tác nhân nghiên cứu cho thấy điểm số cao hơn 2,3 lần so với GPT-5.6 Sol.
Anthropic đã thay đổi đáng kể cách tiếp cận của mình đối với Fable 5.1: mô hình giờ đây được yêu cầu tự xử lý các tác vụ dài hơn, phức tạp hơn, đồng thời liên tục kiểm tra kết quả, gọi các công cụ và điều chỉnh đường dẫn trong quá trình thực thi.Kết quả thử nghiệm do chính Anthropic công bố cho thấy rằng, trong Terminal-Bench... Trong bài kiểm tra Khoa học 0.1, Fable 5.1 đạt 52,6%, cao hơn gấp đôi so với GPT-5.6 Sol (22,4%), Fable 5 đạt 24,7% và Opus 5 đạt 29,0%. Bài kiểm tra này đánh giá khả năng của các tác nhân AI trong việc thực hiện các nhiệm vụ nghiên cứu khoa học, yêu cầu mô hình phải hoàn thành công việc nghiên cứu liên tục trong môi trường thiết bị đầu cuối.

Trong Terminal-Bench 4.0, Fable 5.1 đạt 55,8%, cao hơn Fable 5 (42,0%) và Opus 5 (52,3%). Nếu nới lỏng các hạn chế bảo mật, Mythos 5.1, sử dụng cùng một mô hình cơ bản, đã cải thiện điểm số hơn nữa lên 60,9%, trở thành phiên bản đạt điểm cao nhất trong bài kiểm tra này.
Những cải tiến tương tự cũng đã xuất hiện trong các công việc trí thức và các tác vụ tự động hóa kinh doanh. Fable 5.1 trong GDPval-AA v2Nó đạt được 1853 điểm, cao hơn Opus 5 (1824 điểm) và Fable 5 (1723 điểm) trong AutomationBench .Nó đạt được 31,4% trong [chuẩn mực thông thường], 17,1% trong Fable 5 và 26,9% trong Opus 5; và đạt 73,4% trong CursorBench 3.2.0.

Kết quả thử nghiệm này phản ánh những thay đổi cho phép mô hình duy trì hoạt động hiệu quả trong các chuỗi tác vụ dài hơn. Các nghiên cứu trường hợp khách hàng ban đầu của Anthropic minh họa thêm điểm này.
Công ty đầu tư Millennium gặp phải sự cố phần mềm hiếm gặp, xảy ra khoảng một lần mỗi triệu lần chạy. Vấn đề này đã gây khó khăn cho nhóm trong bốn hoặc năm năm, và họ không thể tìm ra nguyên nhân, kể cả với các mô hình đã sử dụng trước đó. Cuối cùng, Fable 5.1 đã phân tích thư viện phần mềm của nhà cung cấp bên ngoài và so sánh kết quả với tệp kết xuất lõi còn lại sau khi hệ thống gặp sự cố, cuối cùng xác định được vấn đề là do lỗi trong thư viện phần mềm.

Bài kiểm tra Ramp là một tác vụ học máy chạy liên tục. Fable 5.1 đã chạy tự động trong 38 giờ, và sau khi xem xét các kết quả trước đó, người ta xác định rằng có lỗi do nhãn gây ra, và sáu thí nghiệm nữa đã được khởi chạy. Sau khi chạy các thí nghiệm qua đêm, mô hình đã trả về các kết quả mới và đề xuất cho các bước tiếp theo.
Một số tác vụ gần gũi hơn với các trường hợp sử dụng thường ngày trong doanh nghiệp. Browserbase đã cho Fable 5.1 thực hiện các tác vụ của trình duyệt, đạt tỷ lệ hoàn thành 82% trong bài kiểm tra khó khăn nhất, cao hơn so với Opus 5 (74%) và Fable 5 (57%). Jane Street Capital cho biết trong các thử nghiệm nội bộ, Fable 5.1 đã giải quyết được nhiều vấn đề lập trình hơn Fable 5 và Opus 5, và kết quả đầu ra của nó vẫn tương đối dễ hiểu ngay cả trong các tác vụ dài, nhiều bước.
Những trường hợp này cho thấy Fable 5.1 cần xử lý nhiều hơn một câu hỏi với một câu trả lời duy nhất. Một tác vụ có thể bắt đầu bằng việc đọc dữ liệu, sau đó tiến hành phân tích mã, gọi công cụ, xác minh thực nghiệm và cuối cùng đánh giá lại kết quả ban đầu để đưa ra kết quả cuối cùng.
Nghiên cứu khoa học là một loại ứng dụng khác mà Anthropic đang giới thiệu.
Trong số đó, thiết kế protein đặc biệt đáng chú ý. Trong phát triển thuốc hiện đại, nhiều loại thuốc cần phải xác định trước các protein có thể liên kết với các mục tiêu cụ thể trong cơ thể người. Anthropic đã sử dụng Mythos 5.1 cùng với các công cụ thiết kế và gấp protein mã nguồn mở để hoàn thành thiết kế, sau đó gửi kết quả mô hình tạo ra cho hai tổ chức bên ngoài để kiểm chứng thực nghiệm.

Trong số 12 mục tiêu, gần 50% các thiết kế được tạo ra bởi Mythos 5.1 cuối cùng đã được xác nhận là chất liên kết hiệu quả. Anthropic cho biết tỷ lệ thành công điển hình trong thiết kế protein hiện nay vào khoảng 10% đến 15%.
Đối với ba trong số các mục tiêu, chất liên kết được thiết kế theo mô hình đã đạt được khả năng liên kết gấp 10 lần so với thiết kế tốt nhất trong cuộc thi thiết kế protein Adaptyv Bio trước đó.
Ý nghĩa của thử nghiệm này nằm ở chỗ mô hình đã thực hiện giai đoạn thiết kế trước khi tiến hành thí nghiệm. Nó có thể tạo ra một sơ đồ dựa trên mục tiêu, sau đó sử dụng các công cụ thiết kế và gấp nếp protein hiện có để tính toán, và cuối cùng cung cấp các kết quả khả thi cho người thực hiện thí nghiệm để kiểm chứng.
Anthropic cũng trình bày một nghiên cứu trường hợp mô hình hóa tính toán. Fable 5.1 đã sử dụng hình ảnh radar được thu thập hơn 30 năm trước bởi sứ mệnh Magellan của NASA, cùng với các bản đồ hiện có bao phủ khoảng một phần năm sao Kim, để huấn luyện một mạng nơ-ron và tái tạo một bản đồ độ cao độ phân giải cao bao phủ khoảng một phần ba sao Kim.


Bản đồ mới hiển thị chi tiết ở tỷ lệ khoảng 2 đến 3 km, so với độ phân giải của bản đồ gốc là khoảng 10 đến 20 km, đồng thời cải thiện độ chính xác đo độ cao lên đến 25%. Anthropic dự định phát hành bản đồ theo giấy phép Creative Commons trước khi bắt đầu công việc tiếp theo cho sứ mệnh VERITAS của NASA và sứ mệnh EnVision của ESA.
Trong sinh học tính toán, Mythos 5.1 tập trung vào hiệu quả tính toán.
Các nhà nghiên cứu thường cần chạy đi chạy lại các mô hình học máy chuyên dụng trên GPU, và tốc độ tính toán ảnh hưởng trực tiếp đến tiến độ thí nghiệm. Mythos 5.1 cải thiện tốc độ suy luận của bảy mô hình học sâu mã nguồn mở lên đến 2,5 lần bằng cách viết các nhân GPU tùy chỉnh và lưu trữ kết quả trung gian, đồng thời duy trì đầu ra nhất quán.

Các mô hình này bao gồm ChromBPNet, Flashzoi, Enformer, Profluent-E1, ProGen2 và Evo2 ở nhiều quy mô khác nhau. Theo ước tính của Anthropic, các mô hình được tối ưu hóa có thể giảm chi phí GPU từ 30% đến 60% trong các phân tích toàn bộ hệ gen.
Anthropic cho biết rằng những tối ưu hóa như vậy thường yêu cầu các nhóm kỹ thuật hiệu năng phải mất nhiều tuần để hoàn thành, trong khi Mythos 5.1 đã đạt được điều này chỉ trong vài ngày, chỉ sử dụng mã nguồn công khai. Kế hoạch tối ưu hóa sẽ được công khai mã nguồn sau này.
Cùng một mô hình cơ bản, nhưng hai bộ cơ chế bảo mật khác nhau
Mặc dù Fable 5.1 và Mythos 5.1 cùng thuộc một mô hình, nhưng phạm vi ứng dụng của chúng lại khác nhau.Fable 5.1 hiện có sẵn trên tất cả các nền tảng, bao gồm AWS, Google Cloud và Microsoft Azure. Các nhà phát triển cũng có thể gọi claude-fable-5-1 thông qua API của Claude.
Về chiến lược an ninh, Anthropic tập trung vào việc điều chỉnh các hạn chế trong lĩnh vực an ninh mạng và khoa học sự sống.
Về mặt an ninh mạng, Fable 5.1 giờ đây có thể giúp người dùng phát hiện các lỗ hổng phần mềm để phục vụ cho các nỗ lực bảo mật phòng thủ. Anthropic cho biết, so với các biện pháp bảo vệ an ninh mạng được sử dụng trước đây trong Fable 5, cơ chế bảo vệ mới này giảm số lần can thiệp trung bình vào Claude Code khoảng 60%.
Lĩnh vực khoa học sự sống tiếp tục áp dụng một phương pháp nghiêm ngặt hơn. Người dùng thông thường tham gia vào các nhiệm vụ nghiên cứu và phát triển khoa học sự sống vẫn sẽ được hướng dẫn sử dụng mô hình Opus, trong khi các chuyên gia có thể đăng ký quyền truy cập vào Mythos 5.1 thông qua Chương trình Thẩm định Khoa học Sự sống. Chương trình này đã hợp tác với chính phủ Hoa Kỳ và đã có những người tham gia đầu tiên.
Mythos 5.1 cũng sẽ được cung cấp cho các chuyên gia an ninh mạng đã được kiểm duyệt thông qua một chương trình xác minh an ninh mạng. Claude Security hiện đã sử dụng Mythos 5.1 để quét mã nguồn tìm lỗ hổng và đề xuất các giải pháp khắc phục để người dùng xem xét.
Đồng thời, Anthropic cũng đã tăng cường các cơ chế bảo mật dữ liệu và an ninh doanh nghiệp của mình.
Tính năng Enterprise Frontier Safeguards (EFS) mới cho phép các doanh nghiệp lưu trữ dữ liệu trong cơ sở hạ tầng đám mây riêng của họ, thay vì trong hệ thống của Anthropic. Theo mặc định, mọi quy trình xem xét thủ công cũng do chính doanh nghiệp xử lý. EFS sẽ được triển khai theo từng giai đoạn bắt đầu từ mùa thu này, và các doanh nghiệp đủ điều kiện có thể sử dụng chế độ không lưu giữ dữ liệu của Fable 5.1 cho đến khi được hỗ trợ đầy đủ.
Anthropic cho biết EFS được phát triển với sự hợp tác của hơn 100 công ty thuộc nhiều lĩnh vực khác nhau, bao gồm tài chính, chăm sóc sức khỏe, sản xuất, viễn thông, pháp luật, bán lẻ và khu vực công.
Dựa trên bản phát hành này, các nâng cấp trong Fable 5.1 tập trung vào một số lĩnh vực rất cụ thể: khả năng xử lý mã mạnh mẽ hơn, độ ổn định cao hơn cho các tác vụ dài, ứng dụng thực tế trong các nhiệm vụ nghiên cứu, chi phí đọc bộ nhớ cache thấp hơn và khả năng kiểm soát dữ liệu rõ ràng hơn cho doanh nghiệp.
Đối với người dùng thông thường, thay đổi trực tiếp nhất có lẽ là mô hình có thể hoàn thành các tác vụ dễ dàng và nhất quán hơn khi xử lý các vấn đề phức tạp; đối với doanh nghiệp, việc giảm chi phí và các cơ chế lưu trữ dữ liệu giúp giảm rào cản sử dụng lâu dài. Anthropic cũng cung cấp các khả năng an ninh mạng và khoa học đời sống được nâng cao cho người dùng chuyên nghiệp đã được kiểm duyệt thông qua Mythos 5.1.
Như vậy, Fable 5.1 đã trở thành một trong những mô hình chính của Anthropic dành cho môi trường sản xuất, trong khi các kịch bản nghiên cứu và chuyên nghiệp có rủi ro cao được đặt riêng trong hệ thống truy cập được kiểm soát của Mythos 5.1.
Giá Cache đã giảm 75%.
Bản cập nhật Fable 5.1 này không chỉ điều chỉnh khả năng của mô hình và cơ chế bảo mật mà còn cả chi phí sử dụng.Anthropic vẫn giữ nguyên mức giá API tiêu chuẩn trước đây của Fable 5: 10 đô la cho mỗi triệu token đầu vào và 50 đô la cho mỗi triệu token đầu ra, mà không trực tiếp giảm giá cơ bản. Tuy nhiên, giá đọc bộ nhớ cache đã giảm từ 1 đô la cho mỗi triệu token xuống còn 0,25 đô la, giảm 75%.

Theo ước tính của Anthropic, dựa trên dữ liệu sử dụng thực tế tính đến tháng 8 năm 2026, tổng chi phí cho một khối lượng công việc điển hình có thể giảm khoảng 25%. Đối với các tác vụ được điều khiển bởi tác nhân (agent) với tỷ lệ đọc bộ nhớ cache cao, mức giảm chi phí thậm chí còn lớn hơn.
Tuy nhiên, các thử nghiệm do tổ chức kiểm thử bên thứ ba Artificial Analysis thực hiện cho thấy rằng việc giảm giá bộ nhớ đệm không nhất thiết có nghĩa là giảm chi phí thực tế cho mỗi tác vụ. Dữ liệu của họ cho thấy rằng ở mức độ suy luận cao nhất, chi phí trung bình để hoàn thành một tác vụ Chỉ số Trí tuệ với Fable 5.1 là 3,76 đô la, cao hơn 20% so với Fable 5. Lý do chính là Fable 5.1 sử dụng số lượng token đầu ra nhiều hơn khoảng 1,7 lần so với Fable 5.
Việc giảm giá dịch vụ bộ nhớ đệm vẫn mang lại khoản tiết kiệm chi phí đáng kể. Phân tích nhân tạo ước tính rằng việc giảm giá dịch vụ đọc bộ nhớ đệm giúp tiết kiệm trung bình khoảng 1,40 đô la cho mỗi tác vụ. Sự thay đổi này chủ yếu được phản ánh trong quá trình thử nghiệm tác nhân, vì các tác vụ này liên tục đọc lại ngữ cảnh đã được xử lý trước đó.
Nếu cường độ suy luận được điều chỉnh từ mức cao nhất xuống mức rất cao, Fable 5.1 đạt điểm Chỉ số Thông minh là 65, và chi phí cho mỗi tác vụ giảm xuống còn 2,72 đô la, thấp hơn 1,04 đô la so với cường độ cao nhất. Tuy nhiên, chi phí này vẫn cao hơn mức 2,34 đô la của Opus 5 ở cường độ suy luận cao nhất.
Do đó, những thay đổi về chi phí trong Fable 5.1 không chỉ đơn thuần là "giảm giá". Anthropic đã giảm chi phí đọc bộ nhớ cache, nhưng mô hình tiêu thụ nhiều token đầu ra hơn trong các tác vụ phức tạp, và cuối cùng chi phí cho mỗi tác vụ phụ thuộc vào phương thức gọi cụ thể và cường độ suy luận.
Hơn nữa, Fable 5.1 hỗ trợ xử lý theo lô. Đối với các tác vụ bất đồng bộ, giá đầu vào và đầu ra có thể được giảm xuống còn 5 đô la và 25 đô la cho mỗi triệu token tương ứng. Hệ số nhân giá cho suy luận chuyên dụng tại Hoa Kỳ là 1,1x, tìm kiếm trên web có giá 10 đô la cho mỗi 1000 lượt tìm kiếm, và việc thu thập dữ liệu web không bị tính phí riêng.

Anthropic cũng cung cấp bảng so sánh giá giữa các mẫu khác nhau. Opus 5 có giá 5 đô la cho đầu vào và 25 đô la cho đầu ra, với chi phí đọc bộ nhớ đệm là 0,50 đô la; Sonnet 5 có giá lần lượt là 2 đô la, 10 đô la và 0,20 đô la.
Giá đầu vào và đầu ra thông thường của Fable 5.1 vẫn cao hơn hai mẫu kia, nhưng giá đọc bộ nhớ cache của nó thấp hơn Opus 5, chỉ cao hơn Sonnet 5 0,05 đô la.