BTC $79,721.63 +0.31%
ETH $2,458.77 +0.13%
BNB $766.65 +6.97%
XRP $1.41 +0.92%
SOL $102.75 +1.19%
TRX $0.3338 +1.19%
DOGE $0.0878 +3.85%
ADA $0.2174 +1.73%
BCH $249.89 -0.39%
LINK $11.92 +2.10%
HYPE $85.48 +1.17%
AAVE $131.81 +0.39%
SUI $0.7967 +6.42%
XLM $0.1843 +2.96%
ZEC $1,018.20 +3.48%
BTC $79,721.63 +0.31%
ETH $2,458.77 +0.13%
BNB $766.65 +6.97%
XRP $1.41 +0.92%
SOL $102.75 +1.19%
TRX $0.3338 +1.19%
DOGE $0.0878 +3.85%
ADA $0.2174 +1.73%
BCH $249.89 -0.39%
LINK $11.92 +2.10%
HYPE $85.48 +1.17%
AAVE $131.81 +0.39%
SUI $0.7967 +6.42%
XLM $0.1843 +2.96%
ZEC $1,018.20 +3.48%

Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Quan điểm cốt lõi
Summary: Anthropic ra mắt mô hình thế hệ mới Claude Fable 5.1 và Claude Mythos 5.1.
Đề xuất đọc thêm
2026-09-02 09:28:23
Anthropic ra mắt mô hình thế hệ mới Claude Fable 5.1 và Claude Mythos 5.1.

Gốc Theo dõi AI của Máy móc Tâm
Vừa mới đây, Anthropic đã ra mắt mô hình thế hệ mới Claude Fable 5.1 và Claude Mythos 5.1.

Anthropic cho biết Claude Fable 5.1 là một trong những mô hình mạnh nhất hiện có công khai, được thiết kế cho suy luận phức tạp, nhiệm vụ dài hạn và quy trình làm việc của Agent. Trong khi đó, Claude Mythos 5.1 đại diện cho ranh giới khả năng cao hơn mà họ đang khám phá.

Cần lưu ý rằng, mặc dù cả hai đều chia sẻ khả năng mô hình cơ bản giống nhau, nhưng đã áp dụng các biện pháp an toàn khác nhau cho các tình huống sử dụng khác nhau.

Trong đó, Fable 5.1 mở cho người dùng thông thường, nhà phát triển và doanh nghiệp, trong khi Mythos 5.1 hướng đến các đối tác trong lĩnh vực rủi ro cao đã được phê duyệt, duy trì kiểm soát truy cập nghiêm ngặt hơn.

Nói cách khác, một cái chịu trách nhiệm cho công việc trong thế giới thực, cái còn lại thì được giữ lại trong môi trường kiểm soát nghiêm ngặt hơn. Và có lẽ đây cũng là một cuộc khám phá của Anthropic về hình thức sản phẩm AI trong tương lai: mô hình mạnh nhất, không nhất thiết phải được cung cấp cho tất cả mọi người dưới cùng một hình thức.

Chính thức cho biết, hai mô hình này đại diện cho một bước tiến quan trọng trong khả năng của dòng sản phẩm Claude, và cho thấy cách họ tiếp tục thúc đẩy việc triển khai an toàn trong khi nâng cao khả năng của mô hình. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Là mô hình "mạnh nhất thế giới", Fable 5.1 vẫn thể hiện hiệu suất ấn tượng, dữ liệu chính thức cho thấy, Fable 5.1 vượt trội hơn thế hệ flagship trước đó là Fable 5 trong nhiều bài kiểm tra chuẩn. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Nhưng khả năng mạnh hơn, giá cả lại rẻ hơn. Anthropic cho biết, Fable 5.1 giữ nguyên giá cơ bản, chi phí đọc bộ nhớ giảm 75% so với Fable 5. Trong thực tế sử dụng, điều này làm giảm tổng chi phí của mô hình cho khối lượng công việc điển hình khoảng 25%; đối với khối lượng công việc có tính chất Agent cao, chi phí có thể giảm tới 45%. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Có vẻ như ngay cả mô hình mạnh nhất cũng đang chú trọng đến tỷ lệ giá trị.

Dưới đây hãy xem chi tiết.

Mức thấp ngang bằng thế hệ trước, Fable 5.1 chủ yếu nhấn mạnh "tỷ lệ giá trị"

So với việc chỉ đơn thuần làm mới bảng xếp hạng, Anthropic lần này muốn nhấn mạnh rằng: Fable 5.1 có thể hoàn thành các nhiệm vụ trước đây chỉ có thể thực hiện ở mức cao của Fable 5 với chi phí suy luận thấp hơn.

Theo thử nghiệm chính thức, Fable 5.1 đã có thể đạt được hiệu suất gần như hoặc vượt qua Fable 5 ở cường độ suy luận thấp và trung bình. Claude Code mặc định sử dụng cường độ suy luận cao, Claude Cowork và Claude . ai thì mặc định sử dụng cường độ trung bình, người dùng cũng có thể điều chỉnh giữa tốc độ, chi phí và hiệu quả tùy theo độ phức tạp của nhiệm vụ.

Cụ thể, Fable 5.1 đạt được 52.6% trong bài kiểm tra chuẩn Terminal - Bench - Science 0.1, tăng hơn gấp đôi so với 24.7% của Fable 5; trong Terminal - Bench 4.0, Fable 5.1 đạt 55.8%, Mythos 5.1 mở rộng khả năng hơn nữa đạt 60.9%.

Trong các bài kiểm tra về công việc tri thức, thao tác máy tính và quy trình kinh doanh, mô hình mới cũng đạt được sự cải thiện. Điểm AutomationBench từ 17.1% của Fable 5 tăng lên 31.4%, CursorBench 3.2.0 từ 70.5% tăng lên 73.4%. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Trong nhiều bài kiểm tra chuẩn, điểm số của Fable 5.1 đều vượt qua Fable 5, khả năng của Agent nghiên cứu khoa học và quy trình làm việc thương mại được cải thiện rõ rệt nhất. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Trong bài kiểm tra Terminal - Bench 4.0, Fable 5.1 và Mythos 5.1 đều vượt qua thế hệ trước Mythos 5 ở các cường độ suy luận khác nhau. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Trong bài kiểm tra Terminal - Bench - Science 0.1, Fable 5.1 đạt điểm cao nhất là 52.6%, gấp đôi Fable 5.

Anthropic cho rằng, một thay đổi quan trọng của Fable 5.1 là nó sẵn sàng theo dõi nguyên nhân gốc rễ của vấn đề, và cũng phù hợp hơn để thực hiện các nhiệm vụ phức tạp kéo dài hàng giờ hoặc thậm chí hàng chục giờ.

Công ty đầu tư Millennium trong thử nghiệm đã phát hiện ra rằng một đoạn mã nội bộ sẽ bị sập khoảng một lần cho mỗi triệu lần chạy. Vấn đề này đã làm phiền đội ngũ kỹ sư trong bốn đến năm năm, các mô hình khác cũng không tìm ra nguyên nhân. Fable 5.1 đã xác định vấn đề bằng cách giải mã thư viện chương trình của nhà cung cấp bên ngoài, so sánh các tệp dump lõi, cuối cùng xác định vấn đề nằm ở một Bug trong thư viện chương trình bên thứ ba.

Ramp cũng đã để Fable 5.1 chạy liên tục trong 38 giờ. Mô hình đã tự động sửa chữa vấn đề khi phát hiện kết quả học máy ban đầu bị ảnh hưởng bởi lỗi nhãn, và khởi động đồng thời sáu nhóm thí nghiệm, cuối cùng tổng hợp ra kết quả mới và các đề xuất tiếp theo.

Từ viết mã đến nghiên cứu khoa học

Trong lần phát hành này, Anthropic đã dành một phần lớn để giới thiệu hiệu suất của Fable 5.1 và Mythos 5.1 trong nghiên cứu khoa học.

Trong thí nghiệm thiết kế protein, các nhà nghiên cứu đã để Mythos 5.1 gọi các công cụ thiết kế và gấp protein mã nguồn mở, sau đó giao thiết kế được tạo ra cho hai tổ chức bên ngoài để xác minh thí nghiệm.

Trên ba protein mục tiêu, độ gắn kết của các tác nhân mà Mythos 5.1 thiết kế đạt được gấp 10 lần so với giải pháp tốt nhất trong cuộc thi thiết kế protein liên quan của Adaptyv Bio. Đối mặt với 12 protein mục tiêu, tỷ lệ phát hiện tác nhân gắn kết hiệu quả mà mô hình thiết kế gần 50%, trong khi mức độ phổ biến trong ngành mà Anthropic đưa ra là từ 10% đến 15%.

Fable 5.1 còn sử dụng hình ảnh radar được thu thập bởi tàu vũ trụ Magellan của NASA cách đây hơn 30 năm để tạo ra một bản đồ độ cao mới với độ phân giải cao cho khoảng một phần ba bề mặt của hành tinh Venus. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Hình ảnh radar của hành tinh Venus được chụp bởi tàu vũ trụ Magellan của NASA, ở giữa là một ngọn núi lửa hình khiên nhỏ có đường kính khoảng 15 km.

Bản đồ ban đầu chỉ có thể hiển thị chi tiết ở quy mô từ 10 đến 20 km, bản đồ mới đã nâng cao khả năng phân giải lên 2 đến 3 km, độ chính xác đo cao nhất có thể tăng 25%. Anthropic dự định công khai bản đồ này theo giấy phép chia sẻ kiến thức, để các nhiệm vụ tiếp theo như NASA VERITAS và Cơ quan Vũ trụ Châu Âu EnVision tham khảo.

Trong lĩnh vực sinh học tính toán, Mythos 5.1 đã tăng tốc độ chạy của 7 mô hình học sâu protein và gen mã nguồn mở lên tới 2.5 lần bằng cách viết các lõi GPU tùy chỉnh và lưu trữ kết quả trung gian, đồng thời giữ cho kết quả đầu ra nhất quán. Trong một số nhiệm vụ phân tích toàn bộ gen, dự kiến có thể giảm chi phí GPU từ 30% đến 60%. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Mythos 5.1 đã tối ưu hóa 7 mô hình protein và gen mã nguồn mở, tốc độ suy luận tăng từ 1.4 đến 2.5 lần.

Anthropic muốn thông qua những trường hợp này để chứng minh rằng mô hình đang từ việc sắp xếp tài liệu, viết mã, tiến xa hơn đến việc đề xuất giải pháp, vận hành công cụ và cung cấp kết quả nghiên cứu có thể được xác minh qua thí nghiệm.

Giá bộ nhớ giảm 75%, nhiệm vụ Agent giảm tối đa 45%

Ngoài hiệu suất, giá cả là một thay đổi trực tiếp nhất của Fable 5.1.

Giá đầu vào và đầu ra của Fable 5.1 không thay đổi, vẫn là 10 đô la cho mỗi triệu Token và 50 đô la, nhưng giá đọc bộ nhớ đã giảm 75% so với mức ban đầu, xuống còn 0.25 đô la cho mỗi triệu Token.

Đọc bộ nhớ đề cập đến việc mô hình sử dụng lại ngữ cảnh đã được xử lý. Tỷ lệ trong các câu hỏi thông thường có thể hạn chế, nhưng trong các nhiệm vụ Agent cần đọc lại thư viện mã, cuộc trò chuyện lịch sử và kết quả công cụ nhiều lần, bộ nhớ thường tạo thành chi phí chính.

Theo tính toán của Anthropic về dữ liệu sử dụng thực tế vào tháng 8 năm 2026, tổng chi phí cho việc thực hiện nhiệm vụ điển hình của Fable 5.1 thấp hơn khoảng 25% so với Fable 5; đối với các nhiệm vụ Agent phức tạp có ngữ cảnh dài và gọi công cụ thường xuyên, mức giảm chi phí có thể đạt tới khoảng 45%. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Sau khi giá đọc bộ nhớ giảm, chi phí cho nhiệm vụ điển hình của Fable 5.1 giảm khoảng 25%, chi phí cho nhiệm vụ Agent cao nhất giảm tới khoảng 45%.

Fable 5.1 hiện đã có mặt trên Claude . ai, Claude Code và Claude API, đồng thời được cung cấp qua AWS, Google Cloud và Microsoft Azure. Các nhà phát triển có thể gọi mô hình mới thông qua claude - fable -5-1.

Cơ chế chống chưng cất được tăng cường

Fable 5.1 và Mythos 5.1 thực tế sử dụng cùng một mô hình cơ bản, sự khác biệt chính giữa hai mô hình nằm ở các hạn chế an toàn.

Fable 5.1 mở hoàn toàn cho người dùng thông thường và doanh nghiệp; Mythos 5.1 có các hạn chế an ninh mạng và sinh học rộng rãi hơn, hiện chỉ được cung cấp cho các cá nhân và tổ chức đã được phê duyệt.

Trong lĩnh vực an ninh mạng, Fable 5.1 đã có thể giúp người dùng phát hiện lỗ hổng phần mềm, nhưng vẫn không thể trực tiếp tạo ra chương trình khai thác lỗ hổng. Các nhiệm vụ đa mục đích như kiểm tra thâm nhập, tạo chương trình khai thác và quét lỗ hổng dựa trên tệp nhị phân vẫn có thể được chuyển giao cho các mô hình có hạn chế nghiêm ngặt hơn.

Sau khi điều chỉnh, số lần chặn sai của cơ chế bảo vệ an ninh mạng mới giảm khoảng 60% so với Fable 5. Tỷ lệ chặn sai của cơ chế an toàn sinh học đối với các vấn đề sinh học cơ bản và y tế cũng giảm 85%, trong khi khả năng cao cấp liên quan đến phát triển sinh học chủ yếu được mở qua kế hoạch phê duyệt của Mythos 5.1.

Anthropic cũng đã ra mắt Enterprise Frontier Safeguards. Doanh nghiệp có thể lưu trữ dữ liệu trong cơ sở hạ tầng đám mây do mình kiểm soát, do doanh nghiệp chịu trách nhiệm về việc kiểm tra thủ công mặc định, từ đó đạt được hiệu quả bảo mật gần như "không giữ dữ liệu". Cơ chế này dự kiến sẽ được triển khai theo từng giai đoạn bắt đầu từ mùa thu năm nay.

Đối với việc chưng cất mô hình quy mô lớn, Fable 5.1 cũng đã thêm các hạn chế mới. Các tài khoản API được tạo sau ngày hôm đó sẽ không thể sửa đổi ngữ cảnh trước trong các cuộc đối thoại nhiều vòng trong khi vẫn giữ lại hồ sơ suy nghĩ lịch sử của Claude. Anthropic cho biết, thay đổi này chủ yếu nhằm ngăn chặn một phương pháp trích xuất khả năng đã được công khai.

Ngoài ra, để đáp ứng yêu cầu của Luật Trí tuệ nhân tạo của Liên minh Châu Âu, đầu ra văn bản của Fable 5.1 sẽ bao gồm dấu hiệu không thể nhìn thấy. Anthropic cũng bắt đầu thử nghiệm phát hiện API trong quy mô nhỏ, mở đầu tiên cho các cơ quan quản lý, truyền thông, tổ chức kiểm tra sự thật và các tổ chức nghiên cứu.

Cuối cùng, người dùng mạng nói đúng, chim dậy sớm sẽ sớm sử dụng 5.1. Vừa mới, Claude 5.1 đã được phát hành! Mô hình mạnh nhất thế giới đã đến

Join ChainCatcher Official
Telegram Feed: @chaincatcher
X (Twitter): @ChainCatcher_
Thẻ liên quan
warnning Cảnh báo rủi ro
app_icon
ChainCatcher Building the Web3 world with innovations.