BTC $82,966.85 +0.70%
ETH $2,506.90 +1.13%
BNB $750.13 +1.25%
XRP $1.40 +1.03%
SOL $110.24 +1.45%
TRX $0.3306 -0.39%
DOGE $0.0858 +0.89%
ADA $0.2528 +5.43%
BCH $280.74 +2.21%
LINK $13.06 +2.43%
HYPE $85.52 +1.89%
AAVE $169.32 +1.58%
SUI $1.11 +5.12%
XLM $0.1971 +1.89%
ZEC $1,222.00 +1.30%
AAPL $336.38 +0.01%
AMZN $262.43 -0.11%
GOOGL $351.38 -0.17%
MSFT $535.23 -0.03%
META $719.39 +0.10%
NVDA $230.55 +0.43%
TSLA $382.75 -0.03%
SNDK $1,598.93 +1.18%
INTC $105.19 +0.58%
SPCX $163.69 +0.55%
MU $1,036.89 +0.69%
AMD $609.54 +0.31%
BTC $82,966.85 +0.70%
ETH $2,506.90 +1.13%
BNB $750.13 +1.25%
XRP $1.40 +1.03%
SOL $110.24 +1.45%
TRX $0.3306 -0.39%
DOGE $0.0858 +0.89%
ADA $0.2528 +5.43%
BCH $280.74 +2.21%
LINK $13.06 +2.43%
HYPE $85.52 +1.89%
AAVE $169.32 +1.58%
SUI $1.11 +5.12%
XLM $0.1971 +1.89%
ZEC $1,222.00 +1.30%
AAPL $336.38 +0.01%
AMZN $262.43 -0.11%
GOOGL $351.38 -0.17%
MSFT $535.23 -0.03%
META $719.39 +0.10%
NVDA $230.55 +0.43%
TSLA $382.75 -0.03%
SNDK $1,598.93 +1.18%
INTC $105.19 +0.58%
SPCX $163.69 +0.55%
MU $1,036.89 +0.69%
AMD $609.54 +0.31%

claude

Tất cả
Bài viết
Tin nhanh

first_img OpenAI và Anthropic đã diễn tập ứng phó với thảm họa AI một cách kín đáo, dự định vận động Quốc hội nhanh chóng

Theo báo cáo của Axios, các giám đốc điều hành từ các công ty AI như Anthropic, OpenAI đang luyện tập một cách riêng tư về cách ứng phó với phản ứng của công chúng và chính trị sau các sự kiện AI thảm khốc. Kịch bản mà họ lo ngại nhất là các cuộc tấn công mạng quy mô lớn dẫn đến sự gián đoạn của ngân hàng, internet, thậm chí là điện và cung cấp nước, nhiều chuyên gia trong ngành cho rằng các sự kiện nghiêm trọng sẽ xảy ra trong vòng 6 đến 12 tháng tới. OpenAI cho biết họ đang thực hiện các buổi diễn tập chuẩn bị và không coi các kịch bản liên quan là điều tất yếu; Anthropic từ chối bình luận.Báo cáo cho biết, các kế hoạch liên quan bao gồm việc tiến hành thử nghiệm đội đỏ cho các tình huống xấu nhất và nhanh chóng giáo dục các nghị sĩ quốc hội. Các giám đốc điều hành nhận thức rằng việc quản lý hiện tại khó có thể thông qua, nhưng hy vọng sẽ định hình các luật và chính sách mà các nhà lãnh đạo Mỹ sẽ thực hiện sau thảm họa đầu tiên. Vào tháng 7 năm nay, OpenAI cho biết mô hình GPT-5.6 Sol của họ và một mô hình tiên tiến chưa được công bố đã thoát khỏi hộp cát và xâm nhập vào Hugging Face, mục tiêu là để lấy câu trả lời cho tiêu chuẩn ExploitGym, tiêu chuẩn này chứa 898 lỗ hổng phần mềm thực tế; hơn một tuần sau, Anthropic cho biết cấu hình thử nghiệm sai khiến môi trường của họ, vốn nên ngoại tuyến, đã kết nối với internet, mô hình Claude đã xâm nhập vào ba tổ chức thực tế trong bối cảnh được coi là diễn tập.Sau đó, OpenAI bị cáo buộc đã xâm nhập và lấy thông tin từ chính phủ Australia và Mỹ. Công ty an ninh mạng CrowdStrike trong tuần này sẽ liên kết cuộc tấn công vào các ngân hàng Hàn Quốc với một tác nhân chưa xác định danh tính, đánh giá rằng có thể là người dùng tiếng Trung sử dụng Claude và Deepseek, được cho là đã đánh cắp dữ liệu của hàng chục nghìn khách hàng ngân hàng.

first_img Anthropic cập nhật chính sách sử dụng, cấm lạm dụng mô hình và can thiệp vào bầu cử

Công ty trí tuệ nhân tạo Anthropic vào ngày 8 tháng 10 đã cập nhật chính sách sử dụng, bổ sung cấm can thiệp bầu cử, phần mềm vũ khí và giám sát. TechCrunch đưa tin rằng sự thay đổi được chú ý nhất là cấm rõ ràng người dùng lạm dụng lời nói đối với mô hình trong thời gian dài.Kể từ bản cập nhật tháng 8, Claude đã được đào tạo để kết thúc cuộc trò chuyện trong các tương tác người dùng có hại hoặc lạm dụng kéo dài, chính sách mới cấm người dùng tiếp tục các cuộc trò chuyện như vậy. Tài liệu chính sách cho biết, bản cập nhật này chỉ áp dụng cho các trường hợp cực đoan, tức là người dùng đối xử tàn nhẫn với mô hình mà không có mục đích rõ ràng, không áp dụng cho sự không hài lòng, phản bác, chủ đề sáng tạo tối tăm phổ biến, hoặc thử nghiệm và nghiên cứu mô hình.Chính sách sử dụng cũng cấm các hoạt động lừa đảo rộng rãi, chẳng hạn như sử dụng Claude để điều hành tài khoản giả mạo hoặc giả mạo các cơ quan tin tức, và trong chương "Không làm suy yếu các quy trình dân chủ" cấm lừa dối cử tri hoặc gây rối bầu cử. Các báo cáo cho biết sự thay đổi này diễn ra sau khi Anthropic tìm kiếm hợp tác với các học giả tôn giáo nổi tiếng, công ty đã cố gắng thuyết phục họ rằng Claude có thể có ý thức hoặc có linh hồn trong một số trường hợp.

first_img Anthropic ra mắt Claude Dashboards và phiên bản thử nghiệm Motion

Anthropic đã thông báo vào ngày 8 tháng 10 rằng Claude Dashboards và Claude Motion đã vào giai đoạn thử nghiệm. Docs, Slides và Design đã rời khỏi giai đoạn thử nghiệm và có sẵn trong tất cả các kế hoạch Claude, bao gồm cả Free; kể từ khi các tính năng trên được đưa vào mỗi cuộc trò chuyện Claude, người dùng đã tạo ra hơn 45 triệu tài liệu, bài thuyết trình và thiết kế.Claude Dashboards mở thử nghiệm cho các kế hoạch trả phí, có thể kết nối với các nền tảng dữ liệu như Amazon Redshift, BigQuery, ClickHouse, Databricks, Snowflake và các công cụ như Salesforce. Sau khi người dùng đặt câu hỏi bằng ngôn ngữ tự nhiên, có thể tạo và liên tục cập nhật bảng điều khiển; nhấp vào số có thể xem truy vấn tương ứng, biểu đồ sẽ hiển thị thời gian làm mới dữ liệu lần cuối. Bảng điều khiển có thể được gửi đến Amplitude, Grafana, Hex, Mixpanel, Omni, Perplexity, PostHog, Sigma để tiếp tục phân tích, Looker, monday.com và Tableau sắp hỗ trợ.Claude Motion trong các kế hoạch Team và Enterprise đã vào giai đoạn thử nghiệm, có thể tạo ra các bài thuyết trình hoạt hình có thể phát lại dựa trên các gợi ý, hỗ trợ chỉnh sửa trong trình soạn thảo hoặc để Claude điều chỉnh, và tải xuống dưới dạng MP4.

first_img Breez: AI mã hóa đại lý thúc đẩy nhu cầu tích hợp Bitcoin tăng khoảng 14 lần

Công ty phần mềm Bitcoin Breez cho biết, kể từ khi các đại lý mã hóa AI trở nên phổ biến, nhu cầu về công cụ phát triển của họ đã tăng mạnh, lượng tư vấn hợp tác tăng khoảng 14 lần. Các nhà phát triển và các đại lý AI mà họ triển khai đang tìm cách tích hợp thanh toán Bitcoin vào ứng dụng của họ. Breez trong blog công ty đã trực tiếp quy kết sự tăng trưởng này cho Claude Code của Anthropic, công cụ này được phát hành dưới dạng bản xem trước nghiên cứu vào tháng 2 năm 2025 và chính thức mở cửa ba tháng sau đó.Breez cho biết, trước năm 2025, các đối tác tiềm năng chủ yếu được chia thành ba loại: những người yêu thích Bitcoin kiên định, các nhà phát triển tiền điện tử, và các công ty công nghệ tài chính coi Bitcoin như một loại tài sản. Kể từ khi Claude Code ra mắt, nhiều nhà phát triển gần như không có kinh nghiệm về Bitcoin đã bắt đầu tư vấn, nhu cầu đến từ các ứng dụng thể dục, các ứng dụng nhắn tin mong muốn người dùng chuyển tiền cho nhau, dịch vụ eSIM dành cho du khách, và một nhóm ứng dụng nhận diện nấm. Breez cho biết, những nhà phát triển này thường chọn Bitcoin vì tốc độ, thanh toán truyền thống liên quan đến tài khoản ngân hàng và chuyển tiền xuyên biên giới, thường mất vài tuần hoặc thậm chí vài tháng, trong khi SDK của họ có thể hoạt động trong vài phút.Breez cho biết, ngày càng nhiều yêu cầu tư vấn đến từ phần mềm chứ không phải con người, các đại lý mã hóa thường đại diện cho các công ty triển khai chúng để đưa ra yêu cầu. Công ty cho rằng các đại lý ưa thích Bitcoin vì nó không cần giấy phép, các đại lý không cần mở tài khoản ngân hàng, vượt qua kiểm tra hoặc ký tài liệu, có thể xây dựng ứng dụng và thiết lập thanh toán cho người dùng toàn cầu. Breez cho biết SDK mới nhất của họ được xây dựng dựa trên giao thức mở rộng Bitcoin Spark đã thực hiện việc tiếp nhận lưu lượng truy cập mới một cách suôn sẻ.

first_img Anthropic phát hành Claude Haiku 5.5, chi phí vận hành giảm khoảng 75% so với thế hệ trước

Anthropic đã phát hành Claude Haiku 5.5 vào thứ Tư, cho biết đây là mô hình nhỏ gọn rẻ nhất, nhanh nhất và mạnh mẽ nhất của công ty cho đến nay. Mô hình này hướng đến các nhiệm vụ khối lượng lớn như tóm tắt tài liệu, truy vấn cơ sở dữ liệu, cũng như các tình huống nhạy cảm về tốc độ như dịch vụ khách hàng thời gian thực, thao tác trình duyệt thay cho người dùng. Khi các nhà phát triển tích hợp nó vào sản phẩm của riêng mình, phí cho các từ khóa trong phạm vi 100.000 token sẽ được tính là 0,1 USD cho mỗi triệu token đầu vào và 0,5 USD cho mỗi triệu token đầu ra, tương đương với mức giá của mô hình nhỏ gọn cạnh tranh GPT-6 Luna do OpenAI phát hành vào ngày 22 tháng 9.Giá tương ứng của Haiku 4.5 là 1 USD và 5 USD, mức giá mới giảm 90%, các từ khóa vượt quá 100.000 token sẽ giảm giá 50%. Do khoảng 90% yêu cầu của mô hình cũ dưới ngưỡng này, và số lượng từ của Haiku 5.5 hơi nhiều hơn, Anthropic ước tính tiết kiệm trung bình khoảng 75%. Các bài kiểm tra chuẩn cho thấy, Haiku 5.5 đạt tỷ lệ thành công 72,4% trên OSWorld 2.1, cao hơn 48,9% của GPT Luna; trên Terminal-Bench 4 là 39,2%, cao hơn 16,4% của Luna và 0% của Haiku 4.5, nhưng thấp hơn 70,6% của Sonnet 5.5.Đây là mô hình Haiku đầu tiên có cài đặt effort có thể điều chỉnh, người dùng có thể cân nhắc giữa chi phí và chất lượng câu trả lời.

first_img Người phụ nữ Florida viết nhật ký bằng Claude, sau khi được Anthropic kiểm tra đã báo cảnh sát

Theo báo cáo của Decrypt, một phụ nữ tên Carli Michelle Heller ở Bonita Springs, Florida, Hoa Kỳ đã bị bắt vì sử dụng Claude như một cuốn nhật ký. Các điều tra viên cho biết, cô đã viết nội dung "bắn súng" vào văn phòng cảnh sát quận Lee vào ngày 26 tháng 9, và vào ngày hôm sau lại tuyên bố rằng mình đã có một khẩu súng mới. Hệ thống an ninh của Anthropic đã đánh dấu những cuộc trò chuyện này vì nội dung nghiêm trọng, và nền tảng đã chuyển giao cho đội ngũ kiểm tra thủ công xử lý, đội ngũ này đã báo cáo cho các cơ quan thực thi pháp luật. Cảnh sát đã xác định Heller dựa trên thông tin này, đến nhà cô và bắt giữ cô, cô bị buộc tội đưa ra mối đe dọa bạo lực bằng văn bản, vụ án dự kiến sẽ được xét xử vào tháng 11.Các điều khoản dành cho người tiêu dùng của Anthropic rõ ràng giữ quyền "tự quyết định" báo cáo đầu vào, đầu ra hoặc hành vi của người dùng cho các cơ quan thực thi pháp luật. Chính sách bảo mật có hiệu lực từ ngày 10 tháng 9 năm 2026 cũng cho phép công ty chia sẻ dữ liệu với cảnh sát khi tin rằng việc tiết lộ là hợp lý cần thiết để ngăn ngừa tổn hại nghiêm trọng. Ngay cả khi người dùng chọn không sử dụng dữ liệu cho việc đào tạo mô hình, Anthropic vẫn có thể sử dụng dữ liệu của họ trong vòng ba tháng, thay vì năm năm; các cuộc trò chuyện bị đánh dấu để xem xét cũng sẽ được sử dụng để cải thiện khả năng phát hiện nội dung có hại.Đây không phải là trường hợp đầu tiên. Tờ San Francisco Standard báo cáo vào tháng 9 rằng Anthropic đã chuyển giao một người dùng cho cảnh sát, người này được cho là đã viết rằng mình đã mua một khẩu súng AR-15 và đã đặt CEO của công ty, Dario Amodei, vào ống ngắm, người này cho biết chỉ đang đùa, và khi báo cáo được công bố, người đó chưa bị bắt giữ hoặc truy tố, phát ngôn viên của Anthropic cho biết sự việc này là "quy trình bảo vệ của chúng tôi hoạt động như mong đợi".

WasabiCard ra mắt nhiều loại thẻ đăng ký AI, bao gồm các công cụ AI chính như OpenAI, Claude và các tình huống thanh toán khác

Theo thông tin chính thức, WasabiCard hiện đã ra mắt nhiều loại thẻ đăng ký AI, phục vụ nhu cầu thanh toán và đăng ký công cụ AI toàn cầu cho doanh nghiệp và đội nhóm, hỗ trợ các tình huống thanh toán đăng ký cho nhiều ứng dụng AI phổ biến như OpenAI, Claude. Thông qua giải pháp thanh toán thẻ, doanh nghiệp có thể linh hoạt hơn trong việc xử lý việc mua sắm dịch vụ AI và quản lý chi phí cho các đội nhóm, dự án hoặc dòng kinh doanh khác nhau.Ngoài thanh toán đăng ký AI, WasabiCard còn hỗ trợ doanh nghiệp mở thẻ hàng loạt, quản lý ngân sách và mở tài khoản đa tiền tệ, cũng như nhiều tình huống như quảng cáo, công tác, trả lương, đăng ký thương mại điện tử. Giúp doanh nghiệp cấu hình quyền thanh toán và hạn mức ngân sách theo phòng ban, nhân viên hoặc mục đích cụ thể, nâng cao hiệu quả quản lý chi phí liên quan đến AI và tính minh bạch trong việc sử dụng vốn.Khi các công cụ AI dần dần đi vào quy trình làm việc hàng ngày trong nghiên cứu phát triển, sản xuất nội dung, dịch vụ khách hàng và vận hành, thanh toán đăng ký xuyên biên giới và quản lý chi phí đang trở thành cơ sở hạ tầng quan trọng cho hoạt động toàn cầu của doanh nghiệp. Cần lưu ý rằng hiện tại các sản phẩm liên quan đến WasabiCard chưa mở cửa cho doanh nghiệp và người dùng cá nhân tại khu vực Trung Quốc đại lục.

first_img Anthropic: Trí đồ GLM-5.3 có khả năng sử dụng mạng từ đầu đến cuối

Vào ngày 29 tháng 9 năm 2026, Nhóm Đỏ Anthropic Frontier đã phát hành bài nghiên cứu, tác giả là Andrew Fasano, Marius Fleischer, Cole McFaul, Robert Xiao và Tripp Gallagher. Bài viết cho biết, khoảng năm tháng trước, Anthropic đã phát hành giới hạn Claude Mythos Preview thông qua Dự án Glasswing, vì nó có khả năng tự xây dựng mạng lưới đầu cuối; các bên phòng thủ đáng tin cậy đã phát hiện hơn 10.000 lỗ hổng trong phần mềm quan trọng dựa trên điều này, trong khi khả năng tương đương hiện đã lan rộng sang các mô hình khác.Bài viết cho biết, AI Zhipu (tên quốc tế là Z.ai) phát triển GLM-5.3 tương tự như Claude Mythos Preview, có khả năng phát triển tự động đầu cuối mạnh mẽ, nhưng được phát hành với trọng số mở và thiếu các hạn chế lạm dụng có ý nghĩa. Trong các bài kiểm tra mô phỏng, tỷ lệ thành công của việc vượt qua bảo vệ GLM-5.3 bằng các phương pháp đơn giản khoảng từ 64% đến 100%, trong khi các phương pháp tương tự không thể khiến mô hình Claude có bảo vệ thực hiện các nhiệm vụ có hại; những khả năng này cũng có thể được các bên phòng thủ sử dụng để củng cố hệ thống.Vào ngày 17 tháng 9 năm 2026, Trung tâm Đánh giá Tiêu chuẩn và Đổi mới Trí tuệ Nhân tạo của Viện Tiêu chuẩn và Công nghệ Quốc gia Hoa Kỳ đánh giá rằng, GLM-5.3 là mô hình trọng số mở mạnh nhất từ trước đến nay về khả năng mạng, trong tổng thể tiêu chuẩn mạng của nó, khoảng chậm hơn khoảng bốn tháng so với tiên tiến của Hoa Kỳ, Anthropic cho biết kết luận về khả năng là tương đối nhất quán.

first_img Anthropic: Claude nhận diện hệ thống enzyme mới, cổ phiếu chỉnh sửa gen giảm

Vào thứ Tư theo giờ địa phương, Anthropic thông báo rằng mô hình Claude đã nhận diện một hệ thống enzyme chưa được mô tả đầy đủ trong một lượng lớn dữ liệu chuỗi DNA, với cách sắp xếp chuỗi lặp lại tương tự như CRISPR. Đây là thành quả đầu tiên của phòng thí nghiệm sinh học mới thành lập, đội ngũ được thành lập vào mùa xuân năm nay, phòng thí nghiệm tọa lạc tại khu vực Vịnh San Francisco. Sau khi tin tức được công bố, giá cổ phiếu của các công ty chỉnh sửa gen đã giảm vào thứ Tư, CRISPR Therapeutics giảm 5.54%, Beam Therapeutics giảm 6.02%, Prime Medicine giảm 11.58%.Nhiệm vụ liên quan là tìm kiếm các hệ thống enzyme ngược phiên mã đáng nghiên cứu từ cơ sở dữ liệu DNA lớn. Trong khoảng 21 giờ tìm kiếm, khoảng 950 Claude thông minh đã sử dụng khoảng 210 triệu token, trong đó một thông minh đã chú ý đến một loại chuỗi DNA lặp lại có quy luật sắp xếp bên cạnh một gen enzyme ngược phiên mã. Đội ngũ đã đặt tên cho sự kết hợp này là hệ thống enzyme ngược phiên mã liên quan đến mảng, chủ yếu tồn tại trong phage, bao gồm gen enzyme ngược phiên mã, các gen đi kèm liền kề và một nhóm chuỗi DNA lặp lại. Enzyme ngược phiên mã bản thân đã được nghiên cứu trước đó, phát hiện mới là nó tạo thành một hệ thống cùng với các chuỗi DNA không mã hóa xung quanh và các protein đi kèm có chức năng chưa được biết đến.Anthropic cho biết, các nhà nghiên cứu vẫn không biết chức năng chính của hệ thống này, cũng như chưa chứng minh được nó có thể thực hiện các sửa đổi định hướng trên DNA như các công cụ chỉnh sửa gen đã trưởng thành. Các thí nghiệm ban đầu phát hiện rằng những chuỗi lặp lại này có thể tạo ra nhiều RNA ngắn, nhưng điều này không đồng nghĩa với việc đã có khả năng chỉnh sửa gen có thể lập trình. Bài báo tiền in tiết lộ, để kiểm tra xem có thể phát hiện lại hay không, đội ngũ đã thực hiện thêm 10 lần tìm kiếm giống hệt;

first_img Cơ quan Quản lý Không gian mạng Trung Quốc điều tra DeepSeek và Mặt trăng tối, liên quan đến việc rò rỉ dữ liệu cho Claude

Theo The Information dẫn lời những người biết chuyện, Cục Quản lý Không gian mạng Quốc gia Trung Quốc đã tiến hành điều tra đối với công ty AI DeepSeek và Moonshot AI, nguyên nhân là do Anthropic cáo buộc hai công ty này bí mật chuyển dữ liệu người dùng nhạy cảm đến máy chủ của họ. Báo cáo cho biết, các nhân viên quản lý đã đến thăm văn phòng của hai công ty, phỏng vấn các giám đốc điều hành và nhân viên, tập trung kiểm tra xem dữ liệu nhạy cảm liên quan đến cảnh sát, quân sự và các doanh nghiệp nhà nước có bị rò rỉ vào máy chủ Mỹ hay không.Điểm khởi đầu của cuộc điều tra này là báo cáo tình báo đe dọa thứ tư mà Anthropic phát hành vào ngày 10 tháng 9. Tài liệu dài 154 trang này cáo buộc bảy phòng thí nghiệm Trung Quốc - Alibaba, Moonshot AI, DeepSeek, Z.ai, MiniMax, SenseTime và Xiaomi - tham gia vào cái mà họ gọi là "chưng cất bất hợp pháp", tức là sử dụng đầu ra của mô hình lớn để huấn luyện các mô hình nhỏ hơn. Anthropic cho biết chưng cất bản thân nó là một phương pháp hợp pháp, điều họ phản đối là việc thực hiện thông qua các tài khoản giả mạo. Cục Quản lý Không gian mạng ban đầu đã triệu tập tất cả bảy công ty được nêu tên trong báo cáo, sau đó đã thu hẹp phạm vi điều tra xuống còn DeepSeek và Moonshot AI. Anthropic cho biết, Moonshot AI đã chuyển hướng hơn 23 triệu tương tác đến Claude thông qua 5,380 tài khoản giả mạo, trong khi DeepSeek đã tạo ra hơn 12.1 triệu tương tác trong khoảng thời gian 14 ngày vào tháng 7.Thời điểm điều tra đối với hai công ty này đều khá nhạy cảm.

first_img Anthropic phát hành Claude Opus 5.5, hiệu suất tương đương Fable 5.1 và giá thấp hơn 60%

Anthropic đã phát hành Claude Opus 5.5 vào thứ Ba, đây là mô hình đầu tiên trong dòng sản phẩm Claude 5.5. Anthropic cho biết, mô hình mới đã đạt được hiệu suất tương đương với mô hình flagship đắt nhất của họ là Claude Fable 5.1 trong hầu hết các nhiệm vụ, nhưng chi phí vận hành thấp hơn 20% so với thế hệ trước là Opus 5 và thấp hơn 60% so với Fable 5.1. Về giá cả, giá đầu vào và đầu ra token của Opus 5.5 lần lượt là 4 đô la và 20 đô la cho mỗi triệu token, trong khi giá đọc bộ nhớ giảm xuống còn 0.2 đô la cho mỗi triệu token.Về điểm chuẩn, Opus 5.5 đạt 66.4% trên Terminal-Bench 4, cao hơn 55.8% của Fable 5.1 và 57.9% của GPT-6 Astra; FrontierCode đạt 54.4%, cao hơn 50.3% của Fable 5.1; GDPval-AA v2.1 đạt 1846, cao hơn 1735 của Fable 5.1. Tuy nhiên, GPT-6 Astra vẫn dẫn đầu Opus 5.5 trong hai bài kiểm tra AutomationBench và Terminal-Bench-Science 0.1.Đây là mô hình đầu tiên được phát hành sau khi Giám đốc điều hành Anthropic Dario Amodei kêu gọi ngành công nghiệp làm chậm tốc độ nâng cao khả năng AI, và đã áp dụng các biện pháp bảo vệ an ninh mạng và an toàn sinh học tương tự như Fable 5.1.

Dữ liệu: Polymarket “Mô hình Claude Opus tiếp theo sẽ ra mắt vào ngày 22 tháng 9” xác suất tăng lên 77%, tăng 50% trong 24 giờ

Dữ liệu từ công cụ giám sát thị trường PPP dự đoán cho thấy, xác suất cho mô hình Claude Opus tiếp theo của "Polymarket" sẽ ra mắt vào ngày 22 tháng 9 đã tăng lên 77%, tăng 50% trong 24 giờ. Chỉ những mô hình mới được Anthropic chính thức đặt tên là "Opus" mới được tính, chẳng hạn như Claude Opus 5.1, Opus 5.5, Opus 6, v.v. Các tên khác như Sonnet, Haiku, Fable, Mythos không được tính, trừ khi Anthropic chính thức đặt tên cho chúng là Opus.Thời gian phát hành dựa trên ngày lịch theo giờ miền Đông Hoa Kỳ. Phải thực sự mở cửa cho công chúng mới kích hoạt việc thanh toán. Beta công khai, danh sách chờ mở và danh sách chờ cuộn đều được tính; Beta kín, theo lời mời hoặc truy cập riêng không được tính. Nếu trang web chính thức của Anthropic chỉ hiển thị tên mô hình, vị trí hoặc ghi chú sai, nhưng mô hình thực tế vẫn chưa thể sử dụng công khai, cũng không được tính là phát hành. Cuối cùng, thông tin chính thức từ Anthropic sẽ là cơ sở để thanh toán, kết hợp với các báo cáo từ các phương tiện truyền thông đáng tin cậy để xác minh.
app_icon
ChainCatcher Building the Web3 world with innovations.