BTC $82,882.12 +0.46%
ETH $2,502.32 +0.60%
BNB $747.80 +0.69%
XRP $1.40 -0.08%
SOL $109.83 +0.49%
TRX $0.3303 -0.39%
DOGE $0.0855 -0.26%
ADA $0.2475 +1.06%
BCH $278.73 +0.51%
LINK $12.97 +1.30%
HYPE $85.34 +1.38%
AAVE $168.05 -0.15%
SUI $1.10 +3.20%
XLM $0.1957 +0.39%
ZEC $1,219.06 +0.52%
AAPL $336.37 +0.02%
AMZN $262.38 -0.05%
GOOGL $351.33 -0.16%
MSFT $534.88 -0.08%
META $719.29 +0.16%
NVDA $230.43 +0.12%
TSLA $382.28 -0.17%
SNDK $1,596.22 +0.28%
INTC $104.99 +0.08%
SPCX $163.86 +0.50%
MU $1,035.66 +0.40%
AMD $609.79 +0.09%
BTC $82,882.12 +0.46%
ETH $2,502.32 +0.60%
BNB $747.80 +0.69%
XRP $1.40 -0.08%
SOL $109.83 +0.49%
TRX $0.3303 -0.39%
DOGE $0.0855 -0.26%
ADA $0.2475 +1.06%
BCH $278.73 +0.51%
LINK $12.97 +1.30%
HYPE $85.34 +1.38%
AAVE $168.05 -0.15%
SUI $1.10 +3.20%
XLM $0.1957 +0.39%
ZEC $1,219.06 +0.52%
AAPL $336.37 +0.02%
AMZN $262.38 -0.05%
GOOGL $351.33 -0.16%
MSFT $534.88 -0.08%
META $719.29 +0.16%
NVDA $230.43 +0.12%
TSLA $382.28 -0.17%
SNDK $1,596.22 +0.28%
INTC $104.99 +0.08%
SPCX $163.86 +0.50%
MU $1,035.66 +0.40%
AMD $609.79 +0.09%

opus

Tất cả
Bài viết
Tin nhanh

first_img Anthropic phát hành Claude Opus 5.5, hiệu suất tương đương Fable 5.1 và giá thấp hơn 60%

Anthropic đã phát hành Claude Opus 5.5 vào thứ Ba, đây là mô hình đầu tiên trong dòng sản phẩm Claude 5.5. Anthropic cho biết, mô hình mới đã đạt được hiệu suất tương đương với mô hình flagship đắt nhất của họ là Claude Fable 5.1 trong hầu hết các nhiệm vụ, nhưng chi phí vận hành thấp hơn 20% so với thế hệ trước là Opus 5 và thấp hơn 60% so với Fable 5.1. Về giá cả, giá đầu vào và đầu ra token của Opus 5.5 lần lượt là 4 đô la và 20 đô la cho mỗi triệu token, trong khi giá đọc bộ nhớ giảm xuống còn 0.2 đô la cho mỗi triệu token.Về điểm chuẩn, Opus 5.5 đạt 66.4% trên Terminal-Bench 4, cao hơn 55.8% của Fable 5.1 và 57.9% của GPT-6 Astra; FrontierCode đạt 54.4%, cao hơn 50.3% của Fable 5.1; GDPval-AA v2.1 đạt 1846, cao hơn 1735 của Fable 5.1. Tuy nhiên, GPT-6 Astra vẫn dẫn đầu Opus 5.5 trong hai bài kiểm tra AutomationBench và Terminal-Bench-Science 0.1.Đây là mô hình đầu tiên được phát hành sau khi Giám đốc điều hành Anthropic Dario Amodei kêu gọi ngành công nghiệp làm chậm tốc độ nâng cao khả năng AI, và đã áp dụng các biện pháp bảo vệ an ninh mạng và an toàn sinh học tương tự như Fable 5.1.

Dữ liệu: Polymarket “Mô hình Claude Opus tiếp theo sẽ ra mắt vào ngày 22 tháng 9” xác suất tăng lên 77%, tăng 50% trong 24 giờ

Dữ liệu từ công cụ giám sát thị trường PPP dự đoán cho thấy, xác suất cho mô hình Claude Opus tiếp theo của "Polymarket" sẽ ra mắt vào ngày 22 tháng 9 đã tăng lên 77%, tăng 50% trong 24 giờ. Chỉ những mô hình mới được Anthropic chính thức đặt tên là "Opus" mới được tính, chẳng hạn như Claude Opus 5.1, Opus 5.5, Opus 6, v.v. Các tên khác như Sonnet, Haiku, Fable, Mythos không được tính, trừ khi Anthropic chính thức đặt tên cho chúng là Opus.Thời gian phát hành dựa trên ngày lịch theo giờ miền Đông Hoa Kỳ. Phải thực sự mở cửa cho công chúng mới kích hoạt việc thanh toán. Beta công khai, danh sách chờ mở và danh sách chờ cuộn đều được tính; Beta kín, theo lời mời hoặc truy cập riêng không được tính. Nếu trang web chính thức của Anthropic chỉ hiển thị tên mô hình, vị trí hoặc ghi chú sai, nhưng mô hình thực tế vẫn chưa thể sử dụng công khai, cũng không được tính là phát hành. Cuối cùng, thông tin chính thức từ Anthropic sẽ là cơ sở để thanh toán, kết hợp với các báo cáo từ các phương tiện truyền thông đáng tin cậy để xác minh.

DeepSeek mô hình thị giác đa phương thức Agent khả năng gần đạt Opus 4.8, 4 mục tiêu hòa 2:2

Tin tức từ ChainCatcher, DeepSeek công bố V4-Flash-Vision-Exp đợt đầu tiên của Agent chạy điểm. Trong 4 bài đánh giá Agent đa mô hình, đã hòa với Opus 4.8 với 2 thắng 2 thua: Bài kiểm tra cuối cùng của Agents 27.3 so với 25.7, ZeroBench 35.0 so với 34.0; ApexBench 36.5 so với 39.4, Chartography 64.3 so với 65.0.So với phiên bản văn bản thuần túy V4-Flash-0731, phiên bản hình ảnh đã tăng từ 26.2 lên 36.5 trong ApexBench, Bài kiểm tra cuối cùng của Agents từ 25.2 lên 27.3. Chính thức ghi chú rằng phiên bản văn bản thuần túy sẽ bỏ qua nội dung đa mô hình, do đó chủ yếu thể hiện khả năng sau khi bổ sung đầu vào hình ảnh. Sau khi thêm hình ảnh, khả năng của Agent văn bản không giảm rõ rệt, trong 7 bài đánh giá văn bản có 6 bài cao hơn V4-Flash-0731, như DeepSWE từ 54.4 tăng lên 59.3 (vượt qua Opus 4.8 với 58.0), Toolathlon 75.9 gần như ngang bằng với Opus 4.8 với 76.2.Kết quả này đến từ việc tự kiểm tra của DeepSeek, không phải bảng xếp hạng độc lập của bên thứ ba; công khai nhiệm vụ văn bản của Code Agent sử dụng chế độ cực kỳ đơn giản của DeepSeek Harness, mức độ suy luận là max.

Claude truy cập giọng nói Opus và Sonnet: chỉ cần mở miệng là có thể thay đổi lịch trình, viết email

Tin tức từ ChainCatcher, Anthropic đã nâng cấp chế độ giọng nói của Claude. Người dùng trả phí hiện có thể chọn Opus, Sonnet và Haiku, không còn chỉ sử dụng Haiku nhanh hơn nhưng khả năng yếu hơn.Người dùng có thể chuyển đổi mô hình trong cuộc trò chuyện và cũng có thể chuyển sang văn bản bất cứ lúc nào. Claude mặc định sử dụng mô hình đã chọn trong cuộc trò chuyện văn bản trước đó và gọi phiên bản nhanh nhất trong loạt mô hình đó. Chế độ giọng nói cũng có thể gọi Gmail, Google Calendar, Google Docs và Slack. Người dùng có thể yêu cầu Claude kiểm tra email, thay đổi lịch trình hoặc soạn thảo phản hồi, trước khi thực hiện sẽ yêu cầu quyền truy cập.Phiên bản mới đã được mở thử nghiệm trên điện thoại, máy tính để bàn và trang web. Người dùng miễn phí chỉ có thể sử dụng Haiku và một công cụ kết nối. Giọng nói hiện hỗ trợ nhiều ngôn ngữ như tiếng Anh, tiếng Nhật, tiếng Hàn, nhưng chưa bao gồm tiếng Trung. Lần nâng cấp này chủ yếu cải thiện khả năng suy diễn mô hình và gọi công cụ. Anthropic không thay đổi mô hình giọng nói, vì vậy độ tự nhiên khi nói và trải nghiệm bị ngắt có thể không thay đổi rõ rệt.

WORLD3 RouterLink officially launched routerlink.ai, integrating over 60 cutting-edge models including GPT-5.5 and Claude Opus 4.7

WORLD3 today announced the official launch of its decentralized AI routing network RouterLink, enabling the permanent domain routerlink.ai. This official version brings three core upgrades compared to the previous Alpha stage: complete Web2 payment support (Stripe credit card/debit card/Apple Pay/Google Pay), direct connection to over 60 cutting-edge purebred flagship models (without quantization, without distillation), and official production-level endorsements from three major cloud providers: AWS, Microsoft Azure, and Google Cloud.WORLD3 disclosed that the RouterLink network currently supports over 68 models, covering more than 20 providers, with uptime locked at 99.9%, and daily settlement flow exceeding $1.5 million $WAI. The launched purebred flagship models include Claude Opus 4.7, GPT-5.5, Gemini 3.1 Pro Preview, DeepSeek V4 Pro, Grok 4.3, Qwen3-Max, Llama 4 Maverick, Kimi K2.6, GLM 5.1, MiniMax M2.7, etc., all provided at full specifications. The cumulative $450K quota from the three major cloud collaborations has been fully utilized — including the public inclusion of the AWS Customer Case Study, Microsoft for Startups Level 4 (highest level) + $300K AI Grants, and direct connection to Google Cloud Vertex AI.WORLD3 stated that this official launch also opens up the enterprise procurement channel: Stripe payments and $WAI on-chain payments run in parallel, allowing developers to access the complete catalog of 68 models within 60 seconds after registering their email and recharging with a credit card. The subsequent roadmap includes the RouterLink mainnet, GPU computing power market, an Agent skill market linked with TapClaw, and an enterprise version SLA service that is already in pilot with some clients.
app_icon
ChainCatcher Building the Web3 world with innovations.