BTC $82,885.27 +0.46%
ETH $2,504.87 +0.58%
BNB $746.97 +0.33%
XRP $1.39 -0.52%
SOL $109.53 -0.11%
TRX $0.3301 -0.17%
DOGE $0.0853 -1.23%
ADA $0.2482 -1.20%
BCH $276.88 -0.72%
LINK $12.93 +0.83%
HYPE $85.51 +1.82%
AAVE $168.73 -1.25%
SUI $1.10 +2.19%
XLM $0.1956 -0.22%
ZEC $1,227.17 +1.22%
AAPL $336.40 +0.01%
AMZN $262.43 -0.05%
GOOGL $351.32 -0.15%
MSFT $534.74 -0.12%
META $719.09 +0.07%
NVDA $230.35 -0.08%
TSLA $382.50 -0.14%
SNDK $1,593.98 +0.12%
INTC $104.97 -0.01%
SPCX $163.84 +0.48%
MU $1,034.93 +0.07%
AMD $609.54 -0.23%
BTC $82,885.27 +0.46%
ETH $2,504.87 +0.58%
BNB $746.97 +0.33%
XRP $1.39 -0.52%
SOL $109.53 -0.11%
TRX $0.3301 -0.17%
DOGE $0.0853 -1.23%
ADA $0.2482 -1.20%
BCH $276.88 -0.72%
LINK $12.93 +0.83%
HYPE $85.51 +1.82%
AAVE $168.73 -1.25%
SUI $1.10 +2.19%
XLM $0.1956 -0.22%
ZEC $1,227.17 +1.22%
AAPL $336.40 +0.01%
AMZN $262.43 -0.05%
GOOGL $351.32 -0.15%
MSFT $534.74 -0.12%
META $719.09 +0.07%
NVDA $230.35 -0.08%
TSLA $382.50 -0.14%
SNDK $1,593.98 +0.12%
INTC $104.97 -0.01%
SPCX $163.84 +0.48%
MU $1,034.93 +0.07%
AMD $609.54 -0.23%

opus

Все
Статьи
Новости

first_img Anthropic выпустила Claude Sonnet 5.5, результаты программирования превысили Opus 5.5

Anthropic выпустила Claude Sonnet 5.5 в этот понедельник, как обновленную версию Sonnet 5, выпущенного в июне этого года. Официально заявлено, что скорость работы этой средней модели увеличилась более чем на 30% по сравнению с предыдущим поколением, она демонстрирует наилучшие результаты в четко определенных повседневных задачах, исправлении ошибок, а также в создании документов, презентаций и таблиц, обладая при этом острым дизайнерским мышлением. Цены остаются на уровне 2 долларов за миллион входных токенов и 10 долларов за миллион выходных токенов, что составляет половину от Opus 5.5, при этом расход токенов на каждую задачу уменьшился почти на треть по сравнению с Sonnet 5.В тестах Terminal-Bench 4 Sonnet 5.5 набрала 70.6%, что выше, чем 66.4% у Opus 5.5 и всего 10.3% у Sonnet 5. Результаты независимого тестового агентства Artificial Analysis также показывают ее преимущество, составив 63.6% и 59.6%, в то время как GPT-6 Astra от OpenAI составила 59.1%. В оценке реальной рабочей производительности 44 профессий на GDPval-AA Sonnet 5.5 получила 1844 балла, что практически сопоставимо с 1846 баллами у Opus 5.5, в то время как GPT-6 Sol набрала 1487 баллов.

Клод Opus 5.5 официально запустился на B.AI, API и Web Chat открыты для синхронного использования на двух платформах

23 сентября платформа B.AI объявила о запуске первой модели серии Claude 5.5, выпущенной компанией Anthropic, под названием Claude Opus 5.5, которая теперь доступна для использования с API и Web Chat. Эта модель разработана для программирования агентов с длительным циклом и сложной интеллектуальной работой, достигая уровня Claude Fable 5.1 по большинству задач, при этом стоимость эксплуатации снижена примерно на 40% по сравнению с Opus 5.Модель поддерживает сверхдлинный контекст в 1M токенов и максимальный вывод в 128K, демонстрируя выдающиеся возможности в сценариях компьютерного использования и многошаговой автоматизации. С сегодняшнего дня разработчики и пользователи могут напрямую вызывать Claude Opus 5.5 через платформу B.AI, приглашаем вас войти на chat.b.ai/chat и испытать его прямо сейчас.

first_img Anthropic выпустила Claude Opus 5.5, производительность соответствует Fable 5.1, а цена на 60% ниже

Anthropic во вторник выпустила Claude Opus 5.5, это первая модель в серии Claude 5.5. Anthropic заявила, что новая модель достигла уровня своего самого дорогого флагманского модели Claude Fable 5.1 по большинству задач, но стоимость эксплуатации на 20% ниже, чем у предыдущего поколения Opus 5, и на 60% ниже, чем у Fable 5.1. Что касается цен, стоимость ввода и вывода токенов Opus 5.5 составляет 4 доллара и 20 долларов за миллион соответственно, а цена чтения из кэша снизилась до 0.2 доллара за миллион.В тестах Opus 5.5 набрала 66.4% на Terminal-Bench 4, что выше, чем 55.8% у Fable 5.1 и 57.9% у GPT-6 Astra; FrontierCode набрала 54.4%, что выше, чем 50.3% у Fable 5.1; GDPval-AA v2.1 набрала 1846, что выше, чем 1735 у Fable 5.1. Тем не менее, GPT-6 Astra все еще опережает Opus 5.5 в двух тестах: AutomationBench и Terminal-Bench-Science 0.1.Это первая модель, выпущенная после того, как генеральный директор Anthropic Дарио Амодеи призвал отрасль замедлить темпы повышения возможностей ИИ, и она использует те же меры кибербезопасности и биобезопасности, что и Fable 5.1.

Данные: Polymarket "Следующая модель Claude Opus будет 22 сентября" вероятность возросла до 77%, за 24 часа увеличилась на 50%

Инструмент мониторинга рынка PPP прогнозирует, что вероятность выхода следующей модели Claude Opus от Polymarket "выросла до 77% 22 сентября", увеличившись на 50% за 24 часа. Только новые модели, официально названные Anthropic "Opus", считаются действительными, например, Claude Opus 5.1, Opus 5.5, Opus 6 и т.д. Другие названия, такие как Sonnet, Haiku, Fable, Mythos и т.д., не считаются, если только Anthropic официально не назовет их Opus.Дата публикации определяется по календарной дате восточного времени США. Для активации расчетов модель должна быть действительно открыта для публики. Открытое бета-тестирование и открытые списки ожидания считаются; закрытое бета-тестирование, по приглашению или частный доступ не считаются. Если на официальном сайте Anthropic просто указано название модели, заполнитель или ошибка в обозначении, но модель фактически еще недоступна для публики, это также не считается публикацией. В конечном итоге основным источником для расчетов является официальная информация от Anthropic, дополненная проверкой через надежные СМИ.

Данные: Polymarket прогнозирует, что вероятность выхода следующего поколения Claude Opus от Anthropic возросла до 90%

PPP прогнозный инструмент мониторинга рынка показывает, что вероятность того, что "Anthropic следующего поколения Claude Opus будет выпущен до 27 сентября", возросла до 90%, увеличившись на 13% за 24 часа; вероятность выпуска до 30 сентября возросла до 94%, увеличившись на 7% за 24 часа.Согласно правилам расчета, если следующая модель Claude Opus от Anthropic будет открыта для общественного использования до указанной даты (восточное время США ET), этот прогнозный рынок будет рассчитан как "Да"; в противном случае расчет будет "Нет". Claude Opus относится к модели, явно названной Anthropic "Opus", модели, выпущенные под другими названиями, такими как Sonnet, Haiku, Fable или Mythos, не соответствуют условиям. Кроме того, соответствующие модели должны быть официально выпущены и открыты для общественного доступа, включая открытое тестирование или регистрацию в открытом списке ожидания. Закрытое тестирование или любая форма частного доступа не соответствуют условиям расчета.

DeepSeek визуальная модель мультимодального агента достигает уровня Opus 4.8, 4 предмета заканчиваются со счетом 2:2

Сообщение ChainCatcher, DeepSeek опубликовал первые результаты тестирования Agent V4-Flash-Vision-Exp. В 4-х многомодальных оценках Agents' Last Exam 27.3 против 25.7, ZeroBench 35.0 против 34.0; ApexBench 36.5 против 39.4, Chartography 64.3 против 65.0, с результатом 2 победы и 2 поражения против Opus 4.8.По сравнению с чисто текстовой версией V4-Flash-0731, визуальная версия в ApexBench увеличилась с 26.2 до 36.5, Agents' Last Exam с 25.2 до 27.3. Официально указано, что текстовая версия игнорирует многомодальное содержание, поэтому в основном отражает способности после добавления визуального ввода. После добавления визуального ввода способности текстового агента не уменьшились, в 7 текстовых оценках 6 показали результаты выше V4-Flash-0731, например, DeepSWE увеличился с 54.4 до 59.3 (превысив Opus 4.8 с 58.0), Toolathlon 75.9 почти сравнялся с Opus 4.8 с 76.2.Этот результат получен из официального самотестирования DeepSeek, не является независимым рейтингом третьей стороны; публичная задача текстового агента Code Agent использует ультра-простой режим DeepSeek Harness, уровень вывода - max.

Claude голосовой доступ Opus и Sonnet: просто скажите, чтобы изменить расписание или написать электронное письмо

Сообщение ChainCatcher, Anthropic обновил голосовой режим Claude. Платные пользователи теперь могут выбирать Opus, Sonnet и Haiku, больше не ограничиваясь более быстрым, но менее мощным Haiku.Пользователи могут переключать модели в разговоре и в любое время использовать текст. Claude по умолчанию использует модель, выбранную в последний раз в текстовом чате, и вызывает самую быструю версию из этой серии. Голосовой режим также может использовать Gmail, Google Calendar, Google Docs и Slack. Пользователи могут попросить Claude проверить почту, изменить расписание или составить ответ, перед выполнением будет запрашиваться разрешение.Новая версия уже доступна для тестирования на мобильных устройствах, настольных компьютерах и веб-версии. Бесплатные пользователи могут использовать только Haiku и один инструмент подключения. Голос теперь поддерживает множество языков, включая английский, японский, корейский и другие, но пока не включает китайский. Основное обновление касается способности модели к выводу и вызову инструментов. Anthropic не менял голосовую модель, поэтому естественность речи и опыт прерывания могут не измениться значительно.

Данные: Polymarket "Следующая модель Claude Opus будет выпущена 23 июля 2026 года" вероятность временно составляет 61%, за 24 часа увеличилась на 51%

Сообщение ChainCatcher, инструмент мониторинга рынка PPP прогнозирует, что вероятность того, что "следующая модель Claude Opus будет выпущена 23 июля 2026 года" составляет 61%, за 24 часа увеличившись на 51%. Кроме того, вероятность "выпуска до 24 июля" составляет 9%; вероятность "выпуска до 25 июля" составляет 5%.Это событие будет рассчитано по дате открытия для публики следующей модели Claude Opus от Anthropic (по восточному времени США). Только модели, официально названные Anthropic "Opus", будут действительными и должны быть открыты для публики (включая открытое тестирование или открытый резерв). Другие модели, такие как Sonnet, Haiku и т.д., не учитываются, окончательное решение будет основано на официальной информации от Anthropic.

WORLD3 RouterLink officially launched routerlink.ai, integrating over 60 cutting-edge models including GPT-5.5 and Claude Opus 4.7

WORLD3 today announced the official launch of its decentralized AI routing network RouterLink, enabling the permanent domain routerlink.ai. This official version brings three core upgrades compared to the previous Alpha stage: complete Web2 payment support (Stripe credit card/debit card/Apple Pay/Google Pay), direct connection to over 60 cutting-edge purebred flagship models (without quantization, without distillation), and official production-level endorsements from three major cloud providers: AWS, Microsoft Azure, and Google Cloud.WORLD3 disclosed that the RouterLink network currently supports over 68 models, covering more than 20 providers, with uptime locked at 99.9%, and daily settlement flow exceeding $1.5 million $WAI. The launched purebred flagship models include Claude Opus 4.7, GPT-5.5, Gemini 3.1 Pro Preview, DeepSeek V4 Pro, Grok 4.3, Qwen3-Max, Llama 4 Maverick, Kimi K2.6, GLM 5.1, MiniMax M2.7, etc., all provided at full specifications. The cumulative $450K quota from the three major cloud collaborations has been fully utilized — including the public inclusion of the AWS Customer Case Study, Microsoft for Startups Level 4 (highest level) + $300K AI Grants, and direct connection to Google Cloud Vertex AI.WORLD3 stated that this official launch also opens up the enterprise procurement channel: Stripe payments and $WAI on-chain payments run in parallel, allowing developers to access the complete catalog of 68 models within 60 seconds after registering their email and recharging with a credit card. The subsequent roadmap includes the RouterLink mainnet, GPU computing power market, an Agent skill market linked with TapClaw, and an enterprise version SLA service that is already in pilot with some clients.
app_icon
ChainCatcher Building the Web3 world with innovations.