BTC $79,733.00 +1.22%
ETH $2,456.14 +0.48%
BNB $766.26 +7.60%
XRP $1.42 +1.72%
SOL $102.77 +1.84%
TRX $0.3328 +1.16%
DOGE $0.0878 +4.02%
ADA $0.2175 +3.73%
BCH $249.80 +0.54%
LINK $11.88 +2.85%
HYPE $85.14 +1.37%
AAVE $130.78 +0.65%
SUI $0.8030 +7.91%
XLM $0.1838 +2.68%
ZEC $1,017.30 +4.55%
BTC $79,733.00 +1.22%
ETH $2,456.14 +0.48%
BNB $766.26 +7.60%
XRP $1.42 +1.72%
SOL $102.77 +1.84%
TRX $0.3328 +1.16%
DOGE $0.0878 +4.02%
ADA $0.2175 +3.73%
BCH $249.80 +0.54%
LINK $11.88 +2.85%
HYPE $85.14 +1.37%
AAVE $130.78 +0.65%
SUI $0.8030 +7.91%
XLM $0.1838 +2.68%
ZEC $1,017.30 +4.55%

Только что вышел Claude 5.1! Самая мощная модель в мире пришла

Ключевые тезисы
Summary: Anthropic представила новое поколение моделей Claude Fable 5.1 и Claude Mythos 5.1.
Anthropic представила новое поколение моделей Claude Fable 5.1 и Claude Mythos 5.1.

Оригинал Следите за AI в Машинном Разуме
Только что Anthropic представила новое поколение моделей Claude Fable 5.1 и Claude Mythos 5.1.

Anthropic утверждает, что Claude Fable 5.1 является одной из самых мощных открытых моделей, доступных в настоящее время, созданной для сложного вывода, длительных задач и рабочих процессов агентов. Claude Mythos 5.1 представляет собой более высокую границу возможностей, которую они исследуют.

Важно отметить, что, хотя обе модели имеют одинаковые базовые возможности, для различных сценариев использования применяются разные меры безопасности.

Fable 5.1 доступна для обычных пользователей, разработчиков и компаний, в то время как Mythos 5.1 предназначена для проверенных партнеров в высокорисковых областях с более строгим контролем доступа.

Другими словами, одна модель предназначена для работы в реальном мире, а другая остается в более строго контролируемой среде. Это также может быть исследованием Anthropic будущих форматов AI-продуктов: самая мощная модель не обязательно будет предоставлена всем в одной и той же форме.

Официальные лица заявили, что эти две модели представляют собой важный прогресс в возможностях серии Claude и демонстрируют, как они продолжают продвигать безопасное развертывание, одновременно повышая возможности модели. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

Как «самая мощная» модель, Fable 5.1 по-прежнему демонстрирует отличные результаты; официальные данные показывают, что Fable 5.1 превосходит предыдущую флагманскую модель Fable 5 по нескольким бенчмаркам. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

Но, несмотря на более высокие возможности, цена снизилась. Anthropic заявляет, что базовая цена Fable 5.1 осталась прежней, а стоимость чтения кэша снизилась на 75% по сравнению с Fable 5. В реальном использовании это снижает общую стоимость модели для типичных рабочих нагрузок примерно на 25%; для высокоагентных рабочих нагрузок стоимость может снизиться до 45%. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

Похоже, что даже самые мощные модели теперь ориентируются на соотношение цена-качество.

Давайте рассмотрим это подробнее.

Низкие уровни достигают уровня предыдущего поколения, Fable 5.1 акцентирует внимание на «соотношении цена-качество».

В отличие от простого обновления списка, Anthropic на этот раз хочет подчеркнуть, что Fable 5.1 может выполнять задачи, которые раньше требовали высоких уровней Fable 5, с более низкими затратами на вывод.

Согласно официальным тестам, Fable 5.1 уже может достигать результатов, близких или даже превышающих показатели Fable 5 при низкой и средней интенсивности вывода. Claude Code по умолчанию использует высокую интенсивность вывода, Claude Cowork и Claude . ai используют среднюю интенсивность, пользователи также могут настраивать скорость, стоимость и эффективность в зависимости от сложности задачи.

Конкретно, Fable 5.1 достигла 52.6% в научно-исследовательском бенчмарке Agent Terminal - Bench - Science 0.1, что более чем вдвое превышает 24.7% Fable 5; в Terminal - Bench 4.0 Fable 5.1 достигла 55.8%, а Mythos 5.1, открывающая больше возможностей, достигла 60.9%.

В тестах на знание, компьютерные операции и бизнес-процессы новая модель также показала улучшения. Результаты AutomationBench увеличились с 17.1% Fable 5 до 31.4%, а CursorBench 3.2.0 увеличились с 70.5% до 73.4%. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

Во многих бенчмарках результаты Fable 5.1 превышают результаты Fable 5, причем наибольшее улучшение наблюдается в научно-исследовательских агентах и бизнес-рабочих процессах. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

В тесте Terminal - Bench 4.0 Fable 5.1 и Mythos 5.1 превзошли предыдущее поколение Mythos 5 при различных уровнях вывода. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

В тесте Terminal - Bench - Science 0.1 Fable 5.1 достигла максимального балла 52.6%, что вдвое превышает результат Fable 5.

Anthropic считает, что важным изменением Fable 5.1 является ее большая готовность отслеживать коренные причины проблем, что делает ее более подходящей для выполнения сложных задач, которые могут длиться несколько часов или даже десятков часов.

Инвестиционная компания Millennium обнаружила в тестах, что один внутренний код выдает сбой примерно один раз на миллион запусков. Эта проблема беспокоила инженерную команду в течение четырех-пяти лет, и другие модели не смогли найти причину. Fable 5.1, однако, смогла определить проблему, разобрав внешние библиотеки поставщиков и сопоставив файлы дампа ядра, в конечном итоге локализовав проблему в баге в сторонней библиотеке.

Ramp также позволила Fable 5.1 работать непрерывно в течение 38 часов. Модель, обнаружив, что исходные результаты машинного обучения были искажены ошибками в метках, самостоятельно исправила проблему и одновременно запустила шесть групп экспериментов, в конечном итоге собрав новые результаты и последующие рекомендации.

От написания кода до научных исследований

В этом выпуске Anthropic уделила значительное внимание тому, как Fable 5.1 и Mythos 5.1 проявляют себя в научных исследованиях.

В эксперименте по дизайну белков исследователи заставили Mythos 5.1 использовать инструменты для дизайна и сворачивания белков с открытым исходным кодом, а затем передали созданные дизайны двум внешним учреждениям для экспериментальной проверки.

На трех целевых белках связывающая способность, разработанная Mythos 5.1, достигла в 10 раз лучших решений, представленных на конкурсе по дизайну белков Adaptyv Bio. При наличии 12 целевых белков модель достигла почти 50% точности в дизайне эффективных связывающих агентов, в то время как обычный уровень, предоставленный Anthropic, составляет от 10% до 15%.

Fable 5.1 также использовала радиолокационные изображения, собранные NASA более 30 лет назад с помощью зонда Магеллан, чтобы создать новую высокоразрешающую карту высот для примерно одной трети поверхности Венеры. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

Радиолокационное изображение Венеры, сделанное зондом NASA Магеллан, в центре которого находится небольшой щитовой вулкан диаметром около 15 километров.

Существующие карты могли отображать детали только в масштабе 10-20 километров, новая карта повысила разрешение до 2-3 километров, а точность измерения высоты увеличилась на 25%. Anthropic планирует опубликовать эту карту с лицензией на совместное использование знаний для последующих миссий NASA VERITAS и Европейского космического агентства EnVision.

В области вычислительной биологии Mythos 5.1, написав настраиваемые ядра GPU и кэшируя промежуточные результаты, смогла увеличить скорость выполнения 7 открытых белковых и геномных моделей глубокого обучения до 2.5 раз, сохраняя при этом согласованность выходных результатов. В некоторых задачах полного геномного анализа ожидается снижение затрат на GPU на 30% до 60%. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

После оптимизации 7 открытых белковых и геномных моделей Mythos 5.1 скорость вывода увеличилась на 1.4 до 2.5 раз.

Anthropic хочет с помощью этих примеров продемонстрировать, что модели переходят от упорядочивания данных и написания кода к предложению решений, запуску инструментов и предоставлению результатов научных исследований, которые можно проверить экспериментально.

Цены на кэш снизились на 75%, а стоимость задач агентов снизилась на 45%

Помимо производительности, цена является самым очевидным изменением Fable 5.1.

Цены на ввод и вывод Fable 5.1 не изменились и по-прежнему составляют 10 долларов за миллион токенов и 50 долларов, но цена чтения кэша была снижена на 75%, до 0.25 долларов за миллион токенов.

Чтение кэша относится к повторному использованию модели уже обработанного контекста. Доля в обычных вопросах может быть ограниченной, но в задачах агентов, где требуется многократное чтение библиотек кода, исторических диалогов и результатов инструментов, кэш часто составляет основную часть затрат.

Согласно расчетам Anthropic на основе фактических данных использования за август 2026 года, общая стоимость выполнения типичных задач Fable 5.1 ниже примерно на 25% по сравнению с Fable 5; для сложных задач агентов с длинным контекстом и частыми вызовами инструментов снижение затрат может достигать 45%. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

После снижения цен на чтение кэша стоимость типичных задач Fable 5.1 снизилась примерно на 25%, а стоимость высокоагентных задач снизилась на 45%.

Fable 5.1 теперь доступна на Claude . ai, Claude Code и Claude API, а также через AWS, Google Cloud и Microsoft Azure. Разработчики могут вызывать новую модель через claude - fable -5-1.

Механизм защиты от дистилляции был дополнительно усилен

Fable 5.1 и Mythos 5.1 фактически используют одну и ту же базовую модель, основное различие между ними заключается в мерах безопасности.

Fable 5.1 полностью открыта для обычных пользователей и компаний; Mythos 5.1 имеет более свободные ограничения в области кибербезопасности и биологических наук и в настоящее время доступна только для проверенных физических и юридических лиц.

В области кибербезопасности Fable 5.1 уже может помочь пользователям обнаруживать уязвимости программного обеспечения, но все еще не может напрямую генерировать эксплойты. Задачи двойного назначения, такие как тестирование на проникновение, генерация эксплойтов и сканирование уязвимостей на основе двоичных файлов, по-прежнему могут быть переданы моделям с более строгими ограничениями.

После корректировки новая версия механизма защиты кибербезопасности снизила количество ложных срабатываний на 60% по сравнению с Fable 5. Уровень ложных срабатываний механизма биобезопасности для основных биологических и медицинских вопросов также снизился на 85%, а высокие возможности в области биологических наук открываются в основном через программу проверки Mythos 5.1.

Anthropic также представила Enterprise Frontier Safeguards. Компании могут хранить данные в облачной инфраструктуре, контролируемой ими, с обязательным ручным обзором от компании, что позволяет сохранить возможности мониторинга безопасности, достигая эффекта «нулевого хранения данных» в отношении конфиденциальности. Этот механизм планируется поэтапно внедрить с осени этого года.

Что касается дистилляции крупных моделей, Fable 5.1 также ввела новые ограничения. API-аккаунты, созданные после этого дня, не смогут вручную изменять предыдущий контекст в многократных диалогах, сохраняя при этом историю размышлений Claude. Anthropic заявляет, что это изменение предназначено в основном для блокировки уже известного метода извлечения возможностей.

Кроме того, чтобы соответствовать требованиям Закона о Искусственном Интеллекте Европейского Союза, текстовые выходные данные Fable 5.1 будут содержать невидимые водяные знаки. Anthropic также начала небольшие тесты на обнаружение API, которые в первую очередь открыты для регулирующих органов, СМИ, организаций по проверке фактов и исследовательских учреждений.

Наконец, пользователи правы: ранняя пташка уже использует 5.1. Только что вышел Claude 5.1! Самая мощная модель в мире пришла

Join ChainCatcher Official
Telegram Feed: @chaincatcher
X (Twitter): @ChainCatcher_
Связанные теги
warnning Предупреждение о рисках
app_icon
ChainCatcher Building the Web3 world with innovations.