Только что вышел Claude Haiku 5.5! Цена упала на 90%

Только что компания Anthropic выпустила Claude Haiku 5.5, цена которого составляет всего 1/10 от предыдущего поколения Haiku 4.5, 1/20 от Sonnet 5.5 и равна цене OpenAI GPT-6 Luna.

По официальным результатам Luna проиграла ему по всем шести показателям, причем в нескольких категориях она была близка к Sonnet.
Операционная система OSWorld поднялась с 15.7% до 72.4%, до Sonnet 5.5 не хватает всего 11.5 процентных пунктов.
Тестирование программирования Terminal-Bench 4.0, в предыдущем поколении было 0 баллов, в этот раз набрало 39.2%.
В области знаний GDPval-AA набрал 1620 баллов, что более чем в два раза превышает результаты предыдущего поколения.
«Последний экзамен для человечества» HLE без инструментов поднялся с 10.2% до 45.9%.

Сколько можно сэкономить
Цена составляет 0.10 долларов за миллион токенов на ввод и 0.50 долларов на вывод, это цена для подсказок в пределах 100,000 токенов, свыше 100,000 считается 0.50 долларов за ввод и 2.50 долларов за вывод.
Чтение из кэша стоит 0.01 долларов за миллион токенов, при пакетной обработке действует скидка 50%.

По официальным расчетам, выполнение аналогичных задач в среднем экономит около 75% по сравнению с Haiku 4.5, с тем же бюджетом можно выполнить примерно в четыре раза больше вызовов.
Не удалось сэкономить 90%, потому что запросы свыше 100,000 токенов дешевле только на половину, но, к счастью, в предыдущем поколении около 90% запросов были в пределах 100,000, кроме того, новый токенизатор увеличивает количество токенов на 30% для одного и того же текста.
По сравнению с GPT-6 Luna, цены на ввод, вывод и кэш для обеих компаний в пределах 100,000 токенов абсолютно одинаковы.
При работе с длинным контекстом Luna дешевле, она начинает повышать цены только при достижении около 270,000 токенов, и даже тогда ввод стоит 0.20 долларов, а вывод 0.75 долларов.
Кэш для Sonnet 5.5 также с сегодняшнего дня снижен вдвое, с 0.20 долларов до 0.10 долларов за миллион токенов, по официальным расчетам большинство задач для агентов могут стать дешевле на 20%.
Подписка Max и Team с этой недели предоставляет ежемесячные лимиты API, Max 5x предоставляет 100 долларов, Max 20x — 200 долларов, Team — максимум 500 долларов, общий доступ для всей команды, на платформе Claude можно использовать любую модель.
Результаты выше Luna, но в сложном программировании все еще отстает от Sonnet
Это поколение Haiku значительно улучшилось по сравнению с предыдущим.

Операционная система OSWorld поднялась с 15.7% до 72.4%, до Sonnet 5.5 не хватает всего 11.5 процентных пунктов.
Тестирование программирования Terminal-Bench 4.0, в предыдущем поколении не набрало ни одного балла, в этот раз набрало 39.2%.
В области знаний GDPval-AA набрал 1620 баллов, что более чем в два раза превышает результаты предыдущего поколения.
«Последний экзамен для человечества» HLE без инструментов поднялся с 10.2% до 45.9%.
Компьютерные операции — это область, где наблюдается наибольшее улучшение, OSWorld с аналогичной ценой Luna составляет всего 48.9%, Haiku 5.5 опережает его на 23.5 процентных пункта.
С учетом затрат результаты еще более впечатляющие, он достиг уровня Medium, который превышает максимальные результаты Luna, при этом затраты были меньше.

В области знаний GDPval-AA Haiku 5.5 с 1620 баллами обошел Luna с 1437 баллами, до Sonnet 5.5 с 1840 баллами еще далеко, но даже на стандартном уровне Medium он набрал 1277 баллов.
В проекте AA-Briefcase он поднялся с 614 баллов до 1578 баллов, в то время как Luna набрала 1336 баллов.

В области логики и чтения изображений, когда HLE использует инструменты поиска и кода, Haiku 5.5 набрал 57.4%, Sonnet 5.5 — 64.5%. При чтении профессиональных графиков Chartography он поднялся с 6.4% до 46.4%, Luna — 29.1%, Sonnet 5.5 — 61.6%.

Наибольшее различие с Sonnet наблюдается в программировании, на Terminal-Bench 4.0 его 39.2% более чем в два раза превышает Luna (16.4%), но Sonnet 5.5 — 70.6%.
На FrontierCode его 46.4% также обошли Luna с 42.4%, до лучшего результата Sonnet 5.5 с 52.1% не хватает почти 6 процентных пунктов.
Официально также заявлено, что сложное программирование для агентов лучше доверить Sonnet 5.5 и Opus 5.5.
Для чего это подходит
Официально Haiku 5.5 позиционируется как решение для больших объемов, быстрого выполнения и экономии, например, для написания резюме, сжатия контекста, поиска в базе данных и классификации.
Это также самая быстрая модель Claude на данный момент, она лишь немного медленнее, чем Opus в быстром режиме (который стоит очень дорого!), что делает ее подходящей для работы в реальном времени и операций в браузере.
Официально также предоставлены отзывы от ряда звездных AI-приложений.
Asana провела тестирование и обнаружила, что задержка выполнения задач снизилась более чем на 30% по сравнению с их текущими моделями, Box обнаружила, что его задержка составляет всего половину от Haiku 4.5.

Еще одно основное применение — это использование в качестве подагента для Opus или Sonnet, где большая модель разбивает задачи и принимает решения, а Haiku выполняет их.
Cognition использует Devin Fusion, чтобы Opus 5.5 был основным, а Haiku 5.5 — вспомогательным, FrontierCode стабильно достигает 66.2 баллов на высшем уровне, затраты и задержки снизились.

Финансовая AI-компания Rogo использует большую модель для создания PPT, Haiku 5.5 анализирует 10-K отчет и извлекает данные о доходах подразделений.

Учетная запись разработчика Claude предоставила демонстрацию, задача заключалась в том, чтобы с помощью различных домашних предметов спроектировать подставку для яиц, цель — не разбиться при падении с 32 метров.

Opus 5.5 справился за 3 минуты 37 секунд, протестировав 25 вариантов, потратив 0.47 долларов, в то время как с 10 подагентами Haiku 5.5 это заняло всего 58 секунд, протестировав 86 вариантов, потратив 0.14 долларов.
Руководство по использованию Haiku 5.5
Haiku 5.5 уже доступен на платформах Claude Client, Claude Code, AWS, Google Cloud, Microsoft Azure, Cursor, OpenRouter и других, ID модели — claude-haiku-5-5, контекст — 1 миллион токенов, максимальный вывод за один раз — 128,000 токенов.

Это первая версия Haiku, которая может регулировать уровень мышления, от Low до Max всего пять уровней, API по умолчанию — Medium.
SDK для Python и TypeScript также добавили управление компьютером и браузером, в настоящее время находятся в бета-версии.
При переходе с Haiku 4.5 количество токенов текста увеличивается примерно на 30%, max_tokens и затраты необходимо пересчитать.
budgettokens заменены на адаптивные уровни мышления и Effort, temperature, topp, top_k нужно удалить, предварительные ответы больше не работают, требования к формату изменены на структурированный вывод.
Управление компьютером необходимо заменить на новый набор инструментов computertoolset20260801, приоритетный уровень пока не поддерживается.
Если это слишком сложно, можно выполнить одну команду в Claude Code:
Пусть он изменит это сам.
Конечно, для непрофессионалов вы уже можете напрямую общаться с Haiku 5.5 в клиенте!

Не беспокойте Fable, Opus, Sonnet по простым вопросам, Haiku 5.5 даже при низкой интенсивности вывода может точно мгновенно давать ответы, идеально заменяя поисковые системы.

Попробуйте прямо сейчас!
Ссылки:
https://www.anthropic.com/claude-haiku-5-5
Популярные статьи











