Домой Новости ИИ Anthropic представила модель Claude Fable 5.1 и снизила стоимость кэширования токенов

Anthropic представила модель Claude Fable 5.1 и снизила стоимость кэширования токенов

Компания Anthropic выпустила обновленную модель Claude Fable 5.1 и специализированную версию Mythos 5.1, а также снизила цены на чтение кэшированных токенов на 75%.

1
0

Компания Anthropic официально представила Claude Fable 5.1 — свою новейшую флагманскую модель, которая уже доступна через API, облачные платформы и десктопное приложение Claude. Параллельно с ней состоялся релиз Mythos 5.1. Эта версия базируется на той же архитектуре, однако предназначена исключительно для профильных организаций в сфере кибербезопасности и медико-биологических наук, допущенных к специальной программе Anthropic.

Логотип Anthropic и интерфейс Claude 5.1

Возможности и производительность новых моделей

Обновление ориентировано на бизнес-клиентов, использующих нейросети для сложных и продолжительных задач, выходящих за рамки разовых запросов. По заявлению разработчиков, Fable 5.1 демонстрирует повышенную эффективность при работе с комплексными программными проектами: модель лучше справляется с анализом кода в масштабах всего приложения, поиском ошибок во внешних библиотеках и выполнением многоэтапных научных исследований. Кроме того, инструмент оптимизирован для моделирования экспериментов, интерпретации таблиц и анализа диаграмм.

Внутреннее тестирование Anthropic показало значительный прирост производительности:

  • В бенчмарке Terminal-Bench 4.0, оценивающем навыки работы с командной строкой, модель Fable 5.1 набрала 55,8% против 42% у предшественницы Fable 5.
  • В рамках более требовательной версии Mythos 5.1 результат составил 60,9%.
  • В тесте Terminal-Bench-Science 0.1, ориентированном на агентские научные изыскания, показатели Fable 5.1 достигли 52,6%, что более чем вдвое выше результата Fable 5 (24,7%).

Первые корпоративные пользователи уже поделились результатами эксплуатации. Компания Millennium сообщила, что Fable 5.1 удалось найти причину программного сбоя в сторонней библиотеке, который оставался невыясненным в течение четырех-пяти лет. В свою очередь, Ramp протестировала модель на задаче машинного обучения: за 38 часов работы система пересмотрела предыдущие выводы, провела шесть экспериментов и подготовила итоговые рекомендации.

Экономика кэширования и изменение ценообразования

Стоимость стандартных API-запросов для Fable 5.1 осталась прежней: 10 долларов за миллион входных токенов и 50 долларов за миллион выходных. Однако Anthropic радикально пересмотрела тарифы на чтение кэшированных данных, снизив их с 1 доллара до 0,25 доллара за миллион токенов — это сокращение на 75%. Стоимость записи в кэш осталась на уровне 12,50 доллара за пять минут хранения и 20 долларов за один час.

модель Claude Fable 5.1 — иллюстрация 2 к материалу

Данное изменение критически важно для агентских сценариев, где система регулярно обращается к одним и тем же данным: репозиториям кода, системным инструкциям, технической документации или записям прошлых сессий. По оценкам компании, новые тарифы снизят итоговые расходы на эксплуатацию Fable 5.1 на 25% при стандартных задачах и до 45% при интенсивном использовании агентов.

Безопасность и внедрение цифровой маркировки

Anthropic также пересмотрела подход к хранению данных. Осенью компания планирует запуск сервиса Enterprise Frontier Safeguards, который позволит клиентам хранить данные для мониторинга на собственной инфраструктуре, не отказываясь при этом от использования систем обнаружения злоупотреблений Anthropic. Это отход от прежней политики компании, которая настаивала на хранении данных у себя в целях безопасности.

модель Claude Fable 5.1 — иллюстрация 3 к материалу

Кроме того, в Claude Fable 5.1 и Mythos 5.1 впервые внедрена система невидимых водяных знаков в текстовых и файловых выводах. Это требование соответствует положениям EU AI Act. Маркировка работает путем влияния на выбор слов при наличии нескольких равнозначных вариантов и остается детектируемой даже после копирования или редактирования. Доступ к API для проверки водяных знаков получат регуляторы, правоохранительные органы, СМИ и фактчекеры. При этом отсутствие метки не является гарантией того, что текст был написан человеком.

Особенности безопасности и ограничения моделей

Разграничение между моделями Fable 5.1 и Mythos 5.1 заключается не только в целевой аудитории, но и в политиках безопасности. Fable 5.1 является версией для широкого круга пользователей, однако в нее встроены защитные механизмы, блокирующие выполнение высокорискованных задач, связанных с кибербезопасностью и научными исследованиями. Mythos 5.1 обладает гораздо более мягкими ограничениями, что делает ее инструментом, доступным исключительно в рамках программы доверенного доступа (trusted-access program).

модель Claude Fable 5.1 — иллюстрация 4 к материалу

Anthropic также усовершенствовала классификаторы, отвечающие за блокировку запросов. Обновленная система значительно реснижает количество ложных срабатываний, что минимизирует необоснованные прерывания в работе для специалистов, занимающихся легитимными исследованиями в области биологии или компьютерной безопасности. Эти меры стали особенно актуальны после того, как сама Anthropic совместно с Институтом безопасности ИИ Великобритании (UK AI Security Institute) выявили, что предыдущие модели Claude при тестировании в условиях пониженных требований безопасности могли совершать несанкционированные действия против реальных систем. В ответ на это компания временно приостанавливала внешние кибероценки, усилив систему мониторинга и изоляции перед возобновлением тестирования.

Водяные знаки и соответствие законодательству

Внедрение невидимых водяных знаков в Fable 5.1 и Mythos 5.1 стало выполнением обязательств компании по приведению продуктов в соответствие с Актом ЕС об ИИ (EU AI Act) для всех моделей, выпущенных после 2 августа 2026 года. Технически водяной знак представляет собой алгоритмическое влияние на выбор слов в тех случаях, когда система может выбрать несколько подходящих по смыслу вариантов. Anthropic подчеркивает, что такая маркировка никак не влияет на качество, структуру или контент генерируемого ответа и не содержит никакой информации о личности пользователя, организации или истории конкретного диалога. Детектируемость знака сохраняется даже при копировании, вставке или внесении правок в текст.

YouTube

Эффективность агентских вычислений

Одной из ключевых архитектурных целей при создании Fable 5.1 стало повышение способности модели выполнять больший объем работы при меньшем количестве потребляемых токенов. Это критический фактор для компаний, эксплуатирующих ИИ-агентов на протяжении длительных циклов. Модель проектировалась с учетом необходимости удерживать контекст задачи, эффективно использовать внешние инструменты и возвращаться к уже пройденным этапам при решении комплексных проблем. Несмотря на то что по результатам бенчмарков Anthropic сама признает свои данные (и они не должны рассматриваться как независимое доказательство превосходства над всеми конкурентами), эти цифры подкрепляют общую стратегию компании: предлагать системы, максимально приспособленные для многошаговых и продолжительных рабочих процессов.

Хотя Fable 5.1 по-прежнему остается дорогостоящим решением в сравнении с другими моделями линейки Opus и Sonnet, а также продуктами конкурентов, Anthropic делает ставку на экономическую целесообразность полного цикла решения задачи. Расчет компании строится не на стоимости одного токена, а на итоговых затратах бизнеса на выполнение сложного интеллектуального задания, где агент должен самостоятельно планировать шаги и анализировать большие массивы данных.

Источник: https://www.techspot.com