Новости ИИЗнаков 9612Время чтения25 мин

Anthropic представляет Claude Fable 5.1 с более низкой стоимостью агентов и ограниченной версией Mythos

Claude Fable 5.1 обеспечивает более высокую производительность агентов, на 75% более дешёвое чтение кеша и пересмотренные меры защиты, тогда как Mythos 5.1 остаётся ограниченным.

Содержание · 12
  1. 1. Fable 5.1 ориентирован на долгосрочную агентную работу
  2. 2. Anthropic сообщает о широком росте показателей в бенчмарках
  3. 3. Fable и Mythos используют один интеллект, но отличаются доступом
  4. 4. Меры защиты теперь дают меньше ложных срабатываний
  5. 5. Цены на кеш и корпоративные средства контроля данных меняют экономику развёртывания
  6. Частые вопросы
  7. Claude Fable 5.1 общедоступна?
  8. Claude Mythos 5.1 — это другая модель?
  9. Сколько Fable 5.1 стоит через API?
  10. Каковы ограничения контекста и вывода?
  11. Может ли Fable 5.1 проводить тестирование на проникновение?
  12. Источники

1 сентября Anthropic выпустила Claude Fable 5.1 — свою наиболее мощную общедоступную модель для долгосрочно работающих агентов в программировании, исследованиях и интеллектуальном труде. Одновременно компания представила Claude Mythos 5.1 — доступную только по приглашению версию той же базовой модели с более разрешительными мерами защиты для одобренных организаций в области кибербезопасности и наук о жизни.

Fable 5.1 сохраняет базовые API-цены предыдущего поколения: $10 за миллион входных токенов и $50 за миллион выходных токенов. Существенным изменением цен стало снижение стоимости чтения кеша на 75% — с $1 до $0.25 за миллион токенов. По оценке Anthropic, это снижает совокупную стоимость типичных задач Fable примерно на 25%, а высокоагентных задач — вплоть до 45%.

В выпуске также пересмотрены меры защиты, из-за которых исходный Fable 5 было трудно применять для некоторых легитимных задач в биологии и безопасности. Теперь Fable 5.1 может выявлять уязвимости в исходном коде, тогда как тестирование на проникновение, генерация эксплойтов, сканирование бинарных файлов на уязвимости и продвинутые исследования в области наук о жизни по-прежнему подпадают под ограничения или перенаправляются на менее мощные модели.

1. Fable 5.1 ориентирован на долгосрочную агентную работу

Fable 5.1 сменяет Fable 5, который Anthropic представила 9 июня 2026 года для сложных задач, способных асинхронно выполняться днями. Новая модель сохраняет этот фокус, но улучшает производительность в программировании, работе с компьютером, научных исследованиях, бизнес-процессах и междисциплинарных рассуждениях.

Идентификатор модели в API — claude-fable-5-1. Она принимает текст и изображения и генерирует текст, располагает контекстным окном в один миллион токенов и максимальным выводом в 128,000 токенов. Адаптивное мышление всегда включено, а документированные отсечки надёжных знаний и обучающих данных модели — июнь 2026 года.

Anthropic описывает Fable 5.1 как вариант для требовательных рассуждений и долгосрочных агентов, а не как выбор по умолчанию для каждого приложения. В собственных рекомендациях по выбору моделей компания советует начинать большинство задач с более дешёвой Claude Opus 5 и переходить на Fable 5.1, если оценка при более высоких уровнях усилий Opus остаётся недостаточной.

Модель доступна в тарифных планах Claude Pro, Max, Team и Enterprise. Разработчики могут получить к ней доступ через Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry. Anthropic также предлагает инференс только в США по цене в 1.1 раза выше стандартной для входных и выходных токенов.

В Claude Code Fable 5.1 по умолчанию использует высокий уровень усилий, а в Claude Cowork и Claude.ai — средний. Anthropic утверждает, что при более низких настройках усилий модель может приблизиться к производительности Fable 5 или превзойти её при меньшей стоимости, предоставляя разработчикам ещё один контроль над задержкой и потреблением токенов.

2. Anthropic сообщает о широком росте показателей в бенчмарках

Опубликованные Anthropic оценки показывают, что Fable 5.1 превосходит Fable 5 во всех бенчмарках из сравнения при запуске. Это результаты, представленные поставщиком, и в нескольких случаях используются недавно пересмотренные тесты или собственная конфигурация оценки Anthropic.

В Terminal-Bench-Science 0.1, измеряющем агентную научную работу в терминальной среде, Fable 5.1 получила 52.6% против 24.7% у Fable 5, 29.0% у Opus 5 и 22.4% у GPT-5.6 Sol. Anthropic сообщает о стандартной ошибке от 3.5 до 4.5 процентного пункта для каждой модели.

В Terminal-Bench 4.0 для агентного программирования Fable 5.1 получила 55.8%. Mythos 5.1 достигла 60.9% в том же тесте, тогда как Fable 5 получила 42.0%, Opus 5 — 52.3%, а GPT-5.6 Sol — 37.3%. Поскольку Fable и Mythos используют одну и ту же базовую модель, Anthropic связывает разрыв между их результатами с задачами, в которых срабатывали меры защиты Fable.

В CursorBench 3.2.0 Fable 5.1 набрала 73.4%, опередив Fable 5 с 70.5%, Opus 5 с 70.0% и GPT-5.6 Sol с 67.2%. Её результат в AutomationBench вырос до 31.4% с 17.1% у Fable 5. Модель также достигла 65.0% в Humanity’s Last Exam при включённых инструментах — по сравнению с 63.8% у Fable 5 и 63.6% у Opus 5.

Anthropic оценивала Fable 5.1 с активными производственными мерами защиты. В отдельных задачах OSWorld, где эти меры срабатывали, ей не засчитывались баллы, тогда как некоторые другие отмеченные задачи по кибербезопасности и биологии выполнялись резервными моделями Opus. Поэтому компания предупреждает, что опубликованные результаты отражают как базовую модель, так и развёрнутую систему маршрутизации.

3. Fable и Mythos используют один интеллект, но отличаются доступом

Claude Mythos 5.1 не является более мощной базовой моделью, чем Fable 5.1. Anthropic утверждает, что на уровне моделей они идентичны; отличие в том, что Mythos применяет более разрешительные меры защиты для проверенных организаций, чья профессиональная работа иначе вызвала бы ограничения Fable.

Mythos 5.1 имеет то же контекстное окно в один миллион токенов, максимальный вывод в 128,000 токенов, адаптивное мышление и цены $10 за миллион входных и $50 за миллион выходных токенов. Её идентификатор API — claude-mythos-5-1, однако доступ предоставляется только по приглашению и в настоящее время ограничен избранными организациями в США.

Доступ в области наук о жизни организуется через Life Sciences Verification Program, разработанную совместно с правительством США. Anthropic подключила первоначальную группу и заявляет, что планирует более широкий набор участников. Программа смягчает биологические ограничения для одобренных исследований и разработок, сохраняя остальные меры защиты модели.

Cyber Verification Program в настоящее время предоставляет квалифицированным защитникам доступ к определённым моделям классов Opus и Sonnet с ослабленными ограничениями в кибербезопасности. Anthropic заявляет, что доступ к классу Mythos будет добавлен в ближайшем будущем. Claude Security, продукт компании для сканирования кодовых баз, уже работает на Mythos 5.1.

Такое двухуровневое развёртывание позволяет Anthropic широко распространять общие возможности модели в программировании и рассуждениях, сохраняя её наименее ограниченные кибер- и биологические возможности за институциональной верификацией. Это также означает, что результаты бенчмарков Mythos нельзя автоматически считать доступными обычным пользователям Fable.

4. Меры защиты теперь дают меньше ложных срабатываний

Fable 5 представила необычно строгие классификаторы для биологии и кибербезопасности. Когда запрос их активировал, Claude могла переключиться на модель Opus вместо выполнения задачи с помощью Fable. Anthropic признаёт, что исходная реализация блокировала многие безобидные медицинские, образовательные и защитные запросы по безопасности.

Обновлённые биологические меры защиты вмешиваются примерно на 85% реже для безобидных базовых запросов по биологии и медицине, чем классификаторы, поставлявшиеся с Fable 5. Поэтому при повседневных вопросах о здоровье, клинической помощи и обучении биологии должно быть меньше подмен моделей. Исследования в таких областях, как вирусология, токсикология или молекулярный дизайн, по-прежнему могут перенаправляться на Opus, если пользователь не соответствует требованиям для доступа к Mythos.

В кибербезопасности пользователи Claude Code, как ожидается, будут сталкиваться примерно на 60% реже со срабатываниями мер защиты за сеанс. Fable 5.1 может анализировать исходный код для выявления уязвимостей, но по-прежнему перенаправляет тестирование на проникновение, разработку эксплойтов и сканирование уязвимостей на основе бинарных файлов.

Axios независимо сообщил, что эти вмешательства стали практической проблемой для клиентов: некоторые разработчики стремились уменьшить зависимость от Claude, поскольку легитимная работа прерывалась. Таким образом, изменения влияют не только на частоту отказов: меньшее число неожиданных переключений должно сделать поведение агентов для программирования и оценку стоимости более предсказуемыми.

Anthropic также добавила ограничения против дистилляции. Новые API-аккаунты больше не могут редактировать более ранний контекст Claude, сохраняя предыдущую расшифровку мыслительного процесса модели. Существующие аккаунты первоначально освобождены от этого требования, но Anthropic заявляет, что ограничение будет применяться ко всем пользователям с будущими выпусками моделей, потенциально требуя изменений в интеграциях, переписывающих историю разговора.

5. Цены на кеш и корпоративные средства контроля данных меняют экономику развёртывания

Стандартные тарифы на входные и выходные токены не снизились, но чтение кеша особенно важно для агентов, которые многократно используют длинные инструкции, контекст репозитория, результаты инструментов или накопленную историю задач. Снижение этой цены до $0.25 за миллион токенов непропорционально выгодно для долгих сеансов, в которых кешированный контекст составляет большую часть потребления токенов.

Anthropic рассчитала свои оценки экономии в 25% для типичных задач и 45% для высокоагентных задач на основе четырёх недель реального использования в августе 2026 года. Фактическая экономия зависит от того, как часто приложение повторно использует кешированный контекст; задачи, в которых преобладают новые входные данные или сгенерированный вывод, получат меньшее снижение.

Хранение данных остаётся ещё одним ограничением при развёртывании. Fable и Mythos по умолчанию требуют хранения в течение 30 дней для мониторинга безопасности. Anthropic заявляет, что этот мониторинг предназначен для обнаружения паттернов злоупотреблений, распределённых между несколькими сеансами или аккаунтами, а не для обучения моделей на корпоративных данных без разрешения.

Новая система Enterprise Frontier Safeguards предназначена для согласования такого мониторинга с требованиями нулевого хранения данных. В рамках EFS данные об активности могут оставаться в облачной инфраструктуре, контролируемой клиентом, с использованием ключей шифрования, политик доступа и журналов аудита клиента. Автоматический мониторинг может отмечать подозрительные паттерны, тогда как проверку людьми по умолчанию выполняет клиент, а не Anthropic.

EFS была разработана совместно с более чем 100 организациями, а её поэтапное развёртывание запланировано на осень 2026 года. Соответствующие требованиям клиенты могут использовать Fable 5 и Fable 5.1 на условиях нулевого хранения данных до доступности системы. Anthropic не взимает отдельную плату за EFS, хотя клиенты по-прежнему отвечают за расходы на облачное хранилище и передачу данных.

Fable 5.1 и Mythos 5.1 также вводят невидимые текстовые водяные знаки для соблюдения правил прозрачности Европейского союза для моделей, выпущенных после 2 августа 2026 года. Anthropic заявляет, что водяной знак изменяет случайность выбора токенов, не добавляя скрытых символов, дополнительных токенов или идентифицирующих пользователя данных. Первоначально обнаружение доступно через API в режиме закрытого предварительного просмотра для соответствующих требованиям организаций.

Частые вопросы

Claude Fable 5.1 общедоступна?

Да. Она доступна через платные тарифы Claude, Claude API и поддерживаемые облачные платформы. Идентификатор модели API — claude-fable-5-1.

Claude Mythos 5.1 — это другая модель?

Нет. Anthropic заявляет, что Fable 5.1 и Mythos 5.1 используют одну и ту же базовую модель. Mythos имеет более разрешительные меры защиты и доступна только проверенным организациям.

Сколько Fable 5.1 стоит через API?

Стандартная цена составляет $10 за миллион входных токенов и $50 за миллион выходных токенов. Чтение кеша стоит $0.25 за миллион токенов.

Каковы ограничения контекста и вывода?

Fable 5.1 поддерживает контекстное окно в один миллион токенов и до 128,000 выходных токенов на запрос.

Может ли Fable 5.1 проводить тестирование на проникновение?

Её меры защиты по-прежнему перенаправляют тестирование на проникновение, генерацию эксплойтов и сканирование уязвимостей на основе бинарных файлов. Она может выявлять уязвимости в исходном коде в защитных целях.

Источники

Share

Поделиться статьёй