Anthropic анонсировала Claude Fable 5.1 и Claude Mythos 5.1 — самые продвинутые на данный момент модели компании для программирования и интеллектуальной работы. Их исследовательские возможности дают представление о том, как модели ИИ смогут в будущем участвовать в научном прогрессе. Claude Fable 5.1 и Claude Mythos 5.1 — это одна и та же модель, но с разным уровнем защитных механизмов. Fable 5.1 доступна в широком доступе, тогда как Mythos 5.1 предоставляется только через программы доверенного доступа; её защитные механизмы специально разработаны для поддержки работы в области кибербезопасности и биологических наук.

Наряду с ростом возможностей, Fable 5.1 отвечает на обратную связь клиентов по цене, хранению данных и защитным механизмам.

Цена. Fable 5.1 будет стоить примерно на 25% дешевле, чем Fable 5, для типовых нагрузок там, где использование оплачивается по токенам. Это связано со снижением цены на чтение кэша (когда модель считывает уже обработанные и сохранённые входные данные). Для высокоагентных задач экономия часто будет значительно выше — до примерно 45%.

Хранение данных. Новая система Enterprise Frontier Safeguards (EFS) обеспечивает клиентам полную приватность (аналогичную политике нулевого хранения данных), сохраняя при этом лучшую защиту от злоупотреблений. EFS работает за счёт хранения данных в облачной инфраструктуре, полностью контролируемой клиентом, а не Anthropic. Система будет поэтапно доступна корпоративным клиентам начиная с этой осени. До появления EFS клиенты, соответствующие критериям, смогут использовать Fable 5.1 с нулевым хранением данных.

Защитные механизмы. Защитные механизмы улучшены для снижения числа ложных срабатываний (когда система помечает безобидный контент). В сфере кибербезопасности новейшие защитные механизмы блокируют на 60% меньше ложных срабатываний, чем раньше. Отчасти это связано с тем, что Fable 5.1 теперь можно использовать для обнаружения уязвимостей в программном обеспечении — но не для разработки эксплойтов. В биологии создана программа доступа, разработанная в партнёрстве с правительством США, для предоставления доступа к продвинутым биологическим возможностям Claude Mythos 5.1. Регистрация для учёных должна открыться в ближайшее время.

Новый рубеж производительности

Claude Fable 5.1 устанавливает новый стандарт в программировании, интеллектуальной работе и длительных задачах на решение проблем. Тесты показывают, что Fable 5.1 способна на значительно более высокую производительность по сравнению с предшественницей — Fable 5. При установке низкого или среднего уровня усилий Fable 5.1 достигает результатов, аналогичных или лучших, чем у Fable 5, при значительно меньшей стоимости. (Отметим, что по умолчанию Fable 5.1 использует высокий уровень усилий в Claude Code и средний — в Claude Cowork и на Claude.ai.)

Fable 5.1 избегает упрощений, приводящих к снижению качества работы, и достаточно умна, чтобы устранять корневые причины программных проблем. Например, при тестировании инвестиционной компанией Millennium Fable 5.1 обнаружила причину редкого сбоя во внутренних системах, которую не смогли объяснить ни инженеры компании, ни какая-либо другая модель, несмотря на несколько лет попыток.

Сравнение по различным бенчмаркам:

Fable 5.1Fable 5Opus 5GPT-5.6 Sol
Агентные научные исследования — Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Агентное программирование — Terminal-Bench 4.055.8% (60.9% Mythos 5.1)42.0%52.3%37.3%
Интеллектуальная работа — GDPval-AA v21853172318241711
Работа с компьютером — OSWorld 2.0 (частично / строго)77.9% / 41.7%72.9% / 36.1%75.4% / 39.6%— / —
Мультидисциплинарное рассуждение — Humanity's Last Exam (без инструментов / с инструментами)60.9% / 65.0%57.8% / 63.8%56.6% / 63.6%— / —
Бизнес-процессы — AutomationBench31.4%17.1%26.9%19.6%
Агентное программирование — CursorBench 3.2.073.4%70.5%70.0%67.2%

Fable 5.1 оценивалась с включёнными производственными защитными механизмами. На задачах, где эти механизмы срабатывали, Fable 5.1 и Fable 5 получали ноль баллов на OSWorld 2.0, а Fable 5 — ноль на AutomationBench. Во всех остальных случаях срабатывания защитных механизмов задачи по кибербезопасности выполнялись Claude Opus 4.8, а по биологии — Claude Opus 5, что, вероятно, снижает результаты Fable 5.1 и Fable 5 в этих бенчмарках.

Партнёры раннего доступа отметили эти улучшения производительности, а также более качественные, по их словам, результаты работы модели. Вот некоторые из отзывов:

«В наших внутренних бенчмарках Claude Fable 5.1 решает больше задач по программированию, чем Fable 5 или Opus 5, и показывает лучший результат по трейдинговой интуиции. Если предыдущие модели становилось сложнее понимать по мере продолжения работы, Fable 5.1 остаётся читаемой на протяжении длительных многоэтапных задач».

— Craig Falls, руководитель отдела количественных исследований, Jane Street Capital

«Мы переводим весь трафик Opus 5 в Devin на Claude Fable 5.1 в день запуска. В наших тестах она сравнялась или превзошла Fable 5 при меньшей стоимости за задачу, а с новыми ценами на чтение кэша модель класса Fable наконец стала экономически выгодной для нагрузок, которые мы держали на Opus, начиная с код-ревью».

— Walden Yan, сооснователь и CPO, Cognition

«Один участок кода вызывал крайне редкий сбой — примерно раз на миллион запусков, — который никто в команде не мог объяснить в течение четырёх-пяти лет. Все модели, которые пробовали, включая Fable 5, его пропустили. Claude Fable 5.1 первой его нашла: она дизассемблировала библиотеку внешнего поставщика, сопоставила её с дампом памяти и проследила сбой до бага в этой библиотеке. Время, которое потребовалось бы на такой анализ вручную, сложно оправдать».

— Damien, старший портфельный менеджер, Millennium

«Claude Fable 5.1 создала сложный прототип за три дня. Сначала провела исследование по всему коду и документации наших сервисов, чтобы предложить новый расширяемый дизайн. Затем работала часами без присмотра, с надёжными циклами проверки, реализуя весь прототип. Утром я находил очередной завершённый этап с полным визуальным разбором созданного и чёткими доказательствами успеха».

— Ron Sanzone, штатный инженер-программист, MongoDB

«Это дружелюбная Fable. Интеллект уровня Fable, цена уровня Opus, скорость уровня Sonnet. В наших тестах она была примерно в два раза быстрее Opus 5 и использовала вдвое меньше токенов, так что для тех, кто привык использовать Opus как основную модель, это очевидное обновление».

— Dan Shipper, CEO, Every

«В нашем исследовательском наборе задач Claude Fable 5.1 показала новые лучшие результаты. В одной задаче модель предложила оригинальное решение в совершенно другом направлении, отличном от того, что мы видели у других моделей или у людей-исследователей, и это подняло результат значительно выше прежнего плато. Она лучше справляется с творческим решением задач и той вспышкой инсайта, которая нужна для решения сложной проблемы».

— Marquis Wong, главный инженер по ИИ, IMC

«В рамках постоянной оценки моделей ИИ Claude Fable 5.1 показала впечатляющие результаты в наших тестах. С помощью Claude Code она верно определила корневую причину каждой сломанной сборки во всех тестах на всех уровнях усилий. Также она общается более эффективно, чем предыдущие модели Anthropic, с более лаконичными и понятными обновлениями».

— Josh Boyer, выдающийся инженер, Red Hat

«Мы попросили Claude Fable 5.1 проверить клинический исследовательский проект для Rakuten Medical, который уже одобрили три другие передовые модели. Она нашла пробел, который не заметил никто из них, и настояла на дополнительной проверке. Затем предложила совершенно новую гипотезу, превратив набор данных, который мы уже списали со счетов, в новое направление исследования за один день. Это первый случай, когда передовая модель, подобная Claude, позволила нам исследовать новое направление таким образом».

— Felix Giovanni Virgo, главный инженер по ИИ, Rakuten

«Claude Fable 5.1 очень умна. В нашем 30-дневном симулированном тесте по ведению бизнеса, где модель получает полный доступ к симулированным инструментам, клиентам, сотрудникам и поставщикам Square, она оказалась намного эффективнее по токену, чем Opus 5. Планируем использовать её для проработки самых сложных сценариев — тех, что раньше занимали дни у доски, — чтобы наши инженерные команды могли двигаться быстрее».

— Willem Avé, глобальный руководитель продукта, Block

«Для любых исследовательских, новых или долгосрочных задач я бы однозначно использовал Claude Fable 5.1 в роли оркестратора. Один непрерывный запуск на 38 часов на задаче машинного обучения обнаружил, что предыдущий результат был артефактом разметки, внёс исправление, запустил шесть параллельных экспериментов, работавших всю ночь, и вернулся с результатом и следующими шагами. При открытом запросе найти проблему с наибольшим потенциалом влияния, которой никто не занимался, модель выявила незакреплённое предупреждение, связанное с производственным сбоем, вытащила логи и предложила исправление».

— Dwight Temple, старший инженер по машинному обучению, Ramp

«Главное преимущество Claude Fable 5.1 — это письмо: понятнее, содержательнее, лучше следует нашим рекомендациям по стилю. В слепых тестах против Fable 5 я предпочёл её тексты и результаты. А в Canva Code она создала ритм-игру с настоящей музыкой и геймплеем, синхронизированным с созданным уровнем, — то, чего не показала ни одна другая протестированная модель».

— Danny Wu, руководитель отдела ИИ, Canva

«В нашем тесте на создание презентаций PowerPoint Claude Fable 5.1 подготовила лучшие слайды среди всех протестированных моделей, как по оформлению, так и по полноте ответа на исследовательскую тему. Та же полнота проявилась в нашем тесте на цитирование, где модель показала лучшее извлечение фактов из финансовых документов. А на сложных многосоставных вопросах это первая модель, которую мы видели отвечающей на все части вопроса».

— Aabhas Sharma, CTO, Hebbia

«У нас было изменение, затрагивающее более восьми сервисов в трёх кодовых базах. Claude Fable 5.1 составила карту всего процесса от начала до конца с исключительной детализацией — от входящего вызова сервиса до отдельной функции, таблиц и строк базы данных, — и всё это было точным до самого низкого уровня. Мы благодарны за возможность протестировать модель и дать обратную связь, что помогает нам подготовиться к новому рубежу, на котором мы всё больше можем полагаться на такие инструменты для реализации более смелых инициатив».

— Aditya Gupta, штатный инженер-программист, Plaid

«По нашим наборам оценки эксперты предпочитали ответы Claude Fable 5.1 примерно в два раза чаще, чем ответы Fable 5, по повседневным вопросам знаний, исследованиям с высоким намерением, а также по составлению текстов и артефактов — при этом улучшилась обоснованность ответов по сравнению с Fable. Эти результаты сделали Fable 5.1 нашей рекомендацией по умолчанию везде, где ранее выбиралась Fable 5».

— Nilesh Dalvi, руководитель разработки, Glean

«На самых сложных задачах, с которыми мы работаем, Claude Fable 5.1 значительно выделяется среди других моделей, которые мы пробовали. На задаче уровня «большого вызова», которую мы используем как испытательный стенд уже 18 месяцев, модель фактически показала реальный прогресс. Вместо того чтобы застрять в «коллекционировании марок», она нашла явные связи в незанятой области, которых я пока не видел ни у кого другого. Также она оптимизировала вычислительное ядро, на котором Fable 5 «выдохлась», примерно на 35%».

— Sean Ward, сооснователь и CEO, iGent

«В нашем самом сложном бенчмарке для браузерных агентов Claude Fable 5.1 выполнила 82% задач за примерно десять минут каждая, против 74% у Opus 5 и 57% у Fable 5, при этом используя меньше токенов, чем обе. Она чувствуется сильнее Fable 5 во всех измерениях, которые мы тестируем. Также она выполняла ровно нужный объём работы: ни разу не пересекла критическую точку останова за сотни измеренных задач».

— Miguel Gonzalez, технический руководитель, Browserbase

«В нашем внутреннем финансовом бенчмарке Claude Fable 5.1 показывает точность на уровне Fable 5, используя на 20% меньше токенов. Также заметен большой прогресс в генерации слайдов: Fable 5.1 лучше объясняет сложные данные простым языком и переводит их в более профессиональную визуализацию банковского уровня».

— Alex Wang, специалист по прикладному ИИ, Rogo

«Claude Fable 5.1 гораздо увереннее держится в длительной работе без надзора, чем Fable 5. Рабочие процессы, которые я запускал на длительное время, не теряли нить: модель ведёт собственные записи, переставляет приоритеты по мере изменения обстоятельств и продолжает с того места, где остановилась».

— Ben Lafferty, старший штатный инженер, Shopify

«По сравнению с Fable 5, Claude Fable 5.1 показала значительный прогресс на RedlineBench, нашем бенчмарке по редактированию контрактов, — с 47.9 до 57.0. Основной прирост пришёлся на качество первой правки, где результат удвоился, а также заметно выросло принятие поправок контрагентом. Правки модели также стали более лаконичными, с меньшими изменениями документов в среднем».

— Raymond Lin, специалист технического состава, Crosby

«Claude Fable 5.1 — лидирующая модель в наших тестах по расследованию инцидентов, которые используют реальные производственные инциденты для оценки того, насколько эффективно наш агент Bits Investigation может производить анализ корневых причин. Мы сравниваем результаты агента с причинами, установленными нашими инженерами. В этих оценках модель показала более сильное рассуждение, чем Opus 5, и успешно диагностировала самые сложные из протестированных производственных инцидентов».

— Daniel Shan, штатный инженер, Datadog

«Claude Fable 5.1 — самая способная модель, которую мы запускали на CursorBench 3.2, с результатом 73.4% при максимальных усилиях. Мы обнаружили, что она особенно хороша в проверке собственной работы, что позволяет ей брать на себя сложные задачи по программированию от начала до конца».

— Sualeh Asif, директор по машинному обучению, SpaceXAI

«Мы оцениваем модели и системы на реальных рабочих процессах инвесторов. На FrontierFinance, нашем последнем финансовом бенчмарке, Claude Fable 5.1 показывает явный прогресс по сравнению с Fable 5 — 55.9% по рубрике против 49.2%. Прирост достигается за счёт способности глубже копать в обоснованных, авторитетных источниках: в одном вопросе по отчётности модель сразу обратилась к стенограмме звонка и уловила точные цифры, которые упоминало руководство, тогда как другие модели опирались на вторичное освещение».

— Yuhao Zhang, руководитель исследований, Samaya

Научные исследования

Научные возможности Claude Fable 5.1 и Claude Mythos 5.1 протестированы в широком спектре областей. Полученные результаты, включающие приведённые ниже примеры, подтверждают, что модели ИИ скоро начнут вносить важный вклад в научные открытия.

Молекулярный дизайн. Многие современные лекарства работают за счёт связывания с целями в организме, чтобы блокировать, активировать их или доставить к ним что-либо. Высокоаффинные связыватели необходимы для того, чтобы препараты работали при более низких дозах; их разработка — первый шаг в процессе создания многих распространённых видов лекарств. Чтобы проверить, насколько хорошо Claude Mythos 5.1 справляется с этой задачей, модели предоставили доступ к инструментам с открытым кодом для дизайна и фолдинга белков, а её разработки отправили на экспериментальную проверку в две внешние организации. Mythos 5.1 продемонстрировала способность создавать связыватели с очень высокой аффинностью. По трём целям аффинность связывания оказалась в 10 раз выше, чем у лучших разработок, представленных на конкурсах дизайна белков Adaptyv Bio. Показатель успешных попаданий (то есть доля разработок, оказавшихся жизнеспособными связывателями) стал самым высоким из измеренных на данный момент: почти 50% по 12 целям (для сравнения, типичный показатель в дизайне белков сегодня — 10-15%).

Вычислительный анализ и моделирование. Claude Fable 5.1 обучила нейросеть для создания новой карты рельефа высокого разрешения для трети поверхности планеты Венера. Работа основана на радарных снимках, сделанных миссией NASA Magellan более 30 лет назад, и уже существующей карте для одной пятой планеты. Новая карта раскрывает детали до двух-трёх километров вместо 10-20, а высоты определяет до 25% точнее, чем прежде.

Карта опубликована под лицензией Creative Commons заранее, в преддверии предстоящих миссий NASA VERITAS и ESA EnVision, в надежде, что это поможет определить, какие геологические объекты следует выбрать целью для будущих наблюдений.

Вычислительная биология. В вычислительной биологии распространена практика запуска специализированных моделей машинного обучения на GPU. Скорость этих моделей поэтому является узким местом для прогресса исследований. Mythos 5.1 предложила одно из решений этой проблемы: написав собственные GPU-ядра и кэшируя промежуточные результаты, она ускорила семь моделей глубокого обучения с открытым кодом до 2,5 раза (с идентичными результатами).

Выгода от такого ускорения быстро накапливается. В отдельном эксперименте биологи могут запускать эти модели тысячи раз (например, проверяя каждую возможную мутацию рядом с каждым геном человека). В таких анализах оптимизированные модели снижают расчётную стоимость GPU на 30-60%. Такая оптимизация обычно занимает у команды инженеров по производительности несколько недель и часто недоступна академическим лабораториям по стоимости. Mythos 5.1 справилась с этим за считаные дни, используя только общедоступный исходный код. Эти оптимизации планируется вскоре открыть под открытой лицензией.

По мере роста научных возможностей моделей растут и инвестиции в научный прогресс. На прошлой неделе был представлен предварительный обзор Model Hardware Standard, позволяющий Claude напрямую и безопасно управлять лабораторным оборудованием. Также недавно расширена поддержка учёных через программу AI for Science, предоставляющую бесплатные кредиты исследователям, работающим над высокоэффективными научными проектами, а также предложен новый тарифный план Claude Team для учёных со значительной скидкой.

Безопасность, защита и согласованность

Агентные возможности моделей ИИ значительно выросли за последние два года. Но, как было документально показано ранее, увеличение автономности несёт новые риски. Работа над безопасностью, защитой и согласованностью должна развиваться в том же темпе, что и возможности ИИ. Накануне был опубликован отчёт, описывающий, как совершенствуются собственные усилия компании в области согласованности и защиты.

Перед выпуском Claude Fable 5.1 и Claude Mythos 5.1 модели подверглись обширному тестированию рисков во множестве областей (в некоторых случаях — с привлечением внешних исследователей). Полное описание этих усилий приведено в системной карточке; далее — краткое резюме.

Химические и биологические риски. Проверялась степень, в которой Claude Mythos 5.1 может помочь в создании химического или биологического оружия. Тестирование включало экспертный red-teaming, автоматизированные оценки и настольные учения, в которых биологи с степенью PhD работали вместе с экспертами по ИИ, проверяя, может ли модель сравниться по результатам с человеческими специалистами. Возможности Mythos 5.1 превышают возможности Mythos 5. Однако оценки показывают, что модель всё ещё не достигает следующего уровня риска, определённого в Responsible Scaling Policy компании. Поэтому Mythos 5.1 развёртывается с теми же защитными механизмами, что применялись к Mythos 5, ограничивающими доступ к исследовательским биологическим возможностям.

Киберриски. Проведён набор оценок для проверки киберспособностей Claude Mythos 5.1 (с отключёнными защитными механизмами кибербезопасности). В целом модель демонстрирует самые сильные киберспособности среди всех выпущенных моделей, хотя всё ещё остаётся в категории низкого риска согласно Frontier Compliance Framework. Также проведено обширное стресс-тестирование защитных механизмов кибербезопасности для Fable 5.1: помимо собственной динамической оценки их устойчивости, было заказано внешнее тестирование у двух организаций, а также автоматизированное тестирование от Gray Swan. Как и с Fable 5 и Opus 5, доказательств джейлбрейка критической тяжести для этих защитных механизмов не найдено.

Агентная безопасность. Проведены оценки того, как Claude Mythos 5.1 реагирует на злонамеренные запросы и инъекции промптов (враждебные инструкции, скрытые в контенте, который обрабатывают модели ИИ). Модель отказывала в выполнении злонамеренных агентных задач по программированию и работе с компьютером с частотой, сопоставимой с Mythos 5, Sonnet 5 и Opus 5, и стала самой устойчивой моделью на данный момент по внешнему бенчмарку инъекций промптов.

Согласованность. Поведение модели протестировано с помощью статических и интерактивных поведенческих оценок, анализа внутренних рассуждений с использованием автоэнкодеров естественного языка, оценок способностей, связанных с несогласованностью, обзора обучающих данных и анализа внутреннего пилотного использования. Также получены отчёты от внешнего тестирования.

Автоматизированный поведенческий аудит показал, что Claude Mythos 5.1 лучше согласована по большинству метрик, чем предшественница — Mythos 5. Модель значительно реже, чем Mythos 5, пытается получить доступ к ресурсам за пределами тестовой среды при получении невыполнимой задачи. Также она реже использует мотивированные рассуждения для оправдания своих действий (например, рассуждая, что ситуация является симуляцией или оценкой), и реже игнорирует явные ограничения в погоне за целями пользователей. По результатам обзора обучающих данных, Mythos 5.1 как пытается, так и успешно осуществляет reward hacking (обман системы вознаграждения) реже в целом, чем Mythos 5.

Хотя в целом оценки согласованности показали улучшения, тестирование обнаружило, что модель иногда всё же может обходить механизмы согласования и классификаторы автоматического режима (подробнее — в системной карточке). Есть и ограничения покрытия оценки согласованности: автоматизированный поведенческий аудит пока даёт меньше видимости в работе с очень длинным контекстом и в мультиагентных настройках. Также покрытие невыполнимых задач (которые могут вызывать более аномальное и несогласованное поведение) меньше желаемого, хотя недавно в этой области были достигнуты улучшения, и работа над этим продолжается.

Защитные механизмы также улучшены так, чтобы модели стали более полезными без компромиссов в безопасности. Изменения описаны ниже.

Автоматизированные защитные механизмы для предприятий. Enterprise Frontier Safeguards (EFS) позволяют обнаруживать злоупотребления моделями и реагировать на них, при этом предоставляя корпоративным клиентам приватность соглашения о нулевом хранении данных. С EFS клиенты хранят данные на собственной облачной инфраструктуре, а не на системах Anthropic; любая проверка человеком по умолчанию выполняется самим клиентом, а не Anthropic. Система EFS разработана в тесном сотрудничестве с более чем 100 клиентами из таких отраслей, как финансовые услуги, здравоохранение, производство, телекоммуникации, юриспруденция, ритейл и государственный сектор, а также с облачными партнёрами Amazon Web Services, Google Cloud и Microsoft Azure.

EFS будет поддерживаться в Claude Code, Claude Enterprise, Claude Platform, Amazon Bedrock, Claude Platform на AWS, Agent Platform от Google и Microsoft Foundry. Развёртывание идёт поэтапно, начиная с этой осени. Как указано выше, клиенты, соответствующие критериям для EFS, могут использовать Fable 5.1 (и Fable 5) с нулевым хранением данных до готовности EFS.

Более точные защитные механизмы для биологии и кибербезопасности. В последние месяцы достигнут прогресс в повышении точности защитных механизмов для Fable 5.1: снижена вероятность срабатывания на безобидный контент (например, вопросы о медицинских проблемах или запросы от киберзащитников, использующих модель для повышения безопасности своих систем), при сохранении надёжной защиты от реальных угроз.

Как сообщалось ранее, новейшие биологические защитные механизмы для Fable 5.1 и Fable 5 срабатывают на 85% реже на безобидные запросы, связанные с элементарной биологией и медицинскими вопросами (по сравнению с механизмами, запущенными вместе с Fable 5). Однако запросы, связанные с исследованиями и разработками в науках о жизни, всё ещё направляются на модели Opus. Возможности модели в области наук о жизни предоставляются профессионалам через программу доступа к Claude Mythos 5.1, разработанную в партнёрстве с правительством США.

С Fable 5.1 обновляются защитные механизмы кибербезопасности для повышения точности. Также теперь разрешено использовать Fable 5.1 для выявления уязвимостей в программном обеспечении — то есть для оборонной работы, повышающей безопасность программ. В результате этих изменений пользователи Claude Code могут ожидать в среднем около 60% меньше срабатываний защитных механизмов за сессию по сравнению с прежними механизмами на Fable 5. При этом защитные механизмы по-прежнему направляют ряд задач двойного назначения в кибербезопасности (задач, имеющих как полезные, так и потенциально вредные применения) на модели Opus. Это касается пентестинга, генерации эксплойтов и сканирования уязвимостей на основе бинарного анализа.

Механизмы против дистилляции. Дистилляция — метод извлечения возможностей передовых моделей, часто применяемый в промышленных масштабах с использованием тысяч фейковых аккаунтов. Дистилляция представляет риск для безопасности, поскольку извлечённые возможности впоследствии могут быть выпущены без надлежащих защитных механизмов. Fable 5.1 получила усиленные механизмы, усложняющие атаки дистилляции. Например, теперь для новых аккаунтов API (созданных начиная с сегодняшнего дня) невозможно вручную редактировать предыдущий контекст Claude в многоходовом диалоге с сохранением стенограммы предыдущих рассуждений модели. Это закрывает распространённую, публично документированную технику дистилляции, позволявшую незаконно извлекать рассуждения Claude. Изменение внедряется постепенно, чтобы минимизировать сбои: существующие аккаунты пока не затронуты, но затронутся с будущими релизами моделей. У небольшого числа клиентов с кастомными интеграциями также появятся изменения.

Доверенный доступ к Claude Mythos 5.1

Claude Mythos 5.1 идентична Fable 5.1, но предлагает более мягкие защитные механизмы для проверенных лиц и организаций, чья работа затрагивается ограничениями по кибербезопасности и наукам о жизни, описанными выше. Доступ предоставляется через две программы доверенного доступа:

  • Cyber Verification Program (CVP): в настоящее время предоставляет доступ к некоторым моделям класса Opus и Sonnet со сниженными киберзащитными механизмами для оборонной работы по безопасности. В ближайшем будущем программа также будет включать доступ к моделям класса Claude Mythos.
  • Life Sciences Verification Program (LSVP): предназначена для того, чтобы специалисты в области наук о жизни могли использовать Claude Mythos 5.1 с защитными механизмами, разработанными для профессиональной исследовательской и научно-технической деятельности (при сохранении всех остальных защитных механизмов). В партнёрстве с правительством США зарегистрированы первые участники, планируется расширение доступа к программе на более широкое сообщество специалистов в науках о жизни.

Помимо этих программ доверенного доступа, продукт Claude Security, сканирующий кодовые базы на уязвимости и предлагающий патчи для проверки человеком, теперь также работает на базе Claude Mythos 5.1.

Соответствие EU AI Act

В июле 2026 года Anthropic (вместе с 190 другими подписантами, включая нескольких других крупных провайдеров моделей ИИ) подписала Кодекс практики по прозрачности контента, созданного ИИ, в рамках EU AI Act.

Это потребовало добавить водяной знак — числовой способ определения вероятности того, что Claude участвовал в написании текста — к результатам моделей, выпущенных после 2 августа 2026 года. Этот водяной знак невидим для тех, у кого нет доступа к API обнаружения. Он не влияет на качество или содержание результатов Claude и не содержит информации о пользователе, его организации или переписке с Claude.

Закон также требует предоставить пользователям способ определить, содержит ли текст водяной знак. Поэтому в приватном превью запускается API обнаружения. Сейчас он доступен организациям, имеющим на это право по законодательству ЕС (регуляторам, правоохранительным органам, СМИ, фактчекерам, независимым исследователям, образовательным организациям и группам гражданского общества ЕС), а также предприятиям, обязанным проверять водяные знаки для соблюдения требований закона. Доступ к API обнаружения планируется расширять со временем.

Цена и доступность

Claude Fable 5.1 доступна уже сегодня на всех платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure. Разработчики могут начать работу с claude-fable-5-1 через Claude API.

Как упоминалось выше, снижена цена на чтение кэша Fable 5.1 (когда модель повторно использует уже обработанный контекст) везде, где использование оплачивается по токенам, например в API. Чтение кэша теперь стоит на 75% дешевле — $0,25 за миллион токенов.

Это изменение приводит к существенному снижению общей стоимости работы модели. Для типовых нагрузок расходы снижаются примерно на 25% относительно Fable 5. Для сложных задач программирования и высокоагентных задач экономия может достигать примерно 45%.

Остальное ценообразование Fable 5.1 совпадает с Fable 5: $10 за миллион входных токенов и $50 за миллион выходных токенов. Параллельно продолжается работа по переносу многих улучшений Fable 5.1 на остальные модели линейки.

Как отмечено выше, Claude Mythos 5.1 доступна проверенным киберзащитникам и специалистам в науках о жизни. В настоящее время доступ ограничен рядом организаций США, хотя ведётся координация с правительством США для расширения доступа на более широкий круг внутренних и международных партнёров как можно быстрее.