Anthropic выпустила вторую общедоступную модель класса Mythos: цена за токен прежняя, весь прирост сложен в длинные задачи
Первого сентября Anthropic без особой торжественности выпустила Claude Fable 5.1 — вторую по счёту общедоступную модель класса Mythos. Цену за токен не тронули, чтение из кэша подешевело вчетверо, а весь прирост качества компания аккуратно сложила в одно место: в длинные задачи, на которых предыдущие модели обыкновенно и рассыпались.
Со стороны спецификаций всё выглядит буднично, почти скучно. Модель отзывается на имя claude-fable-5-1, держит миллион токенов контекста и выдаёт до 128 тысяч, стоит десять долларов за миллион входных токенов и пятьдесят за миллион выходных — ровно столько же, сколько июньский Fable 5. Единственная цифра, которая изменилась, спрятана в третьем ряду прайса: чтение из кэша упало вчетверо. По подсчётам самой Anthropic, это даёт около четверти экономии на обычной работе и до сорока пяти процентов — на тех самых агентных сценариях, где модель по двести раз перечитывает один и тот же контекст и где Fable 5 разорял пользователя быстрее, чем успевал ему помочь. Заодно появился бета-режим, позволяющий менять глубину рассуждения посреди диалога, не обнуляя кэш промпта: раньше любая попытка подкрутить настройки на ходу стоила ровно столько же, сколько начать разговор заново.
Рассуждает Fable 5.1 теперь всегда, вопрос только в том, насколько глубоко: параметр effort принимает пять значений, от low до max, и это, пожалуй, честнее прежней схемы, где думать модель предлагалось попросить отдельно.
Бенчмарки, которые Anthropic вынесла в собственную сравнительную таблицу, подобраны с понятным умыслом. На Terminal-Bench-Science, где модель сажают в терминал с научным инструментарием и просят провести многошаговое исследование, результат вырос с 24,7 до 52,6 процента — то есть более чем вдвое. На кодовом Terminal-Bench 4.0 — с 42 до 55,8. На AutomationBench, измеряющем способность связывать десятки вызовов инструментов в одну цепочку, — с 17,1 до 31,4. Humanity's Last Exam, набор задач, который эксперты составляли с прямым намерением никого не пропустить, взят на 60,9 процента без инструментов и на 65 — с ними, а формальные математические доказательства ProofBench модель закрывает на сто процентов, что в этом жанре обычно означает не гениальность, а исчерпанность бенчмарка.
Независимые лидерборды подтверждают ту же картину без энтузиазма пресс-релиза. По данным BenchLM на сентябрь, на SWE-bench Pro у Fable 5.1 81,2 процента — первое место, но впереди Fable 5 с восемьюдесятью и собственного Opus 5 с 79,2; из чужих моделей ближайшая, GPT-5.6 Sol, отстаёт на шестнадцать пунктов, а Gemini 3.5 Flash — на двадцать шесть. Composite Vals Index — 67,87, снова первое место из пятидесяти одного участника и снова с отрывом от Opus 5 в шесть сотых процента.
Отдельного упоминания заслуживает цифра, которой в этой таблице нет. По обзорам Fable 5.1 бодро кочует «95 процентов на SWE-bench Verified»; это результат Fable 5, полученный в июне. Anthropic для версии 5.1 SWE-bench не публиковала вовсе, предпочтя ей агентные тесты, и всякий, кто приписывает новой модели старое достижение, просто переклеил этикетку.
Если сложить структуру прироста в одну фразу, получится следующее: на коротких задачах модель прибавила пару пунктов, на длинных — удвоилась. Разница здесь примерно та же, что между человеком, читающим книгу по странице, и человеком, помнящим сюжет целиком. Fable 5 умел решить сложную задачу; Fable 5.1 умеет не выпустить её из виду на четвёртом часу.
Здесь и возникает сравнение, от которого трудно уйти. Обычная модель ведёт себя как толковый junior: на понятный вопрос отвечает правильно, на двадцатом шаге теряется. Fable 5.1 держит проект целиком, не выгорает к четвергу и не приходит через полгода обсуждать вилку. Остаётся выяснить, во сколько обходится такой сотрудник — и на этом месте доллары из пресс-релиза удобнее заменить рублями из реального прайса.
Сколько стоит сотрудник, который не спит
В тарифах AI Mediator claude-fable-5-1 стоит 2 000 рублей за миллион входных токенов и 10 000 рублей за миллион выходных; чтение из кэша — 50 рублей за миллион, создание кэша — 2 500. Цены указаны без НДС. Обещанная Anthropic четырёхкратная скидка на кэш доехала и до рублёвого прайса: у июньского claude-fable-5 кэшированный запрос стоит 200 рублей за миллион, у новой версии — пятьдесят.
Дальше арифметика несложная. Умеренно активная работа — часа три агентных задач в день, примерно три миллиона входных токенов, из которых подавляющая часть приходит из кэша, и триста тысяч выходных. Чтение из кэша обходится в 135 рублей, свежий вход в 600, ответы модели в 3 000. К этому честно прибавляется создание самого кэша: чтобы прочитать оттуда 2,7 миллиона токенов, их сперва надо записать, и при паре перезаписей в день это ещё около 500 рублей. Итого порядка 4 200 рублей в день, или примерно 90 тысяч рублей в месяц при двадцати двух рабочих днях.
Девяносто тысяч рублей — это, по московским меркам, даже не половина оклада senior-разработчика, и оклад этот, в отличие от токенов, сопровождается страховыми взносами, рабочим местом, отпуском и больничными. Сравнение, разумеется, льстит машине: стоит поставить модель на тяжёлый агентный пайплайн с миллионными контекстами, и счёт уходит за несколько сотен тысяч в месяц, но тогда и сопоставлять его нужно уже не с сеньором, а с отделом.
Независимый оценщик Snorkel AI измерил, к слову, не столько успех, сколько его себестоимость, и нашёл, что на задачах, которые решили обе модели, Fable 5.1 тратил на решение заметно меньше работы, чем Opus 5.
Где Fable 5.1 не нужен
Что не мешает Anthropic в собственной документации рекомендовать начинать всё-таки с Opus 5. Тот стоит ровно вдвое дешевле — 1 000 рублей за миллион входных токенов и 5 000 за миллион выходных, — а на CursorBench уступает старшей модели 3,4 пункта. Арифметика, при которой переплата окупается далеко не всегда. Смысл в Fable 5.1 появляется там, где Opus 5 даже на максимальном effort стабильно не дотягивает, либо где задача идёт часами без человека рядом. Прежде чем переводить весь трафик, разумнее прогнать десяток своих самых тяжёлых задач на обеих моделях и посмотреть на счёт.
Слой безопасности
Fable 5.1 — это Mythos 5.1 с надстроенными классификаторами: запросы по кибербезопасности, биологии, химии и дистилляции моделей перехватываются и уходят на Claude Opus 5. Технически отказ приходит не ошибкой, а обычным HTTP 200 со stop_reason: "refusal" и объектом stop_details, где указана сработавшая категория; если модель не успела выдать ни одного токена, отказ не тарифицируется, что можно считать проявлением такта.
Главное, что изменилось в 5.1, — классификаторы перенастроили. По данным Anthropic, ложных срабатываний по биологии на безобидных запросах стало на 85 процентов меньше, а кибер-перехватов за сессию Claude Code — примерно на 60. Цифры измерены на собственном трафике компании и внешне невоспроизводимы, но для тех, кто летом регулярно упирался в отказ на совершенно легальной задаче, они значат больше любой строки в таблице бенчмарков.
Сколько стоит эта деликатность, видно там же: на Terminal-Bench 4.0 неограниченный Mythos 5.1 набирает 60,9 процента против 55,8 у Fable 5.1. Пять пунктов — и есть цена безопасности. Сам Mythos 5.1 доступен только участникам Project Glasswing, так что проверить это на практике большинству желающих не придётся.
Как получить доступ из России
Россия в список регионов, где Anthropic предоставляет Claude.ai и коммерческий API, не входит, и правила компании прямо требуют находиться в поддерживаемом регионе. AI Mediator решает этот вопрос за клиента: доступ к claude-fable-5-1 идёт без VPN, оплата — в рублях, с закрывающими документами, которые можно показать бухгалтерии.
Что мы предлагаем:
Без VPN и зарубежных карт. Обычный запрос к API из российской инфраструктуры. Оплата в рублях — бизнес-картой или безналичным платежом, со счётом и полным пакетом закрывающих документов. Приватность. Мы не сохраняем ваши данные и тексты запросов. Учтите, что на своей стороне Anthropic для моделей класса Mythos применяет обязательное тридцатидневное хранение — от него не освобождает ни один посредник. Без блокировок. Трёхкратная система резервирования и постоянный мониторинг: доступ не пропадает в тот день, когда он вам нужнее всего. Экспертность. Сервис сфокусирован именно на корпоративном API-доступе — для бизнеса, госкомпаний и учебных заведений. Лучшая в РФ цена на API к иностранным AI-моделям. Поддержка и внедрение. Ответ на запрос в течение рабочего дня, в Telegram — обычно за несколько часов; на корпоративном тарифе приоритетная поддержка 24/7 и консультации по интеграции.
Подключение занимает три шага: зарегистрироваться в личном кабинете, пополнить баланс и получить API-ключ.