Бонусы за приглашения

Как работают бонусы за приглашения

Поделитесь ссылкой. Когда друг зарегистрируется по ней и пополнит баланс, вы получите указанный бонус за его последующие пополнения.

Claude Opus 5.5 или Fable 5.1: стоимость разработки и выбор

Opus 5.5 выгоднее как основная модель для проверяемого кода и ограниченных задач с инструментами; Fable 5.1 стоит доплаты там, где ошибку трудно заметить или дорого исправлять.

Содержание
Claude Opus 5.5 или Fable 5.1: стоимость разработки и выбор

Если вы можете просмотреть diff, запустить тесты и проверить готовый результат, для повседневной разработки и чётко ограниченных задач с инструментами стоит сначала выбирать Claude Opus 5.5. Входные и выходные токены у него на 60% дешевле, чем у Fable 5.1, а независимые оценки показывают сопоставимый или более высокий результат. Но Opus способен работать дольше и потратить больше токенов, поэтому низкая цена за токен не отменяет лимиты.

Доплата за Fable 5.1 оправдана, когда результат слишком велик или сложен для быстрой ручной проверки либо когда ошибка в первой версии обойдётся дороже счёта за модель. Ниже — сравнение по опубликованным ценам, независимым тестам и практическому обзору, актуальным на 26 сентября 2026 года.

Короткий вывод: Opus — основной вариант, Fable — для отдельных задач с высоким риском

ЗадачаЧто выбрать сначалаПочему
Новая функция, исправление ошибки или прототип в знакомом проектеOpus 5.5Ниже цена, уровень близок к Fable, результат легко проверить
Миграция, аудит или массовое изменение с понятными критериями приёмкиOpus 5.5Хорошо справляется с длинной работой, если задать контрольные точки и условие остановки
Сложная проблема, где большой diff трудно быстро оценитьFable 5.1В практическом обзоре Fable по-прежнему выбирали для самых трудных задач
Результат желательно получить правильным с первой попыткиFable 5.1Доплата может быть меньше стоимости переделки или срыва срока
Открытая задача без бюджета и определения готовностиНе запускать без контроляOpus может расширять объём работы и продолжать расход; сначала задайте границы

Сравнивать только ярлыки «Opus дешевле» и «Fable умнее» недостаточно. Важна полная стоимость выполнения одной и той же задачи: вход, выход, кэш, вызовы инструментов, повторные попытки, проверка человеком и переделка.

Цена токенов: вход и выход Opus стоят 40% от цены Fable

На 26 сентября 2026 года Anthropic указывает для Opus 5.5 цену $4 за миллион входных и $20 за миллион выходных токенов. В практическом обзоре Every для Fable 5.1 указаны $10 и $50.

За 1 млн токеновOpus 5.5Fable 5.1Разница
Вход$4$10Opus дешевле на 60%
Выход$20$50Opus дешевле на 60%

При одинаковом соотношении входа и выхода Fable стоит в 2,5 раза дороже за токен. Для Opus Anthropic также публикует цену чтения кэша $0,20 и записи кэша $5 за миллион токенов. Прямое сравнение кэша здесь не делается: в использованном источнике по Fable нет цены в том же формате.

Прайс-лист отвечает на вопрос «сколько стоит токен», но не на вопрос «сколько будет стоить задача». Агент для разработки читает файлы, вызывает инструменты, повторно запускает тесты и исправляет собственные изменения, поэтому расход двух моделей на одном задании может сильно различаться.

Расход на задачу: Opus вывел примерно на 53% больше токенов, но стоил дешевле

По данным Artificial Analysis, при максимальном уровне effort средний выход на одну задачу Intelligence Index составил:

  • Opus 5.5 — около 119 000 выходных токенов;
  • Fable 5.1 — около 78 000 выходных токенов.

То есть Opus сформировал примерно на 53% больше текста и служебного вывода. Если совместить эти средние значения с опубликованной ценой выхода, получится следующий пример только для выходных токенов:

  • Opus 5.5: 119 000 ÷ 1 000 000 × $20 ≈ $2,38;
  • Fable 5.1: 78 000 ÷ 1 000 000 × $50 ≈ $3,90.

В этой конкретной оценке Opus использовал примерно в 1,53 раза больше выходных токенов, но выходная часть счёта была примерно на 39% ниже. Из соотношения цен 2,5 к 1 следует, что при похожей структуре входа и выхода Opus может потратить до 2,5 раза больше токенов, прежде чем стоимость сравняется.

Это не расчёт реального заказа на разработку. Здесь нет входных токенов, кэша, инструментов, повторных запусков и особенностей провайдера, а Intelligence Index не воспроизводит ваш репозиторий. Вывод уже: больший выход Opus не делает его автоматически дороже, но низкая цена не повод оставлять долгий запуск без лимита.

Независимые тесты: Opus подходит на роль основного, но не заменяет Fable во всём

Artificial Analysis присвоил Opus 5.5 при максимальном effort 58 баллов — это был лучший результат Intelligence Index на момент публикации. Прямые сравнения с Fable 5.1 выглядят так:

Независимая оценкаOpus 5.5Fable 5.1Что это показывает
Humanity’s Last Exam61,4%59,1%Небольшое преимущество Opus
SciCode66,9%63,1%Opus выше в задачах научного программирования
GDPval-AA v2.11846 Elo1735 EloOpus выше в работе агента со знаниями
AA-Briefcase v1.11822 EloНа 143 Elo ниже OpusOpus лидирует в целом, но Fable немного выше по подоценке rubric-based scoring

В том же отчёте Opus отстаёт в CritPt, AA-LCR и GDP.pdf. Четыре режима effort модели оказались на границе Парето «качество — стоимость задачи». Это сильный аргумент в пользу Opus как сочетания возможностей и цены, но не доказательство победы на любой работе.

В опубликованных Anthropic результатах по программированию направление похоже. Например, для CursorBench 4.0 компания приводит 52,5% у Opus на стандартном medium effort и 51,8% у Fable на max effort. Это данные производителя, причём сама Anthropic предупреждает: небольшая разница между передовыми моделями всё хуже предсказывает реальную работу. Такие цифры подходят для первичного отбора, а не вместо теста на своих задачах.

Практика разработки: зелёные тесты ещё не означают исправный продукт

Команда Every использовала Opus 5.5 семь дней до релиза. Издание сообщает, что Anthropic предоставила ранний доступ, но не влияла на текст обзора. Единого мнения у авторов не было — и это помогает провести границу выбора:

  • один из тестировщиков заменил Fable на Opus как основную модель и счёл его таким же хорошим, а иногда и лучшим для продуктовой разработки и кода;
  • другой назвал модель «уменьшенным Fable»: удобным для ежедневной работы и крупных сквозных проектов, но для самых трудных задач продолжил выбирать Fable;
  • один автор оценил способность Opus к программированию примерно в 90% от Fable. Это личная оценка на его наборе работ, а не универсальный тест.

Самый полезный пример — приложение с голосовой формой. Opus работал около 30 минут и израсходовал примерно 5,9 млн токенов. Автоматические проверки были зелёными, однако при ручном запуске основные экраны выдавали ошибки, а требуемый ИИ-сервис вообще не вызывался.

Поэтому для функций и прототипов в знакомом коде Opus подходит только при трёх контрольных шагах: прочитать diff, запустить настоящее приложение и проверить критические внешние вызовы. Файлы, нужные для проверки, лучше хранить отдельной копией, чтобы агент не изменил или не удалил собственные доказательства.

Когда высокая цена Fable 5.1 всё ещё оправдана

1. Изменение слишком велико для быстрой ручной проверки

Если работа затрагивает несколько сервисов, включает необратимую миграцию данных или может скрывать ошибки безопасности и конкурентного доступа, важнее вероятность правильной первой версии, а не цена токена. В обзоре Every именно крупнейшие и самые сложные задачи по-прежнему отдавали Fable.

Считайте не только доплату за модель, но и сэкономленное время инженера. Если одна предотвращённая ошибка, откат или расследование стоят дороже разницы в API-счёте, Fable может оказаться экономичным выбором.

2. Результат должен быть максимально близок к готовому с первой попытки

В задачах со строгим шаблоном, правилами бренда или жёстким сроком Fable оказался надёжнее из этих двух. В одном задании на презентацию Opus сделал неплохую компоновку, но взял неверный логотип и цвета и добавил неподтверждённое утверждение; Fable подготовил лучший вариант.

Когда точность первой версии важнее пространства для эксперимента, сначала проверьте Fable. «Надёжнее» всё равно не означает «можно не проверять».

3. Проверка человеком дороже вычислений

Если старший разработчик тратит два часа на проверку разросшегося патча Opus, а Fable стабильно выдаёт меньшее изменение, корректность которого проще доказать, более высокий счёт API может снизить общую стоимость. У команды с сильными тестами, превью-средой и обязательным code review, наоборот, низкая цена Opus легче превращается в реальную экономию.

Как честно сравнить модели на своём проекте

Не делайте вывод по одному запросу и не давайте моделям разные инструменты или контекст. Возьмите 5–10 реальных повторяемых задач: обычную функцию, исправление в нескольких файлах, длинную работу и изменение с высоким риском. Дальше соблюдайте одинаковые условия:

  1. Одна и та же версия репозитория, системные инструкции, права инструментов и приёмочные тесты.
  2. Сначала одинаковый уровень effort, затем отдельный запуск каждой модели в её лучшем режиме.
  3. До старта задайте определение готовности, максимальное время, бюджет токенов и условие остановки.
  4. Записывайте вход, выход, кэш, вызовы инструментов, фактическое время, успех с первой попытки и время ручной переделки.
  5. Включайте в стоимость неудачные запуски и повторы, а не только красивый успешный результат.

Правило выбора можно записать так:

Полная стоимость задачи = счёт модели + проверка человеком + переделка и повторы + ожидаемый ущерб от ошибочного результата.

Если доля успеха Opus с первой попытки близка к Fable, сделайте Opus основным. Если Fable заметно сокращает переделку в определённом классе рискованных задач, направляйте к нему только этот класс. Так вы сохраните высокий предел Fable, не оплачивая цену токенов в 2,5 раза выше для каждой обычной просьбы.

Итоговая рекомендация

Для большинства задач программирования и чётко ограниченной работы с инструментами сначала выбирайте Claude Opus 5.5. Вход и выход у него на 60% дешевле, независимые результаты подтверждают уровень передовой модели, а в приведённом примере даже повышенный расход выхода не сделал его дороже Fable.

Платите за Fable 5.1, когда результат трудно проверить, ошибка первой версии особенно дорога или ваш контролируемый тест показывает заметное сокращение переделки. Практичная схема — поручить Opus большую часть проверяемой работы, а Fable оставить для небольшого числа рискованных и ценных задач.

Источники

Данные проверены 26 сентября 2026 года. Цены и поведение моделей могут измениться после обновлений провайдеров.

Готовы оптимизировать LLM workflow?

Подключите единый API, управляйте ключами и контролируйте расходы на AI-модели в BetterToken.

Начать бесплатно