GPT-6 Astra или Claude Fable 5.1: что выбрать для agent-задач
С какой модели начать для работы с инструментами, кода и больших документов: сравнение GPT-6 Astra и Claude Fable 5.1 по стоимости, кешированию и публичным тестам.
Содержание

Для сложных сессий с инструментами, особенно когда нужно вмешиваться по ходу задачи, первой стоит попробовать GPT-6 Astra. Для повторяющегося большого контекста и очень длинных запросов, где чувствительна стоимость, — Claude Fable 5.1. При работе с кодом начните с нескольких своих задач: проверьте обе модели одинаковыми тестами и посмотрите, сколько ручных правок потребуется.
В каталоге BetterToken на 5 сентября 2026 года есть обе модели. Через собственный аккаунт и API Key вы можете подключить их к своему инструменту и сравнить результаты на одинаковых задачах. В Dashboard доступны модель, статус запроса, входные, выходные и кешированные токены, а также соответствующий расход — так можно сопоставить качество результата с затратами на запросы.
Создать аккаунт BetterToken и сравнить модели на своих задачах
Основание для первого выбора Astra — заявленные OpenAI асинхронные вызовы инструментов и mid-turn steering: возможность уточнять направление работы во время выполнения. Это возможности модели по описанию OpenAI; их поддержка в выбранном инструменте и при подключении через BetterToken требует отдельной проверки. Преимущество Fable для большого повторяющегося контекста проще оценить по тарифам: у неё дешевле чтение кеша и нет описанного ниже повышения цены Astra после 272K входных токенов.
Где расходится стоимость
По публичным базовым тарифам OpenAI и Anthropic обе модели стоят $10 за миллион входных и $50 за миллион выходных токенов. Различия начинаются при повторном использовании контекста и очень длинном входе. Цифры в таблице — цены поставщиков на 5 сентября 2026 года; текущая стоимость вызовов через BetterToken указана на его странице цен.
| Параметр | GPT-6 Astra — OpenAI | Claude Fable 5.1 — Anthropic |
|---|---|---|
| Контекст / максимальный ответ | 1 050 000 / 128 000 токенов | 1 000 000 / 128 000 токенов |
| Обычный вход, за 1M токенов | $10 | $10 |
| Выход, за 1M токенов | $50 | $50 |
| Запись кеша, за 1M токенов | $12.50 | $12.50 на 5 минут; $20 на 1 час |
| Чтение кеша, за 1M токенов | $1 | $0.25 |
| Длинный вход | При input свыше 272K: весь input/cache запроса — 2x, output — 1.5x | Контекст до 1M по стандартной цене |
Характеристики и тарифы приведены в документации GPT-6 Astra и Claude Fable 5.1; стандартную цену для контекста Fable до 1M подтверждает документация Anthropic о контекстном окне.
Если запрос Astra превышает 272K входных токенов, повышенная ставка применяется ко всему запросу: input и cache умножаются на 2, output — на 1.5. Доплата касается всего входа, включая первые 272K токенов. При загрузке большого репозитория или набора документов это может изменить выбор даже при близком качестве ответов.
Для повторяющихся запросов разницу показывает простой расчёт по ценам поставщиков. Допустим, первый запрос записывает в кеш общий префикс из 100K токенов, ещё девять запросов целиком читают его из кеша, а суммарный ответ составляет 50K токенов. Для Fable берём запись на 5 минут и предполагаем, что каждое чтение попадает в срок действия кеша; запросы Astra остаются ниже порога 272K.
Astra: 0.1 × $12.50 + 0.9 × $1.00 + 0.05 × $50 = $4.65
Fable: 0.1 × $12.50 + 0.9 × $0.25 + 0.05 × $50 = $3.975 ≈ $3.98
В этом примере рассчитаны только общий префикс и выходные токены; новый вход и повторы запросов оплачиваются дополнительно. Выгода Fable зависит от реального использования кеша: изменение префикса или истечение TTL, то есть срока хранения, потребует новой записи. Часовая запись стоит дороже пятиминутной, поэтому её имеет смысл выбирать под интервалы между своими запросами.
Что показывают публичные тесты
OpenAI выпустила Astra 3 сентября 2026 года, Anthropic — Fable 5.1 1 сентября. На дату проверки прямой OpenAI-доступ к Astra разворачивается поэтапно, а Fable доступна через Claude API и перечисленные Anthropic облачные платформы. Это условия прямого доступа у поставщиков; обе модели уже перечислены в каталоге BetterToken.
В опубликованном OpenAI сравнении есть следующие результаты:
| Тест | GPT-6 Astra | Claude Fable 5.1 | Источник результатов |
|---|---|---|---|
| AutomationBench | 41.4 | 31.4 | OpenAI |
| Terminal-Bench 4.0 | 57.9 | 55.8 | OpenAI |
| DeepSWE | 74.1 | 67.4 | OpenAI |
| Humanity’s Last Exam with tools | 57.2 | 65.0 | OpenAI |
Эти результаты поддерживают выбор Astra для первого прогона задач с инструментами. При этом в сносках OpenAI отмечены различия настроек и тестовой среды — harness, которая управляет инструментами, контекстом и повторами.
Независимый Artificial Analysis оценивает Astra примерно в 61 балл Intelligence Index, Fable 5.1 — в 66. Оценка Fable в 66 баллов получена на max effort с включённым по умолчанию серверным fallback Anthropic; около 4% выходных токенов теста пришлись на Opus 4.8/5, поэтому это результат системы, а не изолированной модели. В Coding Agent Index у них 67 и 70 соответственно. Здесь Astra работает в Codex, а Fable — в Claude Code: результат относится к сочетанию модели и инструмента. Поэтому для выбора модели под свой репозиторий полезнее проверить конкретное исправление или изменение, которое вы можете принять теми же тестами. Собственного платного A/B-прогона этих моделей при подготовке статьи мы не проводили.
Как сравнить модели через BetterToken
Используйте точные Model ID и подходящие Key-группы. На 5 сентября 2026 года структурированный каталог BetterToken указывает:
| Модель | Model ID | Группа API Key | Протокол |
|---|---|---|---|
| GPT-6 Astra | gpt-6-astra | GPT | OpenAI-compatible |
| Claude Fable 5.1 | claude-fable-5-1 | Claude | Anthropic-compatible или OpenAI-compatible — по выбранному инструменту |
Создайте нужные API Keys в своём аккаунте. Для Codex и Claude Code используйте соответствующие инструкции: подключение Codex и подключение Claude Code. Base URL, способ авторизации и протокол выбираются по инструменту; одной конфигурации для всех случаев нет.
Если ваша программа принудительно выбирает инструмент, проверьте tool_choice: по документации Anthropic, Fable 5.1 возвращает 400 для any или конкретного tool. Доступны auto и none. Для программы, которой нужен обязательный вызов заданного инструмента, это условие меняет способ подключения.
Возьмите несколько задач из своей работы: например, исправление знакомого бага, небольшое изменение с тестами или ответ по набору документов. Дайте обеим моделям одинаковые исходные материалы и условия приёмки. Проверьте результат, нужные ручные правки, затраченное время и расход по запросам. Если используете разные инструменты, сохраните их названия и версии; при заметно нестабильном результате повторите задачу.
Выбирайте модель, которая выполняет ваши задачи с подходящими затратами и укладывается в допустимые время и объём ручной работы. Меньшее число правок тоже влияет на стоимость готового результата.