Короткий ответ
Sonnet 5.5 снижает тариф за токен в новом семействе Anthropic. Одинаковый контекст и необычный результат кода делают выбор сложнее простой таблицы цен.
Недорогая модель меняет начальный выбор
Anthropic представил Claude Sonnet 5.5 28 сентября, после официального анонса Opus 5.5 от 22 сентября. Стоимость моделей Claude теперь стоит оценивать по типам работы: какие задачи требуют старшей модели, а какие надёжно выполняет менее дорогая конфигурация? Это относится и к коду, и к документам.
Разработчик позиционирует Sonnet для определённых повседневных задач, Opus — для сложной работы с длительным суждением. Это описание компании. Практически полезно сначала различить точечное исправление ошибки и неоднозначный пересмотр архитектуры, затем выбирать модель и критерий готовности.
Контекст одинаковый, базовые тарифы разные
Документация, проверенная 1 октября, даёт обеим моделям миллион токенов контекста и 128 тысяч выхода. Вход и выход Sonnet стоят вдвое дешевле, но чтение кеша имеет одинаковую цену. Пятиминутная запись кеша оплачивается отдельно. Таблица сохраняет эти категории для расчёта.
Одинаковая ёмкость не доказывает одинаковое извлечение сведений из репозитория. Итоговую стоимость меняют повторная передача контекста, рассуждение и действия инструментов. Для прогноза нужно знать собственную долю кеша и число принятых результатов, а не только тариф одного токена.
| Показатель | Claude Sonnet 5.5 | Claude Opus 5.5 |
|---|---|---|
| Вход, USD / 1 млн токенов | $2 | $4 |
| Выход, USD / 1 млн токенов | $10 | $20 |
| Чтение кеша, USD / 1 млн | $0.20 | $0.20 |
| Запись кеша, USD / 1 млн | $2.50 | $5 |
| Токены контекста | 1,000,000 | 1,000,000 |
| Токены выхода | 128,000 | 128,000 |
| Усилие API по умолчанию | Высокий (high) | Средний (medium) |
| Входные данные | Текст и изображения | Текст и изображения |
Необычный результат кода зависит от усилия
В анонсе 28 сентября Sonnet получает 52,1% на FrontierCode v1.1 Main при xhigh и 46,2% при max. Примечание связывает снижение с дополнительной проверкой, тайм-аутами и правками вне задачи. Для Opus при max опубликовано 54,4%. Это данные разработчика, а не новое испытание редакции.
Оценка проверяет возможность принять изменение без ручного редактирования. Лишняя работа может ухудшить результат, если расширяет задачу. Поэтому максимальный бюджет рассуждения не следует автоматически считать лучшим: нужны заданные границы изменения и намеренно выбранный уровень усилия.
| Модель | Уровень рассуждения | FrontierCode v1.1 Main (%) |
|---|---|---|
| Claude Sonnet 5.5 | Очень высокий (xhigh) | 52.1% |
| Claude Sonnet 5.5 | Максимальный (max) | 46.2% |
| Claude Opus 5.5 | Максимальный (max) | 54.4% |
Настройки по умолчанию требуют уточнения
В документации API Sonnet по умолчанию использует high, тогда как анонс указывает medium для приложений Claude и Claude Code. Для API Opus указан medium. Без записи среды две обычные сессии могут оказаться испытаниями с разными бюджетами рассуждения.
Artificial Analysis отдельно публикует независимые измерения Terminal-Bench 4.0 в своей общей среде. У них должны сохраняться источник и настройки. Значение из рекламного запуска нельзя подставлять вместо независимого результата: это разные наблюдения, полезные именно при корректной атрибуции.
Правило выбора должно поддаваться проверке
Редакционный вывод — начинать с определённой задачи, условия остановки и записанного уровня усилия. Проверяйте обычные исправления отдельно от открытых архитектурных решений. Если Sonnet проходит приёмку, снижение тарифа значимо; если требует постоянного исправления, сравните полный процесс с Opus.
Считайте все попытки, время и замечания проверяющего. После обновления модели пересматривайте распределение задач. На 1 октября подтверждены даты релизов, ёмкость и обычные цены; самая дешёвая конфигурация для конкретной команды зависит от её работы и стандартов проверки.
Вопросы и ответы
Sonnet всегда обходится вдвое дешевле?
Его базовые тарифы входа и выхода вдвое ниже, но чтение кеша стоит столько же. Расход токенов, повторы и время проверки меняют стоимость законченной задачи.
Различаются ли размеры контекста?
Документация, проверенная 1 октября, указывает для обеих моделей миллион токенов контекста и 128 тысяч выхода. Эти два лимита описывают разные возможности.
Почему максимальное усилие ухудшает балл?
Anthropic объясняет, что дополнительная проверка иногда вызывала тайм-ауты или лишние правки. FrontierCode оценивает возможность принять изменение без ручного редактирования.
