Каталог моделей и цены - самая изменчивая часть любой книги про такой продукт, и честнее всего сказать это прямо. Здесь важны не конкретные числа, а устройство тарификации: как считается стоимость, из каких составляющих она складывается и что делает один и тот же запрос дороже или дешевле. Эти правила меняются медленно, в отличие от самих цифр, и знание правил переживает несколько поколений прайс-листа.
Стоимость обычно указывают за миллион токенов и разносят по нескольким колонкам: входные токены, запись в кэш, чтение из кэша и выходные токены. Такая структура сама по себе полезна: она объясняет, почему длинный контекст дорожает быстрее, чем растёт задача, и почему повторное обращение к тому же материалу дешевле первого. Понимая структуру, вы читаете любой прайс-лист, даже если числа в нём другие, и сразу видите, какая колонка отвечает за ваш сценарий.
Кэш заслуживает отдельного разбора, потому что его экономика не сводится к слову дешевле. Запись стоит дороже обычного входа, чтение - на порядок дешевле. Значит, у кэша есть точка окупаемости: он выигрывает, когда один и тот же материал используется многократно, и проигрывает при однократном обращении, где вы платите надбавку за запись и не получаете ни одного дешёвого чтения. Отсюда практическое следствие: длинная связная сессия над одним и тем же кодом экономит, а десяток разрозненных коротких запросов по разным файлам - нет.
Отдельно отмечаются модели с расширенным контекстом. Чаще всего расширенное окно считается по тем же ставкам, без надбавки за длинный контекст; у части каталога вход сверх порога стоит вдвое дороже, а у отдельных моделей поднята и сама базовая ставка. Это важнее, чем кажется: задача, случайно вышедшая за границу, стоит принципиально иначе, чем та же задача, уложившаяся в неё, и разница возникает не постепенно, а скачком. Вот почему дисциплина узкого контекста - не только про качество ответа, но и про деньги.
| Составляющая | Что означает | Что с ней делать |
|---|---|---|
| Входные токены | Всё, что уходит в запрос: контекст, файлы, история | Держать контекст узким - это и качество, и деньги |
| Запись в кэш | Первое сохранение материала для повторного использования | Оправдана при многократных обращениях к тому же материалу |
| Чтение из кэша | Повторное обращение к уже сохранённому | Дешевле входных токенов; выигрывает длинная связная работа |
|---|
| Выходные токены | Всё, что модель написала в ответ | Длинные отчёты стоят денег; просить сжатую сводку |
|---|
| Расширенный контекст | Модели с увеличенным окном | Выше базовая ставка и возможен коэффициент за порогом |
|---|
| Сноски модели | Скрыта по умолчанию, вариант с рассуждением, удвоение за порогом | Именно они определяют счёт, а не заголовок таблицы |
|---|
Есть класс примечаний, которые легко пропустить: модель скрыта по умолчанию, вариант с расширенным рассуждением считается иначе, стоимость удваивается за порогом, для части моделей действует временная акция. Именно такие сноски определяют реальный счёт, а не заголовок таблицы. При выборе модели для регулярной автоматизации читать надо в первую очередь их: разовый эксперимент переживёт любую сноску, а ежедневный прогон умножит её на число запусков.
Важно понимать и то, что таблица цен не является счётом. Фактическую сумму меняют кредиты тарифа, скидки, режим работы и то, какая модель в итоге обслужила запрос при автоматической маршрутизации. Два человека с одинаковым названием модели в интерфейсе могут заплатить по-разному, и разница объясняется не ценой за миллион токенов, а условиями их подписок. Поэтому единственный надёжный источник о ваших расходах - ваш собственный учёт расхода, а не публичная таблица.
Практический вывод для планирования: бюджет считают не по цене за миллион токенов, а по стоимости типичной задачи. Возьмите десяток реальных прогонов, посмотрите фактический расход по каждому и умножьте на ожидаемую частоту. Такой расчёт переживает смену цен и даёт понятную единицу для разговора с финансами - стоимость обзора одного изменения, а не абстрактные токены.
И главное правило работы с этим справочником: перед решением о бюджете или закупке открывают живую страницу цен и текущий каталог в своём аккаунте. Числа в книге - датированный снимок, полезный для понимания структуры и порядка величин. Опираться на них при планировании расходов нельзя, и книга не претендует на обратное.
Инженерный вывод простой: понимайте механику тарификации, а числа проверяйте. Тогда изменение цен перестаёт быть неожиданностью: вы знаете, какие ваши сценарии чувствительны к входным токенам, какие к выходным и где вас спасает кэш. Это же знание отвечает и на вопрос, что делать, если счёт вырос: искать не более дешёвую модель, а составляющую, которая выросла.
Типичные провалы предсказуемы. Планировать бюджет по цене за миллион токенов вместо стоимости типичной задачи. Пропустить сноску про удвоение за порогом контекста. Считать кэш всегда выгодным и платить за запись там, где чтения не будет. Принимать публичную таблицу за счёт, не глядя на собственный учёт расхода. Зашить в автоматизацию модель по вчерашнему снимку. И сравнивать модели по цене, не сравнив по результату на одинаковом наборе задач.