Экономия на AI · проверено 24 сентября 2026 г. · 10 минут

Как сэкономить на Codex: сравниваем стоимость GPT и DeepSeek

Для одной и той же короткой задачи стоимость моделей может отличаться на порядок. Показываем расчёт на 10 000 входных и 2 000 выходных токенов, разбираем кэш и объясняем, как выбрать дешёвую модель для черновика, не жертвуя проверкой сложных изменений.

Три группы фиолетовых токенов разного размера символизируют выбор стоимости модели
Сравнивайте цену одного успешного задания, а не только ставку входного токена.

За что вы платите при работе с Codex

Если Codex CLI запущен через Celestria Gate, деньги списываются с баланса Celestria за обращения к выбранной модели. Это отдельный API-биллинг, а не скидка на подписку OpenAI или бесплатный доступ к ней. Лаунчер помогает выбрать модель и подключить ключ; итоговая цена зависит от текста контекста, ответов, кэша, повторных попыток и числа шагов агента.

Цена в каталоге указана за миллион токенов отдельно для обычного входа, чтения кэша, записи кэша и выхода. Агент часто отправляет большой фрагмент проекта несколько раз, поэтому оценивать его по цене одного короткого чата опасно. Особенно внимательно смотрите на ставку cache write: у некоторых дешёвых на вид моделей она заметно выше обычного входа.

Пример: GPT-6 Sol против DeepSeek Flash

Срез публичного каталога Celestria Gate на 24 сентября 2026 года: gpt-6-sol — 209 ₽ за 1 млн входных и 1 042 ₽ за 1 млн выходных токенов; ~deepseek/deepseek-flash-latest — 12 ₽ за 1 млн входных и 72 ₽ за 1 млн выходных. Цены могут измениться, поэтому перед запуском большой задачи откройте живой каталог.

Представим одно задание без кэша, изображений и дополнительных API-операций: 10 000 входных и 2 000 выходных токенов. GPT-6 Sol: 0,01 × 209 + 0,002 × 1 042 = 4,174 ₽. DeepSeek Flash: 0,01 × 12 + 0,002 × 72 = 0,264 ₽. В этом конкретном сценарии прямой модельный расход ниже примерно на 93,7%. Это не обещание такой экономии в каждом сеансе: если дешёвая модель делает больше шагов, переделывает код или использует дорогой кэш, итог меняется.

Для честного сравнения считайте не стоимость одного сообщения, а стоимость успешно выполненного задания с тестами и исправлениями. Сильная модель может оказаться дешевле, если дешёвой требуется несколько повторов.

МодельВход, ₽ / 1 млнВыход, ₽ / 1 млнПример 10k + 2k
GPT-6 Sol2091 0424,174 ₽
DeepSeek Flash latest12720,264 ₽

Как установить Celestria Gate и включить выбор моделей

Проверьте Node.js 22 или новее. Создайте аккаунт Celestria Gate, пополните баланс и выпустите ключ в разделе «Ключи». В терминале откройте папку проекта и выполните команду ниже. При первом запуске появится запрос ключа; вставьте его в локальный запрос лаунчера. Глобальная установка необязательна: npx скачивает пакет для запуска по требованию.

Меню --choose показывает модели, совместимые с текстовыми задачами, инструментами и потоковым ответом. Выбирайте небольшую модель для простых правок и проверяйте качество на тестах. Если хочется короткую команду celestria, поставьте пакет глобально. На Windows используйте PowerShell, на macOS Terminal, на Linux свой терминал.

node --version
npx --yes @celestriagate/codex-launcher@latest codex --choose
# Необязательно: короткая команда на будущие запуски
npm install -g @celestriagate/codex-launcher@latest
celestria codex --choose

Практическая схема: не платить максимум за каждый шаг

Разделите работу на три класса. Простой поиск по файлам, черновые тесты и объяснение отдельной функции часто разумно начать с бюджетной совместимой модели. Изменение нескольких модулей, миграции и дебаг сложной ошибки стоит сперва проверить на более сильной модели. Критические правки, где ошибка дороже токенов, требуют вашего ревью и тестов независимо от цены модели.

Сохраните один и тот же проверочный набор: задачу, репозиторий, ожидаемые тесты и ограничение времени. Запускайте модели отдельно, фиксируйте расход по ключу и количество необходимых исправлений. Тогда сравнение не будет зависеть от красивого, но случайного ответа на один вопрос.

В Celestria выбор происходит при запуске отдельной сессии; он не подменяет модель в уже открытом диалоге другого клиента. Для ручного выбора точного ID используйте кавычки, чтобы оболочка не обработала специальные символы.

npx --yes @celestriagate/codex-launcher@latest codex '~deepseek/deepseek-flash-latest'
# Или сначала посмотрите актуальные варианты:
npx --yes @celestriagate/codex-launcher@latest models deepseek

Кэш, контекст и лимиты: где экономия может исчезнуть

Перед большим сеансом посмотрите все четыре ставки модели, а не только колонку «вход». У DeepSeek Flash в каталоге на дату статьи вход стоит 12 ₽ / 1 млн, но запись кэша — 3 567 ₽ / 1 млн. Большой объём записи кэша может полностью изменить экономику. Если клиент постоянно переотправляет одно и то же дерево проекта, следите за фактическими usage и списанием.

Установите месячный бюджет организации и отдельный лимит ключа для экспериментов. Начните с короткого задания и посмотрите цену в кабинете; только затем увеличивайте объём. Не делайте бесконечных автоматических повторов при 429 или 5xx: это одновременно увеличивает расход и ухудшает диагностику.

Для агента объём контекста — существенный рычаг. Не прикладывайте большие бинарные файлы, логи и сгенерированные каталоги без необходимости; формулируйте проверяемую цель и ожидаемые тесты. Но не урезайте контекст настолько, чтобы модель исправляла не тот код.

Чек-лист перед заменой основной модели

Celestria Gate полезна здесь не магической скидкой, а снижением стоимости переключения: не нужно перенастраивать клиент на каждого провайдера. Один ключ и одинаковая команда позволяют быстрее проверить реальную экономику на собственном коде.

  • Сравните цены входа, выхода и кэша в актуальном каталоге Celestria Gate.
  • Проверьте, что модель доступна в celestria models и умеет нужные инструменты.
  • Проведите 3–5 типичных задач на двух моделях; сохраните результаты тестов и фактический расход.
  • Считайте стоимость успешной задачи, включая повторные правки, а не отдельного ответа.
  • Оставьте человеку ревью существенных изменений и не отключайте тесты ради экономии.
  • Для экспериментального ключа задайте лимит и не публикуйте его ни в README, ни в скриншотах.

Частые вопросы

На сколько процентов Codex станет дешевле?

Фиксированного процента нет. В приведённом сценарии без кэша прямой расход DeepSeek Flash ниже GPT-6 Sol примерно на 93,7%, но число шагов, кэш и качество результата изменят реальный итог.

Нужна ли подписка OpenAI для такого запуска?

Для API-сессии через Celestria Gate нужен её ключ и баланс; это отдельная оплата по фактическому использованию. Наличие или отсутствие подписки OpenAI не превращает запросы Celestria в бесплатные.

Можно ли ограничить расход?

Да, используйте лимиты в кабинете Celestria для экспериментального ключа и бюджет организации. Проверяйте фактические списания после небольшого теста.

Что выгоднее: самая дешёвая модель или самая сильная?

Зависит от задачи. Сравнивайте цену успешного результата: дешёвая модель может потребовать больше повторов, а сильная — стоить дороже за токен, но быстрее решить сложную задачу.

Источники

Канонический адрес материала · Получить API-ключ