Сравнение моделей · обновлено 2 октября 2026 г. · 11 минут

Claude Opus 5.5 и GPT-6.1 Sol: что выбрать для API

Выбираете модель для приложения, работы с кодом или документов? GPT-6.1 Sol дешевле на коротких запросах. Но после 272 тысяч входных токенов разница в официальных тарифах заметно сокращается. Разберём цены, ограничения и задания, на которых стоит проверить обе модели.

Две рабочие станции с ноутбуком и документами для сравнения Claude Opus 5.5 и GPT-6.1 Sol
Одна задача, две модели. Выбирать удобнее по результату, расходу и объёму правок. Иллюстрации: ImageGen.

С чего начать выбор

Если запускаете новую AI-функцию и важен бюджет, начните с GPT-6.1 Sol. Его обычные входные и выходные токены стоят вдвое дешевле, чем у Opus 5.5 по официальным Standard-тарифам. Это сравнение одинакового количества токенов при входе до 272 тысяч; стоимость одной и той же задачи может отличаться из-за длины ответа и повторных запросов.

На сложных задачах стоит проверить обе модели: правку нескольких файлов, разбор документа и подготовку текста для клиента. Более дорогой вариант оправдан, если именно в ваших проверках он сокращает число попыток или ручных исправлений. Собственного сравнительного теста этой пары мы не проводили. Ниже — опубликованные характеристики, расчёты стоимости и задания, на которых можно проверить обе модели.

Ваша задачаЧто сравнить в первую очередь
Много коротких запросов в приложенииСтоимость удачного ответа и долю повторов; Sol дешевле по ставке
Исправление кодаПроходят ли тесты и сколько осталось правок человеку
Русский текст для клиентаСохранены ли факты, понятен ли следующий шаг
Документ больше 272K токеновПолную стоимость запроса с надбавкой за длинный контекст
Агент с несколькими действиямиРасход всей цепочки и выполнение задачи до конца

Claude Opus 5.5 и GPT-6.1 Sol: основные отличия

Здесь под GPT-6.1 понимаем GPT-6.1 Sol. Характеристики и цены сверены 2 октября 2026 года по документации OpenAI, Anthropic и живому каталогу Celestria Gate. Вход — это ваши инструкции, история разговора и приложенные данные; выход — оплачиваемые токены, которые создаёт модель.

Обе модели принимают текст и изображения и возвращают текст. Окно контекста у обеих примерно миллион токенов, обычный максимальный выход — 128 тысяч токенов, включая рассуждение. Доступность и инструменты проверяйте в каталоге Gate, а доступное окно контекста — через GET /v1/models со своим ключом, если маршрут передаёт эти данные.

ПараметрGPT-6.1 SolClaude Opus 5.5
Модель в Celestria Gategpt-6.1-solanthropic/claude-opus-5.5
Контекст по документации разработчика1 050 000 токенов1 000 000 токенов
Обычный максимальный выход128 000 токенов128 000 токенов
Официальный вход / 1M, Standard$2 до 272K; $4 выше 272K$4 во всём окне контекста
Официальный выход / 1M, Standard$10 до 272K входа; $15 выше$20
Официальное чтение кэша / 1M$0,10 до 272K; $0,20 выше$0,20
РассуждениеОт low до max; medium по умолчаниюAdaptive всегда включено; глубина задаётся effort

Сколько стоит API в рублях

В Celestria Gate на 2 октября 2026 года каталог показывает следующие клиентские ставки за миллион токенов. Эти ставки берутся из доступных маршрутов Gate. Они могут отличаться от официальных цен, пересчитанных из долларов в рубли, и обновляются при изменении условий поставщика.

В рублёвом каталоге GPT-6.1 Sol сейчас дешевле Opus примерно в 2,25 раза по входу и выходу. Перед расчётом бюджета проверьте текущую карточку: при смене маршрута цена может оказаться другой.

МодельОбычный вход / 1MЧтение кэша / 1MВыход / 1M
GPT-6.1 Sol209 ₽11 ₽1 042 ₽
Claude Opus 5.5470 ₽24 ₽2 346 ₽
стоимость = входные токены / 1 000 000 × ставка входа
          + выходные токены / 1 000 000 × ставка выхода
Бумажные токены во входном и выходном лотках и петля повторного использования контекста
В счёте учитываются вход, выход и операции с кэшем. Одинаковая длина видимого ответа ещё не означает одинаковый расход.

Допустим, запрос использует 5 000 входных и 1 000 оплачиваемых выходных токенов. По этим ставкам Sol обойдётся примерно в 2,09 ₽, Opus — в 4,70 ₽. До округления списаний тысяча таких запросов стоит около 2 087 ₽ и 4 696 ₽ соответственно. Это расчёт для одинакового количества токенов. Фактический расход каждой модели мы здесь не измеряли; итоговую сумму смотрите в истории расхода.

Если из этих 5 000 входных токенов 4 000 действительно прочитаны из кэша, повторный запрос стоит примерно 1,30 ₽ у Sol и 2,91 ₽ у Opus. Первая запись кэша оплачивается отдельно; совпадение текста само по себе не гарантирует попадание в кэш. Проверяйте учтённые кэшированные токены в usage. В оплачиваемый выход могут входить и токены рассуждения, поэтому длины видимого ответа недостаточно для точной сметы.

Длинный контекст меняет расчёт

У GPT-6.1 Sol граница — больше 272 тысяч входных токенов. После неё вход и операции с кэшем тарифицируются вдвое дороже, а выход — в полтора раза дороже для всего запроса. Так что тариф $2 за вход не подходит для сметы на большой репозиторий или длинную историю переписки.

У Opus 5.5 в официальном Standard-тарифе надбавки за длинный контекст нет. На условном запросе с 300 тысячами входных и 2 тысячами оплачиваемых выходных токенов Sol стоит $1,23, Opus — $1,24. Разница почти исчезает. Для входа в 100 тысяч и того же выхода получается $0,22 против $0,44. Здесь сравниваем именно официальные долларовые тарифы без кэша и дополнительных инструментов.

Большое окно помогает передать документ целиком, но нужный факт всё равно стоит проверять. Попросите модель назвать раздел и привести короткий подтверждающий фрагмент. Заодно сравните вариант, где в запрос отправлены только найденные по поиску нужные страницы: контекста меньше, а проверить ответ проще.

По приложенному документу найди условия отмены заказа.
Для каждого условия укажи раздел и короткий подтверждающий фрагмент.
Если условие не описано, напиши «не найдено».
Не добавляй правила из других источников.
Длинный документ с закладками и лупой над найденным фрагментом
Хороший ответ по документу легко проверить: у каждого вывода есть место в исходном тексте.

Claude или GPT для программирования

Для кода сравните модели на ошибке из своего проекта. Например, повторная отправка формы создаёт второй заказ. Дайте обеим моделям один и тот же модуль, описание ошибки и способ воспроизведения. Хороший результат исправляет дубль, сохраняет формат ответа API и проходит тесты.

Начните с небольшой задачи, где результат можно быстро проверить. Затем попробуйте изменение в нескольких файлах. Запишите, сколько времени заняло рабочее решение, сколько потребовалось попыток и что вы исправили сами. По этим данным будет проще выбрать модель для повседневной работы.

Повторная отправка формы создаёт второй заказ.
Найди причину в приложенном коде и предложи минимальное исправление.
Сохрани контракт API и не добавляй зависимости без необходимости.
Покажи проверку, которая воспроизводит ошибку и проходит после правки.
Объясни, какие ещё случаи нужно проверить.
Разработчик проверяет изменение кода на ноутбуке рядом со списком проверок
Для сравнения кода полезнее рабочая правка и прошедшие тесты, чем длинное объяснение решения.

Публичная таблица Anthropic для релиза Opus 5.5 включает GPT-6 Astra и GPT-5.6 Sol. GPT-6.1 Sol в ней нет, поэтому эти баллы не показывают победителя нашей пары. Для решения о переходе используйте результаты на своих задачах.

Claude или GPT для текстов на русском

Возьмите сообщение, которое вы действительно собираетесь отправить клиенту. Например: заказ задерживается, новая дата уже известна, клиент может дождаться доставки или оформить возврат. Попросите обе модели сделать письмо понятным и спокойным, сохранив факты.

Сначала прочитайте ответы без названий моделей. Отметьте свои правки: какие канцелярские слова пришлось заменить, какие вступления убрать и какие выдуманные обещания удалить. Если в одном варианте достаточно поправить пару слов, а другой приходится переписывать, это полезное различие для вашей редакционной работы.

Одного письма мало для общего вывода о русском языке. Проверьте ещё объяснение сложной темы и короткий текст для интерфейса. Дайте три примера желаемого тона: так сравнение будет ближе к реальной работе вашей команды.

Факты: доставка задерживается на два дня.
Новая дата — 8 октября. Клиент может дождаться заказа или запросить возврат.
Напиши письмо на русском до 100 слов.
Короткие предложения, спокойный тон, ясный следующий шаг.
Не обещай скидку и не добавляй причин задержки, которых нет в фактах.

Что важно для AI-агента

В агенте модель может несколько раз читать файлы, вызывать инструменты и проверять результат. Поэтому считайте все запросы одной задачи. Дешёвый первый ответ не всегда означает дешёвое выполнение: повторы и растущая история разговора тоже входят в расход.

На уровне официальных API есть различия. GPT-6.1 Sol вызывает инструменты через Responses API. В Chat Completions вызовы инструментов не поддерживаются. У Opus 5.5 нельзя отключить adaptive thinking, а принудительный выбор конкретного инструмента в Claude API возвращает ошибку. Перед переносом агента проверьте используемые параметры и схему обработки ответов.

Gate приводит поддерживаемые запросы к общему формату, но возможности конкретной модели и маршрута остаются важны. Начните с одной цепочки «прочитать — изменить — проверить» и убедитесь, что клиент получает нужные события и итоговый результат. Проверьте на своём подключении, поддерживает ли маршрут новую функцию из документации модели.

Проект проходит этапы чтения, редактирования и проверки и возвращается человеку
Стоимость агента складывается из всей цепочки действий. Окончательную проверку результата удобно оставить человеку.

Как попробовать обе модели через один API

В Celestria Gate обе модели доступны с одним ключом и общим baseURL. В примере на Python меняется только идентификатор модели. Установите пакет командой python -m pip install openai и сохраните ключ в переменной окружения CELESTRIA_API_KEY на своём компьютере или сервере.

Пример отправляет два платных запроса, один каждой модели. Он подходит для короткой проверки подключения и выводит текст вместе с usage. Для сравнения качества подставьте одно из заданий выше и одинаковые входные данные.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["CELESTRIA_API_KEY"],
    base_url="https://api.celestriagate.com/v1",
    timeout=120.0,
    max_retries=0,
)

prompt = "Объясни идемпотентность API простыми словами. До 100 слов."

for model in ["gpt-6.1-sol", "anthropic/claude-opus-5.5"]:
    response = client.responses.create(
        model=model,
        input=prompt,
        reasoning={"effort": "medium"},
        max_output_tokens=4096,
    )
    print(model)
    print(response.status, response.incomplete_details)
    print(response.output_text)
    print(response.usage)

Для начала можно задать одинаковый effort. При этом модели всё равно могут потратить разное количество токенов на рассуждение. Сравните среднее время, полный usage и качество ответа; затем попробуйте изменить глубину под свою задачу. Если status равен incomplete, проверьте incomplete_details: такой ответ не стоит считать завершённым результатом.

Актуальные идентификаторы можно получить через GET /v1/models со своим ключом. Каталог Gate проверяет включённых провайдеров каждые пять минут и отмечает свежую доступную модель в каждом семействе. Для воспроизводимых проверок сохраните выбранный идентификатор модели и дату сравнения.

Как сравнить модели на трёх своих задачах

Выберите три небольших задания: одно по коду, одно по вашему тексту и одно по документу. Заранее запишите, что считается готовым результатом. Для кода это могут быть тесты и сохранённый контракт, для письма — все факты и понятный следующий шаг, для документа — правильный ответ с подтверждением.

Повторите задания хотя бы несколько раз, если результат заметно меняется. Одинаковый исходник не обязательно превращается в одинаковое число токенов: модели могут по-разному разбивать текст и тратить разное количество токенов на рассуждение. Итоговый usage важнее оценки по размеру файла.

Запишите для каждого ответаЗачем
Модель, дата и параметрыЧтобы повторить сравнение
Задача решена: да или нетЧтобы считать полезные результаты
Минуты ваших исправленийЧтобы учесть время человека
Время ответа и полный usageЧтобы оценить скорость и расход
Стоимость всех попытокЧтобы получить цену законченной задачи

Если обе модели проходят ваши проверки, начните с той, что даёт меньшую стоимость и приемлемое время ответа. Если Opus заметно сокращает ваши правки на сложных заданиях, можно оставить его для этих случаев, а массовые короткие запросы направлять в Sol.

Частые вопросы

Что дешевле: Claude Opus 5.5 или GPT-6.1 Sol?

При одинаковом числе токенов и входе до 272K официальный Standard-тариф Sol вдвое ниже по входу и выходу: $2/$10 против $4/$20 за миллион. Выше 272K у Sol повышаются ставки. В Gate на 2 октября 2026 года обычный вход стоит 209 ₽ против 470 ₽, выход — 1 042 ₽ против 2 346 ₽. Текущую цену проверяйте в каталоге.

GPT-6.1 Sol и GPT-6.1 Sol Pro — одна модель?

Это отдельные варианты с разными идентификаторами и тарифами. Здесь сравниваем обычный gpt-6.1-sol. Для Pro нужно отдельно проверить доступность и условия в каталоге.

Что лучше пишет код и тексты на русском?

По одной тарифной таблице этого не определить. Проверьте одинаковую ошибку в своём проекте, письмо клиенту и вопрос по документу. Сравните правильность, объём ручных правок и стоимость выполненной задачи.

Можно ли использовать обе модели в одном приложении?

Да. Через Celestria Gate можно отправлять запросы к обеим моделям с одним ключом. Выбирайте идентификатор в поле model и проверяйте возможности маршрута через GET /v1/models.

Нужно ли отправлять весь документ в миллионный контекст?

Большое окно позволяет это сделать в пределах лимитов модели и маршрута. Но для конкретного вопроса часто удобнее найти нужные фрагменты и передать только их. Проверьте полноту ответа и учитывайте порог повышенной цены Sol.

Источники

Канонический адрес материала · Получить API-ключ