Оплата за токены · Без подписок

Все модели в одном ключе

GPT, Claude, Gemini, Seedream и Veo через один [OI]-совместимый API. Один баланс, один журнал запросов, оплата по факту расхода — без подписок на каждый сервис.

Доступные модели для командного трафика.

Сравните доступные модели и размер контекста до маршрутизации нагрузки.

Пакеты AI-кредитов

Кредиты — внутренняя единица расхода. Стоимость запроса зависит от модели, типа токенов и кэширования; она видна в журнале до оплаты.

Выберите ваш сценарий использования

Без подписок и сгорания

Пакет пополняет баланс AI-кредитов.

Прозрачный расход

Стоимость в AI-кредитах зависит от модели, типа токенов и кэширования.

Один API вместо десяти подписок

Один ключ, один баланс, один журнал запросов. Вы платите за фактический расход токенов, а не за фиксированную подписку на каждый сервис.

Один ключ на все модели

GPT, Claude, Gemini, Seedream, Veo и другие модели через один [OI]-совместимый API. Переключение модели — это смена значения в поле model, без правок кода.

Оплата за токены, не за подписку

Никаких фиксированных платежей за каждый сервис. Баланс списывается по фактическому расходу: входные, выходные токены и кэш считаются отдельно.

Баланс и квоты под контролем

Пополняйте баланс пакетами и видьте расход по каждой модели. Задайте лимиты на ключ, чтобы один клиент не израсходовал бюджет команды.

Потоковые ответы и отмена

Ответ приходит по мере генерации, а не после завершения. Если клиент отключается, запрос закрывается, и вы платите только за полученные токены.

Журнал каждого запроса

Каждый запрос сохраняет модель, статус, задержку, расход токенов и стоимость. Спорный счёт разбирается по журналу, а не по скриншотам.

Ключи и доступ в одном месте

Выпускайте отдельные ключи для каждого инструмента и отзывайте их одним действием. Видно, какой ключ и когда использовался последний раз.

Что происходит с запросом

Запрос приходит один раз и остаётся под контролем: маршрутизация, квота и журнал применяются в одной точке.

Расход виден до счёта

Квота и баланс проверяются до отправки запроса. Вы видите расход по каждой модели, а не общую сумму в конце месяца.

Модель меняется без переписывания кода

Поле model в запросе определяет, какой провайдер ответит. Смена модели — это смена строки, а не переписывание интеграции.

Каждый запрос оставляет след

Запись хранит владельца, ключ, модель, статус, задержку, токены и стоимость. Разбор инцидента не требует ручного сбора данных.

POST/v1/chat/completions
+1.2ms overhead
Ваше приложениеgw_live_key

Существующий клиентский запрос

Проверка бюджета< 0.8ms

Облачный слой управления SaaS

Журнал в реальном времениSSE Stream

Zero-buffer SSE & live trace log

Поставщик модели200 OK

Только после проверок аккаунта

От регистрации до первого запроса

Регистрация, ключ, запрос. Дальше всё измеряется автоматически.

Регистрация и ключ за пару минут

Создайте аккаунт, пополните баланс и выпустите ключ gw_. Дальше ключ используется как обычный API-ключ [OI]-совместимого клиента.

Меняются две строки

В SDK, CLI или настройках агента замените base URL и ключ. Тело запроса и формат ответа остаются прежними — переписывать интеграцию не нужно.

Расход виден сразу

Каждый запрос попадает в журнал с моделью, статусом, задержкой, токенами и стоимостью. Статистику не нужно собирать вручную.

Контроль над AI-расходом команды

Видно, кто использовал модель, какая модель ответила и сколько это стоило. Без ручного сбора статистики.

  • Командные бюджеты
  • Ключи API с ограниченной областью
  • История запросов
  • Видимость использования

Как выглядит журнал

Обезличенный пример записи журнала: владелец, ключ, модель, квота и трассировка в одной строке.

Live Telemetry
пользовательusr_7f2...квота в норме
ключgw_93...лимит в норме
модельgpt-5.5OpenAI
трассировкаtrc_41...записано

Частые вопросы

Коротко о цене, данных и работе с моделями.

Начните с одного ключа.

Создайте аккаунт, пополните баланс и выпустите ключ. Первый запрос можно отправить через любой [OI]-совместимый клиент.