Перейти к содержимому

Тарификация

В расчете стоимости использования сервиса GPT Model Hub учитываются:

  • Входящие токены — количество токенов, полученных при токенизации входящего от модели текста.
  • Исходящие токены — количество токенов, полученных при токенизации исходящего от модели текста.
  • Отпускная единица — минимальный объем потребления, подлежащий тарификации за один запрос к модели.

Тарификация происходит по факту потребления, средства списываются по мере накопления одной отпускной единицы. Остаток токенов, не кратный одной отпускной единице, хранится в течение 24 часов. Если за это время отпускная единица накоплена не будет, то остаток сгорает и не тарифицируется.

Пользователь потратил 120 токенов, т.е. больше одной отпускной единицы.
Списание: 100.
Остаток: 120 - 100 = 20.

Пользователь потратил еще 10 токенов.
Списание: не происходит.
Остаток: 20 + 10 = 30.

Пользователь потратил еще 195 токенов. С учетом остатка списаны средства за 200 токенов, новый остаток — 25 токенов.
Списание: 200.
Остаток: 30 + 195 - 200 = 25.

Информация об остатке хранится 24 часа с момента его расчета. Если пользователь не применяет сервис 24 часа, остаток сгорит и не будет тарифицироваться.

Примечание

Каждая модель имеет свой токенизатор текста, поэтому один и тот же текст в разных моделях может представлять собой разный объем токенов.

МодельСтадия готовностиЦена за 1 млн входящих токенов, с НДС 22%Цена за 1 млн исходящих токенов, с НДС 22%Отпускная единица
qwen3.6-35b-a3bGeneral Availability70,76 ₽283,04 ₽100 токенов
glm-5.2General Availability178,12 ₽746,64 ₽100 токенов
kimi-k2.6General Availability157,38 ₽652,70 ₽100 токенов
gemma-4-31b-itGeneral Availability56,12 ₽224,48 ₽100 токенов
qwen3-235b-instructGeneral Availability79,30 ₽320,86 ₽100 токенов
qwen3-coder-480b-a35bGeneral Availability104,92 ₽419,68 ₽100 токенов
gpt-oss-120bGeneral Availability13,42 ₽54,90 ₽100 токенов
bge-multilingual-gemma2General Availability1,83 ₽1000 токенов
bge-m3General Availability0,61 ₽1000 токенов
bge-reranker-v2-gemmaPreview1000 токенов
bge-reranker-v2-m3Preview1000 токенов
whisper-large-v3Preview1 секунда
qwen3-asr-1.7bPreview1 секунда
gigaam-v3Preview1 секунда
qwen3-tts-12hz-1.7b-custom-voicePreview10 символов

Модели в стадии Preview не тарифицируются и на них не распространяется соглашение об уровне доступности (SLA).

Цены до 01.08.2026:

МодельСтадия готовностиЦена за 1 млн входящих токенов, с НДС 22%Цена за 1 млн исходящих токенов, с НДС 22%Отпускная единица
qwen3.6-35b-a3bGeneral Availability54 ₽219 ₽100 токенов
glm-5.2General Availability115 ₽463 ₽100 токенов
kimi-k2.6General Availability183 ₽732 ₽100 токенов
gemma-4-31b-itGeneral Availability54 ₽219 ₽100 токенов
gemma-3-27b-itGeneral Availability54 ₽219 ₽100 токенов
qwen3-32bGeneral Availability54 ₽219 ₽100 токенов
qwen3-235b-instructGeneral Availability61 ₽244 ₽100 токенов
qwen3-coder-480b-a35bGeneral Availability103 ₽414 ₽100 токенов
glm-4.6-357bGeneral Availability115 ₽463 ₽100 токенов
kimi-k2-instructGeneral Availability183 ₽732 ₽100 токенов
gpt-oss-120bGeneral Availability3,40 ₽13,50 ₽100 токенов
bge-multilingual-gemma2General Availability1,80 ₽1000 токенов
bge-m3General Availability0,60 ₽1000 токенов
bge-reranker-v2-gemmaPreview1000 токенов
bge-reranker-v2-m3Preview1000 токенов
whisper-large-v3Preview1 секунда
qwen3-asr-1.7bPreview1 секунда
gigaam-v3Preview1 секунда
qwen3-tts-12hz-1.7b-custom-voicePreview10 символов