Перейти к содержимому

Быстрый старт

С помощью этой инструкции вы создадите деплоймент языковой модели и проверите ее работу.

  1. В веб-консоли выберите нужный проект. Если у вас нет проекта, создайте его.

  2. В списке сервисов выберите GPT Model Hub. При первом запуске нажмите кнопку Активировать, для этого необходима роль admin.

  3. Создайте сервисный аккаунт с именем sa-inferencer и ролью gpt.inferencer. От имени этого сервисного аккаунта вы будете обращаться к модели.

  4. Создайте API-ключ для сервисного аккаунта sa-inferencer и сохраните его.

  5. Установите утилиту jq.

  1. В веб-консоли выберите нужный проект.
  2. В списке сервисов выберите GPT Model Hub и нажмите кнопку Создать.
  3. Выберите подходящую вам модель для деплоймента. В этом руководстве в качестве примера используется модель qwen3-32b.
  4. Нажмите кнопку Создать.

Выполните тестовый запрос к модели:

bash
curl https://gpt.mwsapis.ru/projects/<имя проекта>/openai/v1/chat/completions \
-H 'Content-Type: application/json' \
-H "Authorization: Bearer <API-ключ сервисного аккаунта sa-inferencer>" \
-d '{
"model": "qwen3-32b",
"messages": [
{
"role": "user", "content": "Привет!"
}
]
}' | jq .

Если вы используете Windows, учитывайте следующие особенности работы с утилитой curl в PowerShell:

  • Используйте curl.exe вместо curl.

    В PowerShell команда curl является псевдонимом для Invoke-WebRequest, а не аналогом curl в UNIX-системах. Из-за этого примеры запросов из документации могут работать некорректно.

  • Установите корректную кодировку вывода.

    По умолчанию PowerShell выводит текст в кодировке консоли (часто CP866 или Windows-1251), тогда как API отдает текст в кодировке UTF-8. Из-за этого русские символы в ответе превращаются в вопросительные знаки (?????). Чтобы избежать этого, перед выполнением запросов установите кодировку UTF-8:

    powershell
    $OutputEncoding = [Console]::OutputEncoding = [System.Text.UTF8Encoding]::new()
  • Передавайте тело запроса в JSON-файле.

    В PowerShell одинарные кавычки и экранирование работают иначе, чем в bash. Надежнее всего передавать тело запроса через JSON-файл. Например, создайте файл data.json:

    json
    {
    "model": "qwen3-32b",
    "messages": [
    { "role": "user", "content": "Привет!" }
    ]
    }

    После чего выполните запрос, экранировав @ обратным апострофом (`):

    powershell
    curl.exe -s `
    https://gpt.mwsapis.ru/projects/<имя проекта>/openai/v1/chat/completions `
    -H "Content-Type: application/json" `
    -H "Authorization: Bearer <API-ключ сервисного аккаунта sa-inferencer>" `
    -d '`@data.json' | jq .

    В PowerShell для переноса строк используется обратный апостроф (`), а не обратный слеш (\).

    bash
    {
    "id": "chatcmpl-c37a7ecbae094877b28654dbbfa14b81",
    "created": 1758740886,
    "model": "qwen3-32b",
    "object": "chat.completion",
    "choices": [
    {
    "finish_reason": "stop",
    "index": 0,
    "logprobs": null,
    "message": {
    "content": "Привет! Как я могу помочь?",
    "role": "assistant",
    "audio": null,
    "refusal": null,
    }
    }
    ],
    "usage": {
    "completion_tokens": 45,
    "prompt_tokens": 72,
    "total_tokens": 117,
    },
    }

    В этом примере в поле usage:

    • prompt_tokens — количество входящих токенов запроса (токенов промпта);
    • completion_tokens — количество исходящих токенов, сгенерированных моделью (токенов ответа).

    Входящие и исходящие токены тарифицируются отдельно.

Попробуйте развернуть и проверить другие модели сервиса GPT Model Hub: