Cloud
В консоль

Преимущества сервиса

Быстрый старт

Несколько минут от регистрации в консоли до готовой к инференсу модели

Собственный инференс

Запросы обрабатываются в контуре MWS Cloud на мощных GPU

OpenAI-совместимый API

Интегрируйте модели через привычные SDK и инструменты

Широкий выбор моделей

Подбирайте модели под задачу и бюджет: от быстрых и экономичных до мощнейших LLM для сложных сценариев

Контроль доступа и потребления

Интеграция с облачной ресурсной моделью, IAM и биллингом. Удобно управляйте правами доступа и следите за потреблением

Kimi K2.6 в GPT Model Hub

Уверенно работает с контекстом в длинных цепочках, пишет и анализирует код, разбирает зависимости.
Подходит для сложных ИИ-сценариев и работы с документами

Сценарии использования

RAG и генерация текста

Поиск, анализ и краткое изложение информации по базе знаний и документам. Подходит для ассистентов, внутренних порталов и аналитики

Код и разработка

Генерация, анализ и рефакторинг кода, работа с зависимостями и техническими сценариями

Чат-боты

Разговорные сценарии, ассистенты и пользовательские интерфейсы. Например, для линии технической поддержки

Поиск и embedding

Создание векторных представлений для поиска, рекомендаций и RAG. Например, для создания интеллектуального поиска или рекомендательной системы

Большой объём запросов

Сценарии с большим количеством запросов, где важны скорость и стоимость: массовая генерация текста, обработка данных и автоматизация. Например, пакетная обработка отзывов о товарах

Модели под ваши задачи

  • Текст и код
  • Текст и изображения
  • RAG и поиск
  • Речь и аудио

Текст и код

Выбирайте модели для генерации и анализа текста, работы с кодом и многошаговых задач. Сравнивайте их на своих задачах и находите подходящий баланс качества, скорости и стоимости. Все доступные модели смотрите в документации

GLM 5.2

Разбирайте длинные документы, сложные запросы и задачи, где решение складывается из нескольких последовательных шагов

Qwen3 Coder 480B A35B

Пишите, объясняйте и перерабатывайте код — от отдельных функций до крупных фрагментов проекта

GPT OSS 120B

Создавайте ИИ-ассистентов и прикладные сценарии, которым нужны анализ информации, следование инструкциям и работа с инструментами

Qwen3.6 35B A3B

Добавляйте в продукты генерацию, анализ и обработку текста — от пользовательских функций до внутренних ИИ-инструментов

Как начать работу

  1. Войдите или зарегистрируйтесь в консоли MWS Cloud Platform
  2. Активируйте сервис и создайте деплоймент модели
  3. Создайте сервисный аккаунт и API-ключ для доступа к модели
  4. Подключите любой AI-клиент и начните использование

Один сервис — десятки ИИ‑сценариев

Чат-боты, поиск по данным, генерация контента, автоматизация процессов — подключайте модели под задачу с помощью GPT Model Hub и комбинируйте их в одном продукте

Собрать ИИ-решение самостоятельно
  • Грант новым пользователям: 3 000 ₽ для физических лиц
  • Доступ к каталогу моделей под разные задачи
  • OpenAI-совместимый API
  • Быстрый старт без настройки инфраструктуры
  • Помощь сообщества и прямая связь с разработчиками
Получить консультацию
  • Грант новым пользователям: 10 000 ₽ — для юридических лиц и ИП
  • Индивидуальные условия по лимитам на тест
  • Проконсультируем по моделям и возможностям сервиса
  • Поможем с интеграцией в ваш проект
  • Сопроводим запуск и масштабирование

FAQ

Что такое MWS GPT Model Hub?

MWS GPT Model Hub — облачный сервис для доступа к языковым, голосовым, эмбеддинг- и реранкер-моделям через единый API. Модели уже развёрнуты и готовы к инференсу — вам не нужно самостоятельно настраивать GPU‑инфраструктуру и обслуживать модели. Управление деплойментами моделей происходит в консоли управления облачной платформы MWS Cloud Platform.

Какие модели доступны в сервисе?

В MWS GPT Model Hub доступны модели для генерации и анализа текста, работы с кодом и изображениями, семантического поиска, реранжирования результатов, распознавания и генерации речи.

Посмотреть полный список моделей можно в документации.

Как начать работу с MWS GPT Model Hub?

Выберите модель в консоли MWS Cloud Platform, создайте сервисный аккаунт и API-ключ. Подключение к модели осуществляется через OpenAI-совместимый API. Примеры запросов и инструкции по подключению доступны в документации.

Можно ли использовать существующие OpenAI-совместимые инструменты и библиотеки?

Да. MWS GPT Model Hub поддерживает OpenAI-совместимый API, поэтому модели можно подключать к приложениям, бэкенд-сервисам и инструментам разработчика с помощью привычных клиентов и библиотек. Для подключения достаточно указать эндпоинт сервиса, API-ключ и ID выбранной модели.

В документации доступны инструкции для подключения популярных инструментов для создания ИИ-агентов и чата с LLM: расширения Cline для VS Code, Langflow и LibreChat.

Как выбрать модель?

Выбор зависит от задачи, формата входных данных и требований к качеству, скорости и стоимости. На этом лендинге модели сгруппированы по основным сценариям: работа с текстом и кодом, текстом и изображениями, RAG и поиском, речью и аудио.

Перед внедрением рекомендуем сравнить несколько моделей на собственных запросах и данных. Если вам нужна помощь с подбором моделей, вы можете оставить заявку на консультацию или обратиться в техническую поддержку.

Как тарифицируется сервис?

Использование моделей в General Availability (общем доступе) оплачивается по фактическому потреблению: отдельно учитывается количество входящих и исходящих токенов. Стоимость зависит от выбранной модели.

Модели в режиме Preview не тарифицируются. Актуальные цены доступны в разделе «Тарификация» в документации.

Есть ли бесплатный доступ?

Сервис предоставляет через консоль управления облачной платформой MWS Cloud Platform. Всем новым пользователям платформы доступен стартовый грант, который можно использовать для знакомства с MWS GPT Model Hub и другими сервисами платформы. Кроме того, модели в режиме «Preview» доступны без тарификации.

Для получения гранта следуйте инструкции на главном экране консоли управления после окончания регистрации.

Что означает статус «Превью» у модели?

Модели со статусом «Preview» доступны для тестирования новых сценариев и знакомства с их возможностями. Для них не предоставляется SLA, а использование не тарифицируется.

Какие квоты и лимиты действуют?

Для моделей действуют ограничения на количество запросов в минуту и количество входящих и исходящих токенов. Также действуют квоты и лимиты на количество деплойментов моделей в проекте. Квоты и лимиты можно изменить по запросу через обращение в техническую поддержку.

Как сервис обрабатывает запросы и данные?

MWS GPT Model Hub не сохраняет запросы и ответы пользователей и не использует их для обучения моделей. Вычисления происходит внутри защищённого контура MWS Cloud.

Куда обратиться, если нужна помощь?

Если вам нужна помощь с выбором модели, подключением API или настройкой лимитов, обратитесь в техническую поддержку MWS Cloud Platform. Если у вас есть вопрос к разработчикам сервиса — напишите нам в открытый чат Сообщества MWS Cloud Platform.

Дополнительные продукты

  • Compute
    Виртуальные машины и диски
  • Managed Kubernetes
    Управление кластерами Kubernetes
  • Object Storage
    Масштабируемое, высокодоступное S3‑совместимое хранилище данных
  • Managed PostgreSQL
    Управляемые базы данных PostgreSQL
  • Managed ClickHouse
    Управляемая аналитическая СУБД ClickHouse

Будьте в курсе обновлений

О новых возможностях платформы мы пишем в блоге и email-рассылке. Подписывайтесь, чтобы быть в курсе последних новостей

Последние события

  • Мероприятия
  • Новости