Новые возможности ИИ-роутера

Сервис ИИ-роутера расширил список доступных моделей. Теперь пользователям доступны современные языковые модели, такие как Kimi К3, Qwen3.8 Max и DeepSeek V4 Flash. Также добавлены инструменты для генерации изображений, включая семейство Flux.2 от Black Forest Labs.

ИИ-роутер позволяет использовать ведущие нейросети через единый API-ключ и один аккаунт. Система сама направляет запросы к нужной модели, избавляя от необходимости регистрироваться на сторонних площадках. Оплата за использование происходит по модели pay-as-you-go в рублях за потребленные токены.

Высокопроизводительные GPU-хосты

Для ресурсоемких задач запущен физический GPU-хост с четырьмя видеокартами NVIDIA H200 NVL PCIe. Каждая карта обладает объемом памяти 141 ГБ HBM3e, что в сумме дает 564 ГБ. Благодаря использованию NVLink-мостов скорость обмена данными между картами в 7 раз выше, чем через стандартную шину PCIe.

Эта конфигурация предназначена для задач, требующих высокой производительности: инференса и дообучения (файнтюнинга) крупных моделей, работы с длинным контекстом и мультимодельных пайплайнов. Виртуальная машина на таком хосте полностью изолирована: на нем не размещаются машины других клиентов.

Обновления инфраструктуры и Kubernetes

В сервисе Managed Kubernetes появилась поддержка версии 1.36. Также реализована возможность автоматического обновления версий Kubernetes на выделенных серверах: пользователи могут настроить автоматическую установку патчей или минорных обновлений.

Для упрощения работы с GPU-кластерами добавлена поддержка Open Kernel Module драйверов. Теперь при создании кластера необходимые драйверы для видеокарт устанавливаются на ноды автоматически.

Управление данными и мониторинг

В облаке появилась возможность автоматической выгрузки аудит-логов в объектное хранилище S3. Это позволяет создавать долгосрочные архивы событий с фильтрацией по проектам и типам сервисов. Файлы сохраняются в иерархической структуре с метаданными, что удобно для аналитики.

Для мониторинга ресурсов внедрена система агрегированных показателей. Теперь можно просматривать утилизацию ресурсов (CPU, памяти, дисков) сразу по всему проекту или сравнивать нагрузку на разные серверы на одном экране. Также пользователи получили возможность самостоятельно управлять технологическим журналом в 1С и экспортировать метрики в Prometheus.

Сетевые диски и новые приложения

География сетевых дисков расширилась: теперь они доступны в Санкт-Петербурге в пулах SPB-3, SPB-4 и SPB-5. Клиенты могут выбирать между базовыми дисками и высокопроизводительными решениями с высокой скоростью чтения и записи (до 500 МБ/с и 25 000 IOPS).

Для быстрого развертывания ИИ-сред добавлены готовые приложения, такие как Hermes, RAGFlow, OpenClaw и Label Studio. Теперь параметры образов (домен, почта, IP) можно вводить через удобные поля с автозаполнением вместо ручного редактирования конфигурационных файлов.

Что это значит

Обновления позволяют пользователям быстрее развертывать готовые ИИ-приложения, использовать топовые нейросети через единый интерфейс и решать задачи высокой сложности на выделенных GPU-хостах с современными видеокартами.