Рег.
Компания анонсировала комплексную ИИ-платформу, которая закрывает полный цикл работы с генеративными нейросетями и ML-моделями – от прототипа до боевого внедрения.
В основе предустановленное окружение с инференс-движком vLLM, оптимизированным под большие языковые модели. Пользователь выбирает готовую модель или загружает свою через Hugging Face CLI. Вычисления идут на выделенном GPU-сервере, данные хранятся локально у клиента. Для доступа к модели автоматически поднимается OpenAI-совместимый эндпоинт на публичном IP. Оплата – почасовая, только за потребляемые ресурсы. Конфигурации охватывают широкий диапазон нагрузок: от NVIDIA A4000 до двухускорительных сборок на базе A100. Провайдер планирует расширить линейку доступных карт.
Помимо инференса, в платформу вошли: JupyterHub для командной ML-разработки с интеграцией Git и S3, корпоративный ИИ-ассистент на Open WebUI с набором предустановленных моделей, а также low-code среда n8n для визуальной сборки сценариев автоматизации.
Подписывайтесь на Телекоммуналку