Сервис открывает доступ к каталогу актуальных языковых моделей для разных бизнес-задач. Специалисты «Турбо Облака» регулярно обновляют его, добавляя новые версии ИИ-моделей по мере выхода, так что пользователям не нужно самостоятельно следить за их жизненным циклом.
В основе платформы высокопроизводительная GPU-инфраструктура на базе NVIDIA H200, объединенных сетью InfiniBand. Вычислительные ресурсы автоматически увеличиваются при росте запросов -- сервис обеспечивает скорость и стабильность даже при пиковых нагрузках.
Главное преимущество Foundation Model Hub — экономия. Запуск собственных ИИ-моделей требует дорогой GPU-инфраструктуры и глубоких технических знаний. Пользователям Foundation Model Hub не нужно приобретать дорогостоящее вычислительное «железо» или нанимать профильных специалистов — все необходимые модели уже развернуты на облачных мощностях дата-центров РТК-ЦОД Tier III и инфраструктуре «Ростелекома», которые обеспечивают низкую задержку сигнала во всех регионах страны.
Для начала работы достаточно выбрать подходящую языковую модель из каталога, получить ключ доступа и интегрировать его в собственный сервис или внутреннюю информационную систему. Foundation Model Hub совместим со спецификацией OpenAI API, поэтому в большинстве случаев для подключения достаточно заменить базовый URL и API-ключ без доработки архитектуры и с минимальными усилиями.
С Foundation Model Hub оплачивается только факт использования токенов, что позволяет избежать лишних расходов. Контролировать бюджет помогают разные ключи доступа (API), когда для отдельных команд и проектов можно установить собственный лимит потребления токенов — например, дневной, недельный или месячный.