Входит в расширения: Сервисы ИИ-инференса
Стадия жизненного цикла модуля: Experimental
У модуля есть требования для установки
Модуль ai-inference даёт минимальный путь заказа инференса в Deckhouse Kubernetes Platform:
- Администратор кластера создаёт
InferenceServiceClass— политики публикации, обязательный непустойmodelPolicy.allowedEndpointTypesи, если нужно,acceleratorPolicy, ограничивающий устройства его заказов. Модуль поставляет встроенныйdefault-llm. - Пользователь namespace создаёт
InferenceServiceиз ссылки на класс, блока модели и опционально сужения перечня классов устройства: договор API платформа выбирает из перечня класса, а среду исполнения — из записи рецепта плана запуска. - Контроллер проверяет заказ, разворачивает объекты его рабочей нагрузки сам и публикует
status.endpoint.
Публичный API: группа ai.deckhouse.io/v1alpha1, виды InferenceServiceClass (cluster) и InferenceService (namespaced).
Компоненты модуля:
- CRD и справочник CR —
crds/,docs/CR*.md; - контроллер — образ
controller, namespaced8-ai-inference; - Helm-шаблоны —
templates/controller/**, user-authz и rbacv2.
Руководства:
- Руководство пользователя — заказать инференс, прочитать состояние заказа, узнать, почему он ждёт;
- Руководство администратора — включить модуль, написать классы, следить за ним и отключить;
- Конфигурация — справочник настроек модуля;
- Пользовательские ресурсы — справочник полей обоих видов;
- Примеры — манифесты, готовые к применению;
- Вопросы и ответы — ответы по причинам отказа.
Устройство и доводы за него — почему каждая часть сделана так, а не иначе: Пошаговый сценарий.
Пользовательские заметки о выпуске: Релизы.
Инженерная сторона хранилища — порождение кода, сценарии показа и дымовые сценарии, ночной круг подтверждения рецептов — предметом этих страниц не является.