VSS告警蓝图VLM模型定制Skill rtvi-vlm-customize-model

本技能用于指导VSS Alerts Blueprint的VLM模型定制:可重定向rtvi-vlm、vlm-as-verifier和vss-agent三个服务的VLM端点,支持OpenAI兼容外部端点与容器内vLLM两种部署模式,并包含配置、迁移和健康检查方法。关键词:VLM、VSS、RTVI、告警蓝图、模型定制、OpenAI兼容、vLLM、端点配置、健康检查。

视频智能服务(VSS) 0 次安装 0 次浏览 更新于 9/6/2026

VLM定制 — VSS告警蓝图

使用时机

本技能用于:将VSS告警蓝图切换到不同VLM端点;独立运行rtvi-vlm并支持OpenAI兼容端点或容器内vLLM;说明修改一个VLM配置不会自动影响所有消费者。

关键说明

  • rtvi-vlm、vlm-as-verifier、vss-agent是三个独立的VLM消费者,配置位置各不相同。
  • 路径基于公开VSS仓库的v3.2.1版本,不适用于DeepStream仓库。
  • 蓝图端的OpenAI兼容路由需分别配置RTVI_VLM_*变量、vlm-as-verifier/configs/config.yml、vss-agent的VLM_MODEL_TYPE/VLM_NAME/VLM_BASE_URL。
  • 独立运行的vllm-compatible需设置VLM_MODEL_TO_USE和MODEL_PATH;HF_TOKEN仅在有需要时设置。
  • 验证部署不能只依赖日志中的“Warmup done”,必须检查不存在“Error during warmup”、就绪以及一次真实推理。
  • 不要将凭据写入日志或聊天;用静默读取并chmod 600。

两种RTVI-VLM部署方式

  • openai-compat:由外部OpenAI兼容服务器提供推理。
  • vllm-compatible:容器内vLLM加载模型,需检查模型架构与镜像内vLLM版本的兼容性。

蓝图侧配置

  • 必须先配置RTVI_VLM_PORT以及修正两条8018硬编码URL。
  • openai-compat方法设置RTVI_VLM_MODEL_TO_USE、RTVI_VLM_ENDPOINT、VLM_NAME、OpenAI/RTVI_VLM_API_KEY等,并推荐通过/models接口校验模型。
  • vllm-compatible设置RTVI_VLM_MODEL_PATH并使用ngc:或git:前缀。

独立配置

设置容器原生变量:VLM_MODEL_TO_USE、VIA_VLM_ENDPOINT、VIA_VLM_OPENAI_MODEL_DEPLOYMENT_NAME等。

配置vlm-as-verifier(仅2d_cv)

通过config.yml指定base_url和model,执行后强制重建alert-bridge。

配置vss-agent

通过VLM_MODEL_TYPE选择rtvi/nim/openai/vllm块,并设置对应的base_url。

健康检查

重建服务后需检查:容器运行、日志中无下载/预热错误、readiness端点、/v1/models返回model、一次真实chat/completions返回非空内容。openai-compat验证方法A的模型ID,vllm-compatible不需要匹配VLM_NAME。