Cosmos推理模型微调Skill tao-finetune-cosmos-reason

该技能用于对Cosmos3-Nano视频问答模型进行监督微调(SFT),支持视频QA、SFT/LoRA、FSDP并行和AutoML;也涵盖评估、推理和量化。关键词:Cosmos-RL、Cosmos3-Nano、视频问答、SFT、LoRA、FSDP、AutoML。

视觉模型微调 0 次安装 1 次浏览 更新于 9/7/2026
名称 tao-finetune-cosmos-reason
描述 Cosmos3-Nano视频问答监督微调,支持FSDP并行和不同GPU配置。用于训练或评估视频问答模型、微调Cosmos3-Nano或兼容的Cosmos Reason模型,支持SFT/LoRA与Cosmos-RL。

Cosmos-RL

SFT微调Cosmos Reason视频QA模型,默认基础模型为HF上的nvidia/Cosmos3-Nano。使用FSDP并行,dp_shard_size=GPU数,dp_replicate_size=节点数。执行环境必须使用解析出的容器镜像,并通过冒烟测试。

包含训练、评估、AutoML、检查点转换、参数指南等。