关于模型与应用
Cosmos3 处理文本、视觉、音频与动作轨迹,可生成多种模态以进行世界仿真;与普通聊天模型分开记录。
系列与其他版本资料2 份材料
系列背景及其他版本材料,与本次更新的证据分开计数。未包含该型号数据的榜单不计入该型号测评。
系列型号目录2
当前模型
官方模型目录Cosmos3-Super可用256K 上下文公开权重
- 模型 ID
nvidia/Cosmos3-Super- 发布
- 2026-05-31
- 可用状态
- 可用
- 输入
- 文本 · 图像 · 视频 · 音频 · 动作轨迹
- 输出
- 文本 · 图像 · 视频 · 音频 · 动作轨迹
- 上下文
- 256,000 tokens
- 参数
- 64B
- 部署 / 访问
- 公开权重 · 本地部署
- 权重
- 公开权重
面向物理 AI 世界仿真;音频可封装于视频,动作输出是轨迹/列表,不是 3D 资产。
Cosmos3-Nano可用256K 上下文公开权重
- 模型 ID
nvidia/Cosmos3-Nano- 发布
- 2026-05-31
- 可用状态
- 可用
- 输入
- 文本 · 图像 · 视频 · 音频 · 动作轨迹
- 输出
- 文本 · 图像 · 视频 · 音频 · 动作轨迹
- 上下文
- 256,000 tokens
- 参数
- 16B
- 部署 / 访问
- 公开权重 · 本地部署
- 权重
- 公开权重
面向物理 AI 世界仿真;音频可封装于视频,动作输出是轨迹/列表,不是 3D 资产。