SenseNova-Vision
- 上下文
- —
- 输入价
- —
- 输出价
- —
- 许可
- 开源
概览
商汤于 2026 年 7 月 13 日发布的理解生成统一视觉大模型,权重以 CC BY-NC 4.0 协议公开(仅限非商用)。它的核心变革是让视觉成为通用基础模型的原生能力,把目标检测、图像分割、深度预测、3D 重建等经典视觉任务统一到同一套多模态生成范式里,终结「一任务一模型」的做法。发布同时开源了名为 SenseNova-Vision-Corpus-50M 的 5000 万条高质量视觉指令数据集。
- 模态
- 多模态
- 许可说明
- 开源 · CC BY-NC 4.0
能力
- 理解与生成统一的视觉大模型,视觉成为大模型原生能力
- 目标检测、图像分割、深度预测、3D 重建等经典视觉任务在同一表征空间统一完成
- 零样本泛化与密集目标分割等困难场景表现突出
- 结构化理解、稠密几何预测、分割与多视图 3D 几何四大方向对齐或超越专用专家模型
