品玩7月13日讯,商汤科技今天正式发布并全面开源其统一视觉大模型SenseNova-Vision。该模型将目标检测、图像分割、深度预测等经典视觉任务,统一表述为多模态生成问题,实现了从“工具执行者”到“世界理解模型”的本质蜕变。
SenseNova-Vision在多项权威评测中表现优异,其性能比肩甚至超越了各领域的专用“专家模型”。模型展现出强大的跨任务知识互补能力,在复杂场景下具备出色的泛化能力,能够从容应对未见过的任务与场景。
为助力全球AI生态发展,商汤同步开源了包含5000万条高质量样本的视觉指令语料库SenseNova-Vision Corpus-50M。此举将大幅降低视觉AI的应用门槛,推动行业迈向更通用的多模态基座模型时代。





0 条评论
请「登录」后评论