商汤科技正式发布并全面开源"日日新SenseNova-Vision"理解生成统一视觉大模型,这是商汤日日新大模型体系的重要视觉能力升级。商汤表示,行业以往的"统一视觉"多是把检测、分割、深度预测等多个专家模型打包封装,本质仍是割裂的,而SenseNova-Vision的核心变革是让视觉成为通用基础模型的原生能力,彻底融入大模型体系。

分割能力涵盖通用分割、推理分割、交互式分割等,得益于强大的多模态理解力,在推理分割与对话式分割表现上尤为惊艳。仅凭单模型即可高质量完成多视角点云重建与相机位姿估计,性能在通用视觉路线中处于领先位置。
全面超越Vision Banana,数据同步开源
横向对比来看,对比语义导向模型,SenseNova-Vision在检测、分割、深度等细节要求极高的视觉任务上实现全面领先。对比生成导向模型Vision Banana,则展现出全面的代际优势——在各项权威评测的绝大多数指标上均实现超越与领跑。Vision Banana仅能应对四大核心板块中的两类问题,而SenseNova-Vision却能同时覆盖结构化理解、稠密几何、全景分割、多视角3D等全任务。
在开源方面,商汤不仅开放了模型本身,还同步开源了包含 5000 万条样本的视觉指令语料库SenseNova-Vision Corpus-50M。未来,商汤将把SenseNova-Vision的核心技术全面融入日日新U系列大模型中。
新思科技Multi-Die协同设计赋能AMD Instinct MI455X GPU正式发布
yihan1944/ppt-ccskill下载-yihan1944/ppt-ccskill网页版下载入口
守岸人极寒之力解析 三层普攻爆发与完美连招
yiqxie/ppt-agentskill下载-yiqxie/ppt-agentskill网页版下载入口
新思科技率先实现全球首个HBM4 IP测试芯片验证
akashva22/ai-ppt-generator:一个静态网页形态的 Agent PPT 生成示例