返回首页
RadarAI··论文与技术

超越 Vision Banana!又一国产视觉神器开源!

中文摘要

商汤开源 SenseNova-Vision 统一视觉大模型,原生融合目标检测、分割、3D重建等多任务,实现多模态性能领先。

English Summary

SenseTime open-sourced SenseNova-Vision, a unified vision model natively integrating object detection, segmentation, and 3D reconstruction for leading multi-task performance.

原文节选

📌 一句话摘要 商汤开源日日新 SenseNova-Vision 统一视觉大模型,实现多任务原生融合,性能领先并提供开源资源。 📝 详细摘要 文章介绍商汤日日新 SenseNova-Vision 这一开源的统一视觉大模型。模型将目标检测、图像分割、深度预测、3D 重建等经典视觉任务原生融入通用多模态大模型体系,实现数据反哺与思维赋能的双向增益。通过零样本泛化、超稠密物体分割、看穿镜面反射和突破视觉错觉等四大场景的实测,...