品玩

科技创新者的每日必读

打开APP
关闭
业界动态

如视解锁3DGS全新能力:画质、性能、规模、门槛,这次我们全都要

shuohang

发布于 56分钟前

近几年三维视觉赛道,3D高斯溅射(3DGS)无疑是现象级技术。凭借照片级的渲染效果,它收获行业高度关注,但落地进程中,这项技术长期陷入“好看不好用”的现实困境。

高画质模型往往数据体量巨大,普通消费级设备难以承载;追求流畅渲染,又会牺牲画面细节;做大场景重建,精度难以保障;想要高精度还原现实,采集设备与拍摄流程门槛又居高不下。如何打破各项性能互相掣肘的行业痛点,兼顾细节、流畅度、场景规模与使用门槛,成为整个行业共同探索的命题。

作为空间智能领域的先行者,如视(Realsee)持续拓展3DGS技术边界,推动这项技术走出实验室Demo,实现多维度能力兼得,加速3DGS从技术演示走向规模化产业落地。

细节与流畅不再二选一,告别靠堆高斯点换画质

行业内普遍存在认知误区:想要画面足够清晰,就要堆砌更多高斯点。但实际上,决定画面最终质量的,并非高斯点的绝对数量,而是高斯点的分布效率。

简单来说就是按需分配算力资源:墙面、天花板这类平坦简单区域,使用少量大高斯点即可完成覆盖;面对文字、雕花、物体纹理边缘等复杂细节区域,则部署细小高斯点做精细化还原。

依托如视自研算法,每一个高斯点都被放置在最优位置,充分发挥各自作用,在保障画面高质量输出的前提下,实现模型数据体积大幅精简。同等场景下,经过优化后的模型文件体积仅为原先的1/4‑1/5

模型轻量化带来直观改变:场景加载速度显著提升,即便是中低端设备也能够流畅渲染高清3D场景。高清的3D重建效果,不再需要依靠高端硬件、超大存储空间与高额算力成本来换取。

攻克大场景重建难题,从单房间到整片园区都能装得下、跑得动

大场景重建,一直是3DGS落地路上的一大拦路虎。当重建范围从一间房屋拓展至整片园区,挑战远不止数据量上涨。复杂的空间关系、暴涨的训练成本、超限的模型体量,很容易造成显存溢出,或是不得不舍弃画面细节换取运行可行性。

对此,如视采用“分块拆解‑独立训练‑融合拼接”的技术思路。将巨型空间切分为多个可控的子模块,每一个分块都完成充分的高斯表达训练,再经过统一对齐融合,拼接成完整连续的真实空间。场景上限不再被单次训练能力束缚,可根据实际业务需求持续向外拓展。

为解决分块拼接容易出现接缝错位的通病,如视打造自研管线,通过“粗调搭建空间骨架、微调打磨画面细节、轻量对齐消除缝隙”多层策略,既保留石碑字迹、器物雕花这类微米级精细特征,又彻底消除分块拼接痕迹,还原严丝合缝的完整三维世界。

更重要的是,这套方案支持流式加载。用户浏览大型三维场景,就像播放流媒体视频一样,无需等待全部资源下载完毕即可沉浸式漫游。

当3DGS实现大场景可扩展、流式化,这项技术便不再只是展厅里炫目的演示效果,能够真正落地住宅、产业园区、工业设施等大量真实业务场景。

降低重建门槛:普通随手拍摄素材,也能生成高质量3DGS

专业LiDAR采集设备依旧是当前产出3DGS模型的高效方案,如视自研的伽罗华P4、庞加莱R1等硬件设备,在3DGS重建上具备顶尖的效果表现,可输出毫米级精度的实景三维数据。但在如视看来,三维世界数字化,不该成为专业设备的专属能力。

如视进一步拓宽3DGS的输入源,全景图、全景视频、单反照片、普通手机拍摄的图像与视频等纯视觉素材,都可以作为重建的原始输入。

传统纯视觉重建依靠特征提取匹配、多阶段几何计算推导空间信息,面对重复纹理、特征匮乏的开阔空间、共视素材不足等场景,极易出现重建失效。而如视另辟蹊径,借助大模型直接完成空间感知。

依托如视沉淀的海量真实空间数据库,自研Argus空间大模型可以基于多视角图像输入做前馈式空间推理,一次性输出图像位姿、深度、点云等关键信息,为3DGS重建构建稳定的空间先验。

内部对比测试显示,传统方法容易翻车的弱重复纹理、低特征大空间、共视不足等难题,Argus模型均展现出更稳定的表现。

空间理解从逐帧反复计算,升级为大模型一步推理,真正拉低了3DGS重建的使用门槛。一部普通手机、一台全景相机、一组日常拍摄照片,普通人随手采集的素材,都可以成为构建三维数字空间的起点。

不止可视化渲染,3DGS正在成为空间智能的底层基石

3D高斯溅射的价值,绝不局限于好看的三维画面。在如视的技术布局中,当3DGS可以低门槛覆盖超大场景、留存丰富细节,它就不再只是可视化工具,更是空间智能的核心基础设施。可计量的真实物理尺度、可修改的空间结构、可解析的语义信息,这些藏在画面之下的数据资产,才是其长期核心价值所在。

放眼更长远的产业视角,如视推进的纯视觉路线3DGS,正在打开相比传统激光雷达方案更广阔的想象空间:

· 世界模型数据飞轮:传统激光雷达重建高度依赖专业团队与设备采集,数据规模有限、更新周期漫长;而纯视觉3DGS能够消化海量互联网公开视频、街景、图像素材,搭建互联网规模的3D世界模型,推动空间数据积累从线性增长迈入指数级飞轮。

· 虚实共生与场景泛化:激光雷达只能复刻现实已经存在的环境;结合AI生成能力,纯视觉3DGS能够批量生成海量合成仿真场景,为机器人补齐地震废墟、极夜暴雪等现实难以采集的极端长尾训练环境。

· 具身智能仿真:原生保留真实光影反射效果,让仿真环境内的机器视觉感知效果无限贴近现实,助力实现零样本仿真到现实迁移,虚拟世界训练习得的能力,可以直接落地真实物理世界。

· 空间计算与大模型交互:纯视觉管线天然适配视觉语言大模型,可将语义信息直接嵌入高斯点,让三维空间从“只能观看”进化为“可理解、可对话、可编辑”。未来的数字空间,不止是被记录保存,更能够被智能查询:定位物体、检索区域、修改空间结构,都将成为现实。

从算法迭代、数据表达优化,再到工程落地深耕,如视持续投入的终极目标,不只是打造效果惊艳的三维场景,更是搭建机器理解物理空间、用空间数据赋能人工智能的底层底座。

真实的物理世界,值得被更好地记录、理解与交互。

下载品玩App,比99.9%的人更先知道关于「业界动态」的新故事

下载品玩App

比99.9%的人更先知道关于「业界动态」的新故事

iOS版本 Android版本
立即下载
shuohang

这家伙很懒,什么也没留下,却只想留下你!

取消 发布
AI阅读助手
以下有两点提示,请您注意:
1. 请避免输入违反公序良俗、不安全或敏感的内容,模型可能无法回答不合适的问题。
2. 我们致力于提供高质量的大模型问答服务,但无法保证回答的准确性、时效性、全面性或适用性。在使用本服务时,您需要自行判断并承担风险;
感谢您的理解与配合
该功能目前正处于内测阶段,尚未对所有用户开放。如果您想快人一步体验产品的新功能,欢迎点击下面的按钮申请参与内测 申请内测