兔展智能联合北京大学、鹏城实验室研发的世界模型 UniWorld-View,登顶李飞飞团队的新视角合成(Novel View Synthesis)榜单。该模型只需一张图片或一段视频,即可生成用户指定相机轨迹的新视角视频,支持推、拉、摇、移乃至360°环绕等操作,提供精确的相机位姿控制。模型已适配国产 昇腾算力,代码与权重已全部开源,训练数据来自北大系初创企业 元空智能

新视角合成技术旨在让AI“脑补”未拍摄到的角度。传统方法在处理单目视频时,因视角覆盖有限,常出现空洞伪影或结构扭曲。生成式路线虽能生成新视角,但多数方法仅将相机位姿作为抽象条件向量输入扩散模型,导致几何与生成分离,控制精度不足。UniWorld-View采用“遮挡感知点云渲染”(Occlusion-aware Point Cloud Rendering)技术,沿相机轨迹逐帧累积遮挡区域并生成mask,在渲染时挖掉这些区域,避免错误纹理误导生成模型,从而提升大基线视角下的生成质量。

兔展智能由北京大学校友与北京大学视觉领域青年领军人才联合创立,专注视觉AI大模型研发,拥有自研多模态大模型底层技术。公司此前发布的 Open-Sora Plan 是行业首个开源文生视频模型,2024年代码引用量位居全球第一;2025年发布的 UniWorld-V2 早于NanoBanana三个月,引领理解与生成统一架构方向;2026年4月发布的 UniWorld-V2.5 在InfoGraph、图文交错等场景对齐GPT-Image-2的生成能力。公司正推进UniWorld模型产品化,近期将推出产模一体设计生产工具 RabbitVis,推动视觉AI进入商业设计工作流。

此次登顶李飞飞团队榜单,标志着国产世界模型在视觉生成领域的技术实力获得国际认可,开源策略也有助于降低行业应用门槛,加速AI在视频生成、3D内容创作等场景的落地。