兔展智慧聯合北京大學、鵬城實驗室研發的世界模型 UniWorld-View,登頂李飛飛團隊的新視角合成(Novel View Synthesis)榜單。該模型只需一張圖片或一段影片,即可生成使用者指定相機軌跡的新視角影片,支援推、拉、搖、移乃至360°環繞等操作,提供精確的相機位姿控制。模型已適配國產 昇騰算力,程式碼與權重已全部開源,訓練資料來自北大系初創企業 元空智慧

新視角合成技術旨在讓AI“腦補”未拍攝到的角度。傳統方法在處理單目影片時,因視角覆蓋有限,常出現空洞偽影或結構扭曲。生成式路線雖能生成新視角,但多數方法僅將相機位姿作為抽象條件向量輸入擴散模型,導致幾何與生成分離,控制精度不足。UniWorld-View採用“遮擋感知點雲渲染”(Occlusion-aware Point Cloud Rendering)技術,沿相機軌跡逐幀累積遮擋區域並生成mask,在渲染時挖掉這些區域,避免錯誤紋理誤導生成模型,從而提升大基線視角下的生成質量。

兔展智慧由北京大學校友與北京大學視覺領域青年領軍人才聯合創立,專注視覺AI大模型研發,擁有自研多模態大模型底層技術。公司此前釋出的 Open-Sora Plan 是行業首個開源文生影片模型,2024年程式碼引用量位居全球第一;2025年釋出的 UniWorld-V2 早於NanoBanana三個月,引領理解與生成統一架構方向;2026年4月釋出的 UniWorld-V2.5 在InfoGraph、圖文交錯等場景對齊GPT-Image-2的生成能力。公司正推進UniWorld模型產品化,近期將推出產模一體設計生產工具 RabbitVis,推動視覺AI進入商業設計工作流。

此次登頂李飛飛團隊榜單,標誌著國產世界模型在視覺生成領域的技術實力獲得國際認可,開源策略也有助於降低行業應用門檻,加速AI在影片生成、3D內容創作等場景的落地。