由北大校友与视觉AI青年领军学者联合创立的兔展智能,近日凭借自研视觉大模型UniWorld-View荣登李飞飞团队发布的全球世界模型权威榜单榜首。该模型首次实现单图/视频输入到可控新视角视频输出的端到端统一建模——支持任意指定相机轨迹(推拉摇移、360°环绕),真正达成‘一张图生4D视频’的技术突破。其核心创新在于双流协同架构:‘几何流’通过点云渲染图与掩码编码精准锚定3D结构;‘外观流’依托原创Ref-DiT模块,以新视角为Query、源帧为Key/Value进行跨帧注意力重建,自动修复伪影并补全纹理。模型已全面适配国产昇腾AI芯片,训练数据源自北大系企业元空智能,全部代码与权重开源至GitHub(PKU-YuanGroup/UniWorld-View)。同步推进商业化落地,产模一体设计工具RabbitVis即将发布,加速视觉AI融入专业设计工作流。
来源:量子位
