用3D几何先验驱动视频扩散,实现更一致的世界生成
用3D几何先验驱动视频扩散,实现更一致的世界生成随着视频扩散模型能力不断提升,从单张图像出发、按照用户指定的相机轨迹生成新视角视频,正在成为 World Modeling 的重要技术路线。
搜索
随着视频扩散模型能力不断提升,从单张图像出发、按照用户指定的相机轨迹生成新视角视频,正在成为 World Modeling 的重要技术路线。
图像生成模型正从「会创作」转向「可操作」。
Eazo 是一个 AI 原生互动内容创作与分发平台。Creator 可以用自然语言创造真正可运行的 App、3D 世界和 AI Agent,并直接发布到 Eazo Feed,让作品被发现、被使用、被试玩、被 Remix,并在真实反馈中找到增长和商业化机会。
该项目名为 Anatomy Atelier,是一款面向人体解剖学习的交互式 3D 网页应用。它把器官模型、知识卡片和交互操作放在同一个界面,我们通过旋转、缩放和点击,更直观地理解人体结构。
从 2D 像素到 3D 场景 Query,影溯正在尝试把三维内容生产推向可规模化调用的新阶段。
如何从一段视频中获得完整、稳定的 3D 物体?过去,这个问题大致沿着两条路线发展。
整个AI圈,都在为Opus 5沸腾!
近日,比特无限发布的 Arko-T,是一款面向 Text-to-Structured 3D Generation 的 4B 参数基础模型。该模型由比特无限联创、首席科学家周平义博士带队完成。它接收自然语言描述,直接输出可执行的 Build123d 程序。程序经过 CAD 内核运行后,可以得到带有命名参数、结构特征和建模过程的 CAD 设计实体。
过去三年,3D Gaussian Splatting(3DGS)几乎成为实时3D场景重建与新视角合成的“默认答案”。
3D打印无疑是全球增长最受关注的赛道之一,但结构化、可编辑的物理3D数据却极度稀缺。就在这个行业真空里,一家年轻公司浮出水面——AI生成矢量3D模型的比特无限(BitInf)。