ECCV'26 Oral|人物不能变、姿势要对齐、风格还得一致:DyRef突破多参考约束下的图像生成难题
ECCV'26 Oral|人物不能变、姿势要对齐、风格还得一致:DyRef突破多参考约束下的图像生成难题给图像生成模型一张人物参考图,它大概率能抓住身份特征。
搜索
给图像生成模型一张人物参考图,它大概率能抓住身份特征。
JEPA世界模型的底层是Yann LeCun自2017年起持续倡导的自监督学习(Self-Supervised Learning, SSL)。
当机器人拥有多个摄像头,它看到的世界是否仍然保持一致?
训练一个顶级文生图模型,到底需要多少钱?
人类可以轻松想象一个还没做出的动作会带来什么:手一松,杯子会掉;往前一推,抽屉会合上。动作尚未发生,大脑已经预演了可能的结果。对机器人来说,具身世界模型(Embodied World Model)会根据当前观察和未来的动作,预测动作执行后的未来画面。
别无脑把Opus 5推理强度拉到max当冤大头。
让 Agent 上网查资料,已经不算新鲜事。
就在刚刚,全球首个3万亿参数级开源模型Kimi K3正式开源!https://github.com/MoonshotAI/Kimi-K3/tree/main。Moonshot AI宣布,发布Kimi K3的模型权重、技术报告,并开源支撑Kimi K3模型训练的关键Infra技术:MoonEP、FlashKDA和AgentEnv。
过去三年,3D Gaussian Splatting(3DGS)几乎成为实时3D场景重建与新视角合成的“默认答案”。
一个前沿模型,被要求随机生成一个奇数。