Paper
Miscellaneous
Related papers that do not yet justify a dedicated category.
Loading...
World Action Models: The Next Frontier in Embodied AI
VLA在具身领域展示了强大的语义泛化, 但他们学习到的是从观察到动作的反应式映射, 没有明确地建模物理世界在干预下的演变方式. 越来越多的工作通过将世界模型整合进动作生成来解决这一限制. 这篇论文定义了WAN, 历史, 发展范式, 数据生态, 评估方法.
AniDoc: Animation Creation Made Easier
视频线稿上色工具, 根据参考角色规格自动将草图序列转换为彩色动画, 模型对参考角色与每帧线稿之间的变化表现出很强的鲁棒性, 甚至可以自动化中间画过程, 用户只需提供一个角色图像以及起始和结束草图, 就可以轻松创建时间上一致的动画.