都在问世界模型怎么落地,PixVerse把答案做成了「好玩」
都在问世界模型怎么落地,PixVerse把答案做成了「好玩」这两年,互动娱乐先在线下火了一轮。
搜索
这两年,互动娱乐先在线下火了一轮。
世界模型应该如何评测?答案是:像真实用户一样去 “玩” 它。
香港大学、香港科技大学与腾讯 ARC Lab 联合提出 SCoPE(Sightline-Coordinate Positional Encoding),一套面向视频 DiT 的射线空间位置编码:让视频模型处理位置关系的基底从张量网格转向射线空间。
当自动驾驶赛车以近 300 km/h 的时速在 F1 赛道上与周车进攻防守、交互博弈,它面对的问题早已不只是提升圈速。
从物理视频生成到运动迁移,再到可控世界建模。
机器人撬开啤酒瓶盖,啤酒泡沫涌起,酒液从画面右下角流入杯中。
视频世界模型跑久了,往往面临三个问题: 画面发灰发糊或者过曝过饱和、场景悄悄换了地方、显存先撑不住。
过去三年,AI 内容生成行业经历了几轮密集的技术迭代。从文生图到文生视频,从几秒的短片到分钟级的长视频,每一轮升级都让生成内容的质量和时长向前推进一步。
太卷了!过去两年,视频生成模型把画面参数几乎卷了个遍。
近日,清华大学智能产业研究院(AIR)与加州大学伯克利分校(BAIR)团队合作提出了一种全新的预测范式 ODEWorld,其建立在连续的“物理时间流”(Physical-Time Flow, PT-Flow)之上。与传统方法直接预测下一帧是什么不同,ODEWorld 试图学习的是:世界究竟怎样从当前状态连续地变化到未来状态。