简介:

VideoWorld是一个探索从无标签视频中学习知识的深度生成模型。

功能:

通过自回归视频生成模型学习任务规则和操作。

利用潜在动态模型(LDM)高效表示多步视觉变化。

在视频围棋任务中达到5段职业水平。

在机器人控制任务中实现跨环境泛化。

提供开源代码和数据,支持进一步研究。

需求人群:

"该产品适合对人工智能、计算机视觉和机器人控制领域感兴趣的科研人员和开发者,尤其是那些希望探索如何从无标签视觉数据中学习知识的研究者。它也适用于需要高效知识获取和泛化能力的机器人和自动化系统开发者。"

浏览量:40

s1785318098921236

打开站点

构建AI去赚钱
s1785341518918206
类似产品

© 2025     AIbase    备案号:闽ICP备08105208号-14

隐私政策

用户协议

意见反馈 网站地图