Motif

Motif 是一个基于 PyTorch 的项目,通过从 LLM(大型语言模型)的偏好中获取奖励函数,训练 AI 代理在 NetHack 上进行。它可以生成与人类行为直觉一致的行为,并且可以通过提示修改进行引导。

需求人群:

"Motif 可以用于训练 AI 代理在开放式且程序生成的游戏中获取内在动机。"

使用场景示例:

使用 Motif 训练 AI 代理在 NetHack 游戏中获取内在动机

使用 Motif 生成与人类行为直觉一致的行为

使用 Motif 通过提示修改来引导 AI 代理的行为

产品特色:

使用 LLM 的偏好创建一组注释对的注释数据集

使用交叉熵将 LLM 的偏好转化为奖励函数

使用强化学习训练代理

浏览量:9

s1785318098921236

打开站点

构建AI去赚钱
s1785341518918206
网站流量情况

最新流量情况

月访问量

5.16m

平均访问时长

00:06:42

每次访问页数

5.81

跳出率

37.20%

流量来源

直接访问

52.27%

自然搜索

32.92%

邮件

0.05%

外链引荐

12.52%

社交媒体

2.15%

展示广告

0

截止目前所有流量趋势图

地理流量分布情况

中国

11.99%

德国

3.63%

印度

9.20%

俄罗斯

5.25%

美国

19.02%

类似产品

© 2024     AIbase    备案号:闽ICP备08105208号-14

隐私政策

用户协议

意见反馈 网站地图