HyperAI

在 Discord 上讨论

日期

4 年前

发布 URL

标签

URLB 全称 Unsupervised Reinforcement Learning Benchmark，是一个无监管强化学习数据集。 URLB 包括两个阶段：无奖励的预训练阶段和有外部奖励的下游任务适应阶段。在 DeepMind 控制套件的基础上，该数据集提供了来自三个领域的 12 个连续控制任务以供评估。

此数据集由社区用户贡献,仅用于教育和信息目的。如有任何内容涉及版权侵权,请通过 [email protected] 联系我们,我们将及时审核并删除。

用 AI 构建 AI

从创意到上线——通过免费 AI 协同编码、开箱即用的环境和最优惠的 GPU 价格,加速您的 AI 开发。

AI 协同编码

开箱即用的 GPU

最优定价

开始使用查看定价

HyperAI Newsletters

订阅我们的最新资讯

我们会在北京时间 每周一的上午九点 向您的邮箱投递本周内的最新更新

邮件发送服务由 MailChimp 提供

HyperAI

在 Discord 上讨论

日期

4 年前

发布 URL

标签

此数据集由社区用户贡献,仅用于教育和信息目的。如有任何内容涉及版权侵权,请通过 [email protected] 联系我们,我们将及时审核并删除。

用 AI 构建 AI

从创意到上线——通过免费 AI 协同编码、开箱即用的环境和最优惠的 GPU 价格,加速您的 AI 开发。

AI 协同编码

开箱即用的 GPU

最优定价

开始使用查看定价

HyperAI Newsletters

订阅我们的最新资讯

我们会在北京时间 每周一的上午九点 向您的邮箱投递本周内的最新更新

邮件发送服务由 MailChimp 提供

用 AI 构建 AI

HyperAI Newsletters

相关数据集

DRACO 跨领域深度研究基准数据集

CL-bench 上下文学习评估基准数据集

MCIF 多模态跨语言指令跟随数据集

用 AI 构建 AI

HyperAI Newsletters

相关数据集

DRACO 跨领域深度研究基准数据集

CL-bench 上下文学习评估基准数据集

MCIF 多模态跨语言指令跟随数据集

用 AI 构建 AI

HyperAI Newsletters

相关数据集

DRACO 跨领域深度研究基准数据集

CL-bench 上下文学习评估基准数据集

MCIF 多模态跨语言指令跟随数据集

相关数据集

DRACO 跨领域深度研究基准数据集

CL-bench 上下文学习评估基准数据集

MCIF 多模态跨语言指令跟随数据集

Command Palette

URLB 强化学习数据集

用 AI 构建 AI

HyperAI Newsletters

Command Palette

URLB 强化学习数据集

相关数据集

DRACO 跨领域深度研究基准数据集

CL-bench 上下文学习评估基准数据集

MCIF 多模态跨语言指令跟随数据集

用 AI 构建 AI

HyperAI Newsletters

Command Palette

URLB 强化学习数据集

相关数据集

DRACO 跨领域深度研究基准数据集

CL-bench 上下文学习评估基准数据集

MCIF 多模态跨语言指令跟随数据集

用 AI 构建 AI

HyperAI Newsletters

相关数据集

DRACO 跨领域深度研究基准数据集

CL-bench 上下文学习评估基准数据集

MCIF 多模态跨语言指令跟随数据集

相关数据集

DRACO 跨领域深度研究基准数据集

CL-bench 上下文学习评估基准数据集

MCIF 多模态跨语言指令跟随数据集