AI社区

热门板块
热门话题

人工智能模型社区 1个主题内容

ChatGPT注册使用 0个主题内容

算力百科 0个主题内容

bug及解决办法 0个主题内容

数据集应用社区 7个主题内容

AI大学 2个主题内容

应用案例：双目作为3D相机，仿照人类双眼感知世界

卷积神经网络（Convolutional Neural Networks）

BP(back propagation)神经网络

SOM 自组织映射神经网络

独立同分布（iid，independently identically distribution）

层次聚类算法

Mean Squared Error 均方误差

致AI开发者的公开信

今日排行

2条结果All
71条结果大模型
2条结果语音
40条结果语言
5条结果数据集
3条结果GPT
2条结果函数
3条结果机器人

本月搜索

2条结果函数
71条结果大模型
2条结果语音
3条结果GPT
2条结果All
30条结果语言模型
40条结果语言
5条结果数据集

首饰数据集
项饰数据集
腕饰数据集
戒指/指环数据集
耳饰数据集
胸针数据集
手把件数据集
头饰数据集
串珠配珠数据集

水果数据集
核果类数据集
仁果类数据集
浆果类数据集
柑果类数据集
瓠果类数据集
其它类数据集

坚果数据集

强化学习

通过推断智能体形态来学习可转移策略 2023-08-14 16:01:06
StoryBench: 一个多方面的连续故事可视化基准测试。 2023-08-24 00:25:22
深入探究单目三维物体跟踪的运动感知匹配技术 2023-08-24 00:16:12
GRIP: 利用潜在一致性和空间线索生成交互姿势 2023-08-24 00:06:12
基于分层变形的少样本物理感知关节网格生成 2023-08-23 09:31:08
从人类视频中构建结构化世界模型 2023-08-23 09:24:20
CamP: 神经辐射场的相机预处理 2023-08-23 09:23:03
自适应阈值启发式算法用于KPI异常检测 2023-08-23 09:18:22
大型语言模型在电信行业的即将到来的影响 2023-08-18 01:19:04
共享用户嵌入的跨属性矩阵分解模型 2023-08-18 01:17:02
魔鬼在于错误：利用大型语言模型进行细粒度机器翻译评估 2023-08-18 01:15:37

Henry G. 3 minutes ago
StoryBench: 一个多方面的连续故事可视化基准测试。 2023-08-24 00:25:22
深入探究单目三维物体跟踪的运动感知匹配技术 2023-08-24 00:16:12
GRIP: 利用潜在一致性和空间线索生成交互姿势 2023-08-24 00:06:12
基于分层变形的少样本物理感知关节网格生成 2023-08-23 09:31:08
从人类视频中构建结构化世界模型 2023-08-23 09:24:20
CamP: 神经辐射场的相机预处理 2023-08-23 09:23:03
自适应阈值启发式算法用于KPI异常检测 2023-08-23 09:18:22
大型语言模型在电信行业的即将到来的影响 2023-08-18 01:19:04
共享用户嵌入的跨属性矩阵分解模型 2023-08-18 01:17:02
魔鬼在于错误：利用大型语言模型进行细粒度机器翻译评估 2023-08-18 01:15:37

通过推断智能体形态来学习可转移策略

Brandon Trabucco

强化学习的典型方法包括对每种新形态从零开始为特定智能体量身定制的训练策略。近期研究在具有类似任务目标的多个智能体上训练的形态不可知策略是否可以在无需再训练的情况下转移到具有未知形态的新智能体上，从而消除策略再训练。其需要以前的方法使用手工设计的新试剂形态描述。...

论文地址：https://arxiv.org/pdf/2206.12279.pdf

用户分享观点：