AI社区

热门板块
热门话题

人工智能模型社区 1个主题内容

ChatGPT注册使用 0个主题内容

算力百科 0个主题内容

bug及解决办法 0个主题内容

数据集应用社区 7个主题内容

AI大学 2个主题内容

应用案例：双目作为3D相机，仿照人类双眼感知世界

卷积神经网络（Convolutional Neural Networks）

BP(back propagation)神经网络

SOM 自组织映射神经网络

独立同分布（iid，independently identically distribution）

层次聚类算法

Mean Squared Error 均方误差

致AI开发者的公开信

今日排行

2条结果语音
71条结果大模型
40条结果语言
2条结果pac
30条结果语言模型
4条结果提示
3条结果模态
3条结果机器人

本月搜索

2条结果All
2条结果函数
71条结果大模型
2条结果语音
3条结果GPT
2条结果pac
30条结果语言模型
40条结果语言

首饰数据集
项饰数据集
腕饰数据集
戒指/指环数据集
耳饰数据集
胸针数据集
手把件数据集
头饰数据集
串珠配珠数据集

水果数据集
核果类数据集
仁果类数据集
浆果类数据集
柑果类数据集
瓠果类数据集
其它类数据集

坚果数据集

强化学习

Thinker：规划和行动学习 2023-07-30 02:28:42
StoryBench: 一个多方面的连续故事可视化基准测试。 2023-08-24 00:25:22
深入探究单目三维物体跟踪的运动感知匹配技术 2023-08-24 00:16:12
GRIP: 利用潜在一致性和空间线索生成交互姿势 2023-08-24 00:06:12
基于分层变形的少样本物理感知关节网格生成 2023-08-23 09:31:08
从人类视频中构建结构化世界模型 2023-08-23 09:24:20
CamP: 神经辐射场的相机预处理 2023-08-23 09:23:03
自适应阈值启发式算法用于KPI异常检测 2023-08-23 09:18:22
大型语言模型在电信行业的即将到来的影响 2023-08-18 01:19:04
共享用户嵌入的跨属性矩阵分解模型 2023-08-18 01:17:02
魔鬼在于错误：利用大型语言模型进行细粒度机器翻译评估 2023-08-18 01:15:37

Henry G. 3 minutes ago
StoryBench: 一个多方面的连续故事可视化基准测试。 2023-08-24 00:25:22
深入探究单目三维物体跟踪的运动感知匹配技术 2023-08-24 00:16:12
GRIP: 利用潜在一致性和空间线索生成交互姿势 2023-08-24 00:06:12
基于分层变形的少样本物理感知关节网格生成 2023-08-23 09:31:08
从人类视频中构建结构化世界模型 2023-08-23 09:24:20
CamP: 神经辐射场的相机预处理 2023-08-23 09:23:03
自适应阈值启发式算法用于KPI异常检测 2023-08-23 09:18:22
大型语言模型在电信行业的即将到来的影响 2023-08-18 01:19:04
共享用户嵌入的跨属性矩阵分解模型 2023-08-18 01:17:02
魔鬼在于错误：利用大型语言模型进行细粒度机器翻译评估 2023-08-18 01:15:37

Thinker：规划和行动学习

S Chung, I Anokhin, D Krueger

Thinker算法允许智能体学习如何自主规划和执行动作，通过与习得模型交互实现更优的性能，为强化学习中规划技能与智能体决策过程的无缝融合提供了新的研究方向。动机：为了填补在模型为学习的情况下，强化学习代理与习得世界模型之间的缺失，使代理能够自主与习得模型交互并利用模...

论文地址：https://arxiv.org/abs/2307.14993

用户分享观点：