AI社区

热门板块
热门话题

人工智能模型社区 1个主题内容

ChatGPT注册使用 0个主题内容

算力百科 0个主题内容

bug及解决办法 0个主题内容

数据集应用社区 7个主题内容

AI大学 2个主题内容

应用案例：双目作为3D相机，仿照人类双眼感知世界

卷积神经网络（Convolutional Neural Networks）

BP(back propagation)神经网络

SOM 自组织映射神经网络

独立同分布（iid，independently identically distribution）

层次聚类算法

Mean Squared Error 均方误差

致AI开发者的公开信

今日排行

2条结果All
71条结果大模型
2条结果语音
40条结果语言
5条结果数据集
3条结果GPT
2条结果函数
3条结果机器人

本月搜索

2条结果函数
71条结果大模型
2条结果语音
3条结果GPT
2条结果All
30条结果语言模型
40条结果语言
5条结果数据集

首饰数据集
项饰数据集
腕饰数据集
戒指/指环数据集
耳饰数据集
胸针数据集
手把件数据集
头饰数据集
串珠配珠数据集

水果数据集
核果类数据集
仁果类数据集
浆果类数据集
柑果类数据集
瓠果类数据集
其它类数据集

坚果数据集

强化学习

学习环境模型引导下的部分可观察性强化学习 2023-08-14 15:54:39
StoryBench: 一个多方面的连续故事可视化基准测试。 2023-08-24 00:25:22
深入探究单目三维物体跟踪的运动感知匹配技术 2023-08-24 00:16:12
GRIP: 利用潜在一致性和空间线索生成交互姿势 2023-08-24 00:06:12
基于分层变形的少样本物理感知关节网格生成 2023-08-23 09:31:08
从人类视频中构建结构化世界模型 2023-08-23 09:24:20
CamP: 神经辐射场的相机预处理 2023-08-23 09:23:03
自适应阈值启发式算法用于KPI异常检测 2023-08-23 09:18:22
大型语言模型在电信行业的即将到来的影响 2023-08-18 01:19:04
共享用户嵌入的跨属性矩阵分解模型 2023-08-18 01:17:02
魔鬼在于错误：利用大型语言模型进行细粒度机器翻译评估 2023-08-18 01:15:37

Henry G. 3 minutes ago
StoryBench: 一个多方面的连续故事可视化基准测试。 2023-08-24 00:25:22
深入探究单目三维物体跟踪的运动感知匹配技术 2023-08-24 00:16:12
GRIP: 利用潜在一致性和空间线索生成交互姿势 2023-08-24 00:06:12
基于分层变形的少样本物理感知关节网格生成 2023-08-23 09:31:08
从人类视频中构建结构化世界模型 2023-08-23 09:24:20
CamP: 神经辐射场的相机预处理 2023-08-23 09:23:03
自适应阈值启发式算法用于KPI异常检测 2023-08-23 09:18:22
大型语言模型在电信行业的即将到来的影响 2023-08-18 01:19:04
共享用户嵌入的跨属性矩阵分解模型 2023-08-18 01:17:02
魔鬼在于错误：利用大型语言模型进行细粒度机器翻译评估 2023-08-18 01:15:37

学习环境模型引导下的部分可观察性强化学习

Edi Muˇskardin

在实际应用中，很少能够假设系统环境的完全可观测性，尽管这些知识对于确定无功控制系统与其环境的精确交互非常重要。因此，本文提出了一种在部分可观测环境中进行强化学习的方法。虽然假设环境行为类似于具有已知离散动作的部分可观测马尔可夫决策过程，但假设不知道其结构或转移...

论文地址：https://arxiv.org/pdf/2206.11708.pdf

用户分享观点：