AI社区

热门板块
热门话题

人工智能模型社区 1个主题内容

ChatGPT注册使用 0个主题内容

算力百科 0个主题内容

bug及解决办法 0个主题内容

数据集应用社区 7个主题内容

AI大学 2个主题内容

应用案例：双目作为3D相机，仿照人类双眼感知世界

卷积神经网络（Convolutional Neural Networks）

BP(back propagation)神经网络

SOM 自组织映射神经网络

独立同分布（iid，independently identically distribution）

层次聚类算法

Mean Squared Error 均方误差

致AI开发者的公开信

今日排行

2条结果All
2条结果pac
71条结果大模型
3条结果GPT
4条结果提示
2条结果函数
30条结果语言模型
40条结果语言

本月搜索

2条结果All
2条结果pac
2条结果函数
71条结果大模型
3条结果GPT
40条结果语言
2条结果语音
30条结果语言模型

首饰数据集
项饰数据集
腕饰数据集
戒指/指环数据集
耳饰数据集
胸针数据集
手把件数据集
头饰数据集
串珠配珠数据集

水果数据集
核果类数据集
仁果类数据集
浆果类数据集
柑果类数据集
瓠果类数据集
其它类数据集

坚果数据集

自然语言理解

ICLR 2022 | 基于对抗自注意力机制的预训练语言模型 2023-07-30 02:27:08
StoryBench: 一个多方面的连续故事可视化基准测试。 2023-08-24 00:25:22
深入探究单目三维物体跟踪的运动感知匹配技术 2023-08-24 00:16:12
GRIP: 利用潜在一致性和空间线索生成交互姿势 2023-08-24 00:06:12
基于分层变形的少样本物理感知关节网格生成 2023-08-23 09:31:08
从人类视频中构建结构化世界模型 2023-08-23 09:24:20
CamP: 神经辐射场的相机预处理 2023-08-23 09:23:03
自适应阈值启发式算法用于KPI异常检测 2023-08-23 09:18:22
大型语言模型在电信行业的即将到来的影响 2023-08-18 01:19:04
共享用户嵌入的跨属性矩阵分解模型 2023-08-18 01:17:02
魔鬼在于错误：利用大型语言模型进行细粒度机器翻译评估 2023-08-18 01:15:37

Henry G. 3 minutes ago
StoryBench: 一个多方面的连续故事可视化基准测试。 2023-08-24 00:25:22
深入探究单目三维物体跟踪的运动感知匹配技术 2023-08-24 00:16:12
GRIP: 利用潜在一致性和空间线索生成交互姿势 2023-08-24 00:06:12
基于分层变形的少样本物理感知关节网格生成 2023-08-23 09:31:08
从人类视频中构建结构化世界模型 2023-08-23 09:24:20
CamP: 神经辐射场的相机预处理 2023-08-23 09:23:03
自适应阈值启发式算法用于KPI异常检测 2023-08-23 09:18:22
大型语言模型在电信行业的即将到来的影响 2023-08-18 01:19:04
共享用户嵌入的跨属性矩阵分解模型 2023-08-18 01:17:02
魔鬼在于错误：利用大型语言模型进行细粒度机器翻译评估 2023-08-18 01:15:37

ICLR 2022 | 基于对抗自注意力机制的预训练语言模型

Hongqiu Wu, Ruixue Ding, Hai Zhao, Pengjun Xie, Fei Huang, Min Zhang

本文提出了 Adversarial Self-Attention 机制（ASA），利用对抗训练重构 Transformer 的注意力，使模型在被污染的模型结构中得到训练。尝试解决的问题：大量的证据表明，自注意力可以从 allowing bias 中获益，allowing bias 可以将一定程度的先验（如 masking，分布的平滑）加入...

论文地址：https://arxiv.org/abs/2206.12608

用户分享观点：