0
点赞
收藏
分享

微信扫一扫

NLP:数据增强/Data Argumentation【词汇替换、随机Mask、回译、添加噪声】

码农K 2022-03-11 阅读 65

数据增强技术在计算机视觉中应用的比较广泛,但是在 NLP 中却很少能得到有效的应用。本质原因在于图像中的一些数据增强方法,比如将图像旋转几度或将其色度转换为灰度,在增强数据的同时并不会改变图像本身的含义。这种特性使得数据增强成为计算机视觉研究中的一种重要工具。

我对是否有人尝试去开发 NLP 相关的数据增强技术很感兴趣,所以找时间研究了一下现有的文献。在这篇文章中,我会努力去概述当前用于文本数据增强的方法,同时也提供对应的参考文献,供大家学习。




参考资料:
一文了解NLP中的数据增强方法
NLP数据增强
17.1 自然语言处理中文本数据增强方法
17.1 自然语言处理中文本数据增强方法

举报

相关推荐

NLP_文本数据增强_5(代码示例)

0 条评论