NLP知识总结和论文整理

词向量

参考论文: Efficient Estimation of Word Representations in Vector Space

CBOW (Continuous Bag-of-Word): 挑一个要预测的词,来学习这个词前后文中词语和预测词的关系

Skip-Gram: 使用文中的某个词,然后预测这个词周边的词。相比 CBOW 最大的不同,就是剔除掉了中间的那个 SUM 求和的过程,将词向量求和的这个过程不太符合直观的逻辑,而Skip-Gram没有这个过程。

NLP知识总结和论文整理

句向量

Seq2Seq Learning 参考论文: Sequence to Sequence Learning with Neural Networks

将一个 sequence 转换成另一个 sequence。也就是用Encoder压缩并提炼第一个sequence的信息,然后用Decoder将这个信息转换成另一种语言或其他的表达形式。

In practice: Google’s NMT System. 参考论文: Google’s Neural Machine Translation System: Bridging the Gap between Human and Machine Translation

CNN for NLP 参考论文:Convolutional Neural Networks for Sentence Classification

注意力

CNN Attention Neural Image Caption Generation 参考论文: Show, Attend and Tell: Neural Image Caption Generation with Visual Attention

Seq2Seq Attention Mechanism 参考论文:Effective Approaches to Attention-based Neural Machine Translation

NEURAL MACHINE TRANSLATION BY JOINTLY LEARNING TO ALIGN AND TRANSLATE

Transformer 参考论文:Attention Is All You Need

Layer Normalization 参考论文:Layer Normalization

Other Normalization 参考论文:PowerNorm: Rethinking Batch Normalization in Transformers

RNN 与 attention 参考论文:Transformers are RNNs: Fast Autoregressive Transformers with Linear Attention

预训练模型

ELMo 参考论文:Deep contextualized word representations

找出词语放在句子中的意思。ELMo还是想用一个向量来表达词语,不过这个词语的向量会包含上下文的信息。

ELMo的训练:前向LSTM预测后文的信息,后向LSTM预测前文的信息。 训练一个顺序阅读者+一个逆序阅读者,在下游任务的时候, 分别让顺序阅读者和逆序阅读者,提供他们从不同角度看到的信息 。

GPT 参考论文:Improving Language Understanding by Generative Pre-Training

Language Models are Unsupervised Multitask Learners

Language Models are Few-Shot Learners

用非监督的人类语言数据,训练一个预训练模型,然后拿着这个模型进行finetune, 基本上就可以让你在其他任务上也表现出色。

BERT 参考论文:BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding

BERT 和GPT 还有ELMo 是一个性质的东西。 它存在的意义是要变成一种预训练模型 ,提供 NLP 中对句子的理解。ELMo 用了双向 LSTM 作为句子信息的提取器,同时还能表达词语在句子中的不同含义;GPT 呢, 它是一种单向的语言模型,同样也可以用 attention 的方式提取到更加丰富的语言意思信息。

Original: https://www.cnblogs.com/AICROC/p/16057409.html
Author: 生于思考
Title: NLP知识总结和论文整理

原创文章受到原创版权保护。转载请注明出处:https://www.johngo689.com/643418/

转载文章受原作者版权保护。转载请注明原作者出处!

(0)

大家都在看

  • JDBC——增删改查及开启事务操作

    1.在JDBC中进行对mysql的添加数据 public void test() throws SQLException { 2.在JDBC中进行对mysql的修改/更新数据 3….

    技术杂谈 2023年7月24日
    068
  • kubeadm 搭建 K8s

    kubeadm 搭建 K8s 本篇主要记录一下 使用 kubeadm 搭建 k8s 详细过程 ,环境使用 VirtualBox 构建的3台虚拟机 1.环境准备 操作系统:Cento…

    技术杂谈 2023年7月11日
    0119
  • Python数据分析–Numpy常用函数介绍(2)

    摘要:本篇我们将以分析历史股价为例,介绍怎样从文件中载入数据,以及怎样使用NumPy的基本数学和统计分析函数、学习读写文件的方法,并尝试函数式编程和NumPy线性代数运算,来学习N…

    技术杂谈 2023年7月25日
    073
  • 数据库架构演变概要

    一. 背景 为了适应业务增长,数据库数据量快速增长,性能日趋下降,稳定性不佳的实际情况,急需架构逐步演变适应未来的业务发展。 二. 现状 【稳定性】数据库为单点,没有高可用和稳定性…

    技术杂谈 2023年7月23日
    063
  • elementui中的el-table,(prop对应多个属性)中拼接两个列表字段并展示

    elementui中的el-table,(prop对应多个属性)中拼接两个列表字段并展示 {{ scope.row.pa_dt_name }}|{{ scope.row.pa_du…

    技术杂谈 2023年7月10日
    090
  • Aerospike 安装

    Aerospike 安装 posted on2022-02-09 17:42 duanxz 阅读(65 ) 评论() 编辑 Original: https://www.cnblog…

    技术杂谈 2023年5月30日
    095
  • openssl、x509、crt、cer、key、csr、ssl、tls 这些都是什么鬼?

    今天尝试在mac机上搭建docker registry私有仓库时,杯具的发现最新的registry出于安全考虑,强制使用ssl认证,于是又详细了解linux/mac上openssl…

    技术杂谈 2023年5月30日
    0136
  • zz

    http://www.woshipm.com/discuss/86673.html Original: https://www.cnblogs.com/lexus/p/789153…

    技术杂谈 2023年5月31日
    069
  • mac 快速安装watchman

    有时候homebrew在国内不太友好,安装软件有时候会。。。你懂的。。 快速安装法: 指南: 然后: Original: https://www.cnblogs.com/loade…

    技术杂谈 2023年5月31日
    077
  • MySQL数据库-数据表(一)

    数据表的基本操作. MySQL 数据库支持多种数据类型,大致可以分为 3 类:数值类型、日期和时间类型、字符串(字符)类型。 (1)数值类型 数值类型用于存储数字型数据,这些类型包…

    技术杂谈 2023年6月21日
    0100
  • JDBC学习

    笔记如上 学了个代码 php;gutter:true; import java.sql.*;</p> <p>public class jdbc01 { pu…

    技术杂谈 2023年6月21日
    078
  • String为什么不是基本数据类型

    java虚拟机处理基础类型与引用类型的方式是不一样的,对于基本类型,java虚拟机会为其分配数据类型实际占用的内存空间,对于引用类型变量,他仅仅是一个指向堆区中某个实例的指针。 O…

    技术杂谈 2023年6月21日
    089
  • 如何在Oracle中复制表结构和表数据

    复制表结构及其数据: 只复制表结构: 或者: 只复制表数据: 如果两个表结构一样: 如果两个表结构不一样: Original: https://www.cnblogs.com/lc…

    技术杂谈 2023年5月31日
    072
  • excel中图表无法编辑的解决办法

    在多人协同办公的情况下,有些表格往往会设置为共享编辑模式,此时会发现sheet页中的的图表却无法编辑或者操作 解决办法: 1、打开【共享工作簿】 2、取消勾选【允许多用户同时编辑,…

    技术杂谈 2023年7月10日
    0325
  • h5新标签介绍

    html5新增了一些标签 这些标签都是语义标签,可以帮助我们更好的理解,代码中的意思;(都是双标签) 案例: 将语义标签翻译过来为 (并没有太多的区别) 但也有几个有意思的标签; …

    技术杂谈 2023年6月1日
    079
  • SpringCloud 学习总结

    SpringCloud 学习总结 学习回顾 1.Maven依赖管理 ​ 在微服务项目中,我们一般是先创建一个父项目模块对整个项目的依赖进行版本限定和依赖控制,子模块继承父模块后,不…

    技术杂谈 2023年6月21日
    094
亲爱的 Coder【最近整理,可免费获取】👉 最新必读书单  | 👏 面试题下载  | 🌎 免费的AI知识星球