使用Encoder-Decoder模型自动生成对联的思路

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情
/* 版权声明:可以任意转载,转载时请标明文章原始出处和作者信息 .*/

                                                     author: 张俊林



在我看到第一篇Encoder-Decoder模型的论文的时候,我就觉得用这个来作对联自动生成是再合适不过的了,做诗词应该也是比较适合的,但是相对诗词,用它来做对联肯定更合适。今天的文章就讲讲这方面的内容。这篇文章主体内容是2015年底形成的,本来我的打算是收集些训练数据,让Encoder-Decoder+Attention生成些对联把这篇文章补充些例子再发出去,不过因为精力原因,迟迟没有做这个实验,短期内可能也没时间做,所以干脆就现在分享出来,哪位有精力和兴趣可以实际做一下试试,这看上去没啥实际用处,但是还是挺好玩的一件事。不过我确信用这个模型做对联生成一定可以做好。


为什么说Encoder-Decoder模型适合作对联呢?因为相对诗词等任务来说,对联要求严格的上下联对仗,老话不是说了吗,以前儿童诗词启蒙时都要学一些对仗规则,比如:天对地,雨对风,大陆对长空,王八对绿豆,八戒对悟空(后面两句是本文作者诗才大发胡诌的,请未成年儿童切勿模仿或者在有大人监督场景下模仿@^^@)。这种严格的对仗关系意味着极强的映射规律性,而这个用RNNEncoder-Decoder来说正好是能够发挥它们长处的地方,所以说Encoder-Decoder加上RNN配置是非常适合用来做对联的。


对联的严格对仗性可以给个小故事,大家直观感受下:


相传解缙少时家贫,其家有片对着地主家的一片竹林,于是他作了副对联:“门对千杆竹,家藏万卷书”。地主心说:我幼儿园肄业文凭,你在我面前你这么装有文化好吗?于是不爽,命人把竹子砍短,解缙灵机一动把对联加了一个字,改成:“门对千杆竹短,家藏万卷书长”。地主气不打一处来,放出功夫熊猫把竹子全吃了,解缙又改对联:“门对千杆竹短无,家藏万卷书长有”。气得地主直跳脚骂娘。


从这个故事我们可以归纳出中心思想就是:从古至今,有钱就是大爷,可以随便砍伐树木破坏生态而不被法律制裁@^^@…..不对,跑偏了,中心思想应该是:肄业的同学都容易创业成功,成为新时达的地主老财,而好好上学的大都免不了家贫的结局…..也不对,你看我这三观都歪到引力波都达不到的宇宙之外了,中心思想是:对联是有极强的对仗性的。而这种对仗性代表了什么?代表了语言单元之间极强的规律性,而这是非常适合通过机器来学习并容易做好的事情,这是为何我坚信用Encoder-Decoder做对联一定能够做好的原因。


|Encoder-Decoder模型


Encoder-Decoder框架可以看作是一种文本处理领域的研究模式,应用场景异常广泛。下图是文本处理领域里常用的

Encoder-Decoder模型 1.Encoder-Decoder模型及RNN的实现 所谓encoder-decoder模型,又叫编码-解码模型。这是一种应用于seq2seq问题的模型。 那么seq2seq又是什么呢?简单的说,就是根据一个输入序列x,来生成另一个输出序列y。seq2seq有很多的应用,例如翻译,文档摘取,问答系统等等。在翻译中,输入序列是待翻译的文本,输出序列是翻译后的文本;在问答系统中,输入序列是提出的问题,而输出序列是答案。 这里复习下Sequence2Sequence任务到底是什么,所谓的Sequence2Seq 阅读详情

相关推荐

Encoder-Decoder Model编码器-解码器模型

摘要:编码器-解码器是一种深度学习模型,由编码器和解码器组成,用于处理序列到序列的任务。编码器将输入序列转换为固定长度的上下文向量,解码器将其转换为输出序列。该模型通过RNN、LSTM或GRU等循环结构实现,并引入注意力机制提高性能。工作流程包括输入编码、上下文向量生成和输出解码。广泛应用于机器翻译、图像处理等领域,能有效处理可变长度序列。

Frost_Descent的博客 2193

Encoder-Decoder模型自动生成文本摘要

出品:贪心科技(公众号:贪心科技)作者:Jason Brownlee前言文本摘要是自然语言处理中的一个问题,即要为源文档创建一篇简短、准确、流畅的摘要。当针对机器翻译开发的Encoder-Decoder循环神经网络结构应用于文本摘要问题时,它也已经被证明是有效的。在Keras深度学习库中应用这种体系结构可能有些困难,因为Keras为了让库变得干净、简单、易于使用而牺牲了一定的灵活性。在本教程中,您...

Mlooker的博客 1万+

AI大模型Transformer架构之编码器(Encoder)和解码器(Decoder),看到就是赚到!!

“ Transformer编码器的作用是特征提取,而解码器的作用是特征重建 ” 像很多人一样,一直在奇怪Transformer架构经过多层编码和解码之后就能处理输入数据并生成新的数据;所以,今天我们就来深入了解一下Transformer的编码器。

Gaga246的博客 1245

关于BERT和Transformer的易错点

1. BERT中使用Transformer作特征提取器,其实只使用了Transformer的Encoder。 那么Decoder去哪了呢?显然是被BERT改造了。Transformer其实是个完整地seq-to-seq模型,可以解决诸如机器翻译、QA这种输入输出为不定长句子的任务,在Transformer中,它使用Encoder特征提取器,然后用Decoder解析,输出我们想要的结果。 而...

谁谓荼苦,其甘如荠 4935

使用Encoder-Decoder模型自动生成对联思路——encode-decoder理解(3)

|Encoder-Decoder模型 Encoder-Decoder框架可以看作是一种文本处理领域的研究模式,应用场景异常广泛。下图是文本处理领域里常用的Encoder-Decoder框架最抽象的一种表示:                                               图1. 抽象的Encoder-Decoder框架 Encoder-Decoder框架可以这...

Fragrant_huee 1260

Encoder-Decoder综述理解(推荐)

文章目录一、Encoder-Decoder(编码-解码)介绍几点说明信息丢失的问题应用二、Seq2Seq(序列到序列)介绍Seq2Seq与Encoder-Decoder代码实现 一、Encoder-Decoder(编码-解码) 介绍 Encoder-Decoder是一个模型构架,是一类算法统称,并不是特指某一个具体的算法,在这个框架下可以使用不同的算法来解决不同的任务。首先,编码(encode)由...

秋水顽石 6万+

轰炸理解深度学习里面的encoder-decoder模型

微信公众号 Encoder-Decoder(编码-解码)是深度学习中非常常见的一个模型框架,比如无监督算法的auto-encoding就是用编码-解码的结构设计并训练的;比如这两年比较热的image caption的应用,就是CNN-RNN的编码-解码框架;再比如神经网络机器翻译NMT模型,往往就是LSTM-LSTM的编码-解码框架。因此,准确的说,Encoder-Decoder并不是一个具体...

Microstrong 5万+

Encoder-Decoder、Seq2Seq、 以及Transformer之间的关系

结论写在前面: Encoder-Decoder 是一种架构,范围非常广泛,只要是用一个编码结构一个解码结构的模型都是Encoder-Decoder 架构 seq2seq 和 Encoder-Decoder基本相同,只不过后者是一种抽象概念,前者是具体的模型,seq2seq可以看是一种结构,有很多这种结构的模型。seq2seq有多种类型,N VS N,N vs 1, 1vs N, N vs M。最后一种应用最广。同时还有基于RNN的seq2seq,基于CNN的seq2seq,基于LSTM的seq2seq

咖乐部 6788

Encoder-Decoder自动生成对联,要试试么?

后台回复“20180717”下载数据和代码编程环境:TensorflowPython 3.6(实现了一份基于seq2seq的自动对联的代码,感兴趣的小伙伴可以下载学习)另...

机器学习算法与Python学习 4352

Encoder-Decoder

2021SC@SDUSC 为了更好的理解模型代码,进行的相关知识补充学习 Encoder-Decoder (以下借鉴网络博客内容) 模型主要是 NLP 领域里的概念。它并不特值某种具体的算法,而是一类算法的统称。Encoder-Decoder 算是一个通用的框架,在这个框架下可以使用不同的算法来解决不同的任务。 Encoder-Decoder 这个框架很好的诠释了机器学习的核心思路: 将现实问题转化为数学问题,通过求解数学问题,从而解决现实问题 文章目录Encoder-Decoder前言Seq2Seq

qq_47537678的博客 6064

机器学习中的EncoderDecoder到底是什么

微信公众号 转自:https://blog.csdn.net/program_developer/article/details/78752680 Encoder-Decoder(编码-解码)是深度学习中非常常见的一个模型框架,比如无监督算法的auto-encoding就是用编码-解码的结构设计并训练...

qq_37163925的博客 3万+

快乐学习大模型task4 Encoder-decoder

是一个多头注意力层,该层将使用第一个注意力层的输出作为 query,使用 Encoder 的输出作为 key 和 value(这是注意力权重计算函数的参数QKV),来计算注意力分数。在第一个子层,输入进入多头自注意力层的同时会直接传递到该层的输出,然后该层的输出会与原输入相加,再进行标准化。是一个掩码自注意力层,即使用 Mask 的注意力计算,保证每一个 token 只能使用该 token 之前的注意力分数;在Encoder中,输出由该层的输入加上该层的输出(注意力层和前馈神经网络的输出),再归一化操作。

m0_71902458的博客 936

Encoder-Decoder综述理解

的过程实际上是一个“信息有损的压缩过程”,如果信息量越大,那么这个转化向量的过程对信息的损失就越大,同时,随着序列长度(sequence length)的增加,意味着时间维度上的序列很长,RNN模型就会出现梯度弥散的问题。一般情况下,输入端的形式各种各样(例如图片,文本、语音等),输出端的形式一般是文本格式,输入序列和输出序列的长度可能会有较大的差异(例如,一对一,多对多,多对一,一对多等)。通过上文可以知道编码器和解码器之间有一个共享的向量(上图中的向量c),来传递信息,而且它的长度是固定的。

顺其自然~专栏 1718

encoder-decoder模型

元学习论文总结||小样本学习论文总结 2017-2019年计算机视觉顶会文章收录 AAAI2017-2019 CVPR2017-2019 ECCV2018 ICCV2017-2019 ICLR2017-2019 NIPS2017-2019 先给自己写个标题,等我理解深刻了,再来填充内容。 Encoder-Decoder(编码-解码)是深度学习中非常常见的一个模型框架,比如无监督算...

VIEO 2万+

Encoder-Decoder实现详解

在序列到序列(Sequence-to-Sequence)任务中,Encoder-Decoder架构是解决机器翻译、文本摘要等问题的经典方案。本文将从核心逻辑到代码实现,层层递进地解析基于RNN的编码器(Encoder)和解码器(Decoder),帮助读者快速理解其设计思路与工作原理。input_size:输入词汇表大小(如源语言有5000个不同单词)。:特征维度(如256),统一词嵌入和RNN的维度,确保数据流通畅。:目标词汇表大小(如目标语言有4345个不同单词)。

qq_62351557的博客 1960

一文看懂 NLP 里的模型框架 Encoder-Decoder 和 Seq2Seq

Encoder-Decoder 和 Seq2Seq Encoder-Decoder 是 NLP 领域里的一种模型框架。它被广泛用于机器翻译、语音识别等任务。 本文将详细介绍 Encoder-Decoder、Seq2Seq 以及他们的升级方案Attention。 什么是 Encoder-DecoderEncoder-Decoder 模型主要是 NLP 领域里的概念。它并不特值某种具体...

weixin_43612023的博客 1271

AI算法之Encoder-Decoder 和 Seq2Seq

Encoder-Decoder 是 NLP 领域里的一种模型框架。它被广泛用于机器翻译、语音识别等任务。 1 什么是 Encoder-DecoderEncoder-Decoder 模型主要是 NLP 领域里的概念。它并不特值某种具体的算法,而是一类算法的统称。Encoder-Decoder 算是一个通用的框架,在这个框架下可以使用不同的算法来解决不同的任务。 Encoder-Decoder ...

Mind_programmonkey的博客 3260

【学习笔记】2.2 Encoder-Decoder

在 Transformer 中,使用注意力机制的是其两个核心组件——Encoder(编码器)和 Decoder(解码器)。

qq_38146189的博客 1080
上一篇: 自然语言处理中CNN模型几种常见的Max Pooling操作
下一篇: 深度学习计算模型中“门函数(Gating Function)”的作用
张俊林博客
张俊林博客 领域专家: 人工智能技术领域 领域专家: 人工智能技术领域
博客等级 码龄22年 6030粉丝 116原创
评论 4
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值