【现代深度学习技术】现代循环神经网络06：编码器-369IT编程

admin管理员组
文章数量:1027455

【现代深度学习技术】现代循环神经网络06：编码器

深度学习 (DL, Deep Learning) 特指基于深层神经网络模型和方法的机器学习。它是在统计机器学习、人工神经网络等算法模型基础上，结合当代大数据和大算力的发展而发展出来的。深度学习最重要的技术特征是具有自动提取特征的能力。神经网络算法、算力和数据是开展深度学习的三要素。深度学习在计算机视觉、自然语言处理、多模态数据分析、科学探索等领域都取得了很多成果。本专栏介绍基于PyTorch的深度学习算法实现。【GitCode】专栏资源保存在我的GitCode仓库：。

正如我们在机器翻译与数据集中所讨论的，机器翻译是序列转换模型的一个核心问题，其输入和输出都是长度可变的序列。为了处理这种类型的输入和输出，我们可以设计一个包含两个主要组件的架构：第一个组件是一个编码器（encoder）：它接受一个长度可变的序列作为输入，并将其转换为具有固定形状的编码状态。第二个组件是解码器（decoder）：它将固定形状的编码状态映射到长度可变的序列。这被称为编码器-解码器（encoder-decoder）架构，如图1所示。

图1 编码器-解码器架构

我们以英语到法语的机器翻译为例：给定一个英文的输入序列：“They”“are”“watching”“.”。首先，这种“编码器－解码器”架构将长度可变的输入序列编码成一个“状态”，然后对该状态进行解码，一个词元接着一个词元地生成翻译后的序列作为输出：“Ils”“regordent”“.”。由于“编码器－解码器”架构是形成后续章节中不同序列转换模型的基础，因此本节将把这个架构转换为接口方便后面的代码实现。

一、编码器

在编码器接口中，我们只指定长度可变的序列作为编码器的输入X。任何继承这个Encoder基类的模型将完成代码实现。

代码语言：javascript代码运行次数：0运行复制

from torch import nn

#@save
class Encoder(nn.Module):
    """编码器-解码器架构的基本编码器接口"""
    def __init__(self, **kwargs):
        super(Encoder, self).__init__(**kwargs)

    def forward(self, X, *args):
        raise NotImplementedError

二、解码器

在下面的解码器接口中，我们新增一个init_state函数，用于将编码器的输出（enc_outputs）转换为编码后的状态。注意，此步骤可能需要额外的输入，例如：输入序列的有效长度，这在机器翻译与数据集中进行了解释。为了逐个地生成长度可变的词元序列，解码器在每个时间步都会将输入（例如：在前一时间步生成的词元）和编码后的状态映射成当前时间步的输出词元。

代码语言：javascript代码运行次数：0运行复制

#@save
class Decoder(nn.Module):
    """编码器-解码器架构的基本解码器接口"""
    def __init__(self, **kwargs):
        super(Decoder, self).__init__(**kwargs)

    def init_state(self, enc_outputs, *args):
        raise NotImplementedError

    def forward(self, X, state):
        raise NotImplementedError

三、合并编码器和解码器

总而言之，“编码器-解码器”架构包含了一个编码器和一个解码器，并且还拥有可选的额外的参数。在前向传播中，编码器的输出用于生成编码状态，这个状态又被解码器作为其输入的一部分。

代码语言：javascript代码运行次数：0运行复制

#@save
class EncoderDecoder(nn.Module):
    """编码器-解码器架构的基类"""
    def __init__(self, encoder, decoder, **kwargs):
        super(EncoderDecoder, self).__init__(**kwargs)
        self.encoder = encoder
        self.decoder = decoder

    def forward(self, enc_X, dec_X, *args):
        enc_outputs = self.encoder(enc_X, *args)
        dec_state = self.decoder.init_state(enc_outputs, *args)
        return self.decoder(dec_X, dec_state)

“编码器－解码器”体系架构中的术语状态会启发人们使用具有状态的神经网络来实现该架构。在下一节中，我们将学习如何应用循环神经网络，来设计基于“编码器－解码器”架构的序列转换模型。

小结

“编码器－解码器”架构可以将长度可变的序列作为输入和输出，因此适用于机器翻译等序列转换问题。
编码器将长度可变的序列作为输入，并将其转换为具有固定形状的编码状态。
解码器将具有固定形状的编码状态映射为长度可变的序列。

本文参与腾讯云自媒体同步曝光计划，分享自作者个人站点/博客。原始发表：2025-05-04，如有侵权请联系 cloudcommunity@tencent 删除循环神经网络深度学习编码架构模型

【现代深度学习技术】现代循环神经网络06：编码器

图1 编码器-解码器架构

一、编码器

在编码器接口中，我们只指定长度可变的序列作为编码器的输入X。任何继承这个Encoder基类的模型将完成代码实现。

代码语言：javascript代码运行次数：0运行复制

from torch import nn

#@save
class Encoder(nn.Module):
    """编码器-解码器架构的基本编码器接口"""
    def __init__(self, **kwargs):
        super(Encoder, self).__init__(**kwargs)

    def forward(self, X, *args):
        raise NotImplementedError

二、解码器

代码语言：javascript代码运行次数：0运行复制

#@save
class Decoder(nn.Module):
    """编码器-解码器架构的基本解码器接口"""
    def __init__(self, **kwargs):
        super(Decoder, self).__init__(**kwargs)

    def init_state(self, enc_outputs, *args):
        raise NotImplementedError

    def forward(self, X, state):
        raise NotImplementedError

三、合并编码器和解码器

代码语言：javascript代码运行次数：0运行复制

#@save
class EncoderDecoder(nn.Module):
    """编码器-解码器架构的基类"""
    def __init__(self, encoder, decoder, **kwargs):
        super(EncoderDecoder, self).__init__(**kwargs)
        self.encoder = encoder
        self.decoder = decoder

    def forward(self, enc_X, dec_X, *args):
        enc_outputs = self.encoder(enc_X, *args)
        dec_state = self.decoder.init_state(enc_outputs, *args)
        return self.decoder(dec_X, dec_state)

小结

“编码器－解码器”架构可以将长度可变的序列作为输入和输出，因此适用于机器翻译等序列转换问题。
编码器将长度可变的序列作为输入，并将其转换为具有固定形状的编码状态。
解码器将具有固定形状的编码状态映射为长度可变的序列。

本文标签：现代深度学习技术现代循环神经网络06编码器

版权声明：本文标题：【现代深度学习技术】现代循环神经网络06：编码器内容由热心网友自发贡献，该文观点仅代表作者本人，转载请联系作者并注明出处：http://it.en369.cn/jiaocheng/1747398122a2163485.html，本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容，一经查实，本站将立刻删除。

369IT编程

【现代深度学习技术】现代循环神经网络06：编码器

【现代深度学习技术】现代循环神经网络06：编码器

一、编码器

二、解码器

三、合并编码器和解码器

小结

【现代深度学习技术】现代循环神经网络06：编码器

一、编码器

二、解码器

三、合并编码器和解码器

小结

更多相关文章

【现代深度学习技术】现代循环神经网络06：编码器

发表评论

推荐文章

Taxonomy works in local XAMPP but doesn&#39;t work live

dart - When I run flutter run, nothing shows up - Stack Overflow

javascript - CSS Animation Fill Mode - What have I done wrong? - Stack Overflow

javascript - Output buffer in JS? - Stack Overflow

javascript - Dynamically change the number of &#39;defer&#39; calls in queue.js - Stack Overflow

热门文章

javascript - Is it possible to calculate distance between two markers in angular-google-maps? - Stack Overflow

javascript - jQuery datetimepicker input text showing date 31121899 when time selected - Stack Overflow

How do I fix the &quot;sorry, you are not allowed to access this page&quot; error I get on the &quot;plugins &gt

javascript - Error in Chrome: &quot;Origin file: is not allowed by Access-Control-Allow-Origin&quot; - Stack Overflow

c - How to iterate through each file on each volume of each disk? - Stack Overflow

woocommerce offtopic - Create templates from attributes for categories

javascript - Removing backslashes in a string - Stack Overflow

add_theme_support post-thumbnails not working

javascript - How do I ultimately return the value of a promise in a Lambda function? - Stack Overflow

有了它，公司的屎山代码就有救了！

最新文章

Axios 源码笔记

什么是 C 语言里的 void, void* 和 void**

GotenNet: Rethinking Efficient 3D Equivariant Graph Neural Networks

【Docker项目实战】使用Docker部署Grist关系型电子表格工具

大数据+GIS：别光想着看地图，人家早就开始“算”地图了！

程序员刚毕业，先去大厂镀金还是先去小厂攒经验？

万象2008清空boss账户密码

【Tools】GitBook简明教程

oracle exadata celldisk 闪存盘受损导致性能下降

SDUT 2138 图结构练习——BFSDFS——判断可达性

javascript - Type &#39;undefined&#39; is not assignable to type &#39;menuItemProps[]&#39; - Stack Overflow

javascript - VS 2015 Angular 2 import modules cannot be resolved - Stack Overflow

javascript - Get the JSON objects that are not present in another array - Stack Overflow

javascript - How to dismiss a phonegap notification programmatically - Stack Overflow

c - Solaris 10 make Error code 1 Fatal Error when trying to build python 2.7.16 - Stack Overflow

Taxonomy works in local XAMPP but doesn't work live

javascript - Dynamically change the number of 'defer' calls in queue.js - Stack Overflow

How do I fix the "sorry, you are not allowed to access this page" error I get on the "plugins &gt

javascript - Error in Chrome: "Origin file: is not allowed by Access-Control-Allow-Origin" - Stack Overflow

javascript - Type 'undefined' is not assignable to type 'menuItemProps[]' - Stack Overflow