主流的序列到序列模型都是基于含有encoder和decoder的复杂的循环或者卷积网络。而性能最好的模型在encoder和decoder之间加了attentnion机制。本文提出一种新的网络结构,摒弃了循环和卷积网络,仅基于attention机制。 主流的序列到序列模型都是基于含有encoder和decoder的复杂的循环或者卷积网络。而性能 你的当前访问异常,请进行认证后继续阅读剩余内容。 提交