Bengio等人新作:注意力可被视为RNN,新模型媲美Transformer,但超级省内存
机器之心
发布于:2024-05-25
文章内容来源于公众号:机器之心,点此可查看原文扫码查看原文,内容版权归相关企业所有,本网站仅供交流学习。若涉及版权问题或存在侵权情况,请及时与我们联系邮件联系:i@playhudong.com,我们将第一时间进行删除处理。
摘要:既能像 Transformer 一样并行训练,推理时内存需求又不随 token 数线性递增,长上下文又有新思路了?
正文加载失败,请扫码查看原文。
本文内容来源于公众号: 机器之心 ,请扫码查看原文。
点此可查看原文