阿里云机器学习平台PAI与华东师范大学论文入选SIGIR 2022
2022-07-12 10:33:41爱云资讯1006
近日,阿里云机器学习平台PAI与华东师范大学高明教授团队合作的论文《结构感知的稀疏注意力Transformer模型SASA》被顶会 SIGIR 2022录取。论文主导通过引入稀疏自注意力的方式来提高Transformer模型处理长序列的效率和性能,并提出了结合代码语言和结构特性的面向长代码序列的Transformer模型性能优化方法。
SIGIR是人工智能领域智能信息检索方向顶级国际会议,涉及搜索引擎、推荐系统等多个方向,该会议曾推动了面向搜索的排序模型、基于深度学习的推荐算法等人工智能领域的核心创新,在学术和工业界都有巨大的影响力。此次入选意味着阿里云机器学习平台PAI自研的稀疏注意力Transformer模型达到了业界先进水平,获得了国际学者的认可,展现了中国机器学习系统技术创新在国际上的竞争力。
那么SASA主要解决了什么问题?基于Transformer的模型在self-attention模块的复杂度随序列长度呈次方增长,多数编程预训练语言模型(Programming-based Pretrained Language Models, PPLM)采用序列截断的方式处理代码序列,从而导致上下文信息缺失。
针对以上问题,SASA设计了四种稀疏注意力模式,包括:sliding window attention,global attention,Top-k attention,AST-aware attention,在一定程度上将计算复杂度与序列长度解耦。其中sliding window和Top-k模式基于局部上下文和重要的attention交互学习表示,抽象语法树(AST)模式引入代码的结构特性,与序列上下文信息相互补足,global attention通过与序列中所有token进行交互来获取全局信息。对比CodeBERT,GraphCodeBERT等方法,SASA在多个长代码任务上取得最佳效果,同时也降低了内存和计算复杂度。
SASA技术将在开源框架EasyNLP中集成,给PAI的NLP开发者提供基于稀疏注意力机制的长序列自然语言处理能力。机器学习平台PAI面向企业客户级开发者,提供轻量化、高性价比的云原生机器学习,涵盖PAI-DSW交互式建模、PAI-Designer可视化建模、PAI-DLC分布式训练到PAI-EAS模型在线部署的全流程。
论文信息
EasyNLP开源地址:https://github.com/alibaba/EasyNLP
论文链接:https://arxiv.org/abs/2205.13730论文名字Understanding Long Programming Languages with Structure-Aware Sparse Attention. SIGIR 2022论文作者刘婷婷,汪诚愚,陈岑,高明,周傲英
相关文章
- 奥运村街道商会携重点企业参访阿里云,共探AI落地和出海新机遇
- 阿里云全栈AI技术引擎驱动SaaS企业全球化升级 构建出海新范式
- 物联网视频云平台AIRTC上线阿里云!除了兼容90%以上接口,还有三大技术优势
- 份额增速双领跑,阿里云引领中国金融云进入全面智能化新阶段
- 四维图新与阿里云达成战略合作 共筑智能汽车新生态
- TCL与阿里云达成全栈AI合作,显示产业智能化转型全面提速
- 阿里云与华五教学协同中心、超星集团联合发布高校AI实践通识课
- 阿里云携手博登智能升级AI数据标注,打造全栈式数据服务平台
- 从算力升级到场景落地,英特尔与阿里云联手为智能应用开辟 “快车道”
- 智能应用落地慢、成本高?英特尔 + 阿里云给出 “降维打击” 方案!
- 更强劲、更稳定、更划算!阿里云 ECS g9i +英特尔至强 6 处理器,解锁智能应用的 “超现实速度”
- 中国车企加速拥抱公有云,阿里云连续四年稳居第一
- 杭州铭师堂携手阿里云开启AI通识培新,共启AI发展新篇章
- AI火花集|从技术竞速到应用共生,阿里云和AI火花先锋“解锁”中国AI应用的破局之路
- 全球最大线上批发商城与线下商城战略合作,阿里云赋能全球贸易AI时代新篇章
- 亚信科技+阿里云 | 大模型协作新突破,让百行千业用上普惠AI !