摘要: 近两年,神经机器翻译(NMT: Neural Machine Translation)技术异军突起,翻译质量取得大幅提升。但不幸的是,NMT 系统的训练成本非常高,限制了这一技术的大范围使用。 阿里翻译团队通过使用阿里云机器学习平台PAI实现了模型训练效率5倍的飞跃,并已应用在英俄电商翻译质量优化项目中。
近两年,神经机器翻译(NMT: Neural Machine Translation)技术异军突起,翻译质量取得大幅提升。但不幸的是,NMT 系统的训练成本非常高,限制了这一技术的大范围使用。
阿里翻译团队通过使用阿里云机器学习平台PAI实现了模型训练效率5倍的飞跃,并已应用在英俄电商翻译质量优化项目中。
1,什么是NMT
NMT一词的出现要追溯到2014年9月1号,加拿大蒙特利尔大学Bengio教授研究组在开放论文网站arxiv上发布了他们最新的研究成果『neural machine translation by jointly learning to align and translate』,NMT进入了人们的视野。
他们设计了一组神经网络,使用一个编码器将源语言句子编码为一个向量,然后使用一个解码器对该向量进行解码,产生译文。同时,引入了注意力机制进一步提高译文质量。
2,阿里翻译如何使用PAI
在阿里巴巴内部,阿里翻译负责为1688国际站、全球速卖通等提供多语言服务,中国卖家填写的一些中文信息会被机器自动翻译成多国语言。该团队同时还为钉钉、东南亚电商Lazada等提供服务。
去年,他们首次将NMT技术应用在通讯场景下。虽然翻译质量取得很大的提升,但模型训练耗时太长。3000万的训练数据在单块GPU卡上一般需要训练20天以上,才能得到一个初步可用的模型。
之后,他们尝试在阿里云机器学习平台PAI上开发支持分布式训练的NMT系统,并于3月底完成了第一个版本。在英俄电商翻译质量优化项目中,分布式NMT系统大大提高了训练速度,使模型训练时间从20天缩短到了4天。
图:使用不同卡数时,在中英100万训练语料上获得的收敛加速比
现在,阿里翻译团队还在破解线上服务处理延时的难题,为神经网络机器翻译模型的大规模应用扫除最后障碍。
3,PAI是什么
PAI是阿里巴巴“NASA”计划发布的首个重磅工具,可完全兼容全球主流的深度学习开源框架。同时,底层提供强大的云端异构计算资源,包含CPU、GPU、FPGA。在GPU方面,可灵活实现多卡调度。
在阿里巴巴内部,PAI已经被广泛使用。淘宝搜索使用PAI的参数服务器,可以把百亿个特征的模型,分散到数十个乃至于上百个参数服务器上,打破规模瓶颈。最终实现搜索结果基于商品和用户的特征进行排序。
在过去的一年时间里,阿里云协助客户落地了多项重大的人工智能应用。但人工智能要想真正成为成为普惠技术,需要一件人人可用的生产工具。PAI正是为此而生。
分享到:
相关推荐
然后,可能会详细介绍如何利用阿里云的机器学习平台PAI(Platform for AI)进行模型训练。PAI提供了一系列的深度学习框架支持,如TensorFlow、PyTorch、MxNet等,以及可视化实验环境,便于用户构建、训练和评估模型...
深度学习在阿里云PAI平台的应用是解决当前深度学习建模效率和性能挑战的重要解决方案。随着深度学习技术的发展,从AlexNet到ResNet等深度神经网络模型的出现,模型的复杂性和规模持续增长,对计算资源和训练效率提出...
阿里云提供了多种服务,如ECS、函数计算FC或机器学习PAI,来支持模型的线上应用。 以上是根据“亚军方案分享”可能涉及的技术点,具体实现细节还需查看压缩包内的代码和文档。每个环节的优化和调参都是团队获得高...
作为阿里云推出的资源,本手册也会介绍阿里云在视觉计算领域的服务和产品,如视觉智能API、机器学习平台PAI等,帮助开发者快速搭建和部署视觉计算模型,实现高效的数据处理和分析。 总的来说,《视觉计算开发者系列...