滴滴开源自然言语了解模型训练平台DELTA | ACL 2019

图灵汇官网

雷锋网消息,于7月28日至8月2日,全球自然语言处理领域的顶级会议ACL2019在意大利佛罗伦萨举行。滴滴在此次会议上正式宣布开源其基于深度学习的语音和自然语言理解模型训练平台DELTA。此举旨在帮助AI开发者更高效地创建和部署自然语言处理及语音模型,加速相关应用的落地。

滴滴自然语言处理首席科学家Kevin Knight在会议现场进行了详细介绍。DELTA主要基于TensorFlow构建,能够同时支持自然语言处理和语音任务以及数值特征的训练。它集成了包括文本分类、命名实体识别、自然语言推理、问答、序列到序列文本生成、语音识别、说话人验证、语音情感识别等多种算法模型,形成了统一的代码架构和接口。

用户只需准备好模型训练数据并指定配置,DELTA的训练流水线便可以根据配置进行数据处理,选择相应的任务和模型,进而完成模型训练。训练完成后,DELTA会自动生成模型文件并保存。这些模型文件具有统一接口,可以直接上线使用,从而实现快速的产品化,简化从研究到生产的流程。

值得一提的是,DELTA不仅支持多种模型的训练,还提供了灵活的配置选项,使得开发者可以基于DELTA构建复杂多样的模型。此外,DELTA在多个常用任务上提供了稳定且高效的基准测试,用户可以轻松复现论文中的模型结果,并在此基础上扩展新模型。在模型构建完成后,用户可以通过DELTA的部署工具快速完成模型上线,实现从论文到产品部署的无缝衔接。

目前,AI开发者可以在GitHub(https://github.com/didi/delta)上查看DELTA的详细介绍和源代码,利用DELTA加速实验进程,部署用于文本分类、命名实体识别、自然语言推理、问答、序列到序列文本生成、语音识别、说话人验证、语音情感识别等任务的系统。更多关于滴滴开源项目的详情,用户也可以访问滴滴的开源平台(https://didi.github.io/)。

本文来源: 图灵汇 文章作者: hkzl2020