英伟达(NVIDIA)今日宣布,在语言理解领域取得了多项突破,包括最快的训练和推理速度以及最大的模型,这将帮助企业通过实时对话人工智能(AI)与客户进行更自然的互动。
英伟达的深度学习应用研究部门副总裁Bryan Catanzaro对此持乐观态度,他认为超大规模的语言模型彻底改变了自然语言AI,因为它解决了许多复杂的语义问题,使真正的对话式AI成为可能。
NVIDIA提到,其AI平台能够以不到一小时的时间训练出当前最先进的AI语言模型BERT(Bidirectional Encoder Representations from Transformers),并且在2毫秒内完成推理。这种性能上的突破可以帮助开发者将顶级的语言理解技术应用于服务全球数百万消费者的各种大规模应用。
此外,针对开发者对更大模型的需求,NVIDIA Research基于Transformers架构构建并训练了迄今为止最大的语言模型。该模型采用了BERT所使用的技术组件,以及其他多种自然语言AI模型。NVIDIA定制的模型拥有83亿个参数,比BERT-Large多24倍。
目前,微软及其他一些最具创新力的初创公司都在采用这一平台。微软Bing团队的项目经理Rangan Majumder表示,微软依赖最先进的AI模型和计算平台,通过结合其Azure AI与NVIDIA BERT,不断优化搜索质量,已经取得了显著进展。
他还提到,在Azure环境下运行推理任务时,NVIDIA GPU相比CPU平台,延迟减少了超过一半,吞吐量提高了5倍,使得Bing能够为全球用户提供更加相关、成本更低且实时的搜索体验。