在11月7日举行的微软21世纪计算大会上,哈尔滨工业大学的刘挺教授分享了关于中文信息处理技术的最新进展。此次大会后,机器之心对刘教授进行了专访,探讨了哈工大近期的AI研究成果、国内外NLP技术的发展趋势,以及哈工大人工智能研究院的愿景。
刘挺教授是自然语言处理(NLP)领域的权威专家,现任哈尔滨工业大学人工智能研究院副院长及计算机学院社会计算与信息检索研究中心主任。他是国家“万人计划”科技创新领军人才和教育部人工智能科技创新专家组成员,研究方向涵盖人工智能、自然语言处理和社会计算。他领导的哈工大社会计算与信息检索研究中心(HIT-SCIR)是国内领先的NLP研究机构之一。
刘教授指出,哈工大SCIR近期开展了多项有趣的研究。首先,他们提出了“事理图谱”,这是一种不同于常规知识图谱的新工具,用于分析事件间的联系,而不是简单的实体或概念。这种方法有助于提升深度学习模型的可解释性。其次,他们在句法分析技术上取得了显著成就,尤其是在2018年CoNLL国际句法分析评测中,对57种语言进行评测时获得了世界第一的成绩。
刘教授强调,哈工大SCIR的研究既不完全理论化,也不完全面向应用,而是力求在理论与实践中找到平衡。他们通过与工业界的紧密合作,深入了解实际问题,并利用最新的技术寻求解决方案。他们希望在技术上保持领先,通过创新方法和技术指标的提升,实现前沿突破。
谈及与工业界的合作,刘教授认为自然语言处理与数据紧密相关,而高校通常缺乏大量数据和强大的计算资源,因此与企业合作至关重要。他们与腾讯、科大讯飞、华为、阿里、小米、搜狗等多家公司展开了深度合作。
对于NLP的未来发展,刘教授认为自然语言处理将成为人工智能的核心领域之一。他认为,当前NLP面临的最大挑战包括文本领域迁移、文本推理等。为了应对这些挑战,他提出了一种从形式到语义再到推理和语用的研究框架。此外,刘教授还提到多模态研究的潜力,尤其是在文本生成领域,即根据图片和视频生成文字。
在对年轻学者的建议方面,刘教授认为年轻的研究人员应选择更有价值和挑战性的课题,避免仅仅追求短期内发表论文。他指出,虽然中国的论文数量众多,但在原创性和国际影响力方面仍有提升空间。他还强调了科学严谨性的重要性,呼吁研究者们追求真正的原理突破,而不是仅仅通过工程化手段提高技术指标。
最后,刘教授介绍了哈工大人工智能研究院的最新情况。该研究院成立于今年5月,旨在培养人才和推动科研。研究院的工作涵盖了基础理论、核心技术、系统层面以及应用领域,包括自然语言处理、机器感知与模式识别、混合增强智能、自主智能、智能金融和智能制造等多个方向。
哈工大计划从明年起招收人工智能专业的本科生,旨在培养更多高水平的人工智能专业人才,并推动人工智能一级学科的建设。