0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

哈工大张民:ChatGPT之后,NLP还有12个待解决命题

传感器技术 ? 来源:传感器技术 ? 2023-03-08 10:15 ? 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

从语言模型角度看,ChatGPT 的天花板非常低,但在触及天花板之前,还有很多红利。

ChatGPT在产业界掀起商业化与资本狂潮的同时,也给自然语言处理(NLP)研究界抛出了许多问题,NLP正在重新成为最热的研究领域之一,但也在面临以ChatGPT为代表的大规模预训练语言模型带来的冲击,ChatGPT将如何重塑NLP技术?NLP的下一步要如何走?

在2月24日深圳人才研修院由鹏城实验室主办的第四届OpenI/O启智开发者大会上,张民教授做了题为《语言智能与机器翻译》的主题演讲,对这一问题展开了深刻的思考。

张民教授在1991年至1997年于哈尔滨工业大学先后获学士、硕士和博士学位,长期从事自然语言处理、机器翻译和人工智能研究。在这次演讲中他谈到ChatGPT背后的NLP技术,他认为ChatGPT是一个技术、数据、算力和工程架构相结合的复杂系统,它的能力来自于基础模型、指令学习和强化学习。NLP人要有复杂系统的观念。

在他看来,ChatGPT给NLP研究者带来的不是威胁,而是为NLP提供了新机会、新研究范式,可更好地解决NLP问题,同时扩大了NLP研究领域,为NLP领域提出了更多待解决的命题,如研究新一代语言大模型、保证模型的可信与安全、提高模型的复杂推理能力和可解释性、增强模型对人类意志的学习、发展多模态大模型等等。

以下是张民教授本次主题演讲的原文,AI科技评论做了不改变原意的编辑:

1

ChatGPT:NLP 技术的一大步

打开了通用AI的大门

在讲这次报告的内容之前,我先就ChatGPT谈几个观点。

第一,要高度认可、拥抱、跟踪而不是跟风跨时代的以ChatGPT为代表的新一代NLP/AI技术

第二,跟踪之后,要在OpenAI的这个大模型基础上做创新性研究。很多人担心,在大模型的时代,NLP是不是不需要再做了,其实完全不是,我们要做的事情更多,而且极多。

大家想一下我们的人脑是怎么学习语言的,3岁小孩的语言能力已经很强了,但人脑只有5%的神经元被激活进行语言相关的活动,小孩是怎么做到举一反三的?我们人类学语言是真正去理解,自顶向下和自底向上相结合的学习方式,具有演绎、归纳、推理、联想、举一反三的能力。而ChatGPT是自底向上学习。所以未来的语言模型一定不是ChatGPT这个样子。

本次报告要讲的,是我觉得未来5至10年甚至20年以ChatGPT为代表的NLP要解决的问题。先讲什么是ChatGPT,再讲什么是语言模型、ChatGPT能给NLP什么启发。

首先来讲什么是ChatGPT。第一点,ChatGPT做的事就是使机器像人一样与人对话、交流。自然语言是人类交流最方便、最重要的媒介,语言是用来描述知识和传承文化的工具。因此,ChatGPT很快就被大众迅速接受,所以说ChatGPT是人投票投出来的,这也是ChatGPT能如此之火的一个很重要的原因。

ChatGPT的本质是大规模预训练语言模型,是一个统一的、极简的大模型,这是第二点。

第三个关键点,就是ChatGPT做的是一个NLP问题,但是大家一定要意识到它是一个技术+数据+算力+工程结构的复杂系统。

经常有人问我,ChatGPT带给我们的经验是什么?我通俗地讲,自然语言处理干三件事:让机器听懂人话(理解)、讲人话(生成)、干人事(应用)。相应地,ChatGPT的惊艳之处是什么?第一,非常强的语言理解能力和生成能力,理解人类的意图,然后侃侃而谈,娓娓道来;第二,它能把伦理、道德等方面的不当内容去掉,并可拒绝回答;第三,它使用了三项技术,包括表示学习、注意力机制和学习人类意志,没有这些技术就没有大模型,更没有ChatGPT。

非严格讲,“学习人类意志”是ChatGPT这类模型所独有的,这个说法听起来很高大上,其实就是通过算法调整模型参数,进而让机器知道人到底想要机器做什么、怎么能干好。

ChatGPT的理论基础是什么?就是从语料当中学东西。语料数据里面能蕴涵多少知识,ChatGPT最多就能拥有多少知识。从这个角度看,ChatGPT因此也是一个知识工程。所以语料库语言学、认知语言学和计算语言学是ChatGPT的语言学理论基础。如果你相信语言能够表达知识,那么ChatGPT就能学会其中的知识。

所以我们对ChatGPT的一个评价是:NLP技术的一大步,开启了AGI(通用人工智能)的一扇门。

2ChatGPT 背后的语言模型

只要上过中学、学过中文或英文,大家就都知道,语言模型包括词、短语、句法结构、语义和篇章等不同层面。从另外一个角度讲,语言模型涵盖很多种表示方法,比如产生式、逻辑、谓词、框架等等。从知识表述的角度看,语言模型则包括规则、统计和神经网络的方法。

抽象讲,语言模型是计算机表示和处理自然语言的数学模型。语言模型是一个单纯的、统一的、抽象的形式化系统,自然语言经过语言模型的描述,就能被计算机处理了,因此语言模型对于自然语言处理极其重要。

那么ChatGPT所用的语言模型是什么?它的语言模型其实早在上世纪七八十年代就有了,即当时语音识别领域最常用的N-gram语言模型。ChatGPT是一种基于N-gram的生成式语言模型。比如,在一个句子中,第二个词的概率以第一个词为基础,第三个词的概率以前两个词为基础,如此类推。公式极其简单,ChatGPT所干的唯一一件事,就是学一堆神经网络参数,给定前N个词,预测下一个词是什么。比如“Where are we (going)”这个句子,ChatGPT会对所有可能的词的概率进行从低到高的排序,根据它的模型预测出第四个词是going的概率最大。

大家想一想,为什么只做这一件事就能够实现复杂对话?只是如此简单地预测下一个词,为何它就能这么惊艳,能够写文章、对话、编程序、制表等等?有一个经典的“猴子打字机悖论”,如果你给一个猴子无限长的时间,让它在键盘上敲打,它就能在某个时间点写出一部莎士比亚全集。这是没错的,从数学的角度讲一定能实现。

ChatGPT就相当于一只猴子,把词随意地组合起来,但ChatGPT的好处是什么?猴子需要无限长的时间,它也并不知道打出哪个字最好,而ChatGPT有非常强的预测下一个词的能力,只要给它上文,它就能对下一个词进行精准预测。ChatGPT写一篇论文的时候,给人感觉是一气呵成,实际上这时候它绝对不是简单地给定前一个N个词预测下一个词,而是已经隐含在语言模型中地编码了这篇文章的结构。写一篇学术论文一定要布局好结构,ChatGPT就是根据这个布局来工作的。ChatGPT最擅长的就是写作,侃侃而谈,“编故事”。

那么ChatGPT的原理到底是什么?有三个方面:基础模型,指令学习,强化学习。

基础模型使ChatGPT具备强大的能力。有了能力就是有了力气,但有了力气还不知道到底能干什么,指令学习就是让模型知道干什么,强化学习则是让模型干得更好。还有一个人类反馈,即奖励模型,是为了强化学习用的,用奖励模型去做强化学习,希望ChatGPT做到跟人类一样、符合人类的意志。就像高文老师讲的,ChatGPT太讨好人类,表面上看是这样,但其实我觉得问题在于训练数据、奖励模型和强化学习的导向以及伦理道德的因素,导致它太像人类。

ChatGPT的核心技术有两点,一个是基础模型,一个是对基础模型的人类意志对齐微调。至少从交互的角度看,微调是非常有效的。微调能做到什么效果?从交互的角度讲,它能使原本13B的模型性能达到175B模型的水平,提高10倍。而从知识的角度讲,13B的模型知识贫瘠,讲得再花言巧语也没有用。

3大模型时代,NLP 怎么做?

目前来看,ChatGPT不能干的、干错的,比它能干的要多得多。但是大家要坚信一点,ChatGPT技术刚刚出现,那些不能干的很多问题可以很快解决。

同时,我们也应该看到ChatGPT有它的天花板,它确实是有很多问题,说一千道一万,ChatGPT本身模型能力有限,比如会出现张冠李戴的问题。像对于“1+1=2”,ChatGPT不是用计算器去算的,而是利用模型去预测1+1等于几,2出现的概率大,所以它认为是2。如果你赋予ChatGPT计算能力,那么所有数字四则运算问题它都会。

我们应该看到,ChatGPT的天花板非常低,但是在到达天花板之前,我们有很多红利。科学的进步毕竟是波浪式的。

再来谈一谈ChatGPT与语言智能和机器翻译。这个方向我已经做了几十年了,但是我觉得机器翻译是最容易被ChatGPT颠覆的,一定是。人类做翻译的时候经过语言理解和生成的过程,ChatGPT恰恰具有很强的语言理解和生成能力。目前机器翻译模型严格依赖双语数据,把机器翻译看做是一个映射过程,而不是理解和生成过程。目前机器翻译模型面临很多难以解决的问题,首先是双语数据少,还有准确性、篇章、指代、低资源领域和语种、噪声等等问题。这些问题理论和技术上都可以被大模型很好解决。

再回答一下学术界普遍关心的问题,在大模型的时代怎么去做NLP?我总结了12个问题,任何一个问题解决了我认为都具有跨时代的意义。

一、新一代语言模型。Masked LM and GLM建模能力强,但模型的描述能力非常有限,理论上几乎是所有LM中描述能力最弱的模型(除了BOW模型)。下一代可计算性更强、描述能力更强的语言模型是什么?至少不仅仅具有强大生成能力。

二、大模型时代的自然语言的深度理解(NLU)。至少从现在开始,所有的自然语言处理任务都很难绕开大模型。基于连接主义的符号主义方法应该是一个趋势。

三、可信NLP。模型输出结果可信、可验真。

四、安全可靠NLP。价值观、道德、政治、隐私、伦理等。

五、具有复杂推理能力和可解释NLP。连接主义和符号主义相结合的方法。

六、知识建模、获取和使用。模型直接融入结构化知识,或者作为功能插件。

七、具有增量学习、持续学习、人在回路能力的NLP。

八、小模型、模型编辑、领域适应、领域模型、面向特定应用和任务的模型、人类快速可干预。

九、人类意志的学习和对齐(物理、人类系统和信息智能社会的对齐)。

十、NLP引领的多模态大模型。自然语言模态偏向认知,而其他模态偏向感知。除了NLP大模型,多模态大模型更应该以NLP为引领或者基础。

十一、NLP大工程和复杂系统的理念和认知:算法模型、算力、数据、系统工程。

十二、开源、开放、共享、产业、人才、资本、政府、社会……

最后总结一下,一是非常感谢表示学习,有了它之后NLP从离散数学模型进入连续数学模型时代,得到强大的数学工具的支持,比如可导、可微、神经网络等任意连续数学函数;二是注意力和人机对齐机制,注意力拟合NLP的上下文。三是大,模型大、参数多、数据量大,由量变产生质变,涌现出各种能力。但这些才刚刚开始,成绩多,问题更多,我们可做的事情极多。下一代模型的突破将加速发展,真正迈向通用人工智能。我们也期待下一代计算机能够解决算力问题。学、产、研、用、资、政,大家要一起来做。

审核编辑 :李倩

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 语言模型
    +关注

    关注

    0

    文章

    563

    浏览量

    10842
  • nlp
    nlp
    +关注

    关注

    1

    文章

    490

    浏览量

    22660
  • ChatGPT
    +关注

    关注

    29

    文章

    1590

    浏览量

    9180

原文标题:哈工大张民:ChatGPT 之后,NLP 还有 12 个待解决命题

文章出处:【微信号:WW_CGQJS,微信公众号:传感器技术】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    TPU编程竞赛系列|2025中国国际大学生创新大赛产业命题赛道,算能11项命题入选!

    中国国际大学生创新大赛(原“互联网+”大赛)产业命题正式公布,算能十一项命题成功入选。本次算能赛题主要聚焦于国产TPU处理器的边缘系统开发和RISC-V架构处理器的系统设计。大赛提供了多款开发板以供
    的头像 发表于 06-05 17:03 ?812次阅读
    TPU编程竞赛系列|2025中国国际大学生创新大赛产业<b class='flag-5'>命题</b>赛道,算能11项<b class='flag-5'>命题</b>入选!

    和安信可Ai-M61模组对话?手搓一ChatGPT 语音助手 #人工智能 #

    ChatGPT
    jf_31745078
    发布于 :2025年03月12日 15:56:59

    OpenAI尝试减少对ChatGPT的审查

    近日,OpenAI宣布了一项新政策,旨在改变其训练人工智能模型的方式,以明确拥护“知识自由”的理念。OpenAI强调,无论一话题多么具有挑战性或争议性,都应当被平等对待和呈现。 据OpenAI表示
    的头像 发表于 02-17 14:42 ?2941次阅读

    ChatGPT新增实时搜索与高级语音功能

    在OpenAI的第八天技术分享直播中,ChatGPT的搜索功能迎来了重大更新。此次更新不仅丰富了ChatGPT的功能体系,更提升了其实用性和竞争力。 新增的实时搜索功能,是此次更新的亮点之一
    的头像 发表于 12-17 14:08 ?676次阅读

    NLP技术在聊天机器人中的作用

    的第一作用是帮助聊天机器人理解用户的意图。聊天机器人需要能够识别用户的问题或请求,并将其转化为可执行的任务。这涉及到以下几个步骤: 词义消歧 :NLP技术可以帮助聊天机器人理解单词的多种含义,并根据上下文选择正确的解释。 意图识
    的头像 发表于 11-11 10:33 ?1109次阅读

    OpenAI推出ChatGPT搜索功能

    近日,OpenAI再次迈出了重要的一步,为其广受好评的ChatGPT平台添加了一项全新的搜索功能。 据悉,这项被命名为“ChatGPT搜索”的新功能,将为用户带来前所未有的搜索体验。以往,当用户需要
    的头像 发表于 11-04 10:34 ?707次阅读

    ChatGPT:怎样打造智能客服体验的重要工具?

    ChatGPT作为智能对话生成模型,可以帮助打造智能客服体验的重要工具。以下是一些方法和步骤:1.数据收集和准备:收集和整理与客服相关的数据,包括常见问题、回答示例、客户对话记录等。这将用于训练
    的头像 发表于 11-01 11:12 ?469次阅读
    <b class='flag-5'>ChatGPT</b>:怎样打造智能客服体验的重要工具?

    ChatGPT 在游戏开发中的创新应用

    在游戏开发领域,人工智能技术的应用正变得越来越广泛。ChatGPT,作为一种先进的自然语言处理(NLP)模型,为游戏开发带来了许多创新的应用。 1. 动态对话系统 ChatGPT的强项之一是生成自然
    的头像 发表于 10-25 18:05 ?1287次阅读

    ChatGPT 的多语言支持特点

    在当今这个全球化的世界里,语言多样性是一不可忽视的现象。随着互联网的普及和国际交流的增加,人们对于能够理解和交流多种语言的需求也在不断增长。在这样的背景下,人工智能领域中的自然语言处理(NLP
    的头像 发表于 10-25 17:30 ?1576次阅读

    ChatGPT 与人工智能的未来发展

    ChatGPT是人工智能领域的一重要里程碑,它代表了自然语言处理(NLP)技术的最新进展。ChatGPT是由人工智能研究实验室OpenAI开发的一种深度学习模型,它能够理解和生成自然
    的头像 发表于 10-25 16:30 ?2572次阅读

    怎样搭建基于 ChatGPT 的聊天系统

    搭建一基于ChatGPT的聊天系统是一涉及多个步骤的过程,包括理解ChatGPT的API、设计用户界面、处理数据和集成ChatGPT模型
    的头像 发表于 10-25 16:23 ?1065次阅读

    ChatGPT 适合哪些行业

    ChatGPT 是一种基于人工智能的自然语言处理技术,它能够理解和生成人类语言。这种技术在多个行业中都有广泛的应用潜力。以下是一些ChatGPT特别适合的行业,以及它在这些行业中可能的应用方式
    的头像 发表于 10-25 16:11 ?1041次阅读

    如何使用 ChatGPT 进行内容创作

    使用ChatGPT进行内容创作是一高效且富有创意的过程。以下是一些关键步骤和建议,帮助您充分利用ChatGPT进行内容创作: 一、准备阶段 注册与登录 : 确保您已注册ChatGPT
    的头像 发表于 10-25 16:08 ?1079次阅读

    华纳云:ChatGPT 登陆 Windows

    Windows 该应用目前仅供ChatGPT Plus、Team、Enterprise 和 Edu 用户使用, 是一早期版本,将在今年晚些时候推出“全面体验”。 OpenAI 写道:“使用官方
    的头像 发表于 10-18 15:50 ?539次阅读

    华工科技联合哈工大实现国内首台激光智能除草机器人落地

    华工科技党委书记、董事长、总裁马新强一行赴哈尔滨对哈尔滨工业大学机器人技术与系统全国重点实验室(后简称哈工大机器人实验室)、爱辉区智能激光除草机器人试点基地进行实地调研,代表华工科技中央研究院同哈工大机器人实验室正式签约并举行专家聘任仪式。
    的头像 发表于 09-06 10:45 ?1591次阅读