哈工大张民：ChatGPT 之后，NLP 还有 12 个待解决命题

来源:专点发布时间：2025-09-09 15:16:17

作者丨张民

演讲整理丨李梅

编辑丨岑峰

ChatGPT在产业界掀起商业化与资本狂潮的哈工P还同时，也给自然语言处理（NLP）研究界抛出了许多问题，大张待解NLP正在重新成为最热的决命研究领域之一，但也在面临以ChatGPT为代表的哈工P还大规模预训练语言模型带来的冲击，ChatGPT将如何重塑NLP工艺？大张待解NLP的下一步要如何走？

在2月24日深圳人才研修院由鹏城实验室主办的第四届OpenI/O启智开发者大会上，张民教授做了题为《语言智能与机器翻译》的决命B站剧情号聊天记录流出合集主题演讲，对这一问题展开了深刻的哈工P还思考。

张民教授在1991年至1997年于哈尔滨工业大学先后获学士、大张待解硕士和博士学位，决命长期从事自然语言处理、哈工P还机器翻译和机器智能研究。大张待解在这次演讲中他谈到ChatGPT背后的决命NLP工艺，他认为ChatGPT是哈工P还一个工艺、信息、大张待解算力和工程架构相结合的决命复杂系统，它的能力来自于基础模型、指令学习和强化学习。NLP人要有复杂系统的观念。

在他看来，ChatGPT给NLP研究者带来的不是威胁，而是为NLP提供了新机会、新研究范式，可更好地解决NLP问题，同时扩大了NLP研究领域，为NLP领域提出了更多待解决的命题，如研究新一代语言大模型、保证模型的可信与保障、提高模型的复杂推理能力和可解释性、增强模型对人类意志的学习、增长多模态大模型等等。

以下是张民教授本次主题演讲的原文，AI科技评论做了不改变原意的编辑：

ChatGPT：NLP 工艺的一大步

打开了通用AI的大门

在讲这次报告的内容之前，我先就ChatGPT谈几个观点。

第一，要高度认可、拥抱、跟踪而不是跟风跨时代的以ChatGPT为代表的新一代NLP/AI工艺。

第二，跟踪之后，家庭后台泄露全集要在OpenAI的这个大模型基础上做创新性研究。很多人担心，在大模型的时代，NLP是不是不需要再做了，其实完全不是，我们要做的事情更多，而且极多。

大家想一下我们的人脑是怎么学习语言的，3岁小孩的语言能力已经很强了，但人脑只有5%的神经元被激活进行语言相关的活动，小孩是怎么做到举一反三的？我们人类学语言是真正去理解，自顶向下和自底向上相结合的学习方式，具有演绎、归纳、推理、联想、举一反三的能力。而ChatGPT是自底向上学习。所以未来的语言模型一定不是ChatGPT这个样子。

本次报告要讲的，是我觉得未来5至10年甚至20年以ChatGPT为代表的NLP要解决的问题。先讲什么是ChatGPT，再讲什么是语言模型、ChatGPT能给NLP什么启发。

首先来讲什么是ChatGPT。第一点，ChatGPT做的事就是使机器像人一样与人对话、交流。自然语言是人类交流最方便、最关键的媒介，语言是用来描述知识和传承文化的工具。因此，ChatGPT很快就被大众迅速接受，所以说ChatGPT是人投票投出来的，这也是ChatGPT能如此之火的一个很关键的原因。

ChatGPT的本质是大规模预训练语言模型，是一个统一的、极简的大模型，这是第二点。

第三个关键点，就是ChatGPT做的是一个NLP问题，但是大家一定要意识到它是一个工艺+信息+算力+工程结构的复杂系统。

经常有人问我，ChatGPT带给我们的经验是什么？我通俗地讲，自然语言处理干三件事：让机器听懂人话（理解）、讲人话（生成）、干人事（应用）。相应地，ChatGPT的惊艳之处是什么？第一，非常强的语言理解能力和生成能力，理解人类的意图，然后侃侃而谈，娓娓道来；第二，它能把伦理、道德等方面的不当内容去掉，并可拒绝回答；第三，它使用了三项工艺，包括表示学习、注意力机制和学习人类意志，没有这些工艺就没有大模型，更没有ChatGPT。

非严格讲，“学习人类意志”是ChatGPT这类模型所独有的，这个说法听起来很高大上，其实就是通过运算规则调整模型参数，进而让机器知道人到底想要机器做什么、怎么能干好。

ChatGPT的理论基础是什么？就是从语料当中学东西。语料信息里面能蕴涵多少知识，ChatGPT最多就能拥有多少知识。从这个角度看，ChatGPT因此也是一个知识工程。所以语料库语言学、认知语言学和计算语言学是ChatGPT的语言学理论基础。如果你相信语言能够表达知识，那么ChatGPT就能学会其中的知识。

所以我们对ChatGPT的一个评价是：NLP工艺的一大步，开启了AGI（通用机器智能）的一扇门。

ChatGPT 背后的语言模型

只要上过中学、学过中文或英文，大家就都知道，语言模型包括词、短语、句法结构、语义和篇章等不同层面。从另外一个角度讲，语言模型涵盖很多种表示方法，比如产生式、逻辑、谓词、框架等等。从知识表述的角度看，语言模型则包括规则、统计和神经网络的方法。

抽象讲，语言模型是计算机表示和处理自然语言的数学模型。语言模型是一个单纯的、统一的、抽象的形式化系统，自然语言经过语言模型的描述，就能被计算机处理了，因此语言模型对于自然语言处理极其关键。

那么ChatGPT所用的语言模型是什么？它的语言模型其实早在上世纪七八十年代就有了，即当时语音识别领域最常用的N-gram语言模型。ChatGPT是一种基于N-gram的生成式语言模型。比如，在一个句子中，第二个词的概率以第一个词为基础，第三个词的概率以前两个词为基础，如此类推。公式极其简单，ChatGPT所干的唯一一件事，就是学一堆神经网络参数，给定前N个词，预测下一个词是什么。比如“Where are we （going）”这个句子，ChatGPT会对所有可能的词的概率进行从低到高的排序，根据它的模型预测出第四个词是going的概率最大。

大家想一想，为什么只做这一件事就能够实现复杂对话？只是如此简单地预测下一个词，为何它就能这么惊艳，能够写文章、对话、编程序、制表等等？有一个经典的“猴子打字机悖论”，如果你给一个猴子无限长的时间，让它在键盘上敲打，它就能在某个时间点写出一部莎士比亚全集。这是没错的，从数学的角度讲一定能实现。

ChatGPT就相当于一只猴子，把词随意地组合起来，但ChatGPT的好处是什么？猴子需要无限长的时间，它也并不知道打出哪个字最好，而ChatGPT有非常强的预测下一个词的能力，只要给它上文，它就能对下一个词进行精准预测。ChatGPT写一篇论文的时候，给人感觉是一气呵成，实际上这时候它绝对不是简单地给定前一个N个词预测下一个词，而是已经隐含在语言模型中地编码了这篇文章的结构。写一篇学术论文一定要布局好结构，ChatGPT就是根据这个布局来工作的。ChatGPT最擅长的就是写作，侃侃而谈，“编故事”。

那么ChatGPT的原理到底是什么？有三个方面：基础模型，指令学习，强化学习。

基础模型使ChatGPT具备强大的能力。有了能力就是有了力气，但有了力气还不知道到底能干什么，指令学习就是让模型知道干什么，强化学习则是让模型干得更好。还有一个人类反馈，即奖励模型，是为了强化学习用的，用奖励模型去做强化学习，希望ChatGPT做到跟人类一样、符合人类的意志。就像高文老师讲的，ChatGPT太讨好人类，表面上看是这样，但其实我觉得问题在于训练信息、奖励模型和强化学习的导向以及伦理道德的因素，导致它太像人类。

ChatGPT的核心工艺有两点，一个是基础模型，一个是对基础模型的人类意志对齐微调。至少从交互的角度看，微调是非常有效的。微调能做到什么效果？从交互的角度讲，它能使原本13B的模型性能达到175B模型的水平，提高10倍。而从知识的角度讲，13B的模型知识贫瘠，讲得再花言巧语也没有用。

大模型时代，NLP 怎么做？

目前来看，ChatGPT不能干的、干错的，比它能干的要多得多。但是大家要坚信一点，ChatGPT工艺刚刚出现，那些不能干的很多问题可以很快解决。

同时，我们也应该看到ChatGPT有它的天花板，它确实是有很多问题，说一千道一万，ChatGPT本身模型能力有限，比如会出现张冠李戴的问题。像对于“1+1=2”，ChatGPT不是用计算器去算的，而是利用模型去预测1+1等于几，2出现的概率大，所以它认为是2。如果你赋予ChatGPT计算能力，那么所有数字四则运算问题它都会。

我们应该看到，ChatGPT的天花板非常低，但是在到达天花板之前，我们有很多红利。科学的进步毕竟是波浪式的。

再来谈一谈ChatGPT与语言智能和机器翻译。这个方向我已经做了几十年了，但是我觉得机器翻译是最容易被ChatGPT颠覆的，一定是。人类做翻译的时候经过语言理解和生成的过程，ChatGPT恰恰具有很强的语言理解和生成能力。目前机器翻译模型严格依赖双语信息，把机器翻译看做是一个映射过程，而不是理解和生成过程。目前机器翻译模型面临很多难以解决的问题，首先是双语信息少，还有准确性、篇章、指代、低资源领域和语种、噪声等等问题。这些问题理论和工艺上都可以被大模型很好解决。

再回答一下学术界普遍关心的问题，在大模型的时代怎么去做NLP？我总结了12个问题，任何一个问题解决了我认为都具有跨时代的意义。

一、新一代语言模型。Masked LM and GLM建模能力强，但模型的描述能力非常有限，理论上几乎是所有LM中描述能力最弱的模型（除了BOW模型）。下一代可计算性更强、描述能力更强的语言模型是什么？至少不仅仅具有强大生成能力。

二、大模型时代的自然语言的深度理解（NLU）。至少从现在开始，所有的自然语言处理任务都很难绕开大模型。基于连接主义的符号主义方法应该是一个趋势。

三、可信NLP。模型输出结果可信、可验真。

四、保障可靠NLP。价值观、道德、政治、隐私、伦理等。

五、具有复杂推理能力和可解释NLP。连接主义和符号主义相结合的方法。

六、知识建模、获取和使用。模型直接融入结构化知识，或者作为功能插件。

七、具有增量学习、持续学习、人在回路能力的NLP。

八、小模型、模型编辑、领域适应、领域模型、面向特定应用和任务的模型、人类快速可干预。

九、人类意志的学习和对齐（物理、人类系统和信息智能社会的对齐）。

十、NLP引领的多模态大模型。自然语言模态偏向认知，而其他模态偏向感知。除了NLP大模型，多模态大模型更应该以NLP为引领或者基础。

十一、NLP大工程和复杂系统的理念和认知：运算规则模型、算力、信息、系统工程。

十二、开源、开放、共享、产业、人才、资本、政府、社会……

最后总结一下，一是非常感谢表示学习，有了它之后NLP从离散数学模型进入连续数学模型时代，得到强大的数学工具的支持，比如可导、可微、神经网络等任意连续数学函数；二是注意力和人机对齐机制，注意力拟合NLP的上下文。三是大，模型大、参数多、信息量大，由量变产生质变，涌现出各种能力。但这些才刚刚开始，成绩多，问题更多，我们可做的事情极多。下一代模型的突破将加速增长，真正迈向通用机器智能。我们也期待下一代计算机能够解决算力问题。学、产、研、用、资、政，大家要一起来做。

更多内容，点击下方关注：

哈工大张民：ChatGPT 之后，NLP 还有 12 个待解决命题

未经「AI科技评论」授权，严禁以任何方式在网页、论坛、社区进行转载！
公众号转载请先在「AI科技评论」后台留言取得授权，转载时需标注来源并插入本公众号名片。

雷峰网(公众号：雷峰网)

雷峰网版权文章，未经授权禁止转载。详情见转载须知。

返回资讯首页 >>

时尚

更多 >

广西桂林一公司车间发生设备爆炸事件，致1死7伤
更新：2025-09-09 14:39
超4.42亿！端午档票房很给力
更新：2025-09-09 14:21
特斯拉首款无人驾驶 RobotTaxi，升级版 Optimus 还是画大饼？
更新：2025-09-09 14:16
Harrison Chase：独创AI智能体「认知架构」，定制+极简加减法双驱动
更新：2025-09-09 14:02

风站话

更多 >

波兰防长：东部发现的不明物体为俄军用无人机
△波兰国防部长科西尼亚克-卡梅什当地时间8月20日下午，波兰国防部长科西尼亚克-卡梅什称，在该国东部卢布林省一处农田坠落并爆炸的不明物体是一架俄罗斯无人机，并且波兰的雷达系统“没有探测到此次领空侵犯行 ...
实测豆包1.5后，看到了字节不走捷径的底气
2025 年 1 月，豆包大模型 1.5 全面上线火山方舟，其中豆包通用模型 pro 在多个权威测评集综合得分优于GPT4o、Claude 3.5 Sonnet 等业界一流模型，模型效果达到全球领先水 ...
“2025影像亚洲中国电影放映周”在布达佩斯举办
来源标题：“2025影像亚洲中国电影放映周”在布达佩斯举办新华社布达佩斯5月25日电记者陈浩孟凡宇）“2025影像亚洲中国电影放映周”24日晚在匈牙利首都布达佩斯开幕，约400 ...
有史以来最拉风的看片会！《风驰赛车手》导演陆伟揭秘幕后故事
来源标题：有史以来最拉风的看片会！《风驰赛车手》导演陆伟揭秘幕后故事5月27日的北京枫花园汽车电影院，引擎轰鸣声此起彼伏。由酷酷综、优酷体育联合Golfroom共同举办的“300码CLU ...
伊朗军队举行导弹演习
当地时间8月21日上午，伊朗军方宣布，为期两天的导弹演习正式开始。据悉，此次演习将使用伊朗军队最新研发的防御武器。CCTV国际时讯） ...
大阪世博会中国馆举行中国电影日活动
来源标题：大阪世博会中国馆举行中国电影日活动新华社东京5月25日电记者胡晓格）中国电影日活动25日在大阪世博会中国馆举行，这是中国电影活动首次在世博会平台举办。中日电影界代表以及世博会各场馆代表等百余 ...
Andrej Karpathy 最新视频盛赞 DeepSeek：R1 正在发现人类思考的逻辑并进行复现
继近日斯坦福李飞飞、Percy Liang 等人推出 S1 后，李飞飞的学生、OpenAI 早期成员与前特斯拉 AI 总监也录制了一期最新长达 3 小时的长视频上传到 YouTube，深入浅出地从神经 ...
十年“拾光”·共启新篇2025新鲜提案·黎里真实影像大会黎里对话顺利举办
来源标题：十年“拾光”·共启新篇2025新鲜提案·黎里真实影像大会黎里对话顺利举办2025年5月28日，2025新鲜提案·黎里真实影像大会“拾光年·新坐标：共筑 ...
词作家杨湘粤忆千百惠：不久前还在深圳演出，是几代人的记忆
8月20日深夜，著名歌手千百惠因病去世的消息传遍网络，引发公众追念。当晚，著名词作家杨湘粤向南都N视频记者回忆道，今年6月下旬，千百惠还来到深圳，与周冰倩同台演唱了《走过咖啡屋》。“她是一个乐观、豁达 ...
14部影片亮相端午档
来源标题：14部影片亮相端午档当端午档遇上六一儿童节，将会擦出怎样的火花？据统计，共有包括《私家侦探》《碟中谍8：最终清算》《时间之子》等在内的14部影片将亮相该档期，其中有13部新片和一部重映片。这 ...
“春天里送你一首诗”诗歌朗诵会在昌平向上学校成功举办
来源标题：“春天里送你一首诗”诗歌朗诵会在昌平向上学校成功举办【绿荫下的邀约：自然教育与思政育人诗意融合】五月的春风掠过昌平兴寿镇辛庄村的林间，小满刚过，向上学校的小剧场内流淌着诗意的旋律。为深化&l ...
全面焕新无广告网易云音乐iPad端新版（beta）正式上线
来源标题：全面焕新无广告网易云音乐iPad端新版beta）正式上线5月28日，网易云音乐宣布iPad端产品新版beta）正式上线，产品功能、界面设计、iPad系统适配等全面升级，打造无广告纯净版的大 ...