语言智能的新发展与新挑战
语言智能是人工智能的一个领域,主要关注人类语言的智能分析和处理,涉及语音识别、自然语言理解、自然语言生成、机器翻译等领域。近日,最能体现语言智能水平的ChatGPT引发各界的广泛关注,人们怀着极大的兴趣在讨论和尝试着这项崭新的技术成果。或兴奋,或迷茫或恐慌。兴奋的是语言智能技术真的使计算机能像人类一样和我们自如地聊天解惑了,并且话语自如、有理有据,可以拒绝不合理的提问,效果如此之好,竟引发了轰动效应;惶恐的是ChatGPT具有超强的生成能力,不仅可以聊天,还可以写文章、作诗、编码程序等,这样的话,ChatGPT就会代替人类和语言相关的工作和岗位,给人类生活带来颠覆性变化;迷惑的是我们的语言智能研究下一步朝着哪个方向走?如何理性地分析ChatGPT取得的突破和主要不足?赶上或超越它的机会和落脚点在哪里?对于语言智能的飞速发展,我们要有科学理性的态度,既要热情拥抱人工智能的新发展,让它更好地服务于人类社会,又要预防它带给我们的消极影响,看到我们的不足和差距,迎头赶上。
一、ChatGPT的功能与不足
ChatGPT是由openAI研发的一种人工智能聊天机器人程序,它是基于GPT3.5架构的大型语言模型并通过强化学习进行训练,可以和人类以自然语言对话的形式进行交互,还可以用于相对复杂的语言工作比如文本生成,自动问答,自动摘要等,同时具备一定的编写和调试计算机程序的能力。ChatGPT 的出现是语言智能领域的一大进步,标志着语言智能技术可以融合于信息搜索、人机交互、对话生成等方面,应用场景的落地具有广阔空间,潜力无穷。
首先,ChatGPT是一个基于深度学习的大规模预训练对话模型,主要功能是对话聊天,它通过强化学习来理解提问者的话语意图,能够较好地引入人类反馈,具备主动承认错误,区分问题是否符合伦理要求,质疑不正确的问题等,并通过清晰的逻辑思路来组织话语,距离人类的聊天方式和口气越来越近。相对于以前的对话系统,ChatGPT的主要突破在以下几点:
(一)超强的生成能力可以完成多种任务。ChatGPT除了与人对话聊天外,还能按照输入的关键词和表达的意图写小说、写论文、创作诗歌、作图、编写和纠正程序代码。还可以用在教案生成、资料查询、智能教学、智能创作和设计,在医疗、法律、教育、咨询服务等领域具有广阔应用前景。
(二)与搜索引擎相结合,基于海量数据,实现更为符合人类需求的查询结果,实现交互式搜索,给用户带来全新的体验
(三)交互能力大幅度提升。除了具有广博的知识,它还能很好地组织自己的话语,思路清晰,逻辑严密,“因此”“而且”“但是”等话语连接词使用恰当,几乎接近人类语言的能力。还能主动承认错误,拒绝不合理的提问等等。
ChatGPT的主要功能在于提供信息和社交能力,有望成为人在精神陪伴,面对挫折困难的时候提供引导和安慰的帮手。总之,ChatGPT已经成为互联网时代的语言智能的技术领跑者,给人类社会带来更加智能化和便捷化的服务。
当然,作为一种新兴人工智能模型,ChatGPT也存在一些问题和不足,主要在于:
(一)尽管对话能力和交互能力大幅度提升,但经常出现事实性错误。由于它是数据驱动的模型,对于数据背后的真实世界的状态,原理和规则等缺乏足够的认知,因此会出现一本正经地胡说八道情况。不符合常理的话语会经常出现。
(二)对于一般知识了解广泛,但无法提供专业性较强、有深度、有洞见的问题答案。例如对它进行物理学测试,简单常识性问题回答较好,越是难度增加,答案不能令人满意。说明ChatGPT掌握的知识并不深入、不专业。
(三)基于多层复杂神经网络搭建的深度学习模型,目前还不能解释其算法逻辑,经常出现事实性错误,产出的结果不具有安全性保障。如果被恶意利用,将造成严重的安全隐患,或危害法律。
二、ChatGPT 的工作范式
ChatGPT是一个基于transformer神经网络架构和生成预训练技术的大型语言模型,通过对超大型文本语料的训练,来获得语言知识和世界知识。同时它还引入基于人类偏好的强化学习方法,将其应用于自然语言建模。训练的语料,除了海量无标注数据,ChatGPT还利用标注精细的专门语料库,训练机器更高的适应性和更准确的知识。这些知识是怎么被机器获得和输出的呢?ChatGPT使用的transformer神经网络结构对数据进行训练,可以输入序列,将其转化为对应的输出序列,知识是通过神经网络训练得到的。在训练过程中,ChatGPT使用了海量的自然语言文本数据来学习单词的嵌入表示,以及上下文之间的关系,这些知识被编码在神经网络的参数中,输出的结果都生成于这些参数之中。收到用户的问题时,ChatGPT会将其输入到神经网络中,神经网络会根据它学到的知识回答问题,反馈给用户。超强的记忆力是它的重要特征。ChatGPT作为一个现象级的技术产品,在生成内容方面无疑是革命性的,代表着人工智能大模型加大数据范式方法的成功,也说明采用统计模型方法模拟人类语言智能的新发展。ChatGPT在大模型的基础上,采用人类反馈强化学习的训练机制和提示引导模式,促使模型逐渐顺应人类思考逻辑,趋向人类认知和习惯,这是它的一大创新。
三、对未来语言智能走向的影响
ChatGPT除了对人类生活带来影响,对语言智能领域的研究范式和发展走向也会带来巨大的冲击。从大量的语言数据中学习,挖掘语言规律和语义关系,极大地改进了自然语言理解和生成的质量,取得惊喜的使用效果,使我们对大语言模型有了新的认知和思考:大模型范式是否成为未来语言智能的主流技术?学术界和企业界从事多年的自然语言处理研究还需要继续搞下去吗?ChatGPT会给AI领域的研究带来怎样的影响?
预训练模型的出现代表了自然语言处理技术的飞跃,减少了对特征工程的依赖,逐渐带动整个领域研究范式的转变。这种范式转变带来的影响主要体现在:
一是自然语言处理研究子领域的逐渐弱化,例如词性标注、命名实体识别、句法分析、指代消解等问题,它们在大模型+大数据独领风骚的背景下,将会逐渐失去吸引力,甚至被淡忘和遗弃。
二是自然语言处理不同子领域的技术方法和技术框架日趋统一。多少年来,为了让机器理解人类语言,人们想尽各种方法来标注词性,理解语义。ChatGPT的出现,让人们看到了语言预训练模型威力,通过这种范式处理自然语言效果会更好。
第三,从全球语言智能的发展来看,大模型范式的一路领航势必导致技术、资源、用户的高度趋合,最终走向技术和资源的单极垄断。
四、未来发展
尽管ChatGPT在智能交互方面获得惊人的能力,但它毕竟是一个预训练语言模型,基于预存知识和模型回答问题,并不具备真正的理解能力和创造能力,不能理解自己输出的内容。面对语言智能的新发展和新挑战,未来可以着重考虑以下几个着力点。
(一)深度学习模型的优化。结合人类语言习得,语言使用规律和习惯,推进深度学习模型研究,提高语义理解能力,更好模拟人类语言能力。
(二)多模态语言理解与生成。随着多模态数据的不断增加,如何在多模态语言理解任务中有效融合多种信息来源,提高语言理解的准确性是当前语言智能研究的一个重要方向。ChatGPT主要是文本的自动生成,多模态的语言理解和生成问题尚未完全解决。需要未来深入研究多模态学习和多模态生成技术。
(三)领域知识图谱的构建。虽然ChatGPT可以搜索众多信息,对一般问题回答较好,但相对有深度和专业性较强的问题却表现得力不从心。如何更好地利用知识图谱的语义信息,提高自然语言处理任务的准确性,更好地服务于各类专业性用户,也是未来可以发展的一个领域。
(四)加强人工智能伦理和数据安全等问题的研究。ChatGPT是生成型人工智能,不是简单地分析和处理数据,很可能会引发道德和法律方面的违规行为。比如,对信息数据来源无法进行事实核查,存在个人数据和商业秘密泄露,或提供虚假信息的隐患。学生使用ChatGPT写论文是否算抄袭等等,因此加强科技伦理研究,建立数据安全法规的约束机制,增强人们对技术变革的现代智慧是非常迫切的任务。
作者:李佐文,系北京外国语大学人工智能与人类语言重点实验室教授、博士生导师
大家都在看
-
玻璃机械防腐 最核心的性能到底是什么 做玻璃深加工的同行,选防腐涂层时,是不是总被五花八门的参数晃花眼?盐雾时长、表面硬度、耐酸碱值,个个标得亮眼,可用到自家生产线上,没几个月就鼓包掉漆、锈迹斑斑,问题到底出在哪?很多人觉得是硬度不够,或 ... 机械之最03-22
-
世界不锈钢之最:一张图看懂10种“王者级”不锈钢,用途一目了然 在工业制造、家居生活、医疗器械、海洋工程等领域,不锈钢早已成为不可或缺的材料。但你知道吗?不锈钢并不是只有一种,不同型号性能天差地别,有的耐高温、有的耐强酸、有的薄如蝉翼,还有的堪称“不锈钢界天花板” ... 机械之最03-22
-
三一重工:工程机械隐形冠军,从跟随到领跑的硬核逆袭 说起隐形冠军,很多人第一反应是那些藏在产业链深处、不面向普通消费者,却在细分领域牢牢占据霸主地位的企业。工程机械行业听起来离日常很远,可我们脚下的路、住的楼、坐的高铁背后,都离不开这个行业的支撑,而三 ... 机械之最03-22
-
5类机械中最常用的机构,原理、类型、应用一次性讲透 做机械设计、机电一体化相关工作的朋友都清楚,机构是所有机械设备的核心骨架,小到日常的缝纫机、门禁开关,大到起重机、机床生产线,都离不开基础机构的支撑。很多刚入门的新手总被各类机构的原理、选型绕晕,今天 ... 机械之最03-21
-
沃野染新绿 春耕绘丰景——从春耕一线看“十五五”开局农业生产新气象 3月20日,春分时节,恰逢农历二月初二“龙抬头”。“春分龙抬头,五谷大丰收。”当前,南方早稻开始育秧,北方冬小麦全面返青,广袤田野上生机盎然。“抓好春耕备耕,对于确保粮食丰产和粮食安全至关重要。”习近平 ... 机械之最03-21
-
二月二,龙抬头,一同走近“华夏第一龙” 今天是农历二月初二民间俗称“龙抬头”的日子让我们一同走近一件“了不起的文物”绿松石龙形器它被称为“华夏第一龙”许多学者认为它是中华民族龙图腾最直接、最正统的根源“超级国宝”,叹为观止2002 ... 机械之最03-21
-
叙事权的博弈:从《霍去病》看AI时代的技术迷恋 作者:谭 苗 李婧怡近期,以AI作为核心生产工具生成的短片剧集《霍去病》引发广泛争议。但与作品相比,出圈的并非剧集本身,而是网络舆论所塑造的AI神话。“团队仅有3人”“仅花费3000元成本”等数据引发全网惊叹, ... 机械之最03-21
-
真金白银来了丨氢能工程机械,这次真的可以干 3月16日,工业和信息化部、财政部和国家发展和改革委员会联合印发了《关于开展氢能综合应用试点工作的通知》。这份面向“城市群”的试点部署看起来像是能源与交通的事,但对工程机械行业来说,它其实把一扇门敲开了 ... 机械之最03-20
-
慢牛退潮后才懂:我们面对的不是市场,是量化机器 指数缓步上行的假象褪去,市场露出最残酷的真相:慢牛遮羞布一扯,全是量化的屠刀在挥舞。2026年3月,A股成交额从万亿台阶回落,波动加剧、个股闪崩频发,曾经温和的赚钱效应消失殆尽。上交所最新数据显示,全市场81 ... 机械之最03-20
-
300℃铁锅里的“费头子”:大巴山22岁高级茶师的“叛逆”与坚守 封面新闻记者 谢杰 舒俊瑜 彭雨田 摄影报道三月,四川巴中南江,茶山起雾。22岁的赵小龙把手伸进300℃的铁锅,鲜叶翻滚,逐渐炒制出扁平绿茶。这个从茶山走出来的“00后”,年纪轻轻,却来头不小:国家一级评茶师、 ... 机械之最03-18
相关文章
- 打造全域科创“超级试验场”——上海杨浦构筑智能经济“生态之林”观察
- 慢牛退潮后才懂:我们面对的不是市场,是量化机器
- 机械类9大“炮灰”专业+死亡城市对照表!选错,985毕业也失业!
- 别再骂机械类是天坑!工科之母 全行业刚需 越老越吃香,十年不失业
- 300℃铁锅里的“费头子”:大巴山22岁高级茶师的“叛逆”与坚守
- 机械类报考,最值钱未必是机器人
- 机械考研:0802和0855,谁更适合普通考生
- 当钢铁有了灵魂:寻找那些最懂“交互叙事”的机械装置造梦者
- 列国鉴丨记者观察:从“南强北弱”到“北升南降”,德国经济版图悄然生变?
- 就业信息:重庆大学机械工程——最详细的就业与岗位拆解
- 机械革命创始人潘春节:以用户为中心,做好每一台电脑
- AI走进了体育场,然后呢?
- 现在的工科报考彻底跑偏了!强国刚需的机械类,反倒被骂成天坑!
- 漠北的惊雷:汉武帝用国家机器碾碎匈奴草原霸权
- 颜值即正义 五款长在审美点上的硬核轻武 哪一把是你的梦中情枪?
- 机械铸魂 铁路传薪——探访北京交通大学大学生机械博物馆
- 从鸡舍到餐桌,一枚让人放心的鸡蛋要经过几道关?
- 记者“养虾”手记:体验五天,发现目前“龙虾”并不适合普通用户
- 机械五虎谁能称王?清华、哈工大硬刚985,这些名校分化有多猛
- 亮黑伯莱塔92X 意式优雅与战术美学的碰撞 黑曜石般的钢铁艺术
热门阅读
-
天下第一暗器暴雨梨花针,传说中的唐门暗器做出来了 07-13
-
汽车投诉排行榜前十名汽车 问题最多的就是这些车 07-13
-
世界上最牛挖掘机,甚至可以挖穿一座城市 11-05
-
世界最大核潜艇制造厂,产量远超中美法 11-20
