0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

困扰NLP领域的这三座大山究竟是什么?

MqC7_CAAI_1981 来源:未知 作者:李倩 2018-09-05 15:32 次阅读

“我的飞机什么时候到?”

把这个问题抛给智能机器人助手。几乎可以肯定,机器立马就懵逼了。

“我”是谁?“飞机”是航班还是淘宝上订的模型玩具呢?“到”又是到哪呢?

如果是人类来回答这个问题,即使在情景不明确的情况下也能在快速澄清后给出回答,但对机器来说,除非依赖大量人为制定的规则,回答这样的问题难度堪比“哥德巴赫猜想”。

面对自然语言处理发展(NLP)存在的诸多难题,该领域的大牛、Salesforce的首席科学家Richard Socher在近日指出:NLP领域的发展要过三座大山。

困扰NLP领域的这三座大山究竟是什么?一起来听大佬说。

一直以来,语言都被认为是人类的独特能力,是智慧的表现。但最近,自然语言处理技术的发展似乎也将语言能力赋予给了机器。

帮你打电话订餐,给你讲故事,解决各种刁钻的冷知识问答…机器的语言能力已经无限接近人类水平。

现在你可以走进昏暗的客厅,让Alexa把智能灯的亮度提高到75%。你也可以询问他世界另一边的天气情况。在Google最近的Duplexde,AI助理已经能够给理发店打电话,为你预约剪发。

曾经被视为科幻的场景现在变为了现实,但为了维持真正的人机关系,机器必须能够与人进行更直观、理解上下文和自然的对话--这仍然是一个挑战。我致力于研究NLP,但是就像AI一样,我们还在这个旅程的开始阶段。

语言是分享信息和与周围连接的一种机制,但是机器需要理解语言的复杂性以及作为人类是如何使用语言进行交流的。情感分析、问题回答和联合多任务学习方面的进步使AI能够真正理解人类以及我们的交流方式。

情感分析

语言本身就是复杂的。它不断发展,而且细致入微,一般人需要数年才能掌握。通过情绪分析,我们可以使用AI来理解特定内容,比如品牌或电影评价是正面的、负面的还是中性的。

我们也能弄清楚演讲者的态度和意图(她是生气,高兴,惊讶还是准备好要买东西了?)。从客户服务到在线社区调节再到算法交易,能够即时分析数千条推特和数百条产品评论来理解公众对一个品牌的看法,这对于企业来说是非常有价值的。

情感分析技术已经存在了一段时间,但并不总是非常精准。随着NLP的进展,这种情况正在发生变化。在我担任首席科学家的Salesforce,我们的AI(叫做Einstein)允许品牌能够通过电子邮件,社交媒体,和聊天短信得到实时的情感分析,为客户提供更好的体验。

准确的情感分析,例如,服务代理可帮助了解应优先服务哪些不满意的客户,或者应向谁提供优惠。也可识别产品缺陷,衡量产品满意度,通过社交平台改变人们对品牌的认知。其他科技公司也提供类似服务。

对于情感分析来说,理解上下文也是很重要的。假设你有一家肥皂公司,有人在推特上说:“这种肥皂对婴儿来说真的很棒。”这可以是对儿童肥皂的积极支持,也可能是暗讽这对孩子来说很可怕。

这句陈述可能包含很多上下文,但又很简单!使用AI分析某一句子结构的所有可能性,并理解一个人在特定语境下的用意,是NLP研究的重大挑战。它既需要标记数据来改进模型培训,也需要新的模型在学习上下文的同时在许多不同类型的任务之间共享知识。

问答

随着NLP更好地解析文本的含义,帮助管理我们生活的数字助理智能将会提高。Siri和Google Assistant等应用程序可为常见问题提供优质答案,并执行简单的命令。理想情况下,我们应该能够问电脑任意问题,并且得到好的答案。

提供更好答案的一种方式是确保计算机理解问题。如果你问“我的飞机什么时候到达?”计算机怎么知道是在谈论你的航班还是从亚马逊订购的木工工具呢?

通过对语义的更深入理解,再加上对上下文数据的更好使用,计算机在判断语义这方面正变得越来越好。我们正在研究如何使用NLP学习每一层上下文,这样AI就可以同时处理所有内容,而不会错过重要的信息。

例如,动态共聚焦网络(dynamic coattentionnetworks可以根据不同的问题对单个文档进行不同的解释,比如,面对一篇体育报道,在回答“哪位运动员获得了冠军?”和“最年轻的参赛者是几岁?”这两个问题是,机器就能对这篇报道作出不同的理解,从而反复假设多个答案,最终得到最好、最准确的结果。

联合多任务学习

科学界善于构建能很好地执行单个任务的人工智能模型。但是,更直观、会话式的并联系上下文的界面则需要一个不断学习的AI模型,它能够将新任务与旧任务集成起来,并在这个过程中学习执行更加复杂的任务。总体上来说,这对所有AI都是适用的,但在语言方面尤其如此,因为语言需要灵活性。

“谁是我的客户?”这是一个十分简单的任务:创建客户列表。但是,“谁是太平洋西北地区对某一特定产品的最佳潜在客户呢”?这样的问题增加了一层复杂性,需要大量的集成任务来提供答案,例如:如何定义“最佳”?客户定位在哪里?是什么因素导致客户对产品感兴趣的?每增加一个因素,问题的复杂性都会急剧增加。

Salesforce研究公司最近进行了一项名为“自然语言十项全能”的研究,该研究将多个任务转化为问答的形式,从而在一个单模型中解决了NLP最困[1]难的10项任务:问题回答,机器翻译,摘要,自然语言推理,情感分析,语义角色标注,关系提取,目标导向对话,数据库查询生成,代词消解。

使用多任务问答模型,将每个任务作为一种问答形式,单个模型在没有任何特定参数或模块的情况下共同学习和处理不同的任务。这不仅意味着数据科学家不再需要为每项任务建立、训练和优化单个模型,而且还意味着该模型具有零射击(zero-shot)学习能力---换句话说就是该模型可以处理以前从未见过或专门训练过的任务。

随着研究人员继续改进这样的模型,我们会看到AI界面在承担更复杂任务时变得更聪明。

虽然我们已经研究NLP很长时间了,但我们要走的路还长着呢。希望随着NLP技术的提升,人类与机器的交互形式最终能够迎来质的飞跃。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 智能机器人
    +关注

    关注

    17

    文章

    863

    浏览量

    82200
  • nlp
    nlp
    +关注

    关注

    1

    文章

    487

    浏览量

    22006

原文标题:语言处理想突破,三座大山必须过

文章出处:【微信号:CAAI-1981,微信公众号:中国人工智能学会】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    AMD深度分析:VR游戏VR电竞需要克服的三座大山

    vr电竞还需要很长的一段路要走,因为vr技术还需要充足的时间来发展,此外,优质的内容以及较低的成本。只有将三座大山攻克了,才能产生广大的群众基础,由此引爆vr电竞。先看技术方面,眩晕感的消除、人体感知的呈现、叙事方式的改变和
    发表于 11-23 11:34 812次阅读

    图解:IGBT究竟是什么?

    图解:IGBT究竟是什么? IGBT究竟是什么?
    发表于 08-10 08:01

    S参数究竟是什么?

    S参数究竟是什么?起决定性作用的S参数将S参数扩展到多端口器件和差分器件
    发表于 03-01 11:46

    我们仿真DDR究竟是仿真什么

    我们仿真DDR究竟是仿真什么?
    发表于 03-04 07:32

    电感饱和究竟是什么

    电感饱和究竟是什么
    发表于 03-11 08:13

    分贝究竟是什么?如何去理解它?

    分贝究竟是什么?如何去理解它?
    发表于 05-31 07:05

    SSD用久了速度会下降,究竟是为什么呢?

    SSD用久了速度会下降,究竟是为什么呢?造成SSD越用越慢的原因有哪些呢?
    发表于 06-18 08:49

    面板产业背负的三座大山

    面板产业背负的三座大山 “中国面板业,目前更像是在做一盘一盘的‘凉拌菜’,真正的产业竞争力还远没有形成。”昨天早晨,在接受《第
    发表于 04-01 13:38 654次阅读

    翻越“三座大山” 我国机器人产业发展机遇来临

    随着仿生结构材料、人工智能、多机器协调和人机共融等新兴技术的不断发展,我国智能机器人市场将迎来新一轮爆发。就未来前景来说,服务机器人比工业机器人后劲更大。 翻越三座大山 我国机器人产业发展机遇来临 目前全球机器人正在快速增长,全球新装机器人在22万台到24万台,我国就占据了25%。
    发表于 11-16 08:56 631次阅读

    Richard Socher:NLP领域的发展要过三座大山

    面对自然语言处理发展(NLP)存在的诸多难题,该领域的大牛、Salesforce的首席科学家Richard Socher在近日指出:NLP领域的发展要过
    的头像 发表于 09-06 11:40 3766次阅读

    中国信息通信产业数据价值要得到充分释放还需翻越三座大山

    数据中的价值只有用起来才是真正的价值,现实情况却是企业生产活动中产生的数据中只有不到2%被保存,而其中得到分析利用的不足10%;并且企业普遍存在烟囱式业务系统,导致数据管理、应用效率低。“接入难、分析难、消费难”已经成为充分释放数据价值所必须翻越的三座大山
    发表于 06-14 10:05 775次阅读

    锂电池全面替代铅酸面临的三座大山

    两轮车主机厂普遍认为,安全、价格和售后服务是锂电池全面替代铅酸面临的三座大山。当前锂电池在电动两轮车领域还没有话语权,也还没有培育出天能、超威级别的头部锂电池供应商。
    的头像 发表于 10-10 15:17 4532次阅读
    锂电池全面替代铅酸面临的<b class='flag-5'>三座大山</b>

    FlexPai 2上市热销,成功翻越量产+硬件+生态三座大山

    的厚积薄发,成功翻越量产+硬件+生态三座大山。 柔宇是全球唯二掌握核心半导体全柔性显示技术量产制造与终端布局的科技企业,并在2018年,就自主设计、建成了全球首条全柔性屏大规模量产线,以7.8英寸的商用量产尺寸计算,目前柔宇一期年产
    的头像 发表于 10-24 10:41 1731次阅读

    究竟是什么是极管的hFE

    究竟是什么是极管的hFE
    发表于 02-15 14:11 9次下载

    S参数究竟是什么?

    S参数究竟是什么?
    发表于 11-01 08:24 2次下载
    S参数<b class='flag-5'>究竟是</b>什么?