加入收藏 | 设为首页

百度CTO王海峰:语言与知识布局始终把握技术及产业两大趋势

来源:本站原创 发布时间:2022-06-30

  自然语言理解(NLP)素有“人工智能皇冠上的明珠”盛誉,这也意味着语言与知识等认知层面的技术突破将进一步促进AI深入发展。

  8月25日,以“掌握知识、理解语言、拥有智能”为主题的百度大脑语言与知识技术峰会举行,百度CTO王海峰发表主旨演讲,解读百度语言与知识技术的发展历程与最新成果,与产学研各界分享技术及产业发展趋势和展望,百度集团副总裁吴甜和百度技术委员会主席吴华分别发布百度语言与知识技术系列产品和数据集共建计划,重磅推出5款产品的新发布,全面加速AI技术大规模应用。这是一场凝聚了百度在语言与知识领域十年技术积累和产业实践的盛会,必将带来深远影响。香港马报现场开奖直播

  语言与知识技术是人工智能认知能力的核心。2010年,百度成立自然语言处理部,在前瞻技术与产业格局上不断引领、创新,十年间已成为中国NLP发展的一面旗帜。

  峰会上,王海峰回顾,“在百度语言与知识技术的布局和发展中,我们始终在注意把握两个趋势,即技术发展趋势和产业发展趋势,并力争引领趋势。”

  纵览百度语言与知识技术发展历程,从研究方法、研究对象、研究方向、产业应用等各个层面,布局完整,不断打磨成熟,始终与应用的发展趋势、需求一脉相承,与产业接轨。

  十年来,百度大脑语言与知识技术成果丰硕,获得包括国家科技进步奖在内的20多个奖项,30多项国际竞赛冠军,发表学术论文超过300篇,申请专利2000多项。技术不断突破创新的同时,也在产品上创新探索,同时将领先的技术输出给开发者与合作伙伴,提升各行业智能化水平。

  首先,知识图谱是机器认知世界的重要基础,百度打造了世界上最大规模知识图谱,拥有超过50亿实体和5500亿事实,并在不断演进和更新。百度知识图谱应用于各行各业,每天的调用次数超过400亿次。

  其次,在融入知识的基础上,语言理解能力不断增强。2019年3月,百度提出知识增强的语义理解框架ERNIE,在深度学习的基础上融入知识,同时具备持续学习能力,曾一举登顶全球权威数据集GLUE榜单,首次突破90分大关,刷新榜单历史。基于知识图谱和语义表示,突破了阅读理解、对话理解以及跨模态深度语义理解等技术。

  第三,语言生成是语言与知识技术中的重要组成部分。基于预训练技术的成功经验,百度提出基于多流机制的语言生成预训练技术,兼顾词、短语等不同粒度的语义信息,显著提升生成效果。百度也探索了多文档摘要生成,通过图结构语义表示引入篇章知识,在单文档和多文档摘要生成效果都有提升。

  应用系统层面,对话系统和机器翻译等成绩卓著。百度提出了知识图谱驱动的对话控制技术,以及首个基于隐空间的大规模开放域对话模型PLATO等,并推出智能对话定制和服务平台UNIT,帮助开发者高效构建智能对话系统,实现规模化应用。百度翻译支持200多种语言,每天响应超过千亿字符的翻译请求,支持超过40多万家第三方应用,技术上,提出了多智能体联合学习、基于语义单元的同传模型、稀缺语种分组混合训练算法等。

  百度大脑语言与知识技术的持续探索和创新取得了令业界瞩目的成绩,同时这些技术以平台化的方式输出,赋能千行万业,持续提升产业智能化水平。

  王海峰首次发布了百度大脑语言与知识产品全景图。百度集团副总裁吴甜接续发布语义理解技术与平台文心、智能文档分析平台TextMind和AI同传会议解决方案3大新产品,同时发布了6项升级,包括智能创作平台的3个场景方案、以及智能对话定制与服务平台UNIT的3项全新升级。

  吴甜表示,“我们一直致力于将语言与知识技术凝聚成一系列技术平台和产品,在应用中产生大量价值,为广大开发者和产业实践者提供以语言与知识技术为核心驱动的系列产品。”

  百度推出的语义理解技术与平台文心,基于深度学习平台飞桨打造,依托领先的语义理解核心技术,集成优秀的预训练模型、全面的NLP算法集、端到端开发套件和平台,提供一站式NLP开发与服务,让开发者更简单、高效地定制企业级NLP模型。文心经过了大量真实应用场景的淬炼,具备优秀的工业级落地实力。

  全新发布的智能文档分析平台TextMind,基于OCR、NLP技术,以文档解析为核心能力,支持文档对比与文档审核,具备“多快好省”的核心优势,促进企业办公智能升级。

  百度大脑智能创作平台针对媒体应用场景再升级,全新推出智能策划、智能采编、智能审校三大媒体场景方案,进一步助力媒体人更快、更好地创作,可谓切中媒体人的“痛点”。

  智能对话定制与服务平台UNIT升级3大特性:更智能的任务式对话理解、极致便捷的表格问答和融合通用的新对话引擎。此次UNIT全新升级的三大能力,将进一步降低任务式对话、智能问答的定制成本,并融合通用对话能力,提升交互体验。

  全新发布的AI同传会议解决方案,覆盖会议全场景、全流程,旨在打造用户随身的“会议同传专家”。吴甜现场展示了如何只用一台电脑和一部手机快速搭建一套同传服务,只需点点鼠标、打几个字,就能快速获得专业的同传服务。

  数据匮乏、算力不足历来是语言与知识技术研发中面临的瓶颈。为突破瓶颈,百度联合中国计算机学会、中国中文信息学会发起中文自然语言处理数据共建计划——千言,解决数据稀缺问题。千言一期由来自国内11家高校和企业的数据资源研发者共同建设,已涵盖开放域对线余个中文开源数据集。

  百度技术委员会主席吴华表示,“未来,我们希望有更多的数据集作者能够参与共建千言,共同推动中文信息处理技术的进步,建设世界范围的中文信息处理影响力。我们计划在未来3年,面向20多个任务,收集和建设不少于100个中文自然语言处理数据集,覆盖语言与知识技术全部领域。”

  (百度技术委员会主席吴华(中)与中国中文信息学会副理事长兼秘书长孙乐(左)、中国计算机学会自然语言处理专委会主任周国栋(右)一起正式启动千言计划)

  吴华还发布了百度语言与知识技术算力共享计划,通过百度AI STUDIO平台提供算力支持,让广大开发者破除算力桎梏,专注于技术创新。

  十年征程,百度语言与知识技术发展历程中培养、吸引了大量全球顶尖人才。会上,百度推出以王海峰为代表的百度NLP“十年十人”,十年坚守,不忘初心,秉持“技术信仰”,勇攀技术高峰,矢志不渝致力于让机器更好地理解世界、更好地服务于人。

  正如王海峰所言,“我们致力于更好地与学术界、产业界携手,推动语言与知识技术发展,进而推动人工智能技术持续进步,为产业智能升级、社会经济高质量发展贡献力量。我们对未来充满信心,坚持研究和发展让机器掌握知识、理解语言、拥有智能,继续突破和创新,为技术和社会进步做出更大贡献。”(王新)

  2022年6月25日,福建省福清市一都镇后溪,游客在漂流项目游玩。暑期来临,一都镇迎来乡村旅游的游玩高峰,许多游客前来戏水消暑,乐享夏日清凉

  2022年6月22日,广东省江门台山市海宴镇沙尾厂村,莲藕丰收季,藕农将采收的莲藕装车销售。

  2022年6月21日,新疆伊犁边境管理支队开干沟边境派出所民警深入偏远牧区,扎实开展打击整治养老诈骗防范宣传。

  2022年6月20日清晨,安徽和县公安局白桥派出所民警携江淮义警,来到李白诗中的天门山脚下,在人员集中的水岸码头、轮渡船上向群众开展长江禁捕宣传,特别是禁用渔具网具对渔业资源的破坏。

  河北省承德县食用菌生产总量3.4亿棒(袋),产量34万吨,产值34亿元。

  2022年6月16日,雨后太阳西下时在海口市与澄迈县老城镇交汇处的天空出现彩虹,随后晚霞又映红天际,渐渐将整个天空披上一层层红蓝色着装,让椰城海口无比灿烂辉煌。

  2022年6月15日,位于福建省福安市下白石镇的一家造船厂生产红火,多艘船舶开工建设即将交付。

  2022年5月27日,江苏淮安市委巡察机构在盱眙县陡山村开展入户走访调研,详细了解巡察整改情况,收集群众意见建议,充分发挥巡察联系服务群众纽带作用。

  今年6月是全国第21个“安全生产月”,中国铁路南昌客运段乘务人员在出乘前严格落实安全生产、疫情防控、消防安全、餐车管理及食品卫生安全检查,加强列车安全管理,确保铁路安全运输,服务旅客平安出行。

  2022年6月12日,武警青海总队执勤支队将特战分队拉练至沙漠地域,开展徒步行军、快速追逃、搏击对抗等课目的实战训练,全面检验和提高队员在恶劣环境下的综合作战能力。

  在西藏自治区昌都市八宿县然乌镇,周围遍布美丽的湖泊与宏伟的雪峰,湖泊、田园、雪山与村庄相映成趣,秀美如画。

  2022年6月7日,江西省遂川县巾石乡东坑村,随处可见一片片绿油油的稻田,错落有致,不同层次的绿色相互交织,青山、屋舍掩映成景。

  2022年6月2日,湖南省常宁市庙前镇泉井村,许广高速公路老屋场特大桥上车水马龙,与农房民居、绿色田园相互映衬,呈现出一副夏日里的乡村生态画卷

  2022年6月3日,江苏省白马湖农场有限公司收割小麦场面,犹如一幅三夏 机械化会战图。

  2022年6月2日,江西省抚州市南丰县太源乡开展做香包、打糍粑、包粽子、编五彩绳等端午民俗活动,迎接传统佳节的到来。

  2022年5月28日,安徽省宁国市千年古镇胡乐老街,村民与游客们围坐在长桌前,分享端午特色美食。端午临近,胡乐老街传承非遗文化打造艺术乡村——我们的端午系列非物质文化遗产展演活动拉开帷幕,吸引游客前来参与体验古镇浓浓的民俗风情。

  2022年5月31日,江苏淮安市实验小学组织即将毕业的六年级学生拍摄不同队型的毕业照,定格幸福校园生活。

  2022年5月30日,第六个全国科技工作者日,在位于山东烟台的中国科学院烟台海岸带研究所,科研人员潜心钻研、静心攻关,在岗位上度过自己的节日

织梦CMS官方 DedeCMS维基手册 织梦技术论坛
Power by DedeCms