分享好友 厨具导购网站首页 频道列表
人工智能可以自动完成文本摘要
2024-06-26 13:15    3127    中华厨具网

谷歌的人工智能实现了最先进的文本摘要性能

自动文本摘要是机器学习算法正在努力的方向之一,微软近期发布的相关论文也表明了这一趋势。对于那些每天要阅读大量文字信息的工作者们来说,这是一个值得庆贺的好消息。有调查显示,这类工作者每天仅在阅读信息上就要花费大约2.6小时。

相应的,google brain和伦敦帝国理工学院的一个团队构建了一个系统——pegasus(pre-training with extracted gap-sentences for abstractive summarization sequence-to-sequence),它使用了谷歌的变形金刚架构,结合了针对文本摘要能力的预训练目标。据称,它在12种测试中均达到了达到最先进的水平,这些测试包括了科学、故事、电子邮件、专利和立法法案等。不仅如此,它在材料缺乏的文本整合测试中也表现惊人。

正如研究人员指出的那样,文本摘要的目的是总结输入的文档,生成其准确和简洁的摘要。

抽象的摘要也不是简单地从输入的文本中复制粘贴文字的片段,而是会产生新单词或总结重要信息,从而使输出的语言保持流畅。

变形金刚是google brain (谷歌的人工智能研究部门)的研究人员在介绍的一种神经结构。

它提取特征以及学习做出预测的方式和所有的深度神经网络一样:神经元被安排在相互连接的层中,这些层传递着输入数据的信号,调整每个连接的权重。

但变形金刚架构又有其独特之处:每个输出元素和每个输入元素都有连接,并动态计算它们之间的权重。

在测试中,研究小组选择了表现最佳的pegasus模型,该模型包含了5.68亿个参数。它有两个训练材料。一个是从3.5亿个网页中提取出来的文本,有750gb。还有一个训练材料则覆盖了15亿篇新闻类型的文章,总计3.8tb。研究人员说,在后者的情况下,他们用白名单域来植入网络爬虫工具,覆盖了质量参差不齐的内容。

根据研究员的说法,pegasus生成的摘要语言非常优秀,流畅性和连贯性都达到了高水准。此外,在文本匮乏的环境中,即使只有100篇示例文章,它生成的摘要质量与在20,000到200,000篇文章的完整数据集上训练过的模型相当。

转载:中国机器人网(原始来源:评论:0)

以上是网络信息转载,信息真实性自行斟酌。

版权/免责声明:
一、本文图片及内容来自网络,不代表本站的观点和立场,如涉及各类版权问题请联系及时删除。
二、凡注明稿件来源的内容均为转载稿或由企业用户注册发布,本网转载出于传递更多信息的目的;如转载稿涉及版权问题,请作者联系我们,同时对于用户评论等信息,本网并不意味着赞同其观点或证实其内容的真实性。
三、转载本站原创文章请注明来源:中华厨具网

免责声明:

本站所有页面所展现的企业/商品/服务内容、商标、费用、流程、详情等信息内容均由免费注册用户自行发布或由企业经营者自行提供,可能存在所发布的信息并未获得企业所有人授权、或信息不准确、不完整的情况;本网站仅为免费注册用户提供信息发布渠道,虽严格审核把关,但无法完全排除差错或疏漏,因此,本网站不对其发布信息的真实性、准确性和合法性负责。 本网站郑重声明:对网站展现内容(信息的真实性、准确性、合法性)不承担任何法律责任。

温馨提醒:中华厨具网提醒您部分企业可能不开放加盟/投资开店,请您在加盟/投资前直接与该企业核实、确认,并以企业最终确认的为准。对于您从本网站或本网站的任何有关服务所获得的资讯、内容或广告,以及您接受或信赖任何信息所产生之风险,本网站不承担任何责任,您应自行审核风险并谨防受骗。

中华厨具网对任何使用或提供本网站信息的商业活动及其风险不承担任何责任。

中华厨具网存在海量企业及店铺入驻,本网站虽严格审核把关,但无法完全排除差错或疏漏。如您发现页面有任何违法/侵权、错误信息或任何其他问题,请立即向中华厨具网举报并提供有效线索,我们将根据提供举报证据的材料及时处理或移除侵权或违法信息。