范文健康探索娱乐情感热点
投稿投诉
热点动态
科技财经
情感日志
励志美文
娱乐时尚
游戏搞笑
探索旅游
历史星座
健康养生
美丽育儿
范文作文
教案论文
国学影视

算法自动划重点AI学会抱佛脚

  预训练模型的兴起给自然语言处理(NLP)带来了"新面貌"。
  近年来,Google、Facebook、OpenAI、微软、百度等人工智能"头部玩家"推出多个颇具影响的预训练模型,并反复迭代出十多个版本。无论学术界还是业界,人们对大规模预训练模型"热情高涨"。
  日前,来自清华大学的一支研究团队提出一种简单高效的NLP学习框架。不同于当下NLP社区主流的"大规模预训练+下游任务微调"的范式,这一框架无需进行大规模预训练,同时将训练效率提升两个数量级,并在多个NLP任务上,实现了比肩甚至超出预训练模型的性能。近日,相关研究以预印本形式,在arXiv上发表。
  预训练模型的"内功"
  预训练模型在自然语言处理领域蓬勃发展,近年来在多个子方向取得了颠覆性的成果。
  "自然语言处理的‘预训练’过程,就像武侠小说中,练武之人的‘修炼内功’。"上海对外经贸大学副研究员邵浩说,"一个人要成为武林高手,需要有扎实的"内功",内功修炼好之后,再去学各种招式就非常容易上手,并能发挥其最大效用。"
  随着深度学习的发展,模型参数显著增长,从而需要越来越大的数据集,用于充分训练模型参数。然而,因大部分NLP任务的标注成本极为高昂,尤其是句法和语义相关的任务,构建大规模标注数据集尤为困难。
  相比较而言,大规模无标注数据集相对易于构建。为更好地利用海量无标签文本数据,常规的做法是首先从这些数据中学到较好的文本表示,然后再将其用于其他任务。许多研究表明,在大规模无标注语料中训练的预训练语言模型,可以使多方面NLP任务获得显著的性能提升。
  通过海量无标注语料来预训练神经网络模型,可以让人工智能更利于下游NLP任务的完成。预训练模型的作者已经设计出了基准模型,这样,使用者就可以在自己的NLP数据集上应用该模型,而无需从头开始构建模型来解决类似的问题。尽管后续过程需要进行一些微调,但这为人们节省了大量的时间和计算资源。
  2018年,无监督的双向预训练语言模型ELMo被提出,这种上下文相关的文本表示方法在多个典型任务上表现惊艳,能有效处理一词多义问题。紧随其后,GPT,BERT等预训练语言模型相继被提出,预训练模型技术开始在NLP领域大放异彩,并在各种下游任务中遍地开花。
  任务驱动模型出场
  "预训练语言模型因其强大的性能被广泛关注,基于‘预训练—微调’的范式也成为许多NLP任务的标准方法。"清华大学交叉信息研究院助理教授、RecurrentAI联合创始人杨植麟对《中国科学报》说,"然而,当前通用语言模型的预训练成本极其高昂,这使得只有少数资源充足的研究机构或组织能够对其展开探索。"
  为解决上述问题,杨植麟团队提出的一种完全不需要预训练语言模型的高效学习框架。这一框架从通用语料中筛选出与下游任务相关的子集,并将语言建模任务与下游任务进行联合训练。
  该论文第一作者、清华大学计算机科学实验班(姚班)大四本科生姚星丞介绍说,提出任务驱动的语言模型的想法源于一个基本的观察:人类可以通过对关键信息的学习,在有限的时间和精力投入情况下,快速掌握某一任务技能。例如,在临近考试时,学生仅根据考纲复习浏览若干相关章节的要点即可应对考试,而不必学习所有可能的知识点。与之类似,预训练语言模型在某一下游任务上的优良表现,"很有可能因为来自于语料中与下游任务相关的数据"。
  基于这一判断,该团队提出任务驱动的语言模型(TLM),它仅利用从大规模通用语料中提取的少量与下游任务相关的数据,就可以取得与全量数据类似的结果。
  "相较于传统的预训练模型RoBERTa(基于BERT的改进模型,使用更大的批次和更多的数据对模型进行更长的训练),TLM仅需要约1%的训练时间与1%的语料,即可在众多NLP任务上,表现出比肩甚至超出预训练模型的性能。"姚星丞说,"我们目前也正在尝试将任务驱动的方法推广到更大规模的模型上,如GPT-3或T5。"
  跳出预训练范式
  为了从大规模通用语料中抽取关键数据,TLM以任务数据作为查询对象,用基于稀疏特征的BM25算法作为召回算法,对通用语料库进行相似数据的召回。
  "除已有的下游任务数据以外,其余的语料均通过BM25算法进行相似性匹配而自动筛选,不需要人工做额外的选择与标记。"姚星丞说。"TLM基于任务数据和召回数据,同时优化任务目标和语言建模目标,从零开始进行联合训练。"
  为了测试TLM的性能,研究人员在8项NLP分类任务上,从三个不同规模展开了对比实验。这8项任务涵盖了计算机科学、生物医药、新闻、评论等4个领域,包括了训练样本数量小于5000的低资源任务和训练样本数量大于20000的高资源任务,任务类型覆盖了话题分类,情感分类,实体关系抽取等。
  测试结果显示,和对应"预训练—微调"基准相比,TLM实现了相当甚至更优的性能。平均而言,TLM减少了两个数量级规模的训练计算量以及训练语料的规模。整体来说,预训练模型以极高的成本学习尽可能多的,和任务无关的知识,而TLM以非常低的成本,针对每个任务学习相关知识。
  "当我们有少数特定目标的任务需要解决的时候(例如希望对少量几个数据集进行研究),TLM会是非常高效的。"姚星丞说,"而需要一次性解决大量任务时(例如工业界构建一个NLP平台为多方提供相似的服务),预训练模型仍然具有优势。"
  此外,TLM是任务驱动的,所以可以给研究人员更大的自由度,从而自定义策略进行标记、序列长度、数据表示、超参数的调整等等,从而达到提高性能和效率的目的。
  "TLM的提出,让NLP研究跳脱出‘预训练—微调’范式成为可能,这有利于推动NLP研究公平化。"杨植麟解释说,预训练本身严重依赖大量的计算资源,这一限制使大多数NLP研究者只能专注于对微调算法的研究。然而微调算法的性能上限,很大程度上受预训练模型性能的约束。而TLM可以让大多数研究人员可以以较低的代价和较高的效率,基于最先进的解决方案对模型架构、损失函数、算法等方面进一步自由探索。
  杨植麟认为,未来会有更多有趣的研究可以在TLM的基础上展开。例如,如何经济地达到更大规模预训练模型的表现效果;如何提升TLM的通用性与可迁移性;可否利用TLM进行小样本或零样本学习等。此外,还可以将预训练模型和TLM结合,从而在通用性和效率之间实现更好的权衡。(张双虎)
  相关论文信息:https://arxiv.org/pdf/2111.04130.pdf
  项目地址:https://github.com/yaoxingcheng/TLM

继续造芯!央视爆料,它将成为中国第二家自研Soc的厂商相信大家都非常关注自研芯片的消息,确实,作为手机中最重要的零部件,芯片可以说是手机的心脏。如果不能掌握芯片的自研技术,在面对国外的芯片制裁,以及在未来中国能自主生产芯片时,必然会落七夕节有没有什么礼物推荐?性价比高的运动蓝牙耳机七夕将近,又是非常适合运动的季节,所以在挑选七夕礼物的时候,完全可以考虑将一款好的运动耳机来作为伴礼哦。近年来,主打运动类的真无线蓝牙耳机越来越多,各种国产品牌推出的新品可谓层出不国货精品战略的得意之作魅族Lipro筒灯测评今天轮到测评Lipro筒灯了,原打算是筒灯射灯放在一篇文章,因他们系出同源,有很多的共同点,为让读者能更好get到灯具的不同运用,还是另起一篇文。正面实拍与lipro的其他产品一样紫光展锐何时能替代海思?昨天CINNO发布了2021年6月中国智能手机SoC市场数据,海思的份额占比已经下降到10以下。反之,上半年缺货的高通,6月份额迎来大幅增长,市场占比来到37,挤下联发科重新回到第小米连发5款新品,从499到16999全都有,你最喜欢哪一款?伴随着时间的不断走过,小米发布会也终于要召开了,本次发布会上,小米带来了多款旗舰新品,这些新品既有当下的黑科技产品,也有一些十分经典的产品更新,但每一样都能够带来足够的震撼。那么接vivo手机有哪些优缺点?说到vivo这个国产品牌,很多年轻人都是早有耳闻。毕竟,vivo就是靠着时尚吸引了无数年轻人的目光。那么,vivo手机有哪些优缺点呢?我在这里给大家分享一下我的看法。优点外观精致设热门中概股周一收盘普涨区块链概念股表现强势美股周一收盘涨跌不一,道指上周五创历史新高后小幅下滑。道指跌106。66点,或0。30,报35101。85点纳指涨24。42点,或0。16,报14860。18点标普500指数跌4。三星后悔吗?关停中国工厂转向越南,产能仅剩70,新机可能延迟根据多家市场调研机构显示,三星第二季度智能手机出货量出现较大波动,全球多地市场出现严重下滑,6月份甚至被小米实现份额反超。作为全球第一大智能手机品牌,行业内长期保持较大优势,什么原RedmiK30Pro无刘海设计加持,各方面表现可圈可点,值得入手哈喽大家好,我是你们的老朋友小生,每天都会给大家更新我的原创内容,RedmiK30Pro,一款性价比很高的手机。下面我们一起来了解一下。外观方面,RedmiK30Pro在外观上最大移动电源内卷了?参数高没啥用,颜值高才是王道现在的移动电源行业可以说都被带入了参数内卷的旋涡中,今天你出5000毫安时容量,明天我出10000毫安时,后天它又有了20000毫安时今天你20W快充,明天我50W快充,后天我又有阿里员工性侵事件中的手机录音问题这几天阿里员工性侵事件持续占据热点。其中有一个问题议论较多,就是女主表示疑遭阿里高管性侵后,给其打电话。阿里高管在电话中承认性侵,但因苹果手机通话时无法录音,没有取得证据,报警后阿
高校财务共享模式优化研究目前大多数高校都已逐步实施财务共享服务模式,而以去中心化信息共享可追溯性为特征的区块链技术可以优化完善高校的财务共享模式。本文主要分析了高校财务共享模式引入区块链技术的必要性,提出西圣AresPro体验报告外观重细节,音质是亮点前言西圣作为南卡的子品牌,一向以高性价比著称。最近西圣为了扰乱入门级蓝牙耳机的门槛特意推出了这款西圣AresPro通话降噪蓝牙耳机。为了让各位小伙伴在入门级蓝牙耳机中多一个选择,我美媒俄政府网站面临前所未有的黑客攻击潮据美国华盛顿邮报网站3月17日报道,俄罗斯政府周四表示,俄政府网站和官方媒体面临着一波前所未有的黑客攻击潮,促使监管机构对来自国外的信息加以过滤。俄罗斯数字发展与通信部在一份声明中星游早报霍格沃茨的遗产演示视频几万人砍价PDD仍失败1苹果M1Ultra实测情况惨烈近日苹果正式解禁了MacStudio,外媒TheVerge也测试了满血的M1Ultra版本,并与RTX3090进行了对比。在苹果官方的对比中,这颗顶云米RoyalAI激光影院售价4万元,影院级巨幕颠覆家庭娱乐体验近年来受疫情因素的影响,人们对家庭娱乐的需求与日俱增,宅经济引爆了家用投影仪市场。而随着生活品质的不断提高,用户不再满足于单一的追剧需求,而是希望在家也能享受到逼真的影院级体验屏幕国产电视机品牌哪个好,海信电视怎么样首先我们来看一下这款电视的外观,不难发现和市面上普通电视相比,这款电视多了一个摄像头,我们称之为智慧眼,这样的一个智慧眼能为我们带来哪些有趣的功能呢?首先它可以实现广角的大屏美拍功昕诺飞推出整合UVC紫外线空气消毒机二代搭载H12级HEPA过滤网,滤除花粉螨虫灰尘等颗粒物经InnovativeBioanalysis实验室验证,可有效灭活室内空气中99。99的新型冠状病毒SarsCov2通过创新改善华为首款1亿像素手机,nova9SE开售2199元起华为nova9SE于3月16日发布,搭载一亿像素影像系统,支持66W超级快充,售价2199元起,将于今日(3月18日)1008正式开售。8GB128GB版本2199元8GB256G华为新品手机P50E怎么样,4099元价位上的竞争力如何,能打吗?最近朋友问华为新发布的P50E手机怎么样,评价君看了看手上的P50Pro,觉得其能有后续机型推出就已经很好,P50系列确实也是一代经典。而具体到新产品P5OE,其在4099元价位上5999就能买无锁iPhone13Pro?网友入手后发现是企业定制机现在黑解iPhone13Pro一般也就5000多不到6000。网友称自己买了一台无锁iPhone13Pro居然也不到6000块,大家都十分诧异,毕竟这个价格是买不到无锁iPhoneiPhone14屏幕细节曝光LTPOOLED面板仍为Pro版专属不久前2022苹果春季发布会正式举行,其中新款iPhoneSE3和iPhone13Pro的全新配色毫无疑问地成为了此次发布会的最大看点。但对于不少果粉来说,被寄予厚望的新一代iPh