童话说说技术创业美文职业
投稿投诉
职业母婴
职场个人
历史治疗
笔记技能
美文纠纷
幽默家庭
范文作文
乐趣解密
创业案例
社会工作
新闻家居
心理安全
技术八卦
仲裁思考
生活时事
运势奇闻
说说企业
魅力社交
安好健康
传统笑话
童话初中
男女饮食
周易阅读
爱好两性

最高20倍!压缩ChatGPT等模型文本提示,极大节省AI算

1月5日 心碎巷投稿
  在长文本场景中,ChatGPT等大语言模型经常面临更高算力成本、更长的延迟以及更差的性能。为了解决这三大难题,微软开源了LongLLMLingua。
  据悉,LongLLMLingua的核心技术原理是将“文本提示”实现最高20倍的极限压缩,同时又可以准确评估提示中内容与问题的相关程度,消除无关内容保留关键信息,达到降本增效目的。
  实验结果显示,经过LongLLMLingua压缩后的提示,比原始提示的性能提升了17。1,同时输入GPT3。5Turbo的tokens减少了4倍。在LongBench和ZeroScrolls测试中显示,每1,000个样本节省28。5美元和27。4美元的成本。
  当压缩约10ktokens的提示,压缩率在210倍范围内时,端到端延迟可以降低1。43。8倍,显著加速了推理速率。
  论文地址:https:arxiv。orgabs2310。06839
  开源地址:https:github。commicrosoftLLMLingua
  从介绍论文来看,LongLLMLingua主要由问题感知的粗细粒度压缩、文档重排序、动态压缩比率和压缩后子序列恢复4大模块组成。
  问题感知的粗粒度压缩模块
  该模块的设计思路是,使用问题文本进行条件化,评估每个段落与问题的相关程度,保留相关度更高的段落。
  具体来说,通过计算问题文本与各段落的条件困惑度,判断二者的逻辑关联程度,条件困惑度越低表示相关性越高。
  在此基础上,设置阈值保留困惑度较低的段落,过滤掉与问题不相关的段落。这实现了根据问题快速移除大量冗余信息的粗粒度压缩。
  文档重排序模块
  研究表明,在提示中,靠近开始和结束位置的内容对语言模型的影响最大。所以该模块根据各段落的相关程度对其进行重新排序,使关键信息出现在对模型更敏感的位置,减少中间位置信息损失。
  通过利用粗粒度压缩模块计算出的各段落与问题的关联度,对段落进行排序,使关联度最高的段落排在最前面。这进一步增强了模型对关键信息的感知。
  在获取重排序后的相关段落后,需要进一步压缩每个段落内的词量。此时动态压缩比率模块对提示进行精细调控。
  动态压缩比率模块
  对更相关的段落使用更低的压缩比率,分配更多的保留词语预算,而对相关性较弱的段落则使用更高的压缩比率。
  通过利用粗粒度压缩结果中的段落关联度,动态确定每个段落的压缩比率。关联度最高的段落压缩比率最低,依次类推。
  实现自适应、细粒度的压缩控制,有效保留关键信息。压缩后还需要提高结果的可靠性,这就需要下面的压缩后子序列恢复模块。
  压缩后子序列恢复模块
  在压缩过程中,一些关键词可能被过度删除,影响信息的完整性,而该模块可以检测并恢复这些关键词。
  工作原理是,利用源文本、压缩文本、生成文本之间的子序列关系,从生成结果中恢复完整的关键名词词组,修复压缩带来的信息缺失,提高结果的准确性。
  整个过程有点像我们快速浏览文章、筛选信息、整合要点的工作流程等,使模型快速捕捉文本的关键信息,生成高质量的摘要。
  LongLLMLingua实验数据
  研究人员构建了一个基于NaturalQuestions的多文档问答数据集,其中每个示例包含一个问题及20个相关文档,并需要从这20个文档中查找到答案。
  该数据集模拟了实际的搜索引擎和问答场景,可以评估模型在长文档中的问答性能。
  此外,研究人员还采用了更为通用的长文本理解基准测试集,包括LongBench和ZeroSCROLLS,以评估方法在更广泛场景下的效果。
  其中,LongBench覆盖单文档问答、多文档问答、文本摘要、少样本学习等任务,包含英文数据集。ZeroSCROLLS则包括文本摘要、问答理解、情感分析等典型语言理解任务。
  在这些数据集上,研究人员比较了LongLLMLingua压缩后的提示与原始提示在大语言模型上的性能。同时,也与其他提示压缩方法进行了对比,如基于困惑度的LLMLingua和基于检索的方法,评估了LongLLMLingua的有效性。
  实验结果显示,LongLLMLingua压缩后的提示在问答准确率、生成文本质量等指标上普遍优于原始提示。
  例如,在NaturalQuestions上,压缩4倍的提示提升了17。1的问答准确率。当压缩约10ktokens的提示,压缩率在210倍范围内时,端到端延迟可以降低1。43。8倍。这充分证明LongLLMLingua可以在压缩提示的同时提升关键信息提取。
  (举报)
投诉 评论

StatterNetwork(STT链)历程回顾:一个元宇宙自2022年中Statternetwork受邀出席了在美国举办的全球矿业领域盛会MiningDisruptConference后,Statter作为矿业新秀、元宇宙的创新代表开……比特币矿商BitDigital涉足人工智能基础设施业务:以获站长之家(ChinaZ。com)10月24日消息:在当前比特币持续熊市影响矿工利润的背景下,比特数字(BitDigital)公司正迅速将业务扩展至人工智能(AI)基础设施领域,……区块链公司正在创建人工智能聊天机器人来帮助开发者站长之家(ChinaZ。com)10月24日消息:人工智能(AI)市场正成为世界上增长最快的产业之一。根据市场研究公司NextMoveStrategyConsulting的数据……“淘京抖”首次打响即时零售战,“最后三公里”冠军花落谁家?随着各个平台先后发布双十一打法,双十一大战的的号角已经吹响。“低价”成为这届双十一的关键词,京东喊出“真便宜”的口号,天猫首次把“全网最低价”定位核心KPI,抖音的低价模……双十一低价,哪个巨头吃透了?虽然抖快上周就已经开启预售,但京东和淘天在今明两天的加入才算正式燃起了双十一的烽火。在两大老牌电商的发力下,“低价”依旧是本次双十一的关键词:淘天将“全网最低价”定成了核……卖惨营销,穷途末路?爱“整活”的大学生们最近又躁动了起来。由四个男大学生组成的剧情账号小叮当的伙伴们前不久拍了这么一个短片:在电影《孤独一世》拍摄现场,某演员一直在用薯条蘸酱油吃,本来……ChatGPT能拯救程序员吗?在我二十多岁时,笑容常挂在我的脸上。最初我并未察觉,但和我熟悉的人都会注意到这一点,大多数情况下,这被视为一种正面的特质。然而,有次一位软件工程师用困惑和担忧的眼神问我:……国产大模型猛追ChatGPT:讯飞星火V3发布,明年冲击GP国产大模型正在猛追ChatGPT。继不久前百度最强大模型发布时宣称“不逊色GPT4”,如今讯飞迎头追赶,今天正式发布的讯飞星火认知大模型V3。0,对标的对手依然是Chat……最高20倍!压缩ChatGPT等模型文本提示,极大节省AI算在长文本场景中,ChatGPT等大语言模型经常面临更高算力成本、更长的延迟以及更差的性能。为了解决这三大难题,微软开源了LongLLMLingua。据悉,LongLLML……1800万粉李炮儿加入三只羊,疯狂小杨哥商业版图再扩张7月中旬,千万粉丝达人李炮儿,曾挑战到三只羊当一天老板,为后续的故事埋下伏笔。10月7日晚疯狂小杨哥在直播中表示,会在沈阳开一家三只羊分公司,李炮儿将出任沈阳三只羊公司的……大模型时代,输入法被带飞了现代人都离不开网络。《中国互联网络发展状况统计报告》统计,截至2023年6月,我国网民规模达10。79亿人。网民触网、和世界交流都离不开输入法,而输入法也伴随互联网……看视频可获现金奖励?美团又要出手了说起美团,大家总能联想到外卖、团购,自2011年App发布以来,美团成为众多用户心中的本地生活服务省钱利器。据最新可查数据,今年美团的第二季度收入达到了679。65亿元,同比增……
腾讯版“探探”上线,聊聊陌生人社交背后的需求在刀光剑影、竞争激烈的陌生人社交战场背后,它的产品需求究竟是什么、它又契合了哪些人性特点呢?近日,腾讯开始试足“陌生人社交”的领域,大家都纷纷期待,这个依靠微信、QQ两款……滴滴隐退450天的顺风车江湖:投机、洗牌与博弈顺风车霸主重返丛林,已不再是当年的江湖。整整450天,顺风车市场“变天”了。9月2日,嘀嗒出行在北京举办了一场盛大的发布会,CEO宋中杰表示,嘀嗒已经实现盈利。这是……2020年交互设计的9个趋势转眼到了2019年11月,大家有留意本年度有哪些新科技与新产品体验的出现,以及这些会对我们未来的设计有什么影响?这一年我持续关注国内外大厂商发布的一些新产品与未来技术的升……下沉市场中的那些人与生意互联网和投资圈都在说的下沉,你了解多少?下沉里面的他们是谁?渴望被关注或认同,是本性在工地辛苦搬砖的小李,在大排档中炒了一天菜的厨师小王,在辛苦播种收割的张大……产品经理基础:商业模式分析“工具箱”商业模式是产品的设计基础,本文作者从五个方面对商业模式分析进行了梳理分析,与大家分享。01概述一个新产品的诞生,产品经理会涉及四方面工作:商业模式分析,竞品分析,需……互联网零食:舌尖上的战争硝烟未散,互联网零食行业的战事,也是消费变迁和技术变革的真实映照。“一切就绪,等待战斗!”2019年11月8日,“双十一”前夕,三只松鼠创始人章燎原在朋友圈吹响号角。……互动视频:爱优腾们的互动技术解读2018年底,Netflix上映了互动影视《黑镜:潘达斯奈基》,此后国内掀起了“互动视频”的热潮。在过去的一年中,国内的互动视频领域动作频频。本文中笔者将着重介绍互动技术组件,……从起步到进阶,聊聊国内SaaS服务的发展本文梳理了国内SaaS的整个发展历程以及面对未来的一个发展方向。国内SaaS发展初期SaaS服务商为企业搭建信息化所需要的所有网络基础设施及软件、硬件运作平台,并负……被过度借贷“毁掉”的年轻人本文分析总结了过度借贷出现的原因以及规避过度借贷的几种方式。“为何现在的年轻人越来越习惯于借钱”?对这个问题,我们可以站在不同的视角给出不同的答案。从需求角度……十岁的B站仍在亏钱,激进变现是无奈之举B站正在抉择的当口,坚持内容,还是激进变现?两者的平衡还很难找到,B站的商业化之路将向何方?哔哩哔哩近日发布了该公司截至2019年9月30日的第三季度未经审计财报。……李佳琦、薇娅们火爆,电商的直播新周期开启李佳琦、薇娅火爆的背后其实是以直播和电商为结合点的全新发展时代的来临,在新零售方兴未艾的大背景下,这一现象无疑为我们开启了思考电商发展的全新逻辑。以直播为蓝本,我们可以重……李佳琦、薇娅们拯救直播行业“直播”的行业大趋势下,直播与电商的结合正在为两个行业带来生机。转化率高、能提升用户购物体验、激发用户购物需求的诸多优势中,电商直播不断在用真实的数据展现着它自身强大的生命力,……
友情链接:中准网聚热点快百科快传网快生活快软网快好知文好找作文动态热点娱乐育儿情感教程科技体育养生教案探索美文旅游财经日志励志范文论文时尚保健游戏护肤业界