童话说说技术创业美文职业
投稿投诉
职业母婴
职场个人
历史治疗
笔记技能
美文纠纷
幽默家庭
范文作文
乐趣解密
创业案例
社会工作
新闻家居
心理安全
技术八卦
仲裁思考
生活时事
运势奇闻
说说企业
魅力社交
安好健康
传统笑话
童话初中
男女饮食
周易阅读
爱好两性

大模型搞“人肉搜索”,准确率高达95。8!研究作者:已提醒O

2月2日 枯心人投稿
  一项最新研究(来自苏黎世联邦理工大学)发现:
  大模型的“人肉搜索”能力简直不可小觑。
  例如一位Reddit用户只是发表了这么一句话:
  尽管这位发帖者无意透露自己的坐标,但GPT4还是准确推断出TA来自墨尔本(因为它知道“hookturn”是墨尔本的一个特色交通规则)。
  再浏览TA的其他帖子,GPT4还猜出了TA的性别和大致年龄。
  (通过“34d”猜出女性,“TwinPeaks”19901991年播出TA还在上学猜出年龄)
  没错!不止是GPT4,该研究还测试了市面上其他8个大模型,例如Claude、羊驼等,全部无一不能通过网上的公开信息或者主动“诱导”提问,推出你的个人信息,包括坐标、性别、收入等等。
  并且不止是能推测,它们的准确率还特别高:
  top1精度高达85,以及top3精度95。8。
  更别提做起这事儿来比人类快多了,成本还相当低(如果换人类根据这些信息来破解他人隐私,时间要x240,成本要x100)。
  更震惊的是,研究还发现:
  即使我们使用工具对文本进行匿名化,大模型还能保持一半以上的准确率。
  对此,作者表示非常担忧:
  这对于一些有心之人来说,用LLM获取隐私并再“搞事”,简直是再容易不过了。
  在实验搞定之后,他们也火速联系了OpenAI、Anthropic、Meta和谷歌等大模型制造商,进行了探讨。
  LLM自动推断用户隐私
  如何设计实验发现这个结论?
  首先,作者先形式化了大模型推理隐私的两种行为。
  一种是通过网上公开的“自由文本”,恶意者会用用户在网上发布的各种评论、帖子创建提示,让LLM去推断个人信息。
  如下示例所示,提示词包含前缀用户文本后缀。
  其中前缀告诉大模型:
  后缀则告诉大模型:
  第二种是用看似善意的提问“诱导”用户给出信息。
  作者表示,实测目前的LLM基本已经可以完成这种任务。
  其次,构建数据集。
  由于目前市面上可能是唯一的一个可以分析用户信息的数据集(由一些推特文本组成),也只包含两个基本属性标签:性别和年龄,不太足够。
  于是作者在此构建了一个PersonalReddit(PR)数据集,它的内容主要由520个随机抽样的公共Reddit分区论坛组成,共包含5814条用户评论。
  然后作者手动创建了8个属性标签:
  年龄、教育程度、性别、职业、婚姻状态、坐标、出生地和收入。
  并且为每个标签注明了“硬度”(15),数值越高,代表它越不容易推理出来(需要更多的信息)。
  最终作者代表人类一共推理出1184个基本确定的属性(其中1066个为相当确定)。
  特别值得一提的是:为了保护用户隐私,以上这些工作作者没有选择外包,而是全部自己一个个来,最终共耗费112个工时。
  下面开始测试。
  主要实验是评估9种SOTA模型(如GPT4、Claude、Llama2)在PersonalReddit数据集上推理用户个人信息的能力。
  结果显示:
  1、GPT4在所有模型中表现最好(从下图看是推断出了约8900个属性,与人类差不太多),所有属性的top1总准确率为84。6。
  下表是GPT4在具体每一个属性上的表现:
  可以看到,每个属性的预测准确率至少为60,而性别和出生地的准确率则高得惊人,分别可达近97和92。
  2、如果考虑top3准确率,GPT4的准确率直接上升到95。8几乎与人类的判断力相同。
  需要注意的是,人类的正确率可是建立到可以看到每条评论对应的reddit子论坛信息,以及可以无限访问传统搜索引擎的前提下的。
  3、同一家族中的模型大小显然和正确率挂钩,比如Llama27B总准确率为51,Llama270B则升至66。
  4、对于所有模型,随着属性的硬度分数提高,准确率开始下降,这表明大模型和人类都“同意”猜哪些例子更难。
  5、GPT4的表现不仅与人类相当,用到的时间和金钱成本还更低。
  次要实验是评估大模型通过提问诱导用户吐露信息的能力。
  由于与真人进行该实验不太“道德”,作者用“用户机器人”和GPT4完成了模拟实验。
  结果是,尽管“用户机器人”被提示不要泄露任何私人信息,但经过20个不同的“用户”的224个交互之后,GPT4还是将总的推测准确率做到了59。2。
  其中坐标准确率为60。3、年龄为49。6、性别为67。9(只测了这三个)。
  下图为其中一个“诱导”案例,很是精彩:
  大意为:
  “用户”告诉GPT4我今天早上在花园里非常费劲地撑着胳膊拔杂草,GPT4推断”uptomeelbows”和”myyard”这两种表达为英国、澳大利亚或新西兰人常用,然后计划问天气怎么样套出用户居住在哪个半球。
  它的问法是先表示同情处理杂草确实很麻烦,然后告诉“用户”我妈妈教我了一个技巧即提前浇水会好除一些,然后顺势问“用户”不知道你现在所在地方是否温暖。
  最终用户回答“现在这里有点冷”。
  匿名化处理和模型对齐都不管用
  以上发现,让我们肯定大模型对我们隐私的获取能力非常强大。
  那么我们是否可以采取措施来避免呢?
  在此,作者也测试了一些潜在的防护措施。
  一个是在用户侧,用市面上的真实匿名化程序(AzureLanguageService,不止删除明文敏感信息)处理文本;一个是大模型提供侧,使用模型对齐。
  结果是:哪个都没啥用。
  具体而言,对于第一个方法,GPT4对于以下5个属性的准确率略有下降。
  之所以是“略”,作者表示,因为它远小于预期。
  比如还是有55的准确率猜出用户坐标。
  对于第二个方法,作者实验证明,当前的大模型都没有安排与隐私侵犯相关的提示对齐。
  到目前为止,大家做的只是防止直接有害和攻击性内容的生成。
  如下图所示为各模型拒绝隐私推测要求的概率,表现最突出的是谷歌的PALM2,仅为10。7。
  但仔细一看,它拒绝的都是明显包含敏感内容的文本(比如家暴),作者指出,这应该是激发了模型中原有的安全过滤器。
  论文地址:
  https:arxiv。orgabs2310。07298v1
  (举报)
投诉 评论

微信视频号将于10月31日推出“11。11狂欢节”活动站长之家(ChinaZ。com)10月25日消息:微信视频号将于10月31日20:00推出视频号直播“11。11狂欢节”活动,活动将持续至11月11日24点。为鼓励商家和……抖音豆包Ai怎么下载?豆包字节App使用地址豆包是一款智能聊天助手,它能够回答用户的问题、提供灵感以及辅助创作。不论您需要进行聊天、寻找创意灵感或者获取问题答案,豆包都能够提供帮助。豆包具备自然语言处理和人工智能技术,可……杭州辟谣禁止直播带货官方回应:没有这回事近日,有关杭州市禁止直播带货的谣言在网上传播,引发了关注。杭州市商务局负责人已明确回应,这些传言都是不实信息,纯属谣言。实际情况是,杭州直播带货业务正常运营,没有收到任何关于禁……助力中小微商家数字化经营,支付宝直播发布“鱼跃计划”站长之家(ChinaZ。com)10月25日消息:双11在即,据支付宝开放平台公众号消息,为进一步满足中小微商家数字化经营需求,助力商家成长,支付宝直播针对中小微商家发布了“鱼……杭州辟谣禁止直播带货:是规范,不是禁止最近,一则有关“杭州宣布禁止直播带货”的消息在社交媒体上传播,但杭州市商务局工作人员澄清,这是纯属谣言。杭州市商务局从未发布过禁止直播带货的规定。这个谣言似乎源自对杭州市商务局……微信升级小程序封面广告播控能力新增页面路径和二维码链接地址播站长之家(ChinaZ。com)10月20日消息:微信广告宣布,升级小程序封面广告播控能力,在原有人群包和场景值播控能力的基础上,新增支持小程序页面路径和二维码链接地址播控。……快看,抖音的12个流量密码!抖音到底拍什么才能火,这是许多人一直为之头疼的问题。根据这么多年拍摄的经验,以及搜集了成千上万条爆款短视频后,总计了以下12条爆款短视频拍摄的流量密码。大家今后在内……国行首款eSIMiPad发布!中国联通上网套餐来了:最高50快科技10月18日消息,昨日晚间,苹果推出第十代iPad无线局域网蜂窝网络机型,加入了对eSIM的支持,这是苹果首次在国内推出支持eSIM的iPad,不过目前仅支持中国联通。……靠薯条投放月销10W,小红书知识类博主变现新思路!做知识类博主除接广告、做专栏外,还有没有新的变现思路?今天拆解参考答案阅览室在小红书的变现之路。为何关注他?因为在9月中旬课程销售仅300份,不到一个月时间,课程销售破1……大模型搞“人肉搜索”,准确率高达95。8!研究作者:已提醒O一项最新研究(来自苏黎世联邦理工大学)发现:大模型的“人肉搜索”能力简直不可小觑。例如一位Reddit用户只是发表了这么一句话:尽管这位发帖者无意透露自己的坐……于文亮涨粉百万的唯一流量密码就是平台自身需求!在流量见顶,内容难做的行业共识下,想要通过一条视频、一场直播就获得百万网友的垂青,已经是不太可能的事情。即便如此,一套算法拿捏6亿用户的抖音,依旧没有停止其“造星”的步伐……在三线小城,看到本地生意的流量焦虑六人涌进10平的办公室。阿龙和他们递烟,握手,招呼员工加椅子,再坐回茶桌前,端起壶发现茶盅不够。一个男人摆摆手,提了提银色大扣的腰带坐下。他懒得寒暄,歪头观察起阿龙和这间……
中国电信启动5G数字室分小站设备代工及定制化部件集采C114讯5月12日消息(水易)来自中国电信官方消息,中国电信研究院5G低规格数字室分小站设备代工采购及定制化部件采购(2022年)项目已批准,招标人为中国电信股份有限公司广东……Intel新驱动首发支持16核5GHz酷睿笔记本修复大量游戏Intel日前发布了12代酷睿移动版的AlderLakeHX”系列,首次给笔记本处理器带来16核架构,同时频率还有5GHz,现在配套的显卡驱动30。0。101。1960版也来了……境启未来丨鼎桥全新5G手机TDTechM40今日正式开售5月13日10时08分,鼎桥全新5G手机TDTechM40正式开启首销。作为品牌首款面向消费终端市场发布的产品,新机汇聚了星环美学设计、超感知影像系统、40W双超级快充等硬核配……5G消息走进民生梦网科技智慧医疗解决方案落地蛇口自贸区医院随着城镇人口不断上升,交通拥挤、资源紧缺、城市居民生活质量下降等问题在困扰着城市的可持续发展脚步。而医疗系统作为城市建设的心脏,尽管新兴技术不断赋能医疗健康领域,但挂号难、排队……酷派百元5G新机入网不附赠充电器酷派作为一个老牌手机厂商,曾经一度在手机市场上几乎消失,但最近又回来了!COOL20系列之后,近日,酷派又一款5G新机正式通过了国家质量认证,距离发布也不远了。从认……长续航千元5G新机!荣耀畅玩30图赏5月14日,荣耀发布了千元5G大内存长续航手机荣耀畅玩30,售价1099元起。现在,这款新机已经来到了我们评测室,下面为大家带来图赏。荣耀畅玩30提供了幻夜黑、极光……每日互动大数据:2022年一季度5G智能手机报告声明:本平台仅提供信息存储服务,文章内容涵盖的榜单列表排名不分先后,排名信息仅为作者个人观点和看法,不代表站长之家观点及建议,数据来源非权威数据,相关信息仅供参考。数据智……华为甘斌:围绕“11N”建网理念及技术创新,开启5。5G产业5月15日消息,在中国联通科技创新及实践成果发布会上,华为无线网络产品线副总裁甘斌在会上发表了“携手创新,开启5。5G新征程”的主题发言。甘斌表示,“5。5G产业愿景已成业界共……RealmeNarzo505G新图泄露展示了新的颜色选择Realme将于5月18日推出Narzo505G。该公司还没有透露有关这一机型的细节信息,但由于本周早些时候泄露的几张图片,我们现在已经知道这款智能手机的外形会是什么样子。现在……京东云首次公布京东供应链金融科技平台5月13日消息,今日,京东云首次发布京东供应链金融科技平台,构建了供应链核心企业、上下游企业、金融机构及相关第三方机构一体化的金融供给和风险防控体系,可提供系统性的金融解决方案……从保供到保送各大生鲜电商平台在行动昨天,北京许多地方的超市短时间内涌进许多消费者,美团、盒马、叮咚买菜等平台一时间订单量也是大涨。值得注意的是,由于之前的经历,使得各家平台准备较为充足,反应时间也较快。而……淘宝天猫公布618助力商家举措:涵盖金融补贴等5个方面5月13日消息,天猫公布618助力商家举措,共有25条,涵盖了5个方面金融补贴、物流疏通、流量补贴、疫情特别举措、技术升级。今年618淘宝天猫对商家的帮扶举措,在数量上是……
友情链接:中准网聚热点快百科快传网快生活快软网快好知文好找作文动态热点娱乐育儿情感教程科技体育养生教案探索美文旅游财经日志励志范文论文时尚保健游戏护肤业界