范文健康探索娱乐情感热点
投稿投诉
热点动态
科技财经
情感日志
励志美文
娱乐时尚
游戏搞笑
探索旅游
历史星座
健康养生
美丽育儿
范文作文
教案论文
国学影视

深度学习GPU的选择

  在进行机器学习项目时,特别是在处理深度学习和神经网络时,最好使用GPU而不是CPU来处理,因为在神经网络方面,即使是一个非常基本的GPU也会胜过CPU。
  但是你应该买哪种GPU呢?本文将总结需要考虑的相关因素,以便可以根据预算和特定的建模要求做出明智的选择。为什么 GPU 比 CPU 更适合机器学习?
  CPU(中央处理器)是计算机的主力,它非常灵活,不仅需要处理来自各种程序和硬件的指令,并且处理速度也有一定的要求。 为了在这种多任务环境中表现出色,CPU 具有少量且灵活快速的处理单元(也称为核)。
  GPU(图形处理单元)GPU在多任务处理方面不那么灵活。 但它可以并行执行大量复杂的数学计算。 这是通过拥有更多数量的简单核心(数千个到上万)来实现的,这样可以同时处理许多简单的计算。
  并行执行多个计算的要求非常适合于:图形渲染——移动的图形对象需要不断地计算它们的轨迹,这需要大量不断重复的并行数学计算。机器和深度学习——大量的矩阵/张量计算,GPU可以并行处理。任何类型的数学计算,可以拆分为并行运行。
  在Nvidia自己的博客上已经总结了CPU和GPU的主要区别:
  张量处理单元(TPU)
  随着人工智能和机器/深度学习的发展,现在已经有了更专门的处理核心,称为张量核(Tensor cores)。在执行张量/矩阵计算时,它们更快更有效。因为我们在机器/深度学习中所处理的数据类型就是张量。
  虽然有专用的tpu,但一些最新的GPU也包括许多张量核,我们会在后面总结。Nvidia vs AMD
  这将是一个相当短的部分,因为这个问题的答案肯定是Nvidia
  虽然可以使用AMD的gpu进行机器/深度学习,但在写本文时,Nvidia的GPU具有更高的兼容性,并且通常更好地集成到TensorFlow和PyTorch等工具中(比如目前PyTorch的AMD GPU的支持还只能在Linux上使用)。
  使用AMD GPU需要使用额外的工具(ROCm),这个会有一些额外的工作,并且版本可能也不会更新的很快。这种情况将来可能会有所改善,但是现在为止,最好还是使用Nvidia。GPU选择的主要属性
  选择一个够完成机器学习任务并且符合预算的GPU,基本上归结为四个主要因素的平衡:GPU有多少内存?GPU有多少个CUDA和/或张量核?卡使用什么芯片架构?功耗要求是多少(如果有)?
  下面将逐一探讨这些方面,希望能让你更好地理解什么对你来说是重要的。GPU内存
  答案是,越多越好!
  这实际上取决于你的任务,以及这些模型有多大。例如,如果你正在处理图像、视频或音频,那么根据定义,你将处理相当大量的数据,GPU RAM将是一个非常重要的考虑因素。
  总有办法解决内存不足的问题(例如减少批处理大小)。但是这将会浪费训练的时间,因此需要很好地平衡需求。
  根据经验,我的建议如下:
  4GB:我认为这是绝对的最小值,只要你不是在处理过于复杂的模型,或者大的图像、视频或音频,这个在大多数情况下能工作,但是达不到日常使用的需要。如果你刚刚起步,想尝试一下又不想全力投入,那么可以从它开始
  8GB:这是一个日常学习很好的开始,可以在不超过RAM限制的情况下完成大多数任务,但在使用更复杂的图像、视频或音频模型时会遇到问题。
  12GB:我认为这是科研最基本的的要求。可以处理大多数较大的模型,甚至是那些处理图像、视频或音频的模型。
  12GB+ :越多越好,你将能够处理更大的数据集和更大的批处理大小。超过12GB才是价格真正开始上涨的开始。
  一般来说,如果成本相同的话,选择"速度较慢"但内存较大的卡会更好。请记住,GPU的优势是高吞吐量,这在很大程度上依赖于可用的RAM来通过GPU传输数据。CUDA核心和Tensor 核心
  这其实很简单,越多越好。
  首先考虑RAM,然后就是CUDA。对于机器/深度学习来说,Tensor 核比CUDA核更好(更快,更有效)。这是因为它们是为机器/深度学习领域所需的计算而精确设计的。
  但是这并不重要,因为CUDA内核已经足够快了。如果你能得到一张包含Tensor 核的卡,这是一个很好的加分点,只是不要太纠结于它。
  后面你会看到"CUDA"被提到很多次,我们先总结一下它:
  CUDA核心——这些是显卡上的物理处理器,通常有数千个,4090已经1万6了。
  CUDA 11 -数字可能会改变,但这是指安装的软件/驱动程序,以允许显卡正常的工作。NV会定期发布新版本,它可以像任何其他软件一样安装和更新。
  CUDA代数(或计算能力)-这描述了显卡卡在它的更新迭代的代号。这在硬件上是固定的,因此只能通过升级到新卡来改变。它由数字和一个代号来区分。例子:3。x[Kepler],5。x [Maxwell], 6。x [Pascal], 7。x[Turing]和8。x(Ampere)。芯片架构
  这实际上比你想象的更重要。我们这里不讨论AMD,我的眼里只有"老黄"。
  上面我们已经说了,30系列的卡就是Ampere架构,最新的40系列是 Ada Lovelace。一般老黄都会使用一个著名科学家和数学家来对架构命名,这次选择的是著名英国诗人拜伦之女,建立了循环和子程序概念的女数学家、计算机程序创始人Ada Lovelace来命名。
  了解对于卡的计算能力,我们要了解2个方面:
  显着的功能改进
  这里一个重要的功能就是, 混合精度训练:
  使用精度低于 32 位浮点数的数字格式有很多好处。 首先它们需要更少的内存,从而能够训练和部署更大的神经网络。 其次它们需要更少的内存带宽,从而加快数据传输操作。 第三数学运算在精度降低的情况下运行得更快,尤其是在具有 Tensor Core 的 GPU 上。 混合精度训练实现了所有这些好处,同时确保与完全精度训练相比不会丢失特定于任务的准确性。 它通过识别需要完全精度的步骤并仅对这些步骤使用 32 位浮点而在其他任何地方使用 16 位浮点来实现这一点。
  这里是Nvidia 官方文档,有兴趣的可以看看:
  https://docs.nvidia.com/deeplearning/performance/mixed-precision-training/index.html
  如果您的 GPU 具有 7.x (Turing) 或更高的架构,才有可能使用混合精确训练。 也就是说 桌面的RTX 20 系列或高版本,或服务器上的 "T"或"A"系列。
  混合精度训练具有如此优势的主要原因是它降低了 RAM 使用率,Tensor Core 的 GPU会加速混精度训练,如果没有的话使用FP16也会节省显存,可以训练更大的批大小,间接提升训练速度。
  是否会被弃用
  如果你对RAM有特别高的要求,但又没有足够的钱买高端卡,那么你可能会选择二手市场上的老款GPU。这有一个相当大的缺点……这张卡的寿命结束了。
  一个典型的例子就是Tesla K80,它有4992个CUDA核心和24GB的RAM。2014年,它零售价约为7000美元。现在的价格从 150到170美元不等!(咸鱼的价格600-700左右)这么小的价格却有这么大的内存,你一定很兴奋。
  但是这有一个非常大的问题。K80的计算架构是3.7 (Kepler),CUDA 11起已经不支持(当前CUDA版本为11.7)。这意味着这张卡已经废了,所以它才卖的这么便宜。
  所以在选择2手卡时一定要看清楚是否支持最新版本的驱动和CUDA,这是最重要的。高端游戏卡 VS 工作站/服务器卡
  老黄基本上把卡分成了两部分。消费类显卡和工作站/服务器的显卡(即专业显卡)。
  这两个部分之间有明显的区别,对于相同的规格(RAM, CUDA内核,架构),消费类显卡通常会更便宜。但是专业卡通常会有更好的质量,和较低的能源消耗(其实涡轮的噪音挺大的,放机房还可以,放家里或者试验室有点吵)。
  高端(非常昂贵)的专业卡,你可能会注意到它们有很大的RAM(例如RTX A6000有48GB, A100有80GB!)。这是因为它们通常直接针对3D建模、渲染和机器/深度学习专业市场,这些市场需要高水平的RAM。再说一次,如果你有钱,买A100就对了!(H100是A100的新版,目前无法评价)
  但是我个人认为,我们还是选择消费者的高端游戏卡,因为如果你不差钱,你也不会看这篇文章,对吧选择建议
  所以在最后我根据预算和需求提出一些建议。我将其分为三个部分:低预算中等预算高预算
  高预算不考虑任何超出高端消费显卡。还是那句话如果你有钱:A100,H100随便买。
  本文中会包含在二手市场买到的卡片。这主要是因为我认为在低预算的情况下,二手是可以考虑的。这里还包括了专业桌面系列卡(T600、A2000和A4000),因为它的一些配置比同类消费类显卡稍差,但功耗明显更好。
  低预算
  中等预算
  高预算
  在线/云服务
  如果你决定花钱买显卡不适合你,你可以利用谷歌Colab,它可以让你免费使用GPU。
  但这是有时间限制的,如果你使用GPU太长时间,他们会把你踢出去,然后回到CPU上。如果GPU处于非活动状态太长时间,可能是在你写代码的时候,它也会把GPU拿回来。GPU也是自动分配的,所以你不能选择你想要的确切的GPU(你也可以每月9.9刀弄个Colab Pro,我个人觉得要比低预算好很多,但是要求有梯子,$49.99的Colab Pro+有点贵,不建议)。
  在写本文时,通过Colab可以获得以下GPU:
  在前面也提到了,K80有24GB的RAM和4992个CUDA核心,它基本上是两个K40卡连在一起。这意味着当你在Colab中使用K80时,你实际上可以访问一半的卡,所以也就是只有12GB和2496个CUDA内核。总结
  最后现在4090还是处于耍猴的状态,基本上要抢购或者加价找黄牛
  但是16384 CUDA + 24GB,对比3090 的10496 CUDA ,真的很香。
  而4080 16G的9728CUDA 如果价格能到7000内,应该是一个性价比很高的选择。12G的 4080就别考虑了,它配不上这个名字。
  对于AMD的 7900XTX 应该也是一个很好的选择,但是兼容性是个大问题,如果有人测试的话可以留言。
  40系列老黄一直在耍猴,所以如果不着急的话还再等等把:
  你不买,我不买,明天还能降两百

梦天舱即将发射,天宫再添一厅,完成空间筑家进入倒计时1971年4月19日,世界上第一个空间站苏联礼炮1号进入太空,从那时起人类在太空中便有了可以栖身的住所。空间站从诞生之初到如今已经有超过50年的发展历史。(礼炮1号)图源自于中国载美团即时零售,跨出重要一步本地供给,美团即时零售的下一站苏宁易购入驻美团,相比张近东的迫切,王兴应该是兴奋居多。日前,美团宣布与苏宁易购达成战略合作关系,苏宁易购正式入驻美团外卖。截至目前,苏宁易购超600微信小程序wx。getLocation审核不通过的解决方法写这篇文字的同时,博主已经被小程序接口审核拒了12次了,几乎每次都是1你好,你的小程序xxxxxx申请的wx。getLocation接口因你提供的申请原因辅助图片网页视频内容无法确JDK中自带的JVM分析工具一业务背景对于分布式架构中的文件服务来说,由于涉及大量的IO流操作,很容易引发JVM的相关异常,尤其是内存溢出的问题在最近的一次版本迭代中,真实的业务处理场景和上述几乎一致,由于在知根知底好过于天真地信任,柔软周全胜过于冷面树敌厚重的乌云,挡去了明亮的光线,看透太伤,看清便好。人际交往,知根知底好过于天真地信任,柔软周全胜过于冷面树敌。面对友情世界里的离别和远去,要专心做自己想做的事,给自己创造一个充满能晚上回家三不做,家庭越过越红火,是哪三不做?我们每个人都希望自己有一个温馨幸福的家庭,家可以是给予我们力量和动力的地方。我们只有保护好自己的家庭,让自己的家庭幸福和谐,我们的幸福感才会更加强烈,我们吹有更多的激情,追求幸福美oppo自研芯片3年,钱还没烧完?哲库毛毛雨啦最近听大厂的朋友谈到,oppo旗下哲库招人很猛。薪水高,人数多。如今各方都判断半导体寒冬即将到来的当下实属难得。对于今年的毕业生来说,也算是一种幸运。即便没有拿到oppo(哲库)的新血压标准已公布,不再是12080,你的血压可能处于正常范围内导语我国是真正意义上的高血压大国,光是高血压新发人数就已经超过了3。5亿。高血压作为常见的代谢类疾病,并发症才是其真正凶悍的一面,例如冠心病,脑梗,心梗等严重疾病,或多或少都会和高光子芯片是什么技术?它的集成度又如何?中国在经历美国誓不罢休的芯片制裁打压下,近日来,中科鑫通微电子技术有限公司官宣首条国产光子芯片产线2023年在北京建成,这一消息霸屏这两天的朋友圈。大规模光子集成芯片于2016年由今天10月25日国内油价调整!加油站油价上调后92号95号汽油价格今日国内油价调整信息今天油价涨了!有料财经提醒车主司机根据发改委最新的油价调整通知,全国各地加油站从今天10月25日0时起调整国内成品油价格,具体油价调整方案为每吨柴油汽油价格分别我也不勉强你黄叶飘落秋色美,小区附近风景佳。独自散步不热闹,游人早就各回家。我也不勉强你,是走是留,全凭你自己的意思。在我看来,天下乌鸦一般黑,无论你到哪里找工作赚钱,都要受到老板的制约。你不腾讯突然宣布关闭这项业务,阿里巴巴和百度还能做什么?腾讯地图官网近日宣布,电脑端的腾讯地图将于11月11日停止服务,用户可以下载腾讯地图App。今年5月,搜狗地图也暂停了电脑端的服务,如今仅剩百度地图一家仍旧提供电脑端服务。这一变化长三角铁路新增6个火车站开办互联网订餐业务宁波站12306网络订餐配送员与乘务员在站台交接餐食。徐克兢摄中新网合肥10月25日电(吴兰许文峰)10月25日起,包括安徽芜湖六安在内的长三角铁路6个火车站开办互联网订餐和特产预今年双11京东再升级价保服务,用户领取优惠券也可支持价保封面新闻记者付文超10月24日,京东对外宣布,今年双十一价保服务再升级参与京东11。11的实物类商品几乎全部支持价保服务,更有超5亿种商品支持30天超长价保,且用户领取优惠券也可支颜值时代,健合集团开创内化口服美容新高度王母娘娘的蟠桃太上老君的仙丹五壮观里的人参果西游记中这些关于长生不老延年益寿的桥段,在某种程度上影射了人类对口服美容的追求古已有之,且无止境,而口服美容不只是活在神话故事里。健合集web3。0比特币区块链元宇宙,以及那些待收割的韭菜们前几天看到周星驰在社交账号上招聘web3。0的人才,感觉有必要说说web3。0,当然不是基于技术层面,而是从另一个维度说说web3。0以及其它相关的概念,从而做到如何反欺诈,如何避胃不好难长寿!提醒喝再多小米粥,不如做好这4件事更养胃相信有很多人在生活中都经常喝小米粥,认为小米粥是个对胃很好的食物,但是对于其中的原理却不是很了解。还有人说,小米粥根本养不了胃,这到底是怎么一回事呢?跟随小编一起来具体的了解下。每区块链被纳入监管将开启下一个牛市?2022年即将过去,人们不禁对2023年的区块链行业充满了期待。2022年是熊市,但和2018年的情况完全不同。18年,1CO的证伪,让所有的散户和业内人士都一头雾水,不知道该怎么俞敏洪我为什么宁愿给马云柳传志端茶送水我在头条搞创作第二期凤凰来栖,先得修成梧桐百川来聚,先得胸怀大海。作者洞见Leyla在网上看到俞敏洪早年的一则演讲。他说自己每回和马云柳传志在一起的时候,都会自动把自己下降成为他们湖北恩施拟支持国企团购房,优惠价格不计入备案价格跌幅比例范围大河财立方消息10月25日消息,湖北省恩施州住建局日前发布关于推动房地产业平稳健康发展的若干措施(征求意见稿)(以下简称征求意见稿),其中提到,鼓励多样化房屋征收安置,支持国有企业荣耀80系列的新提示已经到来据称属于荣耀80ProPlus的功能不久前浮出水面。著名的轰动数字聊天站的最新帖子提供了对该系列其他两个成员的洞察。标准版荣耀80的核心是联发科的天玑1080处理器。据说这款手机的击败西部第一!火箭三星狂轰72229,探花秀这场算是扬眉吐气了火箭常规赛第四场面对的对手是排名西部第一的爵士,常规赛前3场比赛爵士取得了3胜0负的战绩,这是很多人都没有想到的,送走了双星米切尔跟戈贝尔还能有这么强的战力,但其实看看他们的大名单
眼周年轻化外切祛眼袋,42岁,术前,术后即刻,术后1个月对比我终于做了眼周年轻化手术外切祛眼袋,今年42岁,来看看我术前,术后即刻,术后1个月对比。眼周年轻化外切祛眼袋术前术前因为有非常明显的眼袋脂肪膨出,就像是二个小口袋一样挂在眼睛下面,韩女星又去时装周抢镜了,全穿黑!张元英美到失真,朴彩英好妩媚hi大家好2023春夏的四大时装周又开始了,因为疫情原因,没有了我朝的大明星天团出战,韩国女星顺势拿下各大品牌的入场券,米兰到巴黎,风风火火的从机场出发到秀场造型,刷足了存在感。类一天两场签约!总投资305。6亿元项目落户成都经开区奋战四季度冲刺一百天,全力以赴拼经济抓项目稳增长,成都经开区(龙泉驿区)在行动。为深入贯彻落实省市区党代会精神,今日,成都经开区(龙泉驿区)连续举办签约活动2场,签约新项目7个,总贵州银保监局关于保险销售和退保的风险提示近期,在保险销售和服务过程中,有消费者反映保险销售误导以及相关退保损失等问题。为维护消费者合法权益,贵州银保监局提示广大保险消费者一购买保险要理性,投保不盲目。市场上商业保险产品种民航数据洞察暑运结束,8月航班量环比降5。77旅游航线昆明德宏跻身TOP10每经记者王帆杨煜每经编辑梁枭国庆假期临近,航班和机票先行。据飞常准民航看板数据,目前国内日均客运航班量已从5000班次以下开始逐步回升,日均执行航班量超7000班次,预计国庆假期(成都世乒赛分组抽签揭晓来源人民网原创稿人民网北京9月28日电(记者李乃妍)北京时间今天,2022年成都世乒赛在其举办地成都举行了分组抽签仪式。出席本次抽签仪式的国乒代表为梁靖崑陈幸同。经过抽签,国乒女队景洪市公安局交通警察大队2022年国庆节交通安全两公布一提示国庆节2022年国庆节即将到来,为确保节日期间道路交通秩序良好,杜绝重大道路交通事故发生,景洪交警结合辖区道路通行情况,发布两公布一提示,请广大交通参与者合理选择出行时间出行线路出(外代二线)巴黎时装周AcneStudios品牌时装秀(外代二线)巴黎时装周AcneStudios品牌时装秀9月28日,模特在法国巴黎时装周上展示AcneStudios品牌的2023春夏新款服装。新华社欧新9月28日,模特在法国巴黎时236万元!宝马M品牌首款混动电驱车型开启预售加速布局新能源每经记者裴健如每经编辑孙磊9月28日,每日经济新闻记者获悉,宝马集团旗下XM车型迎来全球首发,并同步开启中国市场预售,预售价格为236万元。据悉,宝马XM由宝马M部门独立研发,搭载首款网格结构纳米电子皮肤面世首款网格结构纳米电子皮肤面世超薄透气可长时间测量和处理生物信号科技日报北京9月28日电(记者刘霞)韩国大邱庆北科学技术院(DGIST)研究团队成功开发出了世界上第一个纳米结构电子皮打水光后皮肤凹陷怎么办?最近有见群里讨论,水光针打完了凹陷是怎么回事,该怎么处理?有规律的坑坑洼洼,挺惨的我用东厂思维来破解一下01为什么会出现凹陷?正常水光针,应该是给皮肤补营养的,打完后皮肤应该会更饱电视买大屏幕的好还是小屏幕的好?个人觉得电视剧买大屏幕的比较好。当今飞速发展的社会,人民生活水平不断提高,收入也逐步提升,电视剧这一重要家具也进入了很多人的家中,但是在购买电视机的时候人们就会有这样的思虑,买屏幕资讯无人驾驶新进展萝卜快跑将在上海开展全无人测试文懂车帝原创常思玥懂车帝原创行业近日,上海嘉定区无人之境自动驾驶示范体验区近日正式启用,自动驾驶出行服务平台萝卜快跑将于该区内启动自动驾驶全无人测试。ApolloMoon极狐版自动白塔寺,是时候让我们重新认识它宁静的胡同,庄严的白塔空灵的鸽哨在风中划过这儿,有着对于老北京最美好的记忆白塔寺,其实大名叫妙应寺最初元朝修建的时候叫万安寺到明朝重修改名妙应寺至今周边的街道胡同公交站店铺都依白塔国庆七天乐,天天乐不停!快来红谷滩解锁十一假期新玩法!国庆假期大幕即将开启节日的氛围感已经拉满节庆的活动更是精彩绝伦影像展灯光秀童趣馆啤酒露营烧烤美食露天电影音乐喷泉欢迎来到国庆7天乐红谷滩文旅传送门!01hr国家地理经典影像大展全新快讯文旅融合发展展现新路径,今年推出文旅活动1500余项大小新闻客户端9月29日讯(YMG全媒体记者王鸿云摄影报道)今天上午,市政府新闻办召开以十大创新引领改革突破系列新闻发布会第三场。今年以来,我市文旅融合发展展现新路径。通过仙境烟台重要提醒!事关国庆出行国庆假期即将来临文旅部发布提醒自驾游客每到一地主动核酸文化和旅游部提醒广大游客做好个人防护,平安健康出游一合理安排行程。通过权威渠道了解出发地及目的地最新疫情防控政策,自觉遵守当地国庆爬泰山注意提前预约购票,核酸检测结果别超过3天齐鲁网闪电新闻9月29日讯9月29日上午,泰安市政府新闻办召开新闻发布会,介绍发布国庆假日期间泰山景区旅游管理服务的相关工作情况并回答记者提问。假日期间,泰山景区全面落实限量预约错张家港!红了!国庆将至张家港满城飘红随着国庆的脚步越来越近张家港街头的节日气氛也越来越浓放眼望去一面面鲜艳的五星红旗迎风飘扬一抹抹中国红鲜艳夺目漂亮的国庆主题景观创意满满处处点缀着中国红涌动着爱辰山植物园打造兰花世界国庆将是最佳观赏期图说兰花世界将在辰山植物园展览温室启幕来源采访对象供图(下同)新民晚报讯(记者金旻矣)秋风送爽,奇兰馨香。10月1日起,一个全新的兰花世界将在辰山植物园展览温室启幕,200余种(含百达翡丽手表的自鸣声和三问报时功能百达翡丽Ref。6301P大自鸣在高级钟表的世界里,报时表可以说是最吸引人的。通常被描述为终极单一且复杂的一项功能,目前只有少数品牌能够自主生产它们。据估计,瑞士每年只生产几百只三天天洗头还容易油,可能是犯了4大错误现如今,不管是年轻人还是老年人,都有头顶大事,但除了脱发外,让成年人崩溃的还有头发爱出油问题有的人洗完头蓬松柔顺,三五天都不出油有的人则连护发素都不敢用,第二天头发就已经贴上头皮了