范文健康探索娱乐情感热点
投稿投诉
热点动态
科技财经
情感日志
励志美文
娱乐时尚
游戏搞笑
探索旅游
历史星座
健康养生
美丽育儿
范文作文
教案论文

华为深度解读达芬奇架构3DCube计算引擎加速运算

  IT之家8月22日消息 此前,华为正式推出了麒麟810芯片,这款芯片采用华为自研的达芬奇架构,其AI得分在苏黎世联邦理工学院推出的AI Benchmark榜单中位列前三。
  华为在文章中同时表示,8月23日,采用达芬奇架构的AI芯片Ascend910将正式商用发布,同时与之配套的新一代AI开源计算框架MindSpore也将同时亮相。
  针对达芬奇框架,华为中国今天发文进行深度科普。以下则是华为对达芬奇框架的科普内容。
  源起:为什么要做达芬奇架构?
  华为预测,到2025年全球的智能终端数量将会达到400亿台,智能助理的普及率将达到90%,企业数据的使用率将达到86%。可以预见,在不久的将来,AI将作为一项通用技术极大地提高生产力,改变每个组织和每个行业。为了实现AI在多平台多场景之间的协同,华为设计达芬奇计算架构,在不同体积和功耗条件下提供强劲的AI算力。
  初见:达芬奇架构的核心优势
  达芬奇架构,是华为自研的面向AI计算特征的全新计算架构,具备高算力、高能效、灵活可裁剪的特性,是实现万物智能的重要基础。具体来说,达芬奇架构采用3D Cube针对矩阵运算做加速,大幅提升单位功耗下的AI算力,每个AI Core可以在一个时钟周期内实现4096个MAC操作,相比传统的CPU和GPU实现数量级的提升。
  ▲3D Cube
  同时,为了提升AI计算的完备性和不同场景的计算效率,达芬奇架构还集成了向量、标量、硬件加速器等多种计算单元。同时支持多种精度计算,支撑训练和推理两种场景的数据精度要求,实现AI的全场景需求覆盖。
  深耕:达芬奇架构的AI硬实力
  科普1:常见的AI运算类型有哪些?
  在了解达芬奇架构的技术之前,我们先来弄清楚一下几种AI运算数据对象:
  标量(Scalar):由单独一个数组成
  向量(Vector):由一组一维有序数组成,每个数由一个索引(index)标识
  矩阵(Matrix):由一组二维有序数组成,每个数由两个索引(index)标识
  张量(Tensor):由一组n维有序数组成,每个数由n个索引(index)标识
  其中,AI计算的核心是矩阵乘法运算,计算时由左矩阵的一行和右矩阵的一列相乘,每个元素相乘之后的和输出到结果矩阵。在此计算过程中,标量(Scalar)、向量(Vector)、矩阵(Matrix)算力密度依次增加,对硬件的AI运算能力不断提出更高要求。
  典型的神经网络模型计算量都非常大,这其中99%的计算都需要用到矩阵乘,也就是说,如果提高矩阵乘的运算效率,就能最大程度上提升AI算力——这也是达芬奇架构设计的核心:以最小的计算代价增加矩阵乘的算力,实现更高的AI能效。
  科普2:各单元角色分工揭秘,Da Vinci Core是如何实现高效AI计算的?
  在2018年全联接大会上,华为推出AI芯片Ascend 310(昇腾310),这是达芬奇架构的首次亮相,Ascend 310相当于AI芯片中的NPU。
  其中,Da Vinci Core只是NPU的一个部分,Da Vinci Core内部还细分成很多单元,包括核心的3D Cube、Vector向量计算单元、Scalar标量计算单元等,它们各自负责不同的运算任务实现并行化计算模型,共同保障AI计算的高效处理。
  3D Cube矩阵乘法单元是AI计算的核心,这部分运算由3D Cube完成,Buffer L0A、L0B、L0C则用于存储输入矩阵和输出矩阵数据,负责向Cube计算单元输送数据和存放计算结果。
  虽然Cube的算力很强大,但只能完成矩阵乘运算,还有很多计算类型要依靠Vector向量计算单元来完成。Vector的指令相对来说非常丰富,可以覆盖各种基本的计算类型和许多定制的计算类型。
  Scalar标量运算单元主要负责AI Core的标量运算,功能上可以看作一个小CPU,完成整个程序的循环控制,分支判断,Cube、Vector等指令的地址和参数计算以及基本的算术运算等。
  科普3:3D Cube计算方式的独特优势是什么?
  不同于以往的标量、矢量运算模式,华为达芬奇架构以高性能3D Cube计算引擎为基础,针对矩阵运算进行加速,大幅提高单位面积下的AI算力,充分激发端侧AI的运算潜能。以两个N*N的矩阵A*B乘法为例:如果是N个1D的MAC,需要N2的cycle数;如果是1个N2的2D MAC阵列,需要N个Cycle;如果是1个N维3D的Cube,只需要1个Cycle。
  ▲图中计算单元的数量只是示意,实际可灵活设计
  达芬奇架构将大幅提升算力,16*16*16的3D Cube能够显著提升数据利用率,缩短运算周期,实现更快更强的AI运算。举例来说,同样是完成4096次运算,2D结构需要64行*64列才能计算,3D Cube只需要16*16*16的结构就能算出。其中,64*64结构带来的问题是:运算周期长、时延高、利用率低。
  达芬奇架构的这一特性也体现在麒麟810上。作为首款采用达芬奇架构NPU的手机SoC芯片,麒麟810实现强劲的AI算力,在单位面积上实现最佳能效,FP16精度和INT8量化精度业界领先。
  麒麟810支持自研中间算子格式IR开放,算子数量多达240+,处于业内领先水平。更多算子、开源框架的支持以及提供更加完备的工具链将助力开发者快速转换集成基于不同AI框架开发出的模型,极大地增强了华为HiAI移动计算平台的兼容性、易用性,提高开发者的效率,节约时间成本,加速更多AI应用的落地。
  预见:达芬奇架构解锁AI无限可能
  基于灵活可扩展的特性,达芬奇架构能够满足端侧、边缘侧及云端的应用场景,可用于小到几十毫瓦,大到几百瓦的训练场景,横跨全场景提供最优算力。
  以Ascend芯片为例,Ascend-Nano可以用于耳机电话等IoT设备的使用场景;Ascend-Tiny和Ascend-Lite用于智能手机的AI运算处理;在笔记本电脑等算力需求更高的便携设备上,由Ascend 310(Ascend-Mini)提供算力支持;而边缘侧服务器上则需要由Multi-Ascend 310完成AI计算;至于超复杂的云端数据运算处理,则交由算力最高可达256 TFLOPS@FP16的Ascend 910(Ascend-Max)来完成。正是由于达芬奇架构灵活可裁剪、高能效的特性,才能实现对上述多种复杂场景的AI运算处理。
  同时,选择开发统一架构也是一个非常关键的决策。统一架构优势很明显,那就是对广大开发者非常利好。基于达芬奇架构的统一性,开发者在面对云端、边缘侧、端侧等全场景应用开发时,只需要进行一次算子开发和调试,就可以应用于不同平台,大幅降低了迁移成本。不仅开发平台语言统一,训练和推理框架也是统一的,开发者可以将大量训练模型放在本地和云端服务器,再将轻量级的推理工作放在移动端设备上,获得一致的开发体验。
  在算力和技术得到突破性提升后,AI将广泛应用于智慧城市、自动驾驶、智慧新零售、机器人、工业制造、云计算AI服务等场景。未来,AI将应用更加广泛的领域,并逐渐覆盖至生活的方方面面。

FF曾遭到美国劳工部调查贾跃亭被视为风险因素,公司存在巨额亏损北京时间4月20日下午消息,据报道,2020年,法拉第未来公司(FaradayFuture)曾接受了美国劳工部(DepartmentofLabor)的调查。但根据最近一份监管文件中乐视网北京证监局对公司合计罚款2。4亿元对贾跃亭罚款2。41亿元IT之家4月12日晚间消息乐视网今天发布公告,乐视网4月12日收到北京证监局送达的行政处罚决定书,因公司2007年至2016年连续十年财务造假等,北京证监局对公司合计罚款2。4亿元奇异人生重制版合集Switch版宣布跳票IT之家1月23日消息,游戏奇异人生采用动作捕捉技术全面改善视觉效果与动画后,再度推出重制版,将于2月2日在各大平台发售。不过,奇异人生重制版合集官方宣布,游戏的Switch版本将消息称光刻机巨头ASML正寻找氖气替代来源,以防俄乌冲突导致供应中断据路透社报道,ASML正在寻找其他氖气供应来源,以防俄罗斯和乌克兰冲突导致供应中断。ASML一位发言人于当地时间周三表示,尽管乌克兰是全球最大的氖气生产国,但ASML使用的氖气中只海康威视2021年营业总收入813。01亿元同比增长28。03,净利润增长25。39IT之家2月22日消息,海康威视现发布2021年业绩快报,去年实现营收813。01亿元,同比增长28。03净利润167。84亿元,同比增长25。39。海康威视是以视频为核心的智能物鸿星尔克驰援河南捐赠5000万元物资,被网友送微博会员开到2140年IT之家7月23日消息7月21日下午,国产品牌鸿星尔克官方微博表示,鸿星尔克心系灾区,通过郑州慈善总会壹基金紧急捐赠5000万元物资,驰援河南灾区,河南加油!结果鸿星尔克的微博评论揭秘线上娃娃机一个风口的消散,灭火造富的游戏互联网造风口,当空风口吹过,下沉卷大地。在中国万千个因某一制造产业集聚而负盛名的小城镇中,如是曾被风口眷顾者,不在少数。北有津城王庆坨,南有粤地番禺区。前者在持续两年轰轰烈烈的单车B站申请限制D站高消费IT之家7月22日消息哔哩哔哩是由徐逸于2009年6月26日创建的一个弹幕视频分享网站,简称为B站,是一个以ACG相关内容起家的社区,其前身为视频分享网站Mikufans。除B站外B站崩了后,这届年轻人才选择先睡了7月13号晚上,一个普通到不能再普通的夜晚,B站带头崩了,跟着B站一起崩的还有他的老爹A站,友友豆瓣,小弟晋江。网友们突然无所事事了,集体涌入微博。最后,还是微博承受了所有截至7。消息称PP体育将停播意甲联赛IT之家2月6日消息据新华社报道,北京时间2月6日凌晨,意甲联赛第21轮佛罗伦萨与国际米兰的比赛在独家新媒体平台PP体育停播,引发国内体育圈关注。在佛罗伦萨与国际米兰这场比赛前,P爱奇艺推出多画面互动直播超级晚会手机一屏四看,实时互动投票IT之家1月28日消息近期,2021爱奇艺为爱尖叫晚会举办,这是首台多画面互动直播超级晚会,采用一屏四看的观看方式,将主舞台与几大互动专区同时展现在用户面前同时还把晚会主导权交到用
2020年科技界五大反转新闻腾讯老干妈逗鹅冤信小呆1元转让锦鲤辛巴假燕窝2020年是魔幻的一年,留下了不少值得回味的瞬间和事件,其中不乏一些轰轰烈烈的反转新闻和大型翻车现场,它们真真假假,假假真真,彼时把网友们搞得晕头转向,甚至连当事方各路媒体也难辨真英特尔新CEO帕特183基辛格今日正式上任,他将面临哪些挑战2月15日中午消息,据报道,根据之前的宣布,从2月15日开始,英特尔旧将基辛格(PatGelsinger)将接替前任斯旺,担任公司首席执行官,基辛格临危受命,需要帮助英特尔寻找到未英特尔加入AllofUs研究计划加速新冠肺炎研究,至强可扩展处理器提供支持IT之家2月15日消息英特尔近日宣布加入AllofUs研究计划。英特尔表示,AllofUs计划由美国国立卫生研究院发起,希望通过特定的研究人员工作台向美国COVID19(新型冠状病10年了,腾讯微信后台第一天提交的代码曝光IT之家11月23日消息今天微信官方号公布了微信后台第一天提交的代码。IT之家获悉,腾讯官方称,在2010年11月23日凌晨,广州,一群年轻人在小黑屋里干下的。从此,人们的沟通方式SensorTower10月抖音及TikTok下载量位列全球移动应用(非游戏)下载榜冠军IT之家11月23日消息SensorTower商店情报数据显示,今年10月抖音及其海外版TikTok以6600万次下载量,位列全球移动应用(非游戏)下载榜冠军,较2019年同期增长动视暴雪第三季度营收13亿美元,净利润同比降22北京时间11月8日凌晨消息,动视暴雪今日公布了2019财年第三季度财报。报告显示,动视暴雪第三季度净营收为12。82亿美元,高于该公司此前预期的11。05亿美元,但低于去年同期的1暴风集团若2019年年末净资产为负,公司股票可能暂停上市IT之家10月28日消息10月28日,暴风集团发布关于股票存在被暂停上市风险的提示性公告,公告显示,近期公司经营状况发生重大不利变化,资金紧张,难以维持公司正常运转。公司2019年被暴雪起诉抄袭的手游GloriousSaga宣布停运,新浪游戏方面未发声IT之家8月30日消息据游民星空报道,暴雪近日在加利福尼亚州起诉新浪游戏,称其免费游戏GloriousSaga是几乎完全复制魔兽游戏和其相关产品。随后,GloriousSaga于其暴雪手游并非复制PC的游戏体验,未来或有更多游戏移植到SwitchIT之家5月20日消息近日,暴雪总裁AllenBrack接受了外媒GamesBeat的采访。Brack曾经是魔兽世界的执行制片人,去年接任总裁后,Brack一直忙于向暴雪负责人过渡闪电击中希腊雅典卫城,玩家暗示育碧接着送奥德赛?当地时间17日下午,希腊主城区再遇雷雨天气,有闪电击中了雅典卫城。导致售票处玻璃破碎,有两名安保人员和两名游客负轻伤,他们很快被赶来的急救车送到了附近的医院。目前也有消息说,雅典卫2018年全球游戏公司营收排名腾讯第一,网易第七IT之家4月18日消息日前,市场研究机构Newzoo发布2018年全球游戏市场报告,这份报告中显示,全球排名前25位的游戏公司占据全球80的游戏市场份额,它们在2018年总营收规模