在线观看www成人影院-在线观看www日本免费网站-在线观看www视频-在线观看操-欧美18在线-欧美1级

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

始于硬件卻也被硬件所限的深度學(xué)習(xí)

lPCU_elecfans ? 來源:未知 ? 2022-12-05 07:10 ? 次閱讀
電子發(fā)燒友網(wǎng)報道(文/周凱揚(yáng))深度學(xué)習(xí)硬件在AI時代已經(jīng)引領(lǐng)了不少設(shè)計創(chuàng)新,無論是簡單的邊緣推理,還是大規(guī)模自然語言模型的訓(xùn)練,都有了性能上的突破。作為業(yè)內(nèi)在深度學(xué)習(xí)上投入最多的公司之一,英偉達(dá)無疑是這類硬件的領(lǐng)軍者。
近日,在伯克利大學(xué)的電子工程與電腦科學(xué)學(xué)院研討會上,英偉達(dá)的首席科學(xué)家、研究部門高級副總裁同時兼任該校副教授的Bill Dally,分享了從他這個從業(yè)人士看來,發(fā)生在深度學(xué)習(xí)硬件上的一些趨勢。

硬件成為限制

AI的浪潮其實早在20世紀(jì)就被多次掀起過,但真正成為人們不可忽視的巨浪,還是這十幾年的事,因為這時候AI有了天時地利人和:算法與模型,大到足夠訓(xùn)練這些模型的數(shù)據(jù)集,以及能在合理的時間內(nèi)訓(xùn)練出這些模型的硬件。
但從帶起第一波深度學(xué)習(xí)的AlexNet,到如今的GPT-3和Turing NLG等,人們不斷在打造更大的數(shù)據(jù)集和更大的模型,加上大語言模型的興起,對訓(xùn)練的要求也就越來越高。可在摩爾定律已經(jīng)放緩的當(dāng)下,訓(xùn)練時間也在被拉長。

基于Hopper架構(gòu)的H100 GPU / 英偉達(dá)
以英偉達(dá)為例,到了帕斯卡這一代,他們才真正開始考慮單芯片的深度學(xué)習(xí)性能,并結(jié)合到GPU的設(shè)計中去,所以才有了Hopper這樣超高規(guī)格的AI硬件出現(xiàn)。但我們在訓(xùn)練這些模型的時候,并沒有在硬件規(guī)模上有所減少,仍然需要用到集成了數(shù)塊Hopper GPU的DGX系統(tǒng),甚至打造一個超算。很明顯,單從硬件這一個方向出發(fā)已經(jīng)有些不夠了,至少不是一個“高性價比”的方案。

軟硬件全棧投入

硬件推出后,仍要針對特定的模型進(jìn)行進(jìn)一步的軟件優(yōu)化,因此即便是同樣的硬件,其AI性能也會在未來呈現(xiàn)數(shù)倍的飛躍。從上個月的MLPerf的測試結(jié)果就可以看出,在A100 GPU推出的2.5年內(nèi),英偉達(dá)就靠軟件優(yōu)化實現(xiàn)了最高2.5倍的訓(xùn)練性能提升,當(dāng)然了最大的性能提升還是得靠H100這樣的新硬件來實現(xiàn)。
Bill Dally表示這就是英偉達(dá)的優(yōu)勢所在,雖然這幾年投入進(jìn)深度學(xué)習(xí)硬件的資本不少,但隨著經(jīng)濟(jì)下行,不少投資者已經(jīng)喪失了信心,所以不少AI硬件初創(chuàng)公司都沒能撐下去,他自己也在這段時間看到了不少向英偉達(dá)投遞過來的簡歷。
他認(rèn)為不少這些公司都已經(jīng)打造出了自己的矩陣乘法器,但他們并沒有在軟件上有足夠的投入,所以即便他們一開始給出的指標(biāo)很好看,也經(jīng)常拿英偉達(dá)的產(chǎn)品作為對比,未來的性能甚至比不過英偉達(dá)的上一代硬件,更別說Hopper這類新產(chǎn)品了。

加速器

相較傳統(tǒng)的通用計算硬件,加速器在深度學(xué)習(xí)上明顯要高效多了,因為加速器往往都是作為一種專用單元存在的,比如針對特定的數(shù)據(jù)類型和運(yùn)算。加速器可以在一個運(yùn)算周期內(nèi)就完成通常需要花上10秒或100秒才能完成的工作量,效率最高可提升1000倍。

A100和H100的MLPerf跑分 / 英偉達(dá)
當(dāng)然了要追求純粹的性能提升,而不是效率提升的話,這些加速器也可以采用大規(guī)模并行設(shè)計,比如典型的32x32矩陣乘法單元,同時運(yùn)行的運(yùn)算有了千百倍的提升。加速器在內(nèi)存設(shè)計上也更具有優(yōu)勢,比如針對特定的數(shù)據(jù)結(jié)構(gòu)和運(yùn)算,選擇優(yōu)化過的高帶寬低能耗內(nèi)存,同時盡可能使用本地內(nèi)存,減少數(shù)據(jù)搬運(yùn)來控制開銷。
對于英偉達(dá)來說,他們在加速器上的研究更像是為GPU準(zhǔn)備的試驗田,一旦有優(yōu)秀的成果出現(xiàn),這些加速器就會成為GPU上的新核心。

小結(jié)

從Bill Dally的分享中,我們可以看出英偉達(dá)這樣的巨頭在深度學(xué)習(xí)上選擇的技術(shù)路線,以及他們?yōu)楹文茉诒姸喑鮿?chuàng)公司涌現(xiàn)、大廠入局的當(dāng)下巋然不動的底氣。這并不是說深度學(xué)習(xí)硬件的道路只有這一條,類腦芯片等技術(shù)的出現(xiàn)也提供了新的破局機(jī)會,但有了前人經(jīng)驗的借鑒后,在兼顧性能、數(shù)值精度、模型的同時,還是得在軟件上下大功夫才行。

聲明:本文由電子發(fā)燒友原創(chuàng),轉(zhuǎn)載請注明以上來源。如需入群交流,請?zhí)砑游⑿舉lecfans999,投稿爆料采訪需求,請發(fā)郵箱huangjingjing@elecfans.com。


更多熱點文章閱讀

  • 最高漲幅25%,AMD宣布上調(diào)Xilinx FPGA售價,供應(yīng)短缺讓TOP 2廠商受益
  • 時隔20年,莫斯科人汽車再次復(fù)產(chǎn),背后全是中國車企的影子
  • 歐盟超430億歐元投向芯片領(lǐng)域,對上游半導(dǎo)體設(shè)備有何影響?
  • 24W以下電源,新型自供電BJT方案將全面取代其他方案?
  • 車用芯片不再缺?芯片大廠表示有所緩解,真實情況究竟如何呢?


原文標(biāo)題:始于硬件卻也被硬件所限的深度學(xué)習(xí)

文章出處:【微信公眾號:電子發(fā)燒友網(wǎng)】歡迎添加關(guān)注!文章轉(zhuǎn)載請注明出處。

聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報投訴

原文標(biāo)題:始于硬件卻也被硬件所限的深度學(xué)習(xí)

文章出處:【微信號:elecfans,微信公眾號:電子發(fā)燒友網(wǎng)】歡迎添加關(guān)注!文章轉(zhuǎn)載請注明出處。

收藏 人收藏

    評論

    相關(guān)推薦
    熱點推薦

    電子硬件工程師如何從零開始學(xué)習(xí)?(文末免費(fèi)分享從零開始學(xué)習(xí)資料)

    經(jīng)常有用戶咨詢,如何學(xué)習(xí)和提升電子硬件能力,有沒有適合小白學(xué)習(xí)的資料等等;電子硬件工程師是一個結(jié)合理論、實踐和創(chuàng)新能力的職業(yè),需要掌握電路設(shè)計、元器件選型、PCB設(shè)計、嵌入式系統(tǒng)、測試
    的頭像 發(fā)表于 06-04 07:36 ?182次閱讀
    電子<b class='flag-5'>硬件</b>工程師如何從零開始<b class='flag-5'>學(xué)習(xí)</b>?(文末免費(fèi)分享從零開始<b class='flag-5'>學(xué)習(xí)</b>資料)

    硬件原理圖學(xué)習(xí)筆記

    這一個星期認(rèn)真學(xué)習(xí)硬件原理圖的知識,做了一些筆記,方便以后查找。硬件原理圖分為三類1.管腳類(gpio)和門電路類輸入輸出引腳,上拉電阻,三極管與門,或門,非門上拉電阻:正向標(biāo)志作用,給懸空的引腳
    的頭像 發(fā)表于 04-30 18:40 ?705次閱讀
    <b class='flag-5'>硬件</b>原理圖<b class='flag-5'>學(xué)習(xí)</b>筆記

    硬件工程師學(xué)習(xí)路線,不吹牛規(guī)劃

    心理,才能觸發(fā)你的好奇心,去學(xué)下去,這也是成為工程師的首要條件,但這是遠(yuǎn)遠(yuǎn)不夠,還需要一條可供參考的學(xué)習(xí)路線,再加上99%的汗水和1%的靈感才可以。硬件設(shè)計,可以
    的頭像 發(fā)表于 04-16 19:33 ?784次閱讀
    <b class='flag-5'>硬件</b>工程師<b class='flag-5'>學(xué)習(xí)</b>路線,不吹牛規(guī)劃

    擁有一顆熱愛學(xué)習(xí)硬件開發(fā)的決心!

    有沒有大佬能教教硬件開發(fā)設(shè)計和pcb,目前轉(zhuǎn)行在,想學(xué)習(xí)硬件工程師這塊!
    發(fā)表于 04-02 14:46

    智算中心的核心硬件是什么?

    與各種AI算法協(xié)同工作,滿足對算力的極高需求。當(dāng)前主流的AI加速計算芯片包括:1、GPU(圖形處理器)GPU是智算中心的算力擔(dān)當(dāng),其強(qiáng)大的并行計算能力使其在深度學(xué)習(xí)領(lǐng)
    的頭像 發(fā)表于 02-17 14:42 ?1003次閱讀
    智算中心的核心<b class='flag-5'>硬件</b>是什么?

    如何快速學(xué)習(xí)硬件電路

    對于想要學(xué)習(xí)硬件電路的新手來說,一開始可能感到有些困難,但只要掌握了正確的學(xué)習(xí)方法和技巧,就能夠快速地成為一名優(yōu)秀的硬件電路工程師。 首先,新手需要了解基本的電路知識,例如電阻、電容、
    的頭像 發(fā)表于 01-20 11:11 ?957次閱讀
    如何快速<b class='flag-5'>學(xué)習(xí)</b><b class='flag-5'>硬件</b>電路

    學(xué)習(xí)硬件的第一節(jié)課:學(xué)習(xí)讀懂原理圖

    學(xué)習(xí)硬件的第一節(jié)課:學(xué)習(xí)讀懂原理圖 讀懂原理圖對嵌入式軟件工程師和程序員尤為重要。在深入細(xì)節(jié)之前請注意,對所有的嵌入式設(shè)計人員來說、能懂得硬件工程師創(chuàng)建和使用的來描述其
    的頭像 發(fā)表于 12-16 16:04 ?2133次閱讀
    <b class='flag-5'>學(xué)習(xí)</b><b class='flag-5'>硬件</b>的第一節(jié)課:<b class='flag-5'>學(xué)習(xí)</b>讀懂原理圖

    NPU在深度學(xué)習(xí)中的應(yīng)用

    設(shè)計的硬件加速器,它在深度學(xué)習(xí)中的應(yīng)用日益廣泛。 1. NPU的基本概念 NPU是一種專門針對深度學(xué)習(xí)算法優(yōu)化的處理器,它與傳統(tǒng)的CPU和G
    的頭像 發(fā)表于 11-14 15:17 ?1757次閱讀

    pcie在深度學(xué)習(xí)中的應(yīng)用

    深度學(xué)習(xí)模型通常需要大量的數(shù)據(jù)和強(qiáng)大的計算能力來訓(xùn)練。傳統(tǒng)的CPU計算資源有限,難以滿足深度學(xué)習(xí)的需求。因此,GPU(圖形處理單元)和TPU(張量處理單元)等專用
    的頭像 發(fā)表于 11-13 10:39 ?1255次閱讀

    GPU深度學(xué)習(xí)應(yīng)用案例

    能力,可以顯著提高圖像識別模型的訓(xùn)練速度和準(zhǔn)確性。例如,在人臉識別、自動駕駛等領(lǐng)域,GPU廣泛應(yīng)用于加速深度學(xué)習(xí)模型的訓(xùn)練和推理過程。 二、自然語言處理 自然語言處理(NLP)是深度
    的頭像 發(fā)表于 10-27 11:13 ?1155次閱讀

    FPGA加速深度學(xué)習(xí)模型的案例

    FPGA(現(xiàn)場可編程門陣列)加速深度學(xué)習(xí)模型是當(dāng)前硬件加速領(lǐng)域的一個熱門研究方向。以下是一些FPGA加速深度學(xué)習(xí)模型的案例: 一、基于FPG
    的頭像 發(fā)表于 10-25 09:22 ?1101次閱讀

    FPGA做深度學(xué)習(xí)能走多遠(yuǎn)?

    并行計算的能力,可以在硬件層面并行處理大量數(shù)據(jù)。這種并行處理能力使得 FPGA 在執(zhí)行深度學(xué)習(xí)算法時速度遠(yuǎn)超傳統(tǒng)處理器,能夠提供更低的延遲和更高的吞吐量,從而加速模型訓(xùn)練和推理過程,滿足實時性要求較高
    發(fā)表于 09-27 20:53

    如何幫助孩子高效學(xué)習(xí)Python:開源硬件實踐是最優(yōu)選擇

    家長們常常擔(dān)心孩子在學(xué)習(xí)Python時所面臨的挑戰(zhàn),如復(fù)雜性、興趣保持、學(xué)習(xí)進(jìn)度和可用資源。對于希望有效教授孩子Python的家長而言,了解硬件的作用至關(guān)重要,因為結(jié)合硬件項目的Pyt
    的頭像 發(fā)表于 09-06 09:49 ?613次閱讀

    EVASH Ultra EEPROM:美國權(quán)威雜志評為優(yōu)秀硬件存儲廠商

    EVASH Ultra EEPROM:美國權(quán)威雜志評為優(yōu)秀硬件存儲廠商
    的頭像 發(fā)表于 07-01 12:53 ?614次閱讀

    EVASH Ultra EEPROM:Google認(rèn)定為五大硬件廠商之一

    EVASH Ultra EEPROM:Google認(rèn)定為五大硬件廠商之一
    的頭像 發(fā)表于 07-01 12:47 ?547次閱讀
    主站蜘蛛池模板: 99精品国产第一福利网站 | 国产视频三区 | 欧美色视频在线观看 | 国产乱人视频在线看 | 夜夜骑天天干 | www.国产一区二区三区 | 色噜噜狠狠色综合中文字幕 | 美女很黄很黄是免费的·无遮挡网站 | 久久婷婷午色综合夜啪 | 一级特级片 | 欧美一级黄色片视频 | 簧 色 成 人 | 欧美日韩一区二区三区视频 | 亚洲视频一区在线观看 | 黄色片网站观看 | 中文天堂在线www | 美女免费视频色在线观看 | 国产成人精品影视 | xxxx日本老师hd | 亚洲免费黄色网 | 久99频这里只精品23热 视频 | 国模吧在线视频 | 狠狠色噜噜噜噜狠狠狠狠狠狠奇米 | 久久澳门| 曰本三级香港三级人妇99视频 | 黄色hd| 美女视频永久黄网站免费观看国产 | 污视频日本 | 日本网络视频www色高清免费 | 在线播放免费人成毛片乱码 | 日本一区二区三区四区在线观看 | 国产免费久久精品99久久 | 成人国产三级精品 | www.射| 色妹子在线 | 天天影视网天天影网 | 亚洲精品卡1卡二卡3卡四卡 | 亚洲第一在线视频 | 狠狠做久久深爱婷婷97动漫 | 五月婷综合网 | 四虎国产精品永久在线看 |