在线观看www成人影院-在线观看www日本免费网站-在线观看www视频-在线观看操-欧美18在线-欧美1级

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

欲把AI計算成本打下來,谷歌高效益TPU正式開放

E4Life ? 來源:電子發燒友網 ? 作者:周凱揚 ? 2023-11-14 00:18 ? 次閱讀

電子發燒友網報道(文/周凱揚)對于每個想要自己開發和部署AI模型的應用開發者來說,硬件和服務器支出都是一筆不小的費用。就以英偉達GPU為例,即便是消費級的GPU,最近也迎來了一波漲價潮,更不用爆火的A100/H100等型號了。

即便是租賃服務器,基于這些熱門硬件的服務器也遠算不上便宜,因此不少云服務廠商為了進一步拉攏更多AI應用開發者,紛紛推出了性價比更高的選項。這些選項有的是基于CPU的AI計算服務器,有的是基于第三方AI加速器打造的服務器,還有的則是由云服務廠商基于自研加速器打造且獨家提供的服務器。

谷歌高性價比TPU面世

谷歌在今年8月底發布了第五代的自研TPU,TPU v5e。谷歌稱該加速器實現了性能與成本效益的平衡。相比上一代TPU v4,TPU V5e提供了同成本下兩倍的訓練性能,以及針對LLM和生成式AI模型2.5倍的推理性能。

wKgaomVR-HqAJvSzAABXKc7C2hk445.png
TPU v5e架構


單個TPU v5e Pod由256個芯片互聯,總帶寬超過400Tb/s,INT8總算力達100petaOps。而且谷歌為TPU v5e采用了更靈活的配置選項,其支持8個不同的虛擬機配置,單個切片支持單芯片到250多個芯片,如此一來客戶就可以根據自己的模型大小來選擇合適的配置。

而且過去借助谷歌TPU進行的訓練負載只局限于單個切片中,谷歌為此開發了Multislice技術,可通過芯片間互聯以及數據中心網絡中的多個TPU Pod相連,從而將訓練工作擴展到數萬個芯片上。

為了進一步擴大對開發生態的支持,TPU v5e還內置了對JAX、Pytorch和Tensorflow等領先AI框架,以及 Hugging Face 的 TransformersAccelerate、PyTorch Lightning 和 Ray等一系列常用開源工具的支持。

開放使用與自用

近日,谷歌終于宣布TPU v5e進入公用階段,且在最新的MLPerf訓練3.1測試中,TPUv5e獲得了更好的表現。在該測試中,谷歌改進了創新的混合精度訓練算法,除了原生支持的BF16外,還用到了INT8精度格式。這意味著客戶在提高了模型準確性的同時,將花費更少的成本。

wKgZomVR-IOANSMPAAIyMIzn61I221.png
從谷歌云對于TPU v5e的定價表來看,v5e在成本效益上確實有著極大的優勢。不過需要注意的是,v5e與v2、v3 Pod類似,每個芯片中只有一個TensorCore,而v4 Pod的每個芯片中有兩個TensorCore。這也是為何v5e的單芯片峰值算力為197TFLOPS,而v4的單芯片峰值算力為275TFLOPS,可即便如此,在按芯片小時的定價下,其所需成本依然低于v4。

在如此高的性價比下,谷歌不僅將TPU提供給外部開發者使用,其內部一些開發項目也開始用上TPU v5e。比如其PaLM模型的創建,就用到了上文提到的Multislice技術,谷歌的Bard團隊同樣在用TPU v5e訓練這一生成式AI聊天機器人

寫在最后

其實在TPUv5e開放使用之前,谷歌也正式開放了A3 VM這類GPU加速虛擬機的使用。這也是多數云服務廠商采用的多方案供應策略,其自研加速器只需要為客戶提供一個高性價比的方案,而追求更高性能的客戶,依然可以選擇基于H100 GPU打造的服務器。

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • AI
    AI
    +關注

    關注

    88

    文章

    34589

    瀏覽量

    276236
收藏 人收藏

    評論

    相關推薦
    熱點推薦

    SiC價格打下來!兩年內擬降30%,市場加速滲透

    過去,SiC的晶體生長速度慢、良率低,導致生產成本較高,一直限制了SiC的普及。 ? 不過在近期據媒體報道,有業內人士預計,未來兩年SiC芯片價格將下降達30%,原因在于越來越多的本地廠商開始獲得電動汽車認證并擴大了其制造能力。SiC芯片將
    的頭像 發表于 08-03 00:59 ?5127次閱讀

    AlphaEvolve有望革新AI玩具芯片設計,算法進化驅動能效與成本雙突破

    電子發燒友網綜合報道,近期,谷歌?DeepMind發布了一款AlphaEvolve,是一款通用科學AI代理,基于大語言模型Gemini系列與進化計算框架,專注于算法發現與優化。可以支持數百行代碼
    的頭像 發表于 06-18 00:09 ?2064次閱讀

    智算加速卡是什么東西?它真能在AI戰場上干掉GPU和TPU

    隨著AI技術火得一塌糊涂,大家都在談"大模型"、"AI加速"、"智能計算",可真到了落地環節,算力才是硬通貨。你有沒有發現,現在越來越多的AI企業不光用GPU,也不怎么迷信
    的頭像 發表于 06-05 13:39 ?370次閱讀
    智算加速卡是什么東西?它真能在<b class='flag-5'>AI</b>戰場上干掉GPU和<b class='flag-5'>TPU</b>!

    Deepseek海思SD3403邊緣計算AI產品系統

    海思SD3403邊緣計算AI框架,提供了一套開放AI訓練產品工具包,解決客戶低成本AI系統,針
    發表于 04-28 11:05

    TPU處理器的特性和工作原理

    張量處理單元(TPU,Tensor Processing Unit)是一種專門為深度學習應用設計的硬件加速器。它的開發源于對人工智能(AI)和機器學習應用的需求,尤其是深度學習中的神經網絡計算
    的頭像 發表于 04-22 09:41 ?1165次閱讀
    <b class='flag-5'>TPU</b>處理器的特性和工作原理

    谷歌第七代TPU Ironwood深度解讀:AI推理時代的硬件革命

    谷歌第七代TPU Ironwood深度解讀:AI推理時代的硬件革命 Google 發布了 Ironwood,這是其第七代張量處理單元 (TPU),專為推理而設計。這款功能強大的
    的頭像 發表于 04-12 11:10 ?1657次閱讀
    <b class='flag-5'>谷歌</b>第七代<b class='flag-5'>TPU</b> Ironwood深度解讀:<b class='flag-5'>AI</b>推理時代的硬件革命

    谷歌新一代 TPU 芯片 Ironwood:助力大規模思考與推理的 AI 模型新引擎?

    Cloud 客戶開放,將提供 256 芯片集群以及 9,216 芯片集群兩種配置選項。 ? 在核心亮點層面,Ironwood 堪稱谷歌首款專門為 AI 推理精心設計的 TPU 芯片,
    的頭像 發表于 04-12 00:57 ?2220次閱讀

    Banana Pi 發布 BPI-AI2N &amp; BPI-AI2N Carrier,助力 AI 計算與嵌入式開發

    和 Renesas一直致力于推動開源生態的發展,并積極合作打造高效開放計算平臺。BPI-AI2N & BPI-AI2N Car
    發表于 03-19 17:54

    傳DeepSeek自研芯片,廠商們要把AI成本打下來

    外購芯片的成本,掌握供應鏈主動權,另一方面隨著AI推理應用的爆發,AI推理芯片有機會被重新定義。 ? DeepSeek 不完全依賴英偉達 ? 去年12月底發布的DeepSeek-V3模型,整個訓練使用2048塊英偉達H800 G
    的頭像 發表于 02-16 00:09 ?3102次閱讀
    傳DeepSeek自研芯片,廠商們要把<b class='flag-5'>AI</b><b class='flag-5'>成本</b><b class='flag-5'>打下來</b>

    谷歌加速AI部門整合:AI Studio團隊并入DeepMind

    近日,谷歌正緊鑼密鼓地推進其人工智能(AI)部門的整合工作。據谷歌AI Studio主管Logan Kilpatrick在領英頁面上的透露,谷歌
    的頭像 發表于 01-13 14:40 ?653次閱讀

    AI云端計算資源的多維度優勢

    AI云端計算資源,作為AI技術與云計算深度融合的產物,在成本效益、性能優化、數據安全、靈活擴展以
    的頭像 發表于 01-07 11:11 ?409次閱讀

    如何分析美國站群服務器的成本效益?

    美國站群服務器的成本效益分析是一個復雜但至關重要的過程,它涉及到多個方面的考量。主機推薦小編為您推薦美國站群服務器成本效益的詳細分析。
    的頭像 發表于 10-30 11:23 ?412次閱讀

    成本高效益 | 自連醫療設備無線化改造實例匯集

    原文標題:低成本高效益 | 自連醫療設備無線化改造實例匯集 文章出處:【微信公
    的頭像 發表于 10-24 17:25 ?684次閱讀

    谷歌發布革命性AI游戲引擎GameNGen

    谷歌近期震撼推出全球首款完全由人工智能驅動的游戲引擎——GameNGen,這一創新技術標志著游戲開發領域的新紀元。GameNGen憑借其強大的計算能力,能夠在單個TPU上實現每秒20幀的實時游戲生成,每一幀畫面均源自精密的擴散模
    的頭像 發表于 08-29 18:07 ?1109次閱讀

    TPU v1到Trillium TPU,蘋果等科技公司使用谷歌TPU進行AI計算

    ,在訓練尖端人工智能方面,大型科技公司正在尋找英偉達以外的替代品。 ? 不斷迭代的谷歌TPU 芯片 ? 隨著機器學習算法,特別是深度學習算法在各個領域的廣泛應用,對于高效、低功耗的AI
    的頭像 發表于 07-31 01:08 ?3833次閱讀
    主站蜘蛛池模板: 黄色成人免费观看 | 极品美女洗澡后露粉嫩木耳视频 | 4hu影院最新地址www | 日本一区二区三区免费看 | 人人搞人人| 一级欧美在线的视频 | 好紧好爽太大了h快穿 | 天天综合色天天综合 | 色综合天天综合 | 日本午夜三级 | 韩国三级中文字幕hd | 免费爱爱小视频 | 福利视频入口 | 国产精品女人在线观看 | 日本成人视屏 | 曰曰摸天天摸人人看久久久 | 国产一级毛片午夜福 | 一级做a爱 | 亚洲人成网站999久久久综合 | 手机看片国产高清 | 99色在线| 欧美成人亚洲欧美成人 | 她也啪97在线视频 | 欧美一级视频免费 | 色爱区综合激月婷婷激情五月 | 日本三级最新中文字幕电影 | 国产特黄特色的大片观看免费视频 | 亚洲国产精品久久精品怡红院 | 全黄色一级片 | 极品美女啪啪 | 在线播放黄色 | 在线播放免费观看 | 长腿丝袜美女被啪啪 | 粉嫩尤物在线456 | 美女被上视频 | 伊人网站在线观看 | 日韩三级一区 | 欧美伊人久久综合网 | 欧美人成绝费网站色www吃脚 | 伊人97| 夜夜操天天操 |