在线观看www成人影院-在线观看www日本免费网站-在线观看www视频-在线观看操-欧美18在线-欧美1级

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

使用NVIDIA Triton推理服務器來加速AI預測

NVIDIA英偉達企業解決方案 ? 來源:NVIDIA英偉達企業解決方案 ? 2024-02-29 14:04 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

這家云計算巨頭的計算機視覺和數據科學服務使用 NVIDIA Triton 推理服務器來加速 AI 預測。

作為一名狂熱的自行車愛好者,Thomas Park 深知擁有多個變速檔位對于平穩、快速騎行的重要性。

因此,當這位軟件架構師為 Oracle Cloud Infrastructure(OCI)的視覺 AI 服務設計 AI 推理平臺時,他選擇了 NVIDIA Triton 推理服務器,因為它可以通過變換“檔位”,來快速高效地處理幾乎任何 AI 模型、框架、硬件和運行模式。

Park 表示:“NVIDIA AI推理平臺為我們的全球云服務客戶帶來了巨大的靈活性,讓他們可以構建和運行 AI 應用。”Park 是一位在蘇黎世工作的計算機工程師,同時也是一名富有競爭力的自行車手,他曾先后就職于四家全球超大型云服務提供商。

具體而言,Triton 將 OCI 的總擁有成本降低了 10%、將遷移到 Triton 的 OCI 視覺和文檔理解服務模型的預測吞吐量提高了 76%,并將推理延遲降低了 51%。Park 和一位同事在今年早些時候發布的一篇 Oracle 博客中指出,全球有超過 45 個區域數據中心在運行這些服務。

計算機視覺加速深入洞察

依靠 OCI 視覺 AI,客戶可以進行各種物體檢測和圖像分類工作。例如,美國的一家運輸公司利用它來自動檢測經過的車軸數,以計算和結算過橋費,從而節省了忙碌的卡車司機在收費站的等待時間。

OCI AI 還通過 Oracle NetSuite 提供,Oracle NetSuite 是全球 37,000 多個企業組織使用的一套商業應用程序,它可以用于自動識別發票等工作。

在 Park 的努力下,Triton 如今也被其他 OCI 服務所采用。

能夠識別 Triton 的數據服務

負責處理 Oracle 內外部用戶機器學習事務的 OCI 數據科學服務產品管理總監 Tzvi Keisar 表示:“我們的 AI 平臺能夠識別 Triton,以造福于我們的客戶?!?/p>

Keisar 提到:“想要使用 Triton 的客戶不必擔心配置問題,因為平臺會自動完成配置,為他們啟動一個 Triton 驅動的推理終端節點?!?/p>

Triton 包含在 NVIDIA AI Enterprise 中,該平臺可提供企業所需的全方位的安全和支持,并且可以在 OCI Marketplace 上獲得

一個龐大的 SaaS 平臺

OCI 的數據科學服務是一個適用于 Oracle NetSuite 和 Oracle Fusion 應用程序的機器學習平臺。

“這些商業應用套件規模龐大,有數以萬計的客戶也在我們的服務上構建他們的框架?!盞eisar 說。

這些客戶主要是來自于制造業、零售業、交通運輸業等行業的企業用戶。他們正在構建和使用幾乎所有形態與規模的 AI 模型。

推理是該團隊推出的首批服務之一,而 Triton 在推出后不久就進入了該團隊的視線。

最佳的推理框架

“我們看到 Triton 作為一流的服務框架越來越受歡迎,于是開始試用。”Keisar 說,“我們發現它的性能非常出色,彌補了現有產品的不足,尤其是在多模型推理方面。它是目前功能最全面、最先進的推理框架?!?/p>

Triton 于 3 月在 OCI 上發布,已經吸引了 Oracle 許多內部團隊的關注。他們希望將其用于需要同時運行多個 AI 模型以作出預測的推理工作。

他表示:“當用于部署在單個端點上的多個模型時,Triton 的表現和性能都非常好。”

加快未來發展

展望未來,復雜的大語言模型(LLM)激發了眾多用戶的想象力。為了能夠在未來為這些模型上的推理提供更強大的助力,Keisar 的團隊正在對 NVIDIA TensorRT-LLM 軟件進行評估。

身為一名活躍的博主,Keisar 在其最新文章中詳細介紹了在 NVIDIA A10 Tensor Core GPU 上運行具有高達 700 億參數的 Llama 2 LLM 的量化技術。

他表示:“即使減低到四位參數,模型輸出的質量仍然相當不錯。在 NVIDIA GPU 上的部署使我們能夠靈活地在延遲、吞吐量和成本之間找到良好的平衡點?!?/p>




審核編輯:劉清

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • NVIDIA
    +關注

    關注

    14

    文章

    5283

    瀏覽量

    106084
  • 計算機視覺
    +關注

    關注

    9

    文章

    1708

    瀏覽量

    46680
  • LLM
    LLM
    +關注

    關注

    1

    文章

    323

    瀏覽量

    777

原文標題:名不虛傳:NVIDIA Triton 加速 Oracle Cloud 上的推理

文章出處:【微信號:NVIDIA-Enterprise,微信公眾號:NVIDIA英偉達企業解決方案】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    基于RAKsmart云服務器AI大模型實時推理方案設計

    面對高并發請求、嚴格的響應延遲要求及波動的業務負載,傳統本地化部署的算力瓶頸愈發顯著。RAKsmart云服務器憑借其彈性計算資源池、分布式網絡架構與全棧AI加速能力,為AI大模型實時
    的頭像 發表于 05-13 10:33 ?196次閱讀

    AI 推理服務器都有什么?2025年服務器品牌排行TOP10與選購技巧

    根據行業數據,AI推理服務器的性能差異可以達到10倍以上。比如,用普通服務器跑一個700億參數的大模型,可能需要30秒才能出結果,而用頂級服務器
    的頭像 發表于 04-09 11:06 ?943次閱讀
    <b class='flag-5'>AI</b> <b class='flag-5'>推理</b><b class='flag-5'>服務器</b>都有什么?2025年<b class='flag-5'>服務器</b>品牌排行TOP10與選購技巧

    國產推理服務器如何選擇?深度解析選型指南與華頡科技實戰案例

    人工智能技術的爆發催生了對推理算力的迫切需求,而進口服務器的高成本與技術依賴性,推動了國產推理服務器的快速發展。據IDC預測,到2025年,
    的頭像 發表于 03-24 17:11 ?431次閱讀
    國產<b class='flag-5'>推理</b><b class='flag-5'>服務器</b>如何選擇?深度解析選型指南與華頡科技實戰案例

    英偉達GTC2025亮點:Oracle與NVIDIA合作助力企業加速代理式AI推理

    Oracle 數據庫與 NVIDIA AI 相集成,使企業能夠更輕松、快捷地采用代理式 AI Oracle 和 NVIDIA 宣布,NVIDIA
    的頭像 發表于 03-21 12:01 ?649次閱讀
    英偉達GTC2025亮點:Oracle與<b class='flag-5'>NVIDIA</b>合作助力企業<b class='flag-5'>加速</b>代理式<b class='flag-5'>AI</b><b class='flag-5'>推理</b>

    英偉達GTC25亮點:NVIDIA Dynamo開源庫加速并擴展AI推理模型

    Triton 推理服務器的后續產品,NVIDIA Dynamo 是一款全新的 AI 推理
    的頭像 發表于 03-20 15:03 ?603次閱讀

    Oracle 與 NVIDIA 合作助力企業加速代理式 AI 推理

    ——Oracle 和 NVIDIA 今日宣布,NVIDIA 加速計算和推理軟件與 Oracle 的 AI 基礎設施以及生成式
    發表于 03-19 15:24 ?344次閱讀
    Oracle 與 <b class='flag-5'>NVIDIA</b> 合作助力企業<b class='flag-5'>加速</b>代理式 <b class='flag-5'>AI</b> <b class='flag-5'>推理</b>

    使用NVIDIA推理平臺提高AI推理性能

    NVIDIA推理平臺提高了 AI 推理性能,為零售、電信等行業節省了數百萬美元。
    的頭像 發表于 02-08 09:59 ?664次閱讀
    使用<b class='flag-5'>NVIDIA</b><b class='flag-5'>推理</b>平臺提高<b class='flag-5'>AI</b><b class='flag-5'>推理</b>性能

    GPU加速服務器怎么用的

    GPU加速服務器是將GPU硬件與云計算服務相結合,通過云服務提供商的平臺,用戶可以根據需求靈活租用帶有GPU資源的虛擬機實例。那么,GPU加速
    的頭像 發表于 12-26 11:58 ?427次閱讀

    Triton編譯在機器學習中的應用

    1. Triton編譯概述 Triton編譯NVIDIA Triton
    的頭像 發表于 12-24 18:13 ?937次閱讀

    NVIDIA助力麗蟾科技打造AI訓練與推理加速解決方案

    麗蟾科技通過 Leaper 資源管理平臺集成 NVIDIA AI Enterprise,為企業和科研機構提供了一套高效、靈活的 AI 訓練與推理加速
    的頭像 發表于 10-27 10:03 ?758次閱讀
    <b class='flag-5'>NVIDIA</b>助力麗蟾科技打造<b class='flag-5'>AI</b>訓練與<b class='flag-5'>推理</b><b class='flag-5'>加速</b>解決方案

    什么是AI服務器?AI服務器的優勢是什么?

    AI服務器是一種專門為人工智能應用設計的服務器,它采用異構形式的硬件架構,通常搭載GPU、FPGA、ASIC等加速芯片,利用CPU與加速芯片
    的頭像 發表于 09-21 11:43 ?1971次閱讀

    AMD助力HyperAccel開發全新AI推理服務器

    HyperAccel 是一家成立于 2023 年 1 月的韓國初創企業,致力于開發 AI 推理專用型半導體器件和硬件,最大限度提升推理工作負載的存儲帶寬使用,并通過將此解決方案應用于
    的頭像 發表于 09-18 09:37 ?830次閱讀
    AMD助力HyperAccel開發全新<b class='flag-5'>AI</b><b class='flag-5'>推理</b><b class='flag-5'>服務器</b>

    NVIDIA助力提供多樣、靈活的模型選擇

    在本案例中,Dify 以模型中立以及開源生態的優勢,為廣大 AI 創新者提供豐富的模型選擇。其集成的 NVIDIAAPI Catalog、NVIDIA NIM和Triton 推理
    的頭像 發表于 09-09 09:19 ?903次閱讀

    英偉達推出全新NVIDIA AI Foundry服務NVIDIA NIM推理服務

    NVIDIA 宣布推出全新 NVIDIA AI Foundry 服務NVIDIA NIM 推理
    的頭像 發表于 07-25 09:48 ?1042次閱讀

    AI服務器的特點和關鍵技術

    AI服務器,即人工智能服務器,是一種專門設計用于運行和加速人工智能(AI)算法與模型的硬件設備。隨著人工智能技術的快速發展和普及,
    的頭像 發表于 07-17 16:34 ?2961次閱讀
    主站蜘蛛池模板: 色亚洲色图 | 一区卡二区卡三区卡视频 | 亚洲第成色999久久网站 | 曰本女人色黄网站 | 直接在线观看的三级网址 | a级男女性高爱潮高清试 | 国产一级鲁丝片 | 国内外精品免费视频 | 激情五月综合 | 久久性久久性久久久爽 | 五月婷婷六月激情 | 色偷偷伊人 | аⅴ天堂中文在线网 | 偷偷鲁影院手机在线观看 | 香蕉成人国产精品免费看网站 | 深爱激情婷婷 | 欧美αv| 国产香蕉98碰碰久久人人 | 免费jlzzjlzz在线播放视频 | 乱操视频| 一级a爱片久久毛片 | 国产人成高清视频观看 | 日本一区视频在线观看 | 久久精品久噜噜噜久久 | 久久9966精品国产免费 | 色天使亚洲综合在线观看 | 特黄特级高清免费视频毛片 | 又粗又长又爽又长黄免费视频 | 久久成人综合 | 色偷偷偷 | 天天拍天天干天天操 | 亚洲欧美卡通 动漫 丝袜 | 免费播放黄色 | 女女综合网 | 日日操夜夜骑 | 男男h全肉耽污 | 天堂网中文字幕 | 一级特黄女毛毛片 | 色吧色吧色吧网 | 欧美色p| 米奇精品一区二区三区 |