完善資料讓更多小伙伴認識你,還能領(lǐng)取20積分哦,立即完善>
標簽 > llm
在人工智能領(lǐng)域,LLM代表“大型語言模型”。在人工智能(AI)領(lǐng)域自然語言處理(NLP)是一個快速進展的領(lǐng)域。NLP中最重要是大語言模型(LLM)。大語言模型(英文:Large Language Model,縮寫LLM),也稱大型語言模型,是一種基于機器學習和自然語言處理技術(shù)的模型。
文章:314個 瀏覽:620次 帖子:3個
樹莓派秒變編程助手:Ollama+Continue的簡易搭建教程!
以下是如何在RaspberryPi上運行大型語言模型(LLM)的方法。本文的目標是找出在RaspberryPi上運行LLM是否是ChatGPT和GitH...
2025-03-27 標簽:Raspberry Pi樹莓派LLM 141 0
基于DBFP與DB-Attn的算法硬件協(xié)同優(yōu)化方案
本文討論了LLM推理過程對計算資源需求急劇攀升的背景下,現(xiàn)有量化和剪枝技術(shù)、新數(shù)據(jù)格式存在的不足,提出動態(tài)塊浮點數(shù)(DBFP)及其配套算法-硬件協(xié)同框架...
內(nèi)部業(yè)務支撐&前瞻技術(shù)布局 One4All下一代生成式推薦系統(tǒng)
作者:京東零售 申磊 自LLM在自然語言處理等領(lǐng)域取得了矚目成就之后,學術(shù)界積極探索生成式模型對搜廣推系統(tǒng)的增強或改進方式[1],現(xiàn)有工作大體可以分為兩...
推薦系統(tǒng)的主要任務在于根據(jù)用戶的過往行為預測其潛在興趣點,并據(jù)此推薦相應的商品。在傳統(tǒng)的推薦系統(tǒng)中,當處理用戶請求時,會觸發(fā)多個召回模塊,例如熱門商品召...
2025-03-05 標簽:NVIDIA模型推薦系統(tǒng) 509 0
用PaddleNLP在4060單卡上實踐大模型預訓練技術(shù)
作者:算力魔方創(chuàng)始人/英特爾創(chuàng)新大使劉力 之前我們分享了《從零開始訓練一個大語言模型需要投資多少錢》,其中高昂的預訓練費用讓許多對大模型預訓練技術(shù)感興趣...
2025-02-19 標簽:數(shù)據(jù)集大模型LLM 661 0
大語言模型的解碼策略與關(guān)鍵優(yōu)化總結(jié)
本文系統(tǒng)性地闡述了大型語言模型(LargeLanguageModels,LLMs)中的解碼策略技術(shù)原理及其實踐應用。通過深入分析各類解碼算法的工作機制、...
在NVIDIA TensorRT-LLM中啟用ReDrafter的一些變化
Recurrent Drafting (簡稱 ReDrafter) 是蘋果公司為大語言模型 (LLM) 推理開發(fā)并開源的一種新型推測解碼技術(shù),該技術(shù)現(xiàn)在...
NVIDIA TensorRT-LLM 是一個專為優(yōu)化大語言模型 (LLM) 推理而設計的庫。它提供了多種先進的優(yōu)化技術(shù),包括自定義 Attention...
移植Mediapipe LLM Demo到Kotlin Multiplatform
在今年的廈門和廣州 Google I/O Extended 上,我分享了《On-Device Model 集成 (KMP) 與用例》。本文是當時 Dem...
Arm KleidiAI助力提升PyTorch上LLM推理性能
生成式人工智能 (AI) 正在科技領(lǐng)域發(fā)揮關(guān)鍵作用,許多企業(yè)已經(jīng)開始將大語言模型 (LLM) 集成到云端和邊緣側(cè)的應用中。生成式 AI 的引入也使得許多...
如何在 OrangePi 5 Pro?的?NPU?上運行?LLM
在OrangePi5Pro上訪問NPU需要安裝最新版Ubuntu的定制版本,還需要安裝特殊軟件,讓你能在NPU而不是CPU上運行專門轉(zhuǎn)換的LLM。整個過...
本文將分享 TensorRT-LLM 中低精度量化內(nèi)容,并從精度和速度角度對比 FP8 與 INT8。首先介紹性能,包括速度和精度。其次,介紹量化工具 ...
2024-11-19 標簽:數(shù)據(jù)NVIDIA模型 918 0
大模型由于其在各種任務中的出色表現(xiàn)而引起了廣泛的關(guān)注。然而,大模型推理的大量計算和內(nèi)存需求對其在資源受限場景的部署提出了挑戰(zhàn)。業(yè)內(nèi)一直在努力開發(fā)旨在提高...
OpenVINO 2024.4持續(xù)提升GPU上LLM性能
本次新版本在整個 OpenVINO 產(chǎn)品系列中引入了重要的功能和性能變化,使大語言模型 (LLM) 的優(yōu)化和部署在所有支持的場景中更容易、性能更高,包括...
編輯推薦廠商產(chǎn)品技術(shù)軟件/工具OS/語言教程專題
電機控制 | DSP | 氮化鎵 | 功率放大器 | ChatGPT | 自動駕駛 | TI | 瑞薩電子 |
BLDC | PLC | 碳化硅 | 二極管 | OpenAI | 元宇宙 | 安森美 | ADI |
無刷電機 | FOC | IGBT | 逆變器 | 文心一言 | 5G | 英飛凌 | 羅姆 |
直流電機 | PID | MOSFET | 傳感器 | 人工智能 | 物聯(lián)網(wǎng) | NXP | 賽靈思 |
步進電機 | SPWM | 充電樁 | IPM | 機器視覺 | 無人機 | 三菱電機 | ST |
伺服電機 | SVPWM | 光伏發(fā)電 | UPS | AR | 智能電網(wǎng) | 國民技術(shù) | Microchip |
Arduino | BeagleBone | 樹莓派 | STM32 | MSP430 | EFM32 | ARM mbed | EDA |
示波器 | LPC | imx8 | PSoC | Altium Designer | Allegro | Mentor | Pads |
OrCAD | Cadence | AutoCAD | 華秋DFM | Keil | MATLAB | MPLAB | Quartus |
C++ | Java | Python | JavaScript | node.js | RISC-V | verilog | Tensorflow |
Android | iOS | linux | RTOS | FreeRTOS | LiteOS | RT-THread | uCOS |
DuerOS | Brillo | Windows11 | HarmonyOS |