完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>
標(biāo)簽 > llm
在人工智能領(lǐng)域,LLM代表“大型語(yǔ)言模型”。在人工智能(AI)領(lǐng)域自然語(yǔ)言處理(NLP)是一個(gè)快速進(jìn)展的領(lǐng)域。NLP中最重要是大語(yǔ)言模型(LLM)。大語(yǔ)言模型(英文:Large Language Model,縮寫(xiě)LLM),也稱大型語(yǔ)言模型,是一種基于機(jī)器學(xué)習(xí)和自然語(yǔ)言處理技術(shù)的模型。
文章:337個(gè) 瀏覽:1188次 帖子:3個(gè)
探索無(wú)限可能:生成式推薦的演進(jìn)、前沿與挑戰(zhàn)
TL;DR 過(guò)去一年間,生成式推薦取得了長(zhǎng)足的實(shí)質(zhì)性進(jìn)展,特別是在憑借大型語(yǔ)言模型強(qiáng)大的序列建模與推理能力提升整體推薦性能方面?;贚LM(Large ...
TensorRT-LLM的大規(guī)模專家并行架構(gòu)設(shè)計(jì)
之前文章已介紹引入大規(guī)模 EP 的初衷,本篇將繼續(xù)深入介紹 TensorRT-LLM 的大規(guī)模專家并行架構(gòu)設(shè)計(jì)與創(chuàng)新實(shí)現(xiàn)。
2025-09-23 標(biāo)簽:cpu機(jī)器學(xué)習(xí)LLM 424 0
6TOPS算力驅(qū)動(dòng)30億參數(shù)LLM,米爾RK3576部署端側(cè)多模態(tài)多輪對(duì)話
關(guān)鍵詞:瑞芯微RK3576、NPU(神經(jīng)網(wǎng)絡(luò)處理器)、端側(cè)小語(yǔ)言模型(SLM)、多模態(tài)LLM、邊緣AI部署、開(kāi)發(fā)板當(dāng)GPT-4o用毫秒級(jí)響應(yīng)處理圖文混合...
3萬(wàn)字長(zhǎng)文!深度解析大語(yǔ)言模型LLM原理
我們正在參加全球電子成就獎(jiǎng)的評(píng)選,歡迎大家?guī)臀覀兺镀薄x謝支持本文轉(zhuǎn)自:騰訊技術(shù)工程作者:royceshao大語(yǔ)言模型LLM的精妙之處在于很好地利用...
DeepSeek R1 MTP在TensorRT-LLM中的實(shí)現(xiàn)與優(yōu)化
TensorRT-LLM 在 NVIDIA Blackwell GPU 上創(chuàng)下了 DeepSeek-R1 推理性能的世界紀(jì)錄,Multi-Token P...
在之前的技術(shù)博客中,我們介紹了低延遲[1] 和高吞吐[2] 場(chǎng)景的優(yōu)化方法。對(duì)于生產(chǎn)部署,用戶還關(guān)心在滿足特定延遲約束的情況下,每個(gè) GPU 的吞吐表現(xiàn)...
軟件測(cè)試正經(jīng)歷一場(chǎng)深刻的技術(shù)革命。AI,尤其是以GPT、通義千問(wèn)、文心一言、Claude等為代表的大語(yǔ)言模型(LLM),開(kāi)始廣泛介入測(cè)試流程:從需求分析...
利用自壓縮實(shí)現(xiàn)大型語(yǔ)言模型高效縮減
隨著語(yǔ)言模型規(guī)模日益龐大,設(shè)備端推理變得越來(lái)越緩慢且耗能巨大。一個(gè)直接且效果出人意料的解決方案是剪除那些對(duì)任務(wù)貢獻(xiàn)甚微的完整通道(channel)。我們...
RK3568自制底板狂丟包?教你5分鐘用Delayline一鍵復(fù)活網(wǎng)口
在使用飛凌嵌入式RK3568核心板搭配自制底板時(shí),由于PCB走線與參考設(shè)計(jì)存在差異,常導(dǎo)致RGMII接口時(shí)序異常,進(jìn)而出現(xiàn)網(wǎng)口不通或頻繁丟包的情況。本文...
NVIDIA Blackwell GPU優(yōu)化DeepSeek-R1性能 打破DeepSeek-R1在最小延遲場(chǎng)景中的性能紀(jì)錄
本文將探討 NVIDIA TensorRT-LLM 如何基于 8 個(gè) NVIDIA Blackwell GPU 的配置,打破 DeepSeek-R1 在...
使用NVIDIA Triton和TensorRT-LLM部署TTS應(yīng)用的最佳實(shí)踐
針對(duì)基于 Diffusion 和 LLM 類別的 TTS 模型,NVIDIA Triton 和 TensorRT-LLM 方案能顯著提升推理速度。在單張...
LM Studio使用NVIDIA技術(shù)加速LLM性能
隨著 AI 使用場(chǎng)景不斷擴(kuò)展(從文檔摘要到定制化軟件代理),開(kāi)發(fā)者和技術(shù)愛(ài)好者正在尋求以更 快、更靈活的方式來(lái)運(yùn)行大語(yǔ)言模型(LLM)。
小白學(xué)大模型:從零實(shí)現(xiàn) LLM語(yǔ)言模型
在當(dāng)今人工智能領(lǐng)域,大型語(yǔ)言模型(LLM)的開(kāi)發(fā)已經(jīng)成為一個(gè)熱門(mén)話題。這些模型通過(guò)學(xué)習(xí)大量的文本數(shù)據(jù),能夠生成自然語(yǔ)言文本,完成各種復(fù)雜的任務(wù),如寫(xiě)作、...
2025年,如何提升大型語(yǔ)言模型(LLM)的推理能力成了最熱門(mén)的話題之一,大量?jī)?yōu)化推理能力的新策略開(kāi)始出現(xiàn),包括擴(kuò)展推理時(shí)間計(jì)算、運(yùn)用強(qiáng)化學(xué)習(xí)、開(kāi)展監(jiān)督...
樹(shù)莓派秒變編程助手:Ollama+Continue的簡(jiǎn)易搭建教程!
以下是如何在RaspberryPi上運(yùn)行大型語(yǔ)言模型(LLM)的方法。本文的目標(biāo)是找出在RaspberryPi上運(yùn)行LLM是否是ChatGPT和GitH...
2025-03-27 標(biāo)簽:Raspberry Pi樹(shù)莓派LLM 415 0
基于DBFP與DB-Attn的算法硬件協(xié)同優(yōu)化方案
本文討論了LLM推理過(guò)程對(duì)計(jì)算資源需求急劇攀升的背景下,現(xiàn)有量化和剪枝技術(shù)、新數(shù)據(jù)格式存在的不足,提出動(dòng)態(tài)塊浮點(diǎn)數(shù)(DBFP)及其配套算法-硬件協(xié)同框架...
內(nèi)部業(yè)務(wù)支撐&前瞻技術(shù)布局 One4All下一代生成式推薦系統(tǒng)
作者:京東零售 申磊 自LLM在自然語(yǔ)言處理等領(lǐng)域取得了矚目成就之后,學(xué)術(shù)界積極探索生成式模型對(duì)搜廣推系統(tǒng)的增強(qiáng)或改進(jìn)方式[1],現(xiàn)有工作大體可以分為兩...
隨著 DeepSeek、 GPT 和 Llama 等大語(yǔ)言模型(LLMs)不斷推動(dòng)人工智能的邊界,它們?cè)诟咝Р渴鸱矫嬉矌?lái)了重大挑戰(zhàn)。這些模型在生成類似...
NVIDIA大語(yǔ)言模型在推薦系統(tǒng)中的應(yīng)用實(shí)踐
推薦系統(tǒng)的主要任務(wù)在于根據(jù)用戶的過(guò)往行為預(yù)測(cè)其潛在興趣點(diǎn),并據(jù)此推薦相應(yīng)的商品。在傳統(tǒng)的推薦系統(tǒng)中,當(dāng)處理用戶請(qǐng)求時(shí),會(huì)觸發(fā)多個(gè)召回模塊,例如熱門(mén)商品召...
2025-03-05 標(biāo)簽:NVIDIA模型推薦系統(tǒng) 1.2k 0
用PaddleNLP在4060單卡上實(shí)踐大模型預(yù)訓(xùn)練技術(shù)
作者:算力魔方創(chuàng)始人/英特爾創(chuàng)新大使劉力 之前我們分享了《從零開(kāi)始訓(xùn)練一個(gè)大語(yǔ)言模型需要投資多少錢(qián)》,其中高昂的預(yù)訓(xùn)練費(fèi)用讓許多對(duì)大模型預(yù)訓(xùn)練技術(shù)感興趣...
2025-02-19 標(biāo)簽:數(shù)據(jù)集大模型LLM 1.8k 0
編輯推薦廠商產(chǎn)品技術(shù)軟件/工具OS/語(yǔ)言教程專題
電機(jī)控制 | DSP | 氮化鎵 | 功率放大器 | ChatGPT | 自動(dòng)駕駛 | TI | 瑞薩電子 |
BLDC | PLC | 碳化硅 | 二極管 | OpenAI | 元宇宙 | 安森美 | ADI |
無(wú)刷電機(jī) | FOC | IGBT | 逆變器 | 文心一言 | 5G | 英飛凌 | 羅姆 |
直流電機(jī) | PID | MOSFET | 傳感器 | 人工智能 | 物聯(lián)網(wǎng) | NXP | 賽靈思 |
步進(jìn)電機(jī) | SPWM | 充電樁 | IPM | 機(jī)器視覺(jué) | 無(wú)人機(jī) | 三菱電機(jī) | ST |
伺服電機(jī) | SVPWM | 光伏發(fā)電 | UPS | AR | 智能電網(wǎng) | 國(guó)民技術(shù) | Microchip |
Arduino | BeagleBone | 樹(shù)莓派 | STM32 | MSP430 | EFM32 | ARM mbed | EDA |
示波器 | LPC | imx8 | PSoC | Altium Designer | Allegro | Mentor | Pads |
OrCAD | Cadence | AutoCAD | 華秋DFM | Keil | MATLAB | MPLAB | Quartus |
C++ | Java | Python | JavaScript | node.js | RISC-V | verilog | Tensorflow |
Android | iOS | linux | RTOS | FreeRTOS | LiteOS | RT-THread | uCOS |
DuerOS | Brillo | Windows11 | HarmonyOS |