完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>
標(biāo)簽 > LLM
在人工智能領(lǐng)域,LLM代表“大型語(yǔ)言模型”。在人工智能(AI)領(lǐng)域自然語(yǔ)言處理(NLP)是一個(gè)快速進(jìn)展的領(lǐng)域。NLP中最重要是大語(yǔ)言模型(LLM)。大語(yǔ)言模型(英文:Large Language Model,縮寫(xiě)LLM),也稱(chēng)大型語(yǔ)言模型,是一種基于機(jī)器學(xué)習(xí)和自然語(yǔ)言處理技術(shù)的模型。
文章:319個(gè) 瀏覽:701次 帖子:3個(gè)
使用NVIDIA Triton和TensorRT-LLM部署TTS應(yīng)用的最佳實(shí)踐
針對(duì)基于 Diffusion 和 LLM 類(lèi)別的 TTS 模型,NVIDIA Triton 和 TensorRT-LLM 方案能顯著提升推理速度。在單張...
LM Studio使用NVIDIA技術(shù)加速LLM性能
隨著 AI 使用場(chǎng)景不斷擴(kuò)展(從文檔摘要到定制化軟件代理),開(kāi)發(fā)者和技術(shù)愛(ài)好者正在尋求以更 快、更靈活的方式來(lái)運(yùn)行大語(yǔ)言模型(LLM)。
小白學(xué)大模型:從零實(shí)現(xiàn) LLM語(yǔ)言模型
在當(dāng)今人工智能領(lǐng)域,大型語(yǔ)言模型(LLM)的開(kāi)發(fā)已經(jīng)成為一個(gè)熱門(mén)話題。這些模型通過(guò)學(xué)習(xí)大量的文本數(shù)據(jù),能夠生成自然語(yǔ)言文本,完成各種復(fù)雜的任務(wù),如寫(xiě)作、...
2025年,如何提升大型語(yǔ)言模型(LLM)的推理能力成了最熱門(mén)的話題之一,大量?jī)?yōu)化推理能力的新策略開(kāi)始出現(xiàn),包括擴(kuò)展推理時(shí)間計(jì)算、運(yùn)用強(qiáng)化學(xué)習(xí)、開(kāi)展監(jiān)督...
樹(shù)莓派秒變編程助手:Ollama+Continue的簡(jiǎn)易搭建教程!
以下是如何在RaspberryPi上運(yùn)行大型語(yǔ)言模型(LLM)的方法。本文的目標(biāo)是找出在RaspberryPi上運(yùn)行LLM是否是ChatGPT和GitH...
2025-03-27 標(biāo)簽:Raspberry Pi樹(shù)莓派LLM 215 0
基于DBFP與DB-Attn的算法硬件協(xié)同優(yōu)化方案
本文討論了LLM推理過(guò)程對(duì)計(jì)算資源需求急劇攀升的背景下,現(xiàn)有量化和剪枝技術(shù)、新數(shù)據(jù)格式存在的不足,提出動(dòng)態(tài)塊浮點(diǎn)數(shù)(DBFP)及其配套算法-硬件協(xié)同框架...
內(nèi)部業(yè)務(wù)支撐&前瞻技術(shù)布局 One4All下一代生成式推薦系統(tǒng)
作者:京東零售 申磊 自LLM在自然語(yǔ)言處理等領(lǐng)域取得了矚目成就之后,學(xué)術(shù)界積極探索生成式模型對(duì)搜廣推系統(tǒng)的增強(qiáng)或改進(jìn)方式[1],現(xiàn)有工作大體可以分為兩...
隨著 DeepSeek、 GPT 和 Llama 等大語(yǔ)言模型(LLMs)不斷推動(dòng)人工智能的邊界,它們?cè)诟咝Р渴鸱矫嬉矌?lái)了重大挑戰(zhàn)。這些模型在生成類(lèi)似...
NVIDIA大語(yǔ)言模型在推薦系統(tǒng)中的應(yīng)用實(shí)踐
推薦系統(tǒng)的主要任務(wù)在于根據(jù)用戶的過(guò)往行為預(yù)測(cè)其潛在興趣點(diǎn),并據(jù)此推薦相應(yīng)的商品。在傳統(tǒng)的推薦系統(tǒng)中,當(dāng)處理用戶請(qǐng)求時(shí),會(huì)觸發(fā)多個(gè)召回模塊,例如熱門(mén)商品召...
2025-03-05 標(biāo)簽:NVIDIA模型推薦系統(tǒng) 707 0
用PaddleNLP在4060單卡上實(shí)踐大模型預(yù)訓(xùn)練技術(shù)
作者:算力魔方創(chuàng)始人/英特爾創(chuàng)新大使劉力 之前我們分享了《從零開(kāi)始訓(xùn)練一個(gè)大語(yǔ)言模型需要投資多少錢(qián)》,其中高昂的預(yù)訓(xùn)練費(fèi)用讓許多對(duì)大模型預(yù)訓(xùn)練技術(shù)感興趣...
2025-02-19 標(biāo)簽:數(shù)據(jù)集大模型LLM 890 0
0
0
【大規(guī)模語(yǔ)言模型:從理論到實(shí)踐】- 每日進(jìn)步一點(diǎn)點(diǎn)
標(biāo)簽:機(jī)器學(xué)習(xí)大模型LLM 2347 0
在零售技術(shù)做AI的95后:我們這樣搞定技術(shù)難題
? ? 在京東零售技術(shù)團(tuán)隊(duì)中,有很多年輕的算法工程師,他們大多是95后,在加入京東的短短幾年內(nèi),用實(shí)力“啃”下了一個(gè)個(gè)硬骨頭。 從大模型訓(xùn)練的效率優(yōu)化、...
-Arya.ai推出MCP應(yīng)用程序,將通用LLM轉(zhuǎn)化為特定領(lǐng)域?qū)<?印度孟買(mǎi)和紐約2025年5月13日?/美通社/ -- Arya.ai今天宣布推出AP...
新品 | Module LLM Kit,離線大語(yǔ)言模型推理模塊套裝
●●●PART.01產(chǎn)品簡(jiǎn)介ModuleLLMKit是一款專(zhuān)注于離線AI推理與數(shù)據(jù)通信接口應(yīng)用的智能模塊套件,整合了ModuleLLM與Module13...
英偉達(dá)GTC2025亮點(diǎn):電信行業(yè)領(lǐng)先企業(yè)啟用代理式AI優(yōu)化網(wǎng)絡(luò)運(yùn)維
Amdocs、BubbleRAN、ServiceNow、軟銀集團(tuán)與 Tech Mahindra 基于 NVIDIA AI Enterprise 開(kāi)發(fā)大型...
使用 AnythingLLM 輕松部署本地知識(shí)庫(kù)!
作者:算力魔方創(chuàng)始人/英特爾創(chuàng)新大使劉力 一,簡(jiǎn)介 AnythingLLM 是一個(gè)功能強(qiáng)大且靈活的工具,專(zhuān)為在本地環(huán)境中部署和管理知識(shí)庫(kù)而設(shè)計(jì)。它支持多...
2025-03-21 標(biāo)簽:知識(shí)庫(kù)LLM 1042 0
大模型基礎(chǔ)能力越來(lái)越高,各行各業(yè)都希望運(yùn)用AIGC降本增收,卻面臨如何結(jié)合自身業(yè)務(wù)場(chǎng)景優(yōu)化的難題。為了幫助客戶快速打造符合其業(yè)務(wù)需求的AIGC應(yīng)用,足下...
AI的“隨機(jī)性”挑戰(zhàn):它們比人類(lèi)更“不隨機(jī)”?
你有沒(méi)有想過(guò),人類(lèi)真的能做出完全隨機(jī)的選擇嗎?答案可能出乎你的意料。事實(shí)上,人類(lèi)天生就不擅長(zhǎng)“隨機(jī)”,我們總能在看似無(wú)序的事物中發(fā)現(xiàn)規(guī)律,甚至在本該隨機(jī)...
TeleAI提出COPO對(duì)齊方法:8B模型超越Llama3-70B的表現(xiàn)
在自然界中,好奇心驅(qū)使著生物探索未知,是生存和進(jìn)化的關(guān)鍵。人類(lèi),作為地球上最具智能的物種,其探索精神引領(lǐng)了科技、文化和社會(huì)的進(jìn)步。1492 年,哥倫布懷...
實(shí)戰(zhàn)案例 | 眺望RK3588 RKLLM部署DeepSeek-R1全流程
前言:在RK3588上部署Deepseek有兩種方法,分別是使用Ollama工具部署和使用瑞芯微官方的RKLLM量化部署。Ollama是一個(gè)開(kāi)源的大模型...
大模型遭遇算力墻,探索超級(jí)應(yīng)用的發(fā)展路徑
最近,開(kāi)源中國(guó) OSCHINA、Gitee 與 Gitee AI? 全文如下: 大模型撞上 “算力墻”,超級(jí)應(yīng)用的探尋之路 文 / 傅聰 近日,大模型教...
編輯推薦廠商產(chǎn)品技術(shù)軟件/工具OS/語(yǔ)言教程專(zhuān)題
電機(jī)控制 | DSP | 氮化鎵 | 功率放大器 | ChatGPT | 自動(dòng)駕駛 | TI | 瑞薩電子 |
BLDC | PLC | 碳化硅 | 二極管 | OpenAI | 元宇宙 | 安森美 | ADI |
無(wú)刷電機(jī) | FOC | IGBT | 逆變器 | 文心一言 | 5G | 英飛凌 | 羅姆 |
直流電機(jī) | PID | MOSFET | 傳感器 | 人工智能 | 物聯(lián)網(wǎng) | NXP | 賽靈思 |
步進(jìn)電機(jī) | SPWM | 充電樁 | IPM | 機(jī)器視覺(jué) | 無(wú)人機(jī) | 三菱電機(jī) | ST |
伺服電機(jī) | SVPWM | 光伏發(fā)電 | UPS | AR | 智能電網(wǎng) | 國(guó)民技術(shù) | Microchip |
Arduino | BeagleBone | 樹(shù)莓派 | STM32 | MSP430 | EFM32 | ARM mbed | EDA |
示波器 | LPC | imx8 | PSoC | Altium Designer | Allegro | Mentor | Pads |
OrCAD | Cadence | AutoCAD | 華秋DFM | Keil | MATLAB | MPLAB | Quartus |
C++ | Java | Python | JavaScript | node.js | RISC-V | verilog | Tensorflow |
Android | iOS | linux | RTOS | FreeRTOS | LiteOS | RT-THread | uCOS |
DuerOS | Brillo | Windows11 | HarmonyOS |