欧美 国产 日本-欧美 国产 日韩 第一页-欧美 日产 国产精品-欧美 日韩 国产 在线-极品福利视频-极品成人

首頁(yè) > 知識(shí)技能 > 知識(shí)技能 > 性能與成本雙贏:實(shí)測(cè)戴爾AI工作站支撐企業(yè)大模型的本地部署與訓(xùn)練

性能與成本雙贏:實(shí)測(cè)戴爾AI工作站支撐企業(yè)大模型的本地部署與訓(xùn)練

發(fā)布時(shí)間:2024-10-12 22:05:29來(lái)源: 13041198719
談到大模型私有化部署,很多人會(huì)首先想到數(shù)據(jù)中心,以為動(dòng)輒就得使用很多臺(tái)服務(wù)來(lái)支撐。一些中小企業(yè)或者應(yīng)用部門(mén),主要做知識(shí)庫(kù)和智能體方向的應(yīng)用,模型大小基本在70B以?xún)?nèi)。只要搭配合理,用本地的專(zhuān)業(yè)工作站同樣可以訓(xùn)練推理,算得上極具性?xún)r(jià)比的方案了。
 
隨著OpenAI o1-preview的發(fā)布,大模型已經(jīng)越發(fā)成熟,距離走入企業(yè)生產(chǎn)應(yīng)用已經(jīng)很近了。但OpenAI提供訪(fǎng)問(wèn)的次數(shù)非常有限,這給企業(yè)用戶(hù)的AI應(yīng)用普及帶來(lái)了一定的費(fèi)用焦慮和困擾。為了應(yīng)對(duì)日益增長(zhǎng)的訪(fǎng)問(wèn)頻率需求,越來(lái)越多的企業(yè)用戶(hù)傾向于大模型的本地化部署。大模型本地部署可以極大地降低數(shù)據(jù)泄漏的風(fēng)險(xiǎn),而且系統(tǒng)響應(yīng)速度和實(shí)時(shí)性更強(qiáng),在一些需要快速反饋的場(chǎng)景里優(yōu)勢(shì)非常明顯,同時(shí)也能應(yīng)對(duì)企業(yè)個(gè)性化需求。
 
通過(guò)在傳統(tǒng)數(shù)據(jù)中心上進(jìn)行本地大模型部署的方法,會(huì)對(duì)IT設(shè)施帶來(lái)比較大的挑戰(zhàn),因?yàn)閺挠?jì)算資源來(lái)說(shuō),很多企業(yè)的數(shù)據(jù)中心計(jì)算資源很緊張,而且擴(kuò)展成本比較高,甚至有些中小企業(yè)還不具備搭建數(shù)據(jù)中心的能力。所幸的是,對(duì)于知識(shí)庫(kù)等企業(yè)級(jí)AI 應(yīng)用來(lái)說(shuō),完全可以用高配的AI工作站來(lái)應(yīng)對(duì)計(jì)算需求,以經(jīng)濟(jì)高效的方式減輕對(duì)數(shù)據(jù)中心計(jì)算資源的壓力,從而降低云服務(wù)的成本支出。
 
這次我們選用的是Dell Precision 7960 Tower,搭載了4張「NVIDIA RTX 5880 Ada 」顯卡,每張顯卡顯存48GB,相當(dāng)于在1臺(tái)工作站里就能最多有192GB顯存,完全可以部署Llama3.1 70B模型。
 
 
Dell Precision 7960 Tower
 
70B模型擁有700億參數(shù)量,在語(yǔ)言理解和生成方面具有顯著優(yōu)勢(shì),已經(jīng)能夠滿(mǎn)足常見(jiàn)的企業(yè)級(jí)AI應(yīng)用,比如知識(shí)庫(kù)應(yīng)用、對(duì)話(huà)問(wèn)答等,同時(shí)多任務(wù)處理能力也很強(qiáng),可以支持企業(yè)在一個(gè)統(tǒng)一的平臺(tái)上運(yùn)行多種AI 應(yīng)用。同時(shí),開(kāi)源大模型70B的開(kāi)放和靈活使得它在市場(chǎng)上具有廣泛的適用性,大大降低企業(yè)的使用成本。而且量化后的70B模型僅占70G的顯存,非常適合部署在工作站上,降低計(jì)算資源方面的成本。
 
購(gòu)置機(jī)器前我們做了相對(duì)完整的測(cè)試和驗(yàn)證,包括推理、訓(xùn)練和噪音測(cè)試,下面給大家分享一些數(shù)據(jù)。
 
一、測(cè)試環(huán)境
硬件配置:
硬件平臺(tái):Dell Precision 7960 Tower
 
CPU: Intel(R) Xeon(R) w5-3433
 
內(nèi)存:64G DDR5 * 8
 
GPU: NVIDIA RTX 5880 ada * 4
 
軟件平臺(tái)環(huán)境:
操作系統(tǒng):ubuntu22.04
 
Driver Version: 550.107.02
 
CUDA: 12.1
 
軟件包:conda python3.10 torch2.4 vllm0.6.1
 
測(cè)試模型:
這次我們分別測(cè)試了單GPU、雙GPU以及四卡GPU的表現(xiàn)情況。并在不同的模型下進(jìn)行測(cè)試,模型參數(shù)分別為8B/13B/32B/70B,具體模型名稱(chēng)如下:
 
Meta-Llama-3.1-8B-Instruct
 
Baichuan2-13B-Chat
 
Qwen1.5-32B-Chat
 
Meta-Llama-3.1-70B-Instruct
 
說(shuō)明:接下來(lái)的推理測(cè)試,會(huì)使用FP16或FP8格式進(jìn)行測(cè)試。在模型名稱(chēng)的后綴,如果有FP8字樣,則使用的是FP8格式,否則使用的是FP16格式。
 
FP8是NVIDIA、Arm、Intel聯(lián)合推出的8位浮點(diǎn)數(shù)據(jù)格式,用于加速深度學(xué)習(xí)訓(xùn)練和推理。相對(duì)于常用的半精度FP16而言,F(xiàn)P8在不損失多少精度的情況下,將顯存的占用大小減少了一半,特別適合于將大模型部署于工作站上。FP8訓(xùn)練利用E5M2/E4M3格式,具備與FP16相當(dāng)?shù)膭?dòng)態(tài)范圍,適用于反向傳播與前向傳播。FP8訓(xùn)練在相同加速平臺(tái)上的峰值性能顯著超越FP16/BF16,并且模型參數(shù)越大,訓(xùn)練加速效果越好,且其與16-bits訓(xùn)練在收斂性和下游任務(wù)表現(xiàn)上無(wú)顯著差異。
 
推理框架:
vllm推理引擎來(lái)進(jìn)行測(cè)試,為最大程度利用GPU顯存,將其GPU utilization參數(shù)設(shè)置為0.99。
 
述語(yǔ)說(shuō)明:
Batch size: 推理或訓(xùn)練時(shí)輸入的數(shù)據(jù)批量數(shù)量,為1表示單個(gè)輸入,例如一段文字,為2表明同時(shí)進(jìn)行兩段文字的生成,以此類(lèi)推。它代表的是用戶(hù)并發(fā)數(shù)量。
 
token/s:推理或訓(xùn)練的速度,每秒生成的數(shù)量。一個(gè)token是代表一個(gè)單詞或詞根,如果是中文的話(huà),可能是一個(gè)字或一個(gè)詞。
 
AI 應(yīng)用場(chǎng)景測(cè)試列表

 

知識(shí)技能更多>>

寧德時(shí)代參投新公司,哪吒汽車(chē)轉(zhuǎn)經(jīng)銷(xiāo)商,極氪007GT等新車(chē)型來(lái)襲 預(yù)計(jì)2026年發(fā)布 新款保時(shí)捷Cayenne Coupe諜照曝光 豐田皇冠威爾法墨金版上市,91.9萬(wàn)起售,配置升級(jí)能否打動(dòng)你? 2025款?yuàn)W迪Q2L降價(jià)上市,配置微調(diào),售價(jià)17.18-21萬(wàn)元 智能網(wǎng)聯(lián)與快速充電技術(shù)齊亮相2025武漢新能源汽車(chē)技術(shù)及充電樁展會(huì)揭示新能源車(chē)新趨勢(shì) 領(lǐng)克900首發(fā):SPA Evo架構(gòu)旗艦SUV,能否撼動(dòng)大型SUV市場(chǎng)? 法拉第未來(lái)FX首款原型車(chē)諜照曝光,網(wǎng)友:魏牌高山換了個(gè)模具? 搭載高通驍龍數(shù)字底盤(pán) 零跑B10或售13萬(wàn)起 等等再出手 四款國(guó)產(chǎn)SUV來(lái)襲 比亞迪唐L、領(lǐng)克900領(lǐng)銜 推薦奢享版 2025款名爵MG7購(gòu)車(chē)指南 大眾牽手小鵬,合力打造超20000個(gè)自營(yíng)充電終端 嵐圖汽車(chē)首發(fā)LFC超級(jí)后驅(qū)技術(shù),既防眩暈,又抗甩尾! 這三款車(chē)企車(chē)型為何遇冷? 增長(zhǎng)29%!蘇州金龍2024年銷(xiāo)售額超百億 從燃油到新能源,這個(gè)品牌為何從沒(méi)有能力天花板? 2025誰(shuí)是下一家盈利的新勢(shì)力汽車(chē)車(chē)企? 730馬力!Brabus爆改AMG CLC 63 SE 零百加速3.3秒 速騰換殼 捷達(dá)VA7量產(chǎn)下線(xiàn) 預(yù)售12萬(wàn)元起 22.48萬(wàn)起 北京BJ40魔核電驅(qū)版開(kāi)啟預(yù)售 配增程系統(tǒng)/綜合續(xù)航1200km 彰顯中國(guó)品牌實(shí)力 比亞迪海豹拿下日本年度風(fēng)云車(chē)大獎(jiǎng) 降價(jià)6000美元 2025款美版豐田bZ4X上市 配置小幅升級(jí) 有望明年上半年上市 奧迪Q6L e-tron投產(chǎn) A6 e-tron隨后跟進(jìn) 2.9秒破百 BRABUS爆改AMG GT 63 Coupe 動(dòng)力大幅升級(jí) 最高降價(jià)8.5萬(wàn)元 Jeep牧馬人4xe價(jià)格調(diào)整 49.99萬(wàn)元起 名爵MG ES5昆明亮相,首批車(chē)主交車(chē),最低僅售9.99萬(wàn)元起! 海馬汽車(chē)攜多項(xiàng)專(zhuān)利亮相2024海南國(guó)際知識(shí)產(chǎn)權(quán)交易大會(huì) 余承東攜手“四界”領(lǐng)導(dǎo)人亮相央視,揭秘鴻蒙智行背后的故事 當(dāng)?shù)厥蹆r(jià)916.9萬(wàn)起!極石ROX 01正式亮相俄羅斯市場(chǎng) Momenta獲德國(guó)TÜV萊茵ISO 26262 ASIL D功能安全產(chǎn)品認(rèn)證 蓋世汽車(chē)榮獲“AUTOSAR中國(guó)中心年度特別貢獻(xiàn)獎(jiǎng)”
主站蜘蛛池模板: 在线观看色视频 | 狂野欧美性猛交xxxx免费 | 麻豆福利视频 | 国产99r视频精品免费观看 | 国产91第一页 | 精品综合网 | 国产成人精品午夜免费 | 久久精品国产eeuss | 免费一区在线观看 | 日日天日日夜日日摸 | 国产专区中文字幕 | 第一色网站 | 视频福利网 | 视频免费观看在线播放高清 | 四虎免费影院在线播放 | 毛片特黄 | 久久久香蕉 | 一级毛片免费视频观看 | 国产精品亚洲综合网站 | 草草精品视频 | 最近中文字幕无吗免费高清 | 日韩中文精品亚洲第三区 | 孕妇孕妇aaaaa级毛片视频 | 国产91精品久久久久久 | 一级毛片一级毛片一级毛片 | 日韩中文有码高清 | 亚洲精品影院久久久久久 | 四虎影院免费在线 | 四虎影院免费视频 | 国产高清在线精品一区二区三区 | 亚洲国产日韩欧美综合久久 | 亚洲美女视频网站 | 正在播放国产尾随丝袜美女 | 久久九九有精品国产56 | 亚洲国产高清在线精品一区 | 国产精品视频福利 | 成人四虎影院 | 久久久久久久久久综合情日本 | 很黄的孕妇a级黄毛片 | 性五月天 | 全黄a一级毛片 |