91欧美超碰AV自拍|国产成年人性爱视频免费看|亚洲 日韩 欧美一厂二区入|人人看人人爽人人操aV|丝袜美腿视频一区二区在线看|人人操人人爽人人爱|婷婷五月天超碰|97色色欧美亚州A√|另类A√无码精品一级av|欧美特级日韩特级

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

Amazon EC2 Inf2實(shí)例正式可用 助力低成本、高性能的生成式AI推理

全球TMT ? 來源:全球TMT ? 作者:全球TMT ? 2023-04-21 14:33 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

深度學(xué)習(xí)(DL)的創(chuàng)新,特別是大語言模型(LLM)的快速發(fā)展,已經(jīng)席卷了整個(gè)行業(yè)。深度學(xué)習(xí)模型的參數(shù)已從數(shù)百萬增加到數(shù)十億,為我們呈現(xiàn)了越來越多激動(dòng)人心的新能力。它們正在催生新的應(yīng)用,如生成式AI或醫(yī)療保健和生命科學(xué)的高級研究。亞馬遜云科技一直在芯片、服務(wù)器、數(shù)據(jù)中心互連和軟件服務(wù)等多個(gè)方面創(chuàng)新,加速深度學(xué)習(xí)工作負(fù)載的大規(guī)模應(yīng)用。

亞馬遜云科技在2022 re:Invent 全球大會(huì)上,以其最新的自研機(jī)器學(xué)習(xí)推理芯片Amazon Inferentia2為基礎(chǔ),發(fā)布了AmazonEC2 Inf2系列實(shí)例的預(yù)覽版。AmazonEC2 Inf2類型實(shí)例專門針對全球大規(guī)模運(yùn)行高性能深度學(xué)習(xí)推理應(yīng)用程序,為部署在EC2上的生成式AI應(yīng)用提供最佳性價(jià)比,其中包含GPT-J或開放式預(yù)訓(xùn)練Transformer(OPT)語言模型。

現(xiàn)在,亞馬遜云科技宣布Amazon EC2 Inf2實(shí)例正式可用。

Inf2實(shí)例是AmazonEC2上首個(gè)推理優(yōu)化的實(shí)例,支持可擴(kuò)展的分布式推理,可實(shí)現(xiàn)多個(gè)inferentia2芯片之間的超高速連接。用戶可以在Inf2實(shí)例中跨多個(gè)芯片高效部署具有數(shù)千億個(gè)參數(shù)的模型。與Amazon EC2 Inf1實(shí)例相比,Inf2實(shí)例的吞吐量提高4倍,延遲降低10倍。

新Inf2實(shí)例的亮點(diǎn)

Inf2實(shí)例目前有四種可用實(shí)例類型,最高擴(kuò)展至12個(gè)Amazon Inferentia2芯片和192個(gè)vCPU配置。在BF16或FP16數(shù)據(jù)類型下,它們能夠提供2.3 petaFLOPS的綜合計(jì)算能力,并具有芯片間超高速NeuronLink互連的功能。NeuronLink可在多個(gè)Inferentia2芯片上擴(kuò)展大模型,避免通信瓶頸,實(shí)現(xiàn)更高性能的推理。

每個(gè)Inferentia2芯片內(nèi)有32 GB的高帶寬內(nèi)存(HBM),最高配置的Inf2 實(shí)例可提供高達(dá)384 GB的共享加速器內(nèi)存,總內(nèi)存帶寬為9.8 TB/s。對于需要大內(nèi)存支持的的大型語言模型而言,這種帶寬對于支持模型推理尤為重要。

基于專門為深度學(xué)習(xí)工作負(fù)載而構(gòu)建的Amazon Inferentia2芯片的Amazon EC2 Inf2,相比同類實(shí)例,單位功率性能高出了50%。

AmazonInferentia2的創(chuàng)新之處

與亞馬遜自研機(jī)器學(xué)習(xí)訓(xùn)練芯片Amazon Trainium類似,每個(gè)Amazon Inferentia2芯片都配有兩個(gè)經(jīng)過優(yōu)化的NeuronCore-v2引擎、高帶寬內(nèi)存(HBM)堆棧和專用的集體計(jì)算引擎,以便在執(zhí)行多加速器推理時(shí)實(shí)現(xiàn)計(jì)算與通信的并行。

每個(gè)NeuronCore-v2都有專為深度學(xué)習(xí)算法構(gòu)建的標(biāo)量、向量和張量三種引擎,其中張量引擎針對矩陣運(yùn)算進(jìn)行了優(yōu)化;標(biāo)量引擎針對ReLU(修正線性單元)函數(shù)等元素性操作進(jìn)行了優(yōu)化;向量引擎針對批處理規(guī)范化或池化等非元素向量運(yùn)算進(jìn)行了優(yōu)化。

以下是Amazon Inferentia2芯片和服務(wù)器硬件其他創(chuàng)新總結(jié):

數(shù)據(jù)類型——Amazon Inferentia2 支持多種數(shù)據(jù)類型,包括FP32、TF32、BF16、FP16 和UINT8,用戶可以為工作負(fù)載選擇最合適的數(shù)據(jù)類型。它還支持新的可配置FP8(cFP8)數(shù)據(jù)類型,該數(shù)據(jù)類型特別適用于大模型,因?yàn)樗鼫p少了模型的內(nèi)存占用和I/O 要求。

動(dòng)態(tài)執(zhí)行和動(dòng)態(tài)輸入形狀——Amazon Inferentia2 具有支持動(dòng)態(tài)執(zhí)行的嵌入式通用數(shù)字信號處理器DSP),因此無需在主機(jī)上展開或執(zhí)行控制流運(yùn)算符。Amazon Inferentia2 還支持動(dòng)態(tài)輸入形狀,這些形狀對于具有未知輸入張量大小的模型(例如處理文本的模型)至關(guān)重要。

自定義運(yùn)算符——Amazon Inferentia2支持用C++語言編寫的自定義運(yùn)算符。Neuron自定義C++運(yùn)算符使用戶能夠編寫在NeuronCore上天然運(yùn)行的C++自定義運(yùn)算符。用戶可以使用標(biāo)準(zhǔn)的PyTorch自定義運(yùn)算符編程接口將CPU 自定義運(yùn)算符遷移到Neuron 并實(shí)現(xiàn)新的實(shí)驗(yàn)運(yùn)算符,所有這些都無需對NeuronCore 硬件有任何深入了解。

NeuronLink v2——Inf2實(shí)例是AmazonEC2類型中首個(gè)將NeuronLink V2 用于推理優(yōu)化的實(shí)例,NeuronLink v2 為Inferentia2芯片間的提供超高速連接,加強(qiáng)分布式推理性能。NeuronLink v2使用all-reduce等聚合通信(CC)運(yùn)算符,將高性能推理管道擴(kuò)展到所有的推理芯片上。

新Inf2實(shí)例現(xiàn)已可用

用戶可在亞馬遜云科技美東(俄亥俄州)和美東(北弗吉尼亞州)地區(qū)啟動(dòng)Inf2實(shí)例,以按需、預(yù)留和競價(jià)實(shí)例或Savings Plan方式調(diào)用。用戶僅需為其實(shí)際使用的服務(wù)付費(fèi)。如需了解更多相關(guān)信息,請?jiān)L問Amazon EC2定價(jià)網(wǎng)站。

Inf2實(shí)例可使用亞馬遜云科技深度學(xué)習(xí)鏡像進(jìn)行部署,并可通過Amazon SageMaker、Amazon Elastic Kubernetes Service(Amazon EKS)、Amazon Elastic Container Service(Amazon ECS)和Amazon ParallelCluster等托管服務(wù)調(diào)用。

如需了解更多信息,請?jiān)L問Amazon EC2 Inf2實(shí)例頁面,并將相關(guān)反饋發(fā)送給Amazon re:Post for EC2;或垂詢您的AmazonSupport聯(lián)系人。

審核編輯:湯梓紅

聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報(bào)投訴
  • 半導(dǎo)體
    +關(guān)注

    關(guān)注

    339

    文章

    30958

    瀏覽量

    265307
  • AI
    AI
    +關(guān)注

    關(guān)注

    91

    文章

    40366

    瀏覽量

    301945
  • 亞馬遜
    +關(guān)注

    關(guān)注

    8

    文章

    2733

    瀏覽量

    85838
  • 深度學(xué)習(xí)
    +關(guān)注

    關(guān)注

    73

    文章

    5600

    瀏覽量

    124498
  • 生成式AI
    +關(guān)注

    關(guān)注

    0

    文章

    538

    瀏覽量

    1115
收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關(guān)推薦
    熱點(diǎn)推薦

    SGM8541/2/4:低成本高性能CMOS運(yùn)算放大器的卓越之選

    SGM8541/2/4:低成本高性能CMOS運(yùn)算放大器的卓越之選 在電子設(shè)計(jì)的世界里,運(yùn)算放大器是一個(gè)不可或缺的基礎(chǔ)元件。今天,我們要深入探討SGMICRO推出的SGM8541(單通道
    的頭像 發(fā)表于 03-10 11:40 ?150次閱讀

    新品 | AI Pyramid AI Pyramid-Pro,面向本地推理與智能交互的高性能AI PC

    AIPyramid是一款金字塔形狀的高性能AIPC,專為本地AI推理與邊緣智能應(yīng)用而生。內(nèi)置AxeraAX8850SoC,集成八核Cortex-A55處理器與24TOPS@INT8NPU,輕松應(yīng)對
    的頭像 發(fā)表于 02-06 17:24 ?3750次閱讀
    新品 | <b class='flag-5'>AI</b> Pyramid <b class='flag-5'>AI</b> Pyramid-Pro,面向本地<b class='flag-5'>推理</b>與智能交互的<b class='flag-5'>高性能</b><b class='flag-5'>AI</b> PC

    ADA4851系列運(yùn)算放大器:高性能低成本的完美結(jié)合

    ADA4851系列運(yùn)算放大器:高性能低成本的完美結(jié)合 在電子工程師的設(shè)計(jì)世界里,尋找一款性能出色且成本合理的運(yùn)算放大器并非易事。而今天要給大家介紹的ADA4851 - 1/ADA48
    的頭像 發(fā)表于 01-23 16:20 ?239次閱讀

    低成本CMOS高速軌到軌放大器ADA4891-2高性能與多功能的完美結(jié)合

    的ADA4891-1/ADA4891-2/ADA4891-3/ADA4891-4系列CMOS高速放大器,它以低成本實(shí)現(xiàn)高性能,為眾多應(yīng)用場景提供了理想解決方案。 文件下載: ADA4891-2
    的頭像 發(fā)表于 01-22 16:45 ?362次閱讀

    低成本高性能之選,TI單通道模擬開關(guān)助力便攜設(shè)備

    低成本高性能之選,TI單通道模擬開關(guān)助力便攜設(shè)備 在我們?nèi)粘J褂玫碾娮赢a(chǎn)品中,模擬開關(guān)無處不在,它是信號切換和路由的關(guān)鍵部件。好的模擬開關(guān)不僅能提高信號傳輸?shù)馁|(zhì)量,還能降低功耗,延長設(shè)備的續(xù)航時(shí)間
    的頭像 發(fā)表于 01-15 09:30 ?216次閱讀

    亞馬遜云科技推出全新的Amazon AI Factories 將客戶現(xiàn)有基礎(chǔ)設(shè)施轉(zhuǎn)化為高性能AI環(huán)境

    亞馬遜云科技在2025 re:Invent全球大會(huì)上,宣布推出全新的Amazon AI Factories,助力企業(yè)將現(xiàn)有基礎(chǔ)設(shè)施轉(zhuǎn)化為高性能AI
    的頭像 發(fā)表于 12-13 13:44 ?773次閱讀

    亞馬遜新一代自研服務(wù)器芯片Graviton5問世,性能提升25%

    ,基于Graviton5的全新EC2 M9g實(shí)例性能提升高達(dá)25%,其每個(gè)芯片配備192核及5倍擴(kuò)容緩存,助力客戶在擴(kuò)展工作負(fù)載、提升應(yīng)用性能
    的頭像 發(fā)表于 12-09 08:33 ?5389次閱讀

    同系列性能更強(qiáng)!面向高性能 AI 應(yīng)用,AXU2CGB-I 有何亮點(diǎn)?

    AXU2CGB-I 是一款基于 AMD Zynq UltraScale+ MPSoC XCZU2CG 的高性能 AI FPGA 開發(fā)平臺,它在架構(gòu)、存儲配置與接口資源上進(jìn)行了高規(guī)格設(shè)計(jì)
    的頭像 發(fā)表于 11-12 16:56 ?1455次閱讀
    同系列<b class='flag-5'>性能</b>更強(qiáng)!面向<b class='flag-5'>高性能</b> <b class='flag-5'>AI</b> 應(yīng)用,AXU<b class='flag-5'>2</b>CGB-I 有何亮點(diǎn)?

    【「AI芯片:科技探索與AGI愿景」閱讀體驗(yàn)】+AI芯片到AGI芯片

    和探索;人類級別的理解能力;常識推理;現(xiàn)實(shí)世界的知識整合。 3、測試時(shí)計(jì)算 測試時(shí)計(jì)算(TTC)是指在模型推理階段利用額外的計(jì)算資源來提升泛化性能。 4、具身智能與滲透
    發(fā)表于 09-18 15:31

    亞馬遜云科技在中國區(qū)域推出Amazon Graviton4實(shí)例 以自研芯片驅(qū)動(dòng)企業(yè)算力升級

    Graviton4處理器的Amazon Elastic Compute Cloud(Amazon EC2)C8g、M8g和R8g實(shí)例,針對客戶不同類型的工作負(fù)載進(jìn)行優(yōu)化。與
    的頭像 發(fā)表于 09-10 20:51 ?833次閱讀

    車載電器EMC整改:如何低成本實(shí)現(xiàn)高性能抗干擾

    南柯電子|車載電器EMC整改:如何低成本實(shí)現(xiàn)高性能抗干擾
    的頭像 發(fā)表于 09-09 09:57 ?764次閱讀

    NVIDIA Dynamo新增對亞馬遜云科技服務(wù)的支持

    亞馬遜云科技 (AWS) 開發(fā)者和解決方案架構(gòu)師現(xiàn)在可以在基于 NVIDIA GPU 的 Amazon EC2 上使用 NVIDIA Dynamo,包括由 NVIDIA Blackwell 加速
    的頭像 發(fā)表于 07-28 14:31 ?1026次閱讀
    NVIDIA Dynamo新增對亞馬遜云科技服務(wù)的支持

    信而泰×DeepSeek:AI推理引擎驅(qū)動(dòng)網(wǎng)絡(luò)智能診斷邁向 “自愈”時(shí)代

    網(wǎng)絡(luò)智能診斷平臺。通過對私有化網(wǎng)絡(luò)數(shù)據(jù)的定向訓(xùn)練,信而泰打造了高性能、高可靠性的網(wǎng)絡(luò)診斷模型,顯著提升了AI輔助診斷的精準(zhǔn)度與實(shí)用性。該方案實(shí)現(xiàn)了網(wǎng)絡(luò)全流量深度解析能力與AI智能推理
    發(fā)表于 07-16 15:29

    低成本高性能高性價(jià)比SOS無線收發(fā)芯片XL2401D

    低成本高性能高性價(jià)比的SOC無線收發(fā)芯片工作電壓支持在2.5~3.6v。
    的頭像 發(fā)表于 04-02 11:41 ?1046次閱讀
    <b class='flag-5'>低成本</b><b class='flag-5'>高性能</b>高性價(jià)比SOS無線收發(fā)芯片XL2401D

    陣列云從訓(xùn)練到推理

    在云場景下,陣列云(分布計(jì)算集群)從模型訓(xùn)練到推理的完整技術(shù)流程可結(jié)構(gòu)化分解如下: 一、訓(xùn)練階段技術(shù)實(shí)現(xiàn) 1,資源動(dòng)態(tài)編排? 基于Kubernetes集群或云廠商彈性計(jì)算服務(wù)(如AWS EC2
    的頭像 發(fā)表于 03-28 08:32 ?707次閱讀