chinese直男口爆体育生外卖, 99久久er热在这里只有精品99, 又色又爽又黄18禁美女裸身无遮挡, gogogo高清免费观看日本电视,私密按摩师高清版在线,人妻视频毛茸茸,91论坛 兴趣闲谈,欧美 亚洲 精品 8区,国产精品久久久久精品免费

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會員中心
創(chuàng)作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

通過GPU加速機器學習

電子設計 ? 來源:電子設計 ? 作者:電子設計 ? 2022-02-10 17:00 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

早期的機器學習以搜索為基礎,主要依靠進行過一定優(yōu)化的暴力方法。但是隨著機器學習逐漸成熟,它開始專注于加速技術已經很成熟的統計方法和優(yōu)化問題。同時深度學習的問世更是帶來原本可能無法實現的優(yōu)化方法。本文將介紹現代機器學習如何找到兼顧規(guī)模和速度的新方法。

AI領域的轉變

在本系列的第1部分中,我們探討了AI的一些歷史,以及從Lisp到現代編程語言以及深度學習等新型計算智能范式的歷程。我們還討論了人工智能的早期應用,它們依賴于經過優(yōu)化的搜索形式、在海量數據集上進行訓練的現代神經網絡架構,同時解決了十年前還被認為不可能的難題。然而目前仍有兩大難題有待解決,即:如何進一步加速這些應用,以及將它們限制在智能手機這樣的功耗優(yōu)化環(huán)境中。

今天,深度學習成為了多數加速技術的重點研究對象。深度學習是一種神經網絡架構,它依賴于多層神經網絡,其中的每一層都可以支持不同的功能以進行特征檢測。這些深層神經網絡依賴于可方便運用并行計算的矢量運算, 并為神經網絡層分布式計算以及同層諸多神經元并行計算創(chuàng)造了條件。

通過GPU加速機器學習

圖形處理單元(GPU)最初并不是用于加速深度學習應用。GPU是一種特殊的設備,用于加速輸出到顯示設備的幀緩沖區(qū)(內存)的構建。它將渲染后的圖像存入幀緩沖區(qū),而不是依靠處理器來完成。GPU由數以千計的獨立內核組成,它們并行運行并執(zhí)行矢量運算等特定類型的計算。盡管最初GPU專為視頻應用而設計,但人們發(fā)現它們也可以加速矩陣乘法等科學計算。

開發(fā)人員既可以借助于GPU供應商提供的API將GPU處理功能集成到應用中,也可以采用適用于諸多不同環(huán)境的標準軟件包方式。R編程語言和編程環(huán)境包含與GPU協同工作來加快處理速度的軟件包,例如gputools、gmatrix和gpuR。GPU也可以通過numba軟件包或Theano等各種庫借助于Python進行編程。

通過這些軟件包,任何有意將GPU加速應用于機器學習的人都可以達成愿望。但是工程師們還在研究更專門的方法。2019年,英特爾?以20億美元的價格收購了Habana Labs, 一家致力于為服務器中的機器學習加速器開發(fā)定制芯片的公司。此外,英特爾還于2017年以150億美元收購了自動駕駛芯片技術企業(yè)Mobileye。

定制芯片和指令

除了服務器和臺式機中的GPU加速之外,用于機器學習的加速器正在試圖超越傳統平臺,進軍功耗受限的嵌入式設備和智能手機。這些加速器形式多樣,包括U盤、API、智能手機神經網絡加速器以及用于深度學習加速的矢量指令等。

適用于智能手機的深度學習

深度學習工具包已經從PC端延伸到智能手機,可為存在更多限制的網絡提供支持。TensorFlow Lite和Core ML等框架已經部署在用于機器學習應用的移動設備上。Apple?最近發(fā)布了A12 Bionic芯片,這款芯片包括一個8核神經網絡引擎,用于開發(fā)更加節(jié)能的神經網絡應用, 從而擴展Apple智能手機上的深度學習應用。

Google發(fā)布了適用于Android? 8.1并具有機器學習功能的神經網絡API (NNAPI), 目前已應用于Google Lens自然語言處理和圖像識別背景下的Google Assistant。NNAPI與其他深度學習工具包相似,但它是針對Android智能手機環(huán)境及其資源限制而構建的。

深度學習USB

英特爾發(fā)布了其新版神經計算棒,以U盤的形式加速深度學習應用。TensorFlow、Caffe和PyTorch等眾多機器學習框架都可以使用它。當沒有GPU可用時,這將是一個不錯的選擇,同時還可以快速構建深度學習應用原型。

深度學習指令

最后,在機器學習計算從CPU轉移到GPU的同時,英特爾使用新的指令優(yōu)化了其Xeon指令集,來加速深度學習。這些被稱為AVX-512擴展的新指令(所謂的矢量神經網絡指令或VNNi)提高了卷積神經網絡運算的處理量。

總結

GPU在機器學習中的應用實現了在眾多應用中構建和部署大規(guī)模深度神經網絡的能力。機器學習框架使構建深度學習應用變得簡單。智能手機供應商也不甘人后,為受到諸多限制的應用集成了高能效的神經網絡加速器(以及用于定制應用的API現在市面上還有其他可轉移到USB硬件上的加速器,許多新的初創(chuàng)公司也在加大加速器領域的投入,為未來機器學習應用做準備。

審核編輯:何安

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發(fā)燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規(guī)問題,請聯系本站處理。 舉報投訴
  • gpu
    gpu
    +關注

    關注

    28

    文章

    5152

    瀏覽量

    134757
收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    RSoft GPU加速技術重塑光子元件設計效率革命

    設計效率。為了解決這個問題,RSoft 光子器件工具的 FullWAVE FDTD 模組中引入 GPU 加速,通過 NVIDIA GPU 的平行運算能力,使得模擬速度相比 CPU 計算
    的頭像 發(fā)表于 01-12 14:09 ?159次閱讀
    RSoft <b class='flag-5'>GPU</b><b class='flag-5'>加速</b>技術重塑光子元件設計效率革命

    沐曦股份GPU加速技術助力藥物研發(fā)降本增效

    沐曦股份科學計算團隊近期取得突破性進展,成功將主流分子動力學模擬引擎GROMACS中的FEP計算全流程部署于GPU執(zhí)行,并實現2.5倍性能提升,相關成果獲得GROMACS官方團隊的高度認可,該GPU
    的頭像 發(fā)表于 12-02 15:58 ?665次閱讀

    FPGA和GPU加速的視覺SLAM系統中特征檢測器研究

    特征檢測是SLAM系統中常見但耗時的模塊,隨著SLAM技術日益廣泛應用于無人機等功耗受限平臺,其效率優(yōu)化尤為重要。本文首次針對視覺SLAM流程開展硬件加速特征檢測器的對比研究,通過對比現代SoC平臺
    的頭像 發(fā)表于 10-31 09:30 ?490次閱讀
    FPGA和<b class='flag-5'>GPU</b><b class='flag-5'>加速</b>的視覺SLAM系統中特征檢測器研究

    NVIDIA Isaac Lab推動機器人技術突破

    Isaac Lab 是 Isaac Gym 的替代版本,該框架已將 GPU 原生機器人仿真擴展至大規(guī)模多模態(tài)學習的全新領域。Isaac Lab 整合了 GPU 并行的物理真實的仿真、逼
    的頭像 發(fā)表于 10-21 11:20 ?1094次閱讀

    Imagination GPU 驅動更新:新增多項 Vulkan 與 OpenCL 擴展支持

    整理了本次更新的重點內容。Vulkan協作矩陣(CooperativeMatrix)支持為加速圖形后處理、神經著色器、物理仿真以及GPU上的機器學習推理,DDK25
    的頭像 發(fā)表于 10-13 09:21 ?768次閱讀
    Imagination <b class='flag-5'>GPU</b> 驅動更新:新增多項 Vulkan 與 OpenCL 擴展支持

    FPGA在機器學習中的具體應用

    隨著機器學習和人工智能技術的迅猛發(fā)展,傳統的中央處理單元(CPU)和圖形處理單元(GPU)已經無法滿足高效處理大規(guī)模數據和復雜模型的需求。FPGA(現場可編程門陣列)作為一種靈活且高效的硬件
    的頭像 發(fā)表于 07-16 15:34 ?2776次閱讀

    通過NVIDIA Cosmos模型增強機器人學習

    通用機器人的時代已經到來,這得益于機械電子技術和機器人 AI 基礎模型的進步。但目前機器人技術的發(fā)展仍面臨一個關鍵挑戰(zhàn):機器人需要大量的訓練數據來掌握諸如組裝和檢查之類的技能,而手動演
    的頭像 發(fā)表于 07-14 11:49 ?961次閱讀
    <b class='flag-5'>通過</b>NVIDIA Cosmos模型增強<b class='flag-5'>機器人學習</b>

    硅谷GPU云服務器是什么意思?使用指南詳解

    硅谷GPU云服務器本質上是一種IaaS(基礎設施即服務)產品,它將物理服務器上的GPU資源通過虛擬化技術分割成可彈性調配的云服務。與普通CPU云服務器相比,GPU服務器最大的特點是搭載
    的頭像 發(fā)表于 06-16 09:41 ?512次閱讀

    智算加速卡是什么東西?它真能在AI戰(zhàn)場上干掉GPU和TPU!

    隨著AI技術火得一塌糊涂,大家都在談"大模型"、"AI加速"、"智能計算",可真到了落地環(huán)節(jié),算力才是硬通貨。你有沒有發(fā)現,現在越來越多的AI企業(yè)不光用GPU,也不怎么迷信TPU了?他們嘴里多了一個新詞兒——智算加速卡。
    的頭像 發(fā)表于 06-05 13:39 ?1516次閱讀
    智算<b class='flag-5'>加速</b>卡是什么東西?它真能在AI戰(zhàn)場上干掉<b class='flag-5'>GPU</b>和TPU!

    **【技術干貨】Nordic nRF54系列芯片:傳感器數據采集與AI機器學習的完美結合**

    和更多外設接口。無論是運行還是休眠狀態(tài),功耗表現都非常出色! 3. 在傳感器數據采集與AI機器學習中的優(yōu)勢? 答:主頻高、功耗低,內置專用核處理數據采集,還配備AI加速器,讓AI算法運行更高效! 4.
    發(fā)表于 04-01 00:00

    從圖形處理到AI加速,一文看懂Imagination D系列GPU

    Imagination的D系列于2022年首次發(fā)布,見證了生成式AI從云端到智能手機等消費設備中普及。在云端,由于GPU的可編程性、可擴展性和快速處理AI工作負載的能力,GPU已成為高效的AI加速
    的頭像 發(fā)表于 02-27 08:33 ?947次閱讀
    從圖形處理到AI<b class='flag-5'>加速</b>,一文看懂Imagination D系列<b class='flag-5'>GPU</b>

    GPU加速計算平臺的優(yōu)勢

    傳統的CPU雖然在日常計算任務中表現出色,但在面對大規(guī)模并行計算需求時,其性能往往捉襟見肘。而GPU加速計算平臺憑借其獨特的優(yōu)勢,吸引了行業(yè)內人士的廣泛關注和應用。下面,AI部落小編為大家分享GPU
    的頭像 發(fā)表于 02-23 16:16 ?880次閱讀

    GPU 加速計算:突破傳統算力瓶頸的利刃

    在數字化時代,數據呈爆炸式增長,傳統的算力已難以滿足復雜計算任務的需求。無論是人工智能的深度學習、大數據的分析處理,還是科學研究中的模擬計算,都對算力提出了極高的要求。而云 GPU 加速計算的出現
    的頭像 發(fā)表于 02-17 10:36 ?604次閱讀

    機器學習模型市場前景如何

    當今,隨著算法的不斷優(yōu)化、數據量的爆炸式增長以及計算能力的飛速提升,機器學習模型的市場前景愈發(fā)廣闊。下面,AI部落小編將探討機器學習模型市場的未來發(fā)展。
    的頭像 發(fā)表于 02-13 09:39 ?691次閱讀