在线观看www成人影院-在线观看www日本免费网站-在线观看www视频-在线观看操-欧美18在线-欧美1级

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

Arm編譯器現(xiàn)在基于LLVM 13

安芯教育科技 ? 來源:極術(shù)社區(qū) ? 作者:Ashok Bhat ? 2022-06-15 09:19 ? 次閱讀

Arm編譯器Linux 22.0版現(xiàn)在提供了改進(jìn)的編譯器和庫。Arm編譯器Linux版(ACfL)是Arm C/C++編譯器(armclang)、Arm Fortran編譯器(armflang)和Arm性能庫(ArmPL)的組合。在本博客中,我們將探討此版本的新增功能。

Arm編譯器現(xiàn)在基于LLVM 13

Arm編譯器現(xiàn)在基于LLVM 13,這提高了性能。

db2122e6-ec47-11ec-ba43-dac502259ad0.png

我們看到SPEC CPU 2017的許多次級(jí)基準(zhǔn)得到了改進(jìn),geomean總分比之前的21.1版本提高了2.2%。該基準(zhǔn)測(cè)試在AWS c6g.metal(帶Arm Neoverse-N1核心)上運(yùn)行。

針對(duì)Neoverse-V1進(jìn)行了更好的調(diào)整

(AWS Graviton 3核心)

22.0版本的Arm編譯器為Neoverse-V1提供了一個(gè)優(yōu)化的成本模型,并提供了許多與SVE代碼生成相關(guān)的改進(jìn)。這包括(1)優(yōu)化使用SVE的Gather/Scatter功能(2)將循環(huán)(loop)填充對(duì)齊,以更好地利用指令緩存(3)在將向量的一個(gè)元素插入另一個(gè)元素時(shí),優(yōu)化使用SVE拼接操作。

db2ae59c-ec47-11ec-ba43-dac502259ad0.png

這些優(yōu)化的累積效應(yīng)可以在前面的圖中看到。我們?cè)谶@里將Neoverse-V1優(yōu)化的SVE代碼和為Neoverse-V1優(yōu)化的Neon代碼做一個(gè)對(duì)比。我們的基準(zhǔn)是在開發(fā)SVE架構(gòu)擴(kuò)展時(shí)使用的一組具有代表性的微基準(zhǔn)(micro-benchmarks)。您可以看到,22.0(橙色條)中的編譯器優(yōu)于21.1版(藍(lán)色條)。通過這些改進(jìn),22.0版本已準(zhǔn)備好在AWS Graviton 3上開發(fā)HPC應(yīng)用程序。

GCC 11更新

該軟件包現(xiàn)在提供GCC 11系列編譯器,并有許多性能改進(jìn)https://community.arm.com/arm-community-blogs/b/tools-software-ides-blog/posts/performance-improvements-in-gcc-11

具有CPU運(yùn)行時(shí)檢測(cè)的單個(gè)ArmPL

Arm性能庫不再為SVE和非SVE內(nèi)核打包為單獨(dú)的庫。我們現(xiàn)在提供一個(gè)庫,其中包含所有受支持內(nèi)核(包括SVE)的優(yōu)化版本。在運(yùn)行時(shí),庫通過檢測(cè)核的類型,來選擇最佳的例程和配置。作為用戶,您可以自動(dòng)受益于庫中最快的調(diào)整,而無需重新鏈接到特定于核的庫。

更快的BLAS、LAPACK和FFT

ArmPL 22.0進(jìn)一步改進(jìn)了BLAS和LAPACK例程。

db4d41dc-ec47-11ec-ba43-dac502259ad0.png

db655f9c-ec47-11ec-ba43-dac502259ad0.png

上圖顯示了22.0版本比21.0版本的改進(jìn)(2021年初發(fā)布)。這些數(shù)據(jù)來自5000多個(gè)個(gè)案的基準(zhǔn)測(cè)試,涵蓋:廣泛BLAS例程的基準(zhǔn)測(cè)試,一系列重要的LAPACK例程,用于串行(1線程)和并行(8線程)執(zhí)行中的小O(10)、中O(100)和大O(1000)不同的問題場(chǎng)景。

數(shù)學(xué)函數(shù)的改進(jìn)

在22.0中,我們改進(jìn)了許多數(shù)學(xué)函數(shù)的性能。其中包括標(biāo)量函數(shù)(atan、atan2、atan2f、cos、exp、sin和erf)和向量函數(shù)(atanf、atan2f、cosf、erfcf、expo、logf、pow、sinf和tanf)的改進(jìn)。在下圖中,您可以看到Elefunt benchmark在AWS Graviton 2(Neoverse N1)系統(tǒng)上運(yùn)行時(shí)的影響。

db7cbd2c-ec47-11ec-ba43-dac502259ad0.png

模塊名稱變更

該包提供模塊文件,以便輕松加載所需的編譯器或庫。對(duì)于22.0版本,請(qǐng)使用以下模塊命令。

db958514-ec47-11ec-ba43-dac502259ad0.png

結(jié)論

Arm編譯器Linux 22.0版與前21.x系列版相比有許多改進(jìn)和變化。我們將繼續(xù)進(jìn)行進(jìn)一步的改進(jìn),并計(jì)劃在2022年9月/10月發(fā)布下一版本22.1。

最新版本下載地址:

https://developer.arm.com/downloads/-/arm-compiler-for-linux

審核編輯 :李倩

聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • Linux
    +關(guān)注

    關(guān)注

    87

    文章

    11419

    瀏覽量

    212281
  • 編譯器
    +關(guān)注

    關(guān)注

    1

    文章

    1652

    瀏覽量

    49721

原文標(biāo)題:技術(shù)分享 | Arm編譯器Linux版:22.0版本中的新增功能有哪些?

文章出處:【微信號(hào):Ithingedu,微信公眾號(hào):安芯教育科技】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。

收藏 人收藏

    評(píng)論

    相關(guān)推薦

    什么樣的代碼會(huì)被編譯器優(yōu)化

    現(xiàn)在編譯器有多智能,可能你辛辛苦苦寫的代碼,在編譯器看來就是幾句廢話,直接被刪除掉。
    的頭像 發(fā)表于 01-16 16:38 ?413次閱讀

    Triton編譯器與GPU編程的結(jié)合應(yīng)用

    Triton編譯器簡(jiǎn)介 Triton編譯器是一種針對(duì)并行計(jì)算優(yōu)化的編譯器,它能夠自動(dòng)將高級(jí)語言代碼轉(zhuǎn)換為針對(duì)特定硬件優(yōu)化的低級(jí)代碼。Triton編譯器的核心優(yōu)勢(shì)在于其能夠識(shí)別并行模式,
    的頭像 發(fā)表于 12-25 09:13 ?631次閱讀

    Triton編譯器如何提升編程效率

    在現(xiàn)代軟件開發(fā)中,編譯器扮演著至關(guān)重要的角色。它們不僅將高級(jí)語言代碼轉(zhuǎn)換為機(jī)器可執(zhí)行的代碼,還通過各種優(yōu)化技術(shù)提升程序的性能。Triton 編譯器作為一種先進(jìn)的編譯器,通過多種方式提升編程效率,使得
    的頭像 發(fā)表于 12-25 09:12 ?600次閱讀

    Triton編譯器在高性能計(jì)算中的應(yīng)用

    高性能計(jì)算(High-Performance Computing,HPC)是現(xiàn)代科學(xué)研究和工程計(jì)算中不可或缺的一部分。隨著計(jì)算需求的不斷增長(zhǎng),對(duì)計(jì)算資源的要求也越來越高。Triton編譯器作為一種
    的頭像 發(fā)表于 12-25 09:11 ?728次閱讀

    Triton編譯器的優(yōu)化技巧

    在現(xiàn)代計(jì)算環(huán)境中,編譯器的性能對(duì)于軟件的運(yùn)行效率至關(guān)重要。Triton 編譯器作為一個(gè)先進(jìn)的編譯器框架,提供了一系列的優(yōu)化技術(shù),以確保生成的代碼既高效又適應(yīng)不同的硬件架構(gòu)。 1. 指令選擇
    的頭像 發(fā)表于 12-25 09:09 ?655次閱讀

    Triton編譯器的優(yōu)勢(shì)與劣勢(shì)分析

    Triton編譯器作為一種新興的深度學(xué)習(xí)編譯器,具有一系列顯著的優(yōu)勢(shì),同時(shí)也存在一些潛在的劣勢(shì)。以下是對(duì)Triton編譯器優(yōu)勢(shì)與劣勢(shì)的分析: 優(yōu)勢(shì) 高效性能優(yōu)化 : Triton編譯器
    的頭像 發(fā)表于 12-25 09:07 ?871次閱讀

    Triton編譯器在機(jī)器學(xué)習(xí)中的應(yīng)用

    1. Triton編譯器概述 Triton編譯器是NVIDIA Triton推理服務(wù)平臺(tái)的一部分,它負(fù)責(zé)將深度學(xué)習(xí)模型轉(zhuǎn)換為優(yōu)化的格式,以便在NVIDIA GPU上高效運(yùn)行。Triton編譯器支持
    的頭像 發(fā)表于 12-24 18:13 ?782次閱讀

    Triton編譯器支持的編程語言

    Triton編譯器支持的編程語言主要包括以下幾種: 一、主要編程語言 Python :Triton編譯器通過Python接口提供了對(duì)Triton語言和編譯器的訪問,使得用戶可以在Python環(huán)境中
    的頭像 發(fā)表于 12-24 17:33 ?794次閱讀

    Triton編譯器與其他編譯器的比較

    Triton編譯器與其他編譯器的比較主要體現(xiàn)在以下幾個(gè)方面: 一、定位與目標(biāo) Triton編譯器 : 定位:專注于深度學(xué)習(xí)中最核心、最耗時(shí)的張量運(yùn)算的優(yōu)化。 目標(biāo):提供一個(gè)高度抽象、靈
    的頭像 發(fā)表于 12-24 17:25 ?781次閱讀

    Triton編譯器功能介紹 Triton編譯器使用教程

    Triton 是一個(gè)開源的編譯器前端,它支持多種編程語言,包括 C、C++、Fortran 和 Ada。Triton 旨在提供一個(gè)可擴(kuò)展和可定制的編譯器框架,允許開發(fā)者添加新的編程語言特性和優(yōu)化技術(shù)
    的頭像 發(fā)表于 12-24 17:23 ?1324次閱讀

    ARM優(yōu)化C/C++編譯器 v20.2.0.LTS

    電子發(fā)燒友網(wǎng)站提供《ARM優(yōu)化C/C++編譯器 v20.2.0.LTS.pdf》資料免費(fèi)下載
    發(fā)表于 11-07 10:46 ?0次下載
    <b class='flag-5'>ARM</b>優(yōu)化C/C++<b class='flag-5'>編譯器</b> v20.2.0.LTS

    AI編譯器技術(shù)剖析

    隨著人工智能技術(shù)的飛速發(fā)展,AI編譯器作為一種新興的編譯技術(shù)逐漸進(jìn)入人們的視野。AI編譯器不僅具備傳統(tǒng)編譯器的功能,如將高級(jí)語言編寫的源代碼轉(zhuǎn)換為機(jī)器可執(zhí)行的代碼,還融入了人工智能技術(shù)
    的頭像 發(fā)表于 07-17 18:28 ?2244次閱讀

    人工智能編譯器與傳統(tǒng)編譯器的區(qū)別

    人工智能編譯器(AI編譯器)與傳統(tǒng)編譯器在多個(gè)方面存在顯著的差異。這些差異主要體現(xiàn)在設(shè)計(jì)目標(biāo)、功能特性、優(yōu)化策略、適用范圍以及技術(shù)復(fù)雜性等方面。以下是對(duì)兩者區(qū)別的詳細(xì)探討,旨在全面解析
    的頭像 發(fā)表于 07-17 18:19 ?2588次閱讀

    Meta發(fā)布基于Code Llama的LLM編譯器

    近日,科技巨頭Meta在其X平臺(tái)上正式宣布推出了一款革命性的LLM編譯器,這一模型家族基于Meta Code Llama構(gòu)建,并融合了先進(jìn)的代碼優(yōu)化和編譯器功能。LLM編譯器的推出,標(biāo)志著Meta在人工智能領(lǐng)域的又一重大突破,將
    的頭像 發(fā)表于 06-29 17:54 ?1711次閱讀

    芯來科技與華東師范大學(xué)SOLE實(shí)驗(yàn)室合作推動(dòng)LLVM/CLANG編譯器優(yōu)化

    行深入的LLVM/CLANG編譯器優(yōu)化以及程序性能優(yōu)化和調(diào)優(yōu)。 我們不僅優(yōu)化了LLVM編譯器的多個(gè)關(guān)鍵環(huán)節(jié),提升了代碼生成效率和執(zhí)行性能,還針對(duì)視頻編解碼、性能測(cè)試等應(yīng)用場(chǎng)景進(jìn)行了深入
    的頭像 發(fā)表于 06-12 09:09 ?900次閱讀
    芯來科技與華東師范大學(xué)SOLE實(shí)驗(yàn)室合作推動(dòng)<b class='flag-5'>LLVM</b>/CLANG<b class='flag-5'>編譯器</b>優(yōu)化
    主站蜘蛛池模板: 免费一级毛片不卡在线播放 | 国产视频三级 | 天天干天天操天天插 | 成年人一级片 | 三级免费观看 | 成 人网站免费 | 一级片高清 | 精品女同同性视频很黄很色 | 五月天婷五月天综合网在线 | 国产精品午夜免费观看网站 | 日韩亚洲人成网站在线播放 | 在线免费看黄视频 | 永久免费的拍拍拍网站 | bt种子搜索-bt天堂 | 操的好爽视频 | 成人观看天堂在线影片 | 成年1314在线观看 | 九九黄色网 | 日本成人免费网站 | 亚洲欧美国产五月天综合 | 操的好爽视频 | 免费又爽又黄的禁片1000部 | 狠狠亚洲狠狠欧洲2019 | 自拍偷拍福利视频 | 男人操女人视频网站 | 国产毛片哪里有 | 亚洲一区二区在线播放 | 亚洲成a人片在线网站 | 草逼网址 | 夜夜爱夜夜爽夜夜做夜夜欢 | 免费网站成人亚洲 | 午夜dy888理论 | 免费看美女禁处爆涌视频 | 日本一区二区三区在线观看视频 | 99r8这里精品热视频免费看 | 五月天婷婷爱 | 99精品久久久久久久婷婷 | 在线观看免费视频 | 禁漫羞羞入口 | 欧美乱妇高清无乱码 | 黄色片日本网站 |