精品国产人成在线_亚洲高清无码在线观看_国产在线视频国产永久2021_国产AV综合第一页一个的一区免费影院黑人_最近中文字幕MV高清在线视频

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

畢昇Fortran編譯器內聯動態庫函數str_copy

openEuler ? 來源:openEuler ? 作者:openEuler ? 2022-09-21 11:35 ? 次閱讀

項目簡介

項目名稱

畢昇Fortran編譯器內聯動態庫函數str_copy

項目描述

畢昇Fortran編譯器是一款基于classic flang的高性能Fortran編譯器,支持Fortran編程語言的編譯和運行,提供強大的數值計算和數據處理能力,在科學計算領域應用前景廣闊。f90_str_copy_klen是一個實現字符串拷貝功能的動態庫函數,本項目是對該動態庫函數進行內聯,預期提高編譯器字符串拷貝的性能。

項目導師

peixin-qiao

項目開發者

王哲葳,華東師范大學碩士在讀

項目鏈接

https://summer-ospp.ac.cn/#/org/prodetail/22b970386

開發詳情

方案描述

Flang編譯器主要由flang1和flang2兩個組件組成,其中flang1用于解析Fortran代碼并生成中間表示,然后通過flang2生成LLVM IR并輸出。本項目的主要任務就是在flang2中對解析出的“f90_str_copy_klen”函數進行內聯優化。這個項目的方案分為如下幾步:

01

flang2會獲得通過Fortran生成的IR指令列表,遍歷該列表,尋找到函數調用指令“I_CALL”。

02

通過“I_CALL”指令的位置查詢所調用的是否為需要被內聯的函數,如本項目需要實現的“f90_str_copy_klen”函數的內聯。在確認需要內聯的函數后開始生成相應的指令,“f90_str_copy_klen”函數的內聯指令生成過程如下:

  1. 將復制后得到的字符串稱為目標字符串,待復制的字符串稱為輸入字符串。首先需要從原先的指令中獲得輸入字符串并開辟一系列內存空間用于記錄目標字符串、輸入字符串的起始地址、字符串索引及字符串長度。

  2. 對每一個輸入字符串,從頭開始遍歷。分別判斷當前目標字符串、輸入字符串的索引是否小于其長度,如果均符合則將輸入字符串中對應索引的字符復制到目標字符串的相應地址中。如果輸入字符串索引大于等于其長度則處理下一個輸入字符串。如果目標字符串索引大于等于其長度則停止字符串的復制。

  3. 按照2所述流程依次遍歷函數中的輸入字符串,直至所有字符串都完成復制。

  4. 目標字符串索引是否仍小于其長度,若是,則將目標字符串中剩余未被賦值的字符用空格進行補充。

  5. 將實現上述功能的指令替換掉對應的“I_CALL”指令。

03

繼續flang2中的流程以生成對應的LLVM IR 文件。

項目產出

實現了項目方案中所需的功能。

分別用一個字符串、三個字符串作為輸入字符串,完成了共十種輸入字符串各種長度情況下”f90_str_copy_klen”函數內聯的的功能性測試,在這些輸入字符串中也包含了一些ASCII碼小于32(ASCII碼為32表示空格)的特殊字符。十種情況如下:

  • a=b

  1. len(a) < len(b)
  2. len(a) = len(b)
  3. len(a) > len(b)
  • a = b // c // d

  1. len(a) < len(b)
  2. len(a) = len(b)
  3. len(b) < len(a) < len(b) + len(c)
  4. len(a) = len(b) + len(c)
  5. len(b) + len(c) < len(a) < len(b) + len(c) + len(d)
  6. len(a) = len(b) + len(c) + len(d)
  7. len(a) > len(b) + len(c) + len(d)

將“f90_str_copy_klen”在函數中調用一億次,對內聯前后所花費的時間做對比。實驗結果顯示沒有內聯時運行花費的時間約為10秒,內聯后運行花費的時間約為0.7秒。

  • 測試代碼如下:
    主函數:main.f90

    programmain
    integer::i
    character(20)::a,b,c,d
    a="aaaaaaaaaaaaaaa"
    b="aaaaaaaaaaaaaaa"
    c="aaaaaaaaaaaaaaa"
    doi=1,100000000
    calltest(a,b,c,d,20)
    enddo
    end
    

    字符串拼接拷貝函數:test.f90

    subroutinetest(a,b,c,d,n)
    integer::n
    character(n)::a,b,c,d
    d=a//b//c
    endsubroutine
    
  • 測試方法如下:
    未優化前:

    $flangmain.f90-c
    $flangtest.f90-O3-c
    $flangmain.otest.o-oa.out
    $time./a.out
    

    real0m10.190s
    user0m10.180s
    sys0m0.004s

    優化之后(編譯選項-Mx,218,0x1使能該優化功能)

    $flangmain.f90-c
    $flangtest.f90-O3–c–Mx,218,0x1
    $flangmain.otest.o-oa.out
    $time./a.out
    

    real0m0.706s
    user0m0.702s
    sys0m0.004s

審核編輯 :李倩


聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • 函數
    +關注

    關注

    3

    文章

    4308

    瀏覽量

    62445
  • 編譯器
    +關注

    關注

    1

    文章

    1618

    瀏覽量

    49057
  • Fortran
    +關注

    關注

    1

    文章

    7

    瀏覽量

    7645

原文標題:開源之夏 | 【結項報告】畢昇Fortran編譯器內聯動態庫函數str_copy

文章出處:【微信號:openEulercommunity,微信公眾號:openEuler】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏

    評論

    相關推薦

    C7000優化C/C++編譯器

    電子發燒友網站提供《C7000優化C/C++編譯器.pdf》資料免費下載
    發表于 10-30 09:45 ?0次下載
    C7000優化C/C++<b class='flag-5'>編譯器</b>

    Keil編譯器優化方法

    我們都知道,代碼是可以通過編譯器優化的,有的時候,為了提高運行速度或者減少代碼尺寸,會開啟優化選項。
    的頭像 發表于 10-23 16:35 ?343次閱讀
    Keil<b class='flag-5'>編譯器</b>優化方法

    AI編譯器技術剖析

    隨著人工智能技術的飛速發展,AI編譯器作為一種新興的編譯技術逐漸進入人們的視野。AI編譯器不僅具備傳統編譯器的功能,如將高級語言編寫的源代碼轉換為機器可執行的代碼,還融入了人工智能技術
    的頭像 發表于 07-17 18:28 ?1497次閱讀

    人工智能編譯器與傳統編譯器的區別

    人工智能編譯器(AI編譯器)與傳統編譯器在多個方面存在顯著的差異。這些差異主要體現在設計目標、功能特性、優化策略、適用范圍以及技術復雜性等方面。以下是對兩者區別的詳細探討,旨在全面解析其內在差異。
    的頭像 發表于 07-17 18:19 ?1719次閱讀

    Meta發布基于Code Llama的LLM編譯器

    近日,科技巨頭Meta在其X平臺上正式宣布推出了一款革命性的LLM編譯器,這一模型家族基于Meta Code Llama構建,并融合了先進的代碼優化和編譯器功能。LLM編譯器的推出,標志著Meta在人工智能領域的又一重大突破,將
    的頭像 發表于 06-29 17:54 ?1465次閱讀

    IDF4.2.1的編譯器優化bug導致panic怎么處理?

    == 0) && (status.st_utx_out == 0));} 它是一個inline函數。我們都認為inline關鍵字,會告訴編譯器內聯函數,于是它的代碼
    發表于 06-21 10:55

    大模型應用開發平臺+浪潮信息AIStation,讓大模型定制更簡單

    北京2024年6月5日?/美通社/ -- 近日,大模型應用開發平臺與浪潮信息AIStation智能業務生產創新平臺完成兼容性互認證。基于和浪潮信息AIStation,用戶通過預
    的頭像 發表于 06-05 11:58 ?400次閱讀
    <b class='flag-5'>畢</b><b class='flag-5'>昇</b>大模型應用開發平臺+浪潮信息AIStation,讓大模型定制更簡單

    SEGGER編譯器優化和安全技術介紹 支持最新C和C++語言

    SEGGER編譯器是專門為ARM和RISC-V微控制設計的優化C/C++編譯器。它建立在強大的Clang前端上,支持最新的C和C++語言功能。 除其他外,其主要功能包括: 1)?尺寸優化:通過調整
    的頭像 發表于 06-04 15:31 ?1409次閱讀
    SEGGER<b class='flag-5'>編譯器</b>優化和安全技術介紹 支持最新C和C++語言

    C語言:嵌入式開發中的關鍵編譯器角色

    嵌入式程序開發跟硬件密切相關,需要使用C語言來讀寫底層寄存、存取數據、控制硬件等,C語言和硬件之間由編譯器來聯系,一些C標準不支持的硬件特性操作,由編譯器提供。
    發表于 04-26 14:53 ?569次閱讀
    C語言:嵌入式開發中的關鍵<b class='flag-5'>編譯器</b>角色

    KEIL怎么禁止某個函數/某段代碼被編譯器優化?

    有沒有大佬知道,KEIL怎么禁止某個函數/某段代碼 被編譯器優化?
    發表于 04-10 08:17

    QT開發學習筆記1(安裝交叉編譯器

    QT安裝交叉編譯器
    的頭像 發表于 02-18 10:02 ?869次閱讀
    QT開發學習筆記1(安裝交叉<b class='flag-5'>編譯器</b>)

    lsl文件中將text段copy到ram,編譯器具體是如何實現的?

    lsl文件中,將text段copy到ram,編譯器具體是如何實現的?
    發表于 02-02 07:23

    華為舉辦鴻蒙生態千帆啟航儀式,余承東公布HarmonyOS NEXT開放申請

    據余承東介紹,為實現核心競爭力的突破,華為通過多年的努力構建出一套包含鴻蒙內核、ArkTS/倉頡編程語言、方舟編譯器/編譯器、ArkUI以及盤古AI大模型等在內的完整生態體系。
    的頭像 發表于 01-19 09:34 ?823次閱讀

    Triton編譯器的原理和性能

    Triton是一種用于編寫高效自定義深度學習原語的語言和編譯器。Triton的目的是提供一個開源環境,以比CUDA更高的生產力編寫快速代碼,但也比其他現有DSL具有更大的靈活性。Triton已被采用
    的頭像 發表于 12-16 11:22 ?2768次閱讀
    Triton<b class='flag-5'>編譯器</b>的原理和性能

    TVM編譯器的整體架構和基本方法

    有將近兩個月沒有學習一些新東西,更新一下博客了。一直在忙公司的一個項目,是做一款支持LSTM和RNN的通用架構加速IP。自己恰好負責指令編譯工作,雖然開始的指令比較粗糙,沒有一套完整的編譯器架構
    的頭像 發表于 11-30 09:36 ?2321次閱讀
    TVM<b class='flag-5'>編譯器</b>的整體架構和基本方法