首页
/ OpenBLAS在Sunway架构下的交叉编译问题分析

OpenBLAS在Sunway架构下的交叉编译问题分析

2025-06-01 06:59:34作者:裴麒琰

背景介绍

OpenBLAS是一个开源的优化BLAS库实现,广泛应用于科学计算和高性能计算领域。近期有用户在Sunway架构的sw_64sw6a平台上尝试交叉编译OpenBLAS时遇到了问题,本文将深入分析这一问题并提供解决方案。

问题现象

用户在Sunway架构的sw_64sw6a-sunway-linux-gnu平台上使用swgcc 7.1.0编译器进行交叉编译时,CMake配置阶段失败。具体错误表现为编译器无法识别-march=native选项,导致getarch工具编译失败。

技术分析

1. 编译器兼容性问题

Sunway架构使用的swgcc编译器是基于GCC 7.1.0定制的版本,但移除了对-march=native选项的支持。这个选项通常用于让编译器自动检测当前CPU架构并生成最优化的代码,但在交叉编译环境中并不适用。

2. 目标架构选择问题

用户尝试使用-DTARGET=ALPHA参数,这实际上对应的是DEC Alpha架构,而非Sunway架构。OpenBLAS对Alpha架构的支持已经多年未更新,且Sunway架构需要特定的目标参数。

3. CMake与Make构建系统的差异

在传统的Make构建系统中,OpenBLAS可以通过HOSTCC参数指定主机编译器来构建getarch工具。但在CMake的交叉编译环境中,缺乏"主机编译器"的概念,需要预先在cmake/prebuild.cmake中配置目标CPU的参数。

解决方案

1. 使用正确的目标架构参数

对于Sunway架构,应该使用专门针对该架构的目标参数,而非ALPHA。建议尝试以下参数组合:

-DTARGET=SW64

2. 修改CMake配置

可以尝试以下两种方法:

方法一: 修改cmake/prebuild.cmake文件,添加对Sunway架构的支持,移除不兼容的编译选项。

方法二: 使用Make构建系统替代CMake,通过指定HOSTCC参数:

make HOSTCC=gcc TARGET=SW64 CC=swgcc FC=swgfortran

3. 编译器选项调整

移除不支持的-march=native选项,替换为Sunway架构特定的优化选项。可以尝试:

-DCMAKE_C_FLAGS="-O3 -mtune=sw64"

深入建议

对于Sunway这样的特殊架构,建议:

  1. 查阅Sunway架构的官方文档,了解推荐的编译优化选项
  2. 考虑联系OpenBLAS社区,为Sunway架构添加官方支持
  3. 如果性能关键,可以考虑针对Sunway架构手动优化关键内核

总结

在特殊架构上进行交叉编译时,需要特别注意目标架构的选择和编译器的兼容性。OpenBLAS虽然支持多种架构,但对于较新的或特殊的架构可能需要额外的配置工作。建议Sunway平台用户优先使用Make构建系统,并确保使用正确的目标架构参数。

登录后查看全文
热门项目推荐
相关项目推荐

项目优选

收起
kernelkernel
deepin linux kernel
C
22
6
docsdocs
OpenHarmony documentation | OpenHarmony开发者文档
Dockerfile
197
2.17 K
ohos_react_nativeohos_react_native
React Native鸿蒙化仓库
C++
208
285
pytorchpytorch
Ascend Extension for PyTorch
Python
59
94
RuoYi-Vue3RuoYi-Vue3
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
974
574
nop-entropynop-entropy
Nop Platform 2.0是基于可逆计算理论实现的采用面向语言编程范式的新一代低代码开发平台,包含基于全新原理从零开始研发的GraphQL引擎、ORM引擎、工作流引擎、报表引擎、规则引擎、批处理引引擎等完整设计。nop-entropy是它的后端部分,采用java语言实现,可选择集成Spring框架或者Quarkus框架。中小企业可以免费商用
Java
9
1
ops-mathops-math
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
549
81
openHiTLSopenHiTLS
旨在打造算法先进、性能卓越、高效敏捷、安全可靠的密码套件,通过轻量级、可剪裁的软件技术架构满足各行业不同场景的多样化要求,让密码技术应用更简单,同时探索后量子等先进算法创新实践,构建密码前沿技术底座!
C
1.02 K
399
communitycommunity
本项目是CANN开源社区的核心管理仓库,包含社区的治理章程、治理组织、通用操作指引及流程规范等基础信息
393
27
MateChatMateChat
前端智能化场景解决方案UI库,轻松构建你的AI应用,我们将持续完善更新,欢迎你的使用与建议。 官网地址:https://matechat.gitcode.com
1.2 K
133