news 2026/9/10 17:30:52

CANN/ge图编译模型API

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
CANN/ge图编译模型API

aclgrphBuildModel

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

产品支持情况

产品

是否支持

Atlas A3 训练系列产品 / Atlas A3 推理系列产品

Atlas A2 训练系列产品 / Atlas A2 推理系列产品

头文件/库文件

  • 头文件:#include <ge/ge_ir_build.h>
  • 库文件:libge_compiler.so

功能说明

将输入的Graph编译为适配昇腾AI处理器的离线模型,并保存到内存缓冲区。

函数原型

[!NOTE]说明 数据类型为string的接口后续版本会废弃,建议使用数据类型为非string的接口。

graphStatus aclgrphBuildModel(const ge::Graph &graph, const std::map<std::string, std::string> &build_options, ModelBufferData &model) graphStatus aclgrphBuildModel(const ge::Graph &graph, const std::map<AscendString, AscendString> &build_options, ModelBufferData &model)

参数说明

参数名

输入/输出

说明

graph

输入

待编译的Graph。

build_options

输入

graph级别配置参数。

配置参数map映射表,key为参数类型,value为参数值,均为字符串格式,用于描述离线模型编译配置信息。

map中的配置参数请参见aclgrphBuildModel支持的配置参数。

model

输出

编译生成的离线模型缓存,模型保存在内存缓冲区中。详情请参见ModelBufferData。

struct ModelBufferData { std::shared_ptr<uint8_t> data = nullptr; uint64_t length; };

其中data指向生成的模型数据,length代表该模型的实际大小。

返回值说明

参数名

类型

说明

-

graphStatus

GRAPH_SUCCESS(0):成功。

其他值:失败。

约束说明

  • 对于aclgrphBuildModel和aclgrphBuildInitialize中重复的编译配置参数,建议不要重复配置,如果设置重复,则以aclgrphBuildModel传入的为准

  • 使用aclgrphBuildModel接口传入build_options参数时,多张图场景下,如果传入的参数为ge::ir_option::PRECISION_MODE或者ge::ir_option::PRECISION_MODE_V2,多张图设置的参数值需要相同。

  • 使用aclgrphBuildModel接口编译的离线模型,保存在内存缓冲区中:

    • 如果希望将内存缓冲区中的模型保存为离线模型文件xx.om,则需要调用aclgrphSaveModel接口,序列化保存离线模型到文件中。后续使用acl接口进行推理业务,需要使用从文件中加载模型的接口,例如aclmdlLoadFromFile,然后使用aclmdlExecute接口执行推理。

    • 如果离线模型保存在内存缓冲区:

      后续使用acl接口进行推理业务时,需要使用从内存中加载模型的接口,例如aclmdlLoadFromMem,然后使用aclmdlExecute接口执行推理。

    acl接口详细介绍请参见《应用开发指南 (C&C++)》。

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/10 17:29:55

非技术副业者如何从零搭建一人企业:一人企业方法论完整指南

非技术副业者如何从零搭建一人企业&#xff1a;一人企业方法论完整指南 【免费下载链接】opc-methodology 《一人企业方法论》第二版&#xff0c;也适合做其他副业&#xff08;比如自媒体、电商、数字商品&#xff09;的非技术人群。 项目地址: https://gitcode.com/GitHub_T…

作者头像 李华
网站建设 2026/9/10 17:28:07

CANN/GE获取融合Pass执行阶段API

GetStage 【免费下载链接】ge GE&#xff08;Graph Engine&#xff09;是面向昇腾的图编译器和执行器&#xff0c;提供了计算图优化、多流并行、内存复用和模型下沉等技术手段&#xff0c;加速模型执行效率&#xff0c;减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的…

作者头像 李华
网站建设 2026/9/10 17:27:39

自定义类中显示带图片的Android Toast:完整实现与踩坑总结

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/10 17:26:52

JVM内存全景图:从运行时数据区到JMM,理清Java内存模型与调优实战

先聊个真实的“翻车现场”。几年前我在一家做电商中台的公司&#xff0c;某天下午订单服务突然大面积超时&#xff0c;监控面板上老年代GC频率从几分钟一次变成几秒一次&#xff0c;CPU直接被打满。重启之后撑了不到半小时&#xff0c;又打回原形。当时一群人在群里争论是“JVM…

作者头像 李华
网站建设 2026/9/10 17:25:49

论文查重降重工具实测:8款专业工具对比与终极方案

1. 项目背景与核心痛点 每年毕业季&#xff0c;数百万学子都要面临论文查重的终极考验。作为经历过三次毕业论文洗礼的老学长&#xff0c;我深知那种查重率从30%降到5%以下的煎熬。去年帮学弟学妹们测试了市面上23款查重降重工具后&#xff0c;我发现90%的付费工具都存在两个致…

作者头像 李华