news 2026/9/10 14:48:07

昇腾/GE更新可刷新特征内存基址API

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
昇腾/GE更新可刷新特征内存基址API

UpdateGraphRefreshableFeatureMemoryBase

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

产品支持情况

产品

是否支持

Atlas A3 训练系列产品 / Atlas A3 推理系列产品

Atlas A2 训练系列产品 / Atlas A2 推理系列产品

头文件/库文件

  • 头文件:#include <ge/ge_api.h>
  • 库文件:libge_runner.so

功能说明

用于更新除了Fixed之外可刷新的Feature内存基址。

内存大小从GetCompiledGraphSummary>GetRefreshableFeatureMemorySize接口中获取。

如果图中存在Fixed内存,且用户没有调用SetGraphFixedFeatureMemoryBase或SetGraphFixedFeatureMemoryBaseWithType接口设置默认内存类型的Fixed Feature内存基地址,则会自动默认申请Fixed内存。

Feature内存指的是模型执行过程中所需要的中间内存(比如中间节点的输入输出等内存)。

函数原型

Status UpdateGraphRefreshableFeatureMemoryBase(uint32_t graph_id, const void *const memory, size_t size)

参数说明

参数名

输入/输出

说明

graph_id

输入

子图对应的ID。

memory

输入

设置的除了Fixed之外可刷新的Feature内存基址。

size

输入

设置的除了Fixed之外可刷新的Feature内存大小。

返回值说明

参数名

类型

说明

-

Status

SUCCESS:设置成功。

FAILED:设置失败。

约束说明

  • 在调用本接口前,必须先调用CompileGraph接口进行图编译。
  • 调用CompileGraph完成图编译后,您可以通过GetCompiledGraphSummary接口获取Feature地址是否可刷新,只有Feature地址可刷新的图才支持重复调用本接口刷新Feature地址。
  • 该接口只适用于静态编译图,可以通过GetCompiledGraphSummary接口中的IsStatic接口获取图是否为静态编译。
  • 若使用了本接口,又配置了RegisterExternalAllocator接口,则RegisterExternalAllocator接口不生效。
  • 如果通过SetGraphFixedFeatureMemoryBase或SetGraphFixedFeatureMemoryBaseWithType接口将内存类型为MEMORY_TYPE_DEFAULT的Fixed内存地址设置为nullptr,size设置为0,表示关闭Fixed内存功能,该场景下无法再调用本接口。
  • 不能与UpdateGraphFeatureMemoryBase同时使用。

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/10 14:46:45

RustDesk 1.4.5客户端本地编译与硬件加速优化实战

1. 项目概述&#xff1a;RustDesk 1.4.5客户端本地编译实战 在远程桌面工具领域&#xff0c;RustDesk凭借其开源特性和低延迟表现赢得了大量技术用户的青睐。最近在调试一个需要硬件加速的远程医疗场景时&#xff0c;我发现官方预编译版本对NVIDIA显卡的H.264编码器支持不够理想…

作者头像 李华
网站建设 2026/9/10 14:45:52

永磁同步电机转子参数化建模:一字型与V字型拓扑的Maxwell实践

接到一个电机优化项目&#xff0c;领导甩过来一句话&#xff1a;“把一字型和V字型都建个参数化模型&#xff0c;后面要反复调参数的。”如果你是做Ansys Maxwell电机仿真的工程师&#xff0c;听到这句应该能立刻感受到那种复杂心情——参数化建模本身不难&#xff0c;但要做到…

作者头像 李华
网站建设 2026/9/10 14:44:29

文本分类实战:CNN与RNN的原理、实现与选型指南

简介&#xff1a;面向NLP初学者与深度学习实践者的文本分类实战项目&#xff0c;完整实现了基于CNN和RNN的两种经典模型&#xff0c;覆盖情感分析、主题分类等典型任务场景。压缩包共含28个文件&#xff0c;其中9个Python源码涵盖模型定义、数据加载与训练流程&#xff0c;6个p…

作者头像 李华
网站建设 2026/9/10 14:44:04

Spring Boot+Vue旅游系统全栈实践与答辩通关指南

简介&#xff1a;本资源是一套高分通过的Java毕业设计实战项目&#xff0c;面向计算机专业本科生及Java全栈初学者&#xff0c;聚焦旅游管理业务场景&#xff0c;提供从前端Vue到后端SpringBoot的完整闭环开发范例。压缩包含695个文件&#xff0c;主体为85个Java后端逻辑类、32…

作者头像 李华