news 2026/9/10 20:59:45

CANN/ge废弃配置参数说明

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
CANN/ge废弃配置参数说明

后续版本废弃配置

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

OP_SELECT_IMPL_MODE

该参数功能已停止演进,后续版本会废弃。

AI处理器部分内置算子有高精度和高性能实现方式,用户可以通过该参数配置模型编译时算子选择哪种实现方式。

高精度是指在float16输入场景,通过泰勒展开/牛顿迭代等手段进一步提升算子的精度;高性能是指在float16输入的情况下,不影响网络精度前提下的最优性能实现。

参数取值:

  • high_precision:表示算子采用高精度实现模式。

    该选项采用系统内置的配置文件设置算子实现模式,内置配置文件路径为${INSTALL_DIR}/opp/built-in/op_impl/ai_core/tbe/impl_mode/high_precision.ini

    为保持兼容,该参数仅对high_precision.ini文件中算子列表生效,通过该列表可以控制算子生效的范围并保证之前版本的网络模型不受影响。

  • high_performance:(默认值)表示算子采用高性能实现模式。

    该选项采用系统内置的配置文件设置算子实现模式,内置配置文件路径为${INSTALL_DIR}/opp/built-in/op_impl/ai_core/tbe/impl_mode/high_performance.ini

    为保持兼容,该参数仅对high_performance.ini文件中算子列表生效,通过该列表可以控制算子生效的范围并保证之前版本的网络模型不受影响。

  • high_precision_for_all:表示算子采用高精度实现模式。

    该选项采用系统内置的配置文件设置算子实现模式,内置配置文件路径为${INSTALL_DIR}/opp/built-in/op_impl/ai_core/tbe/impl_mode/high_precision_for_all.ini,该文件中列表后续可能会跟随版本更新。

    该实现模式不保证兼容,如果后续新的软件包中有算子新增了实现模式(即配置文件中新增了某个算子的实现模式),之前版本使用high_precision_for_all的网络模型,在新版本上性能可能会下降。

  • high_performance_for_all:表示算子采用高性能实现模式。

    该选项采用系统内置的配置文件设置算子实现模式,内置配置文件路径为${INSTALL_DIR}/opp/built-in/op_impl/ai_core/tbe/impl_mode/high_performance_for_all.ini,该文件中列表后续可能会跟随版本更新。

    该实现模式不保证兼容,如果后续新的软件包中有算子新增了实现模式(即配置文件中新增了某个算子的实现模式),之前版本使用high_performance_for_all的网络模型,在新版本上精度可能会下降。

上述实现模式,根据算子的dtype进行区分。${INSTALL_DIR}请替换为CANN软件安装后文件存储路径。以root用户安装为例,安装后文件默认存储路径为:/usr/local/Ascend/cann。

**参数默认值:**high_performance

配置示例:

{ge::ir_option::OP_SELECT_IMPL_MODE, "high_performance"}

OPTYPELIST_FOR_IMPLMODE

该参数功能已停止演进,后续版本会废弃,请勿使用。

设置optype列表中算子的实现模式。

参数值约束:

  • 列表中的算子使用OP_SELECT_IMPL_MODE参数指定的模式,当前仅支持指定为high_precision、high_performance两种模式,多个算子使用英文逗号进行分隔。
  • 该参数需要与OP_SELECT_IMPL_MODE参数配合使用,且仅对指定的算子生效,不指定的算子按照默认实现方式选择。例如:OP_SELECT_IMPL_MODE配置为high_precision;OPTYPELIST_FOR_IMPLMODE配置为Pooling、SoftmaxV2。表示对Pooling、SoftmaxV2算子使用统一的高精度模式,未指定算子使用算子的默认实现方式。

配置示例:

{ge::ir_option::OPTYPELIST_FOR_IMPLMODE, "Pooling,SoftmaxV2"}

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/10 20:57:47

Firefox 149版本多任务处理与硬件加速全面升级

1. Firefox 149版本核心升级解析Mozilla基金会于本月正式推送了Firefox 149稳定版更新,这次版本迭代聚焦于多任务处理能力的全面提升。作为一名长期跟踪浏览器技术演进的从业者,我在实际测试中发现本次更新包含多项底层架构改进,特别是对硬件…

作者头像 李华
网站建设 2026/9/10 20:54:50

智慧医疗中的中心药房系统架构与实施效果

1. 中心药房的概念与行业背景中心药房(或称云药房)是近年来医疗信息化领域的重要创新模式,它通过集中化药品仓储管理和智能化配送系统,重构了传统医疗机构药品供应流程。我在参与某三甲医院智慧药房建设项目时,亲眼见证…

作者头像 李华
网站建设 2026/9/10 20:53:42

C++与FPGA协同设计:高性能计算与嵌入式系统实践

1. 项目概述:当C遇见FPGA 在嵌入式系统和高性能计算领域,C与FPGA的协同设计正成为解决复杂计算难题的黄金组合。这种设计模式充分利用了C的软件灵活性和FPGA的硬件并行优势,特别适合需要低延迟、高吞吐量的应用场景。我最近完成的一个视频处理…

作者头像 李华
网站建设 2026/9/10 20:50:35

Unigram终极指南:解锁Windows上最流畅的Telegram体验

Unigram终极指南:解锁Windows上最流畅的Telegram体验 在Windows平台上寻找完美的Telegram客户端?Unigram凭借其卓越的原生体验和智能化功能,已经成为无数用户的首选。这款专为Windows优化的客户端不仅界面美观,更在性能和使用便捷…

作者头像 李华
网站建设 2026/9/10 20:50:32

三维点云中岩体结构面自动提取:从TIN到产状计算的完整流程

简介:面向地质建模与GIS领域的工程师和研究者,一套围绕岩体结构面自动提取与产状计算的代码包,覆盖点云预处理(滤波、降噪)、边缘检测、连通性分析以及TIN构建、密度分析等关键技术环节,可根据点云密度自动…

作者头像 李华