CANN/GE算子编译接口
2026/9/10 9:09:27 网站建设 项目流程

aclopCompile

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

产品支持情况

  • Ascend 950PR/Ascend 950DT:不支持
  • Atlas A3 训练系列产品/Atlas A3 推理系列产品:支持
  • Atlas A2 训练系列产品/Atlas A2 推理系列产品:支持
  • Atlas 200I/500 A2 推理产品:支持
  • Atlas 推理系列产品:支持
  • Atlas 训练系列产品:支持
  • IPV350:不支持

功能说明

编译指定算子。在编译算子前,可以调用aclSetCompileopt接口设置编译选项。

每个算子的输入、输出组织不同,在调用接口时严格按照算子输入、输出参数来组织算子,用户在调用aclopCompile时,接口会根据optype、输入tensor的描述、输出tensor的描述、attr等信息查找对应的任务,再编译算子。

函数原型

aclError aclopCompile(const char *opType, int numInputs, const aclTensorDesc *const inputDesc[], int numOutputs, const aclTensorDesc *const outputDesc[], const aclopAttr *attr, aclopEngineType engineType, aclopCompileType compileFlag, const char *opPath)

参数说明

参数名输入/输出说明
opType输入算子类型名称的指针。
numInputs输入算子输入tensor的数量。
inputDesc输入算子输入tensor的描述的指针数组。类型定义请参见aclTensorDesc。
需提前调用aclCreateTensorDesc接口创建aclTensorDesc类型。
inputDesc数组中的元素个数必须与numInputs参数值保持一致。
numOutputs输入算子输出tensor的数量。
outputDesc输入算子输出tensor的描述的指针数组。类型定义请参见aclTensorDesc。
需提前调用aclCreateTensorDesc接口创建aclTensorDesc类型。
outputDesc数组中的元素个数必须与numOutputs参数值保持一致。
attr输入算子属性的指针。类型定义请参见aclopAttr。
需提前调用aclopCreateAttr接口创建aclopAttr类型。
engineType输入算子执行引擎。类型定义请参见aclopEngineType。
compileFlag输入算子编译标识。类型定义请参见aclopCompileType。
opPath输入算子实现文件(*.py)的路径的指针,不包含文件名。预留参数,当前仅支持设置为nullptr。

返回值说明

返回0表示成功,返回其他值表示失败,请参见aclError。

约束说明

  • 编译动态Shape的算子时,如果Shape具体值不明确,但Shape范围明确,则在调用aclCreateTensorDesc接口创建aclTensorDesc类型时,需要将dims数组的表示动态维度的元素值设置为-1,再调用aclSetTensorShapeRange接口设置tensor的各个维度的取值范围;如果Shape具体值以及Shape范围都不明确(该场景预留),则在调用aclCreateTensorDesc接口创建aclTensorDesc类型时,需要将dims数组的值设置为-2,例如:int64_t dims[] = {-2}。
  • 编译有可选输入的算子时,如果可选输入不使用,则需调用aclCreateTensorDesc(ACL_DT_UNDEFINED, 0, nullptr, ACL_FORMAT_UNDEFINED)接口创建aclTensorDesc类型的数据,将数据类型设置为ACL_DT_UNDEFINED,将Format设置为ACL_FORMAT_UNDEFINED,将Shape信息设置为nullptr。
  • 编译有constant输入的算子时,需要先调用aclSetTensorConst接口设置constant输入。调用aclopCompile接口、aclopExecuteV2接口前,设置的constant输入数据必须保持一致。

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询