昇腾CANN/GE融合规则列表
2026/9/10 2:09:45 网站建设 项目流程

融合规则列表

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

如下融合规则关闭后可能会有功能使用上的风险;更多融合规则请参见《图融合和UB融合规则参考》。

Ascend 950PR/Ascend 950DT不支持UB融合。

  • 图融合:Ascend 950PR/Ascend 950DT支持的图融合规则

    • AABiasaddConvFusion
    • AddRmsNormFusionGraphPass
    • ADepthwiseFusionPass
    • Conv2DQuantProcessFusionPass
    • DepthwiseDfFusionPass
    • DepthwiseDwMulFusionPass
    • EinsumPass
    • FixPipeAbilityProcessPass
    • InplaceAddRmsNormFusionPass
    • SoftmaxGradExtFusion
    • TfTagNoConstFoldingFusionPass
    • WeightQuantBatchMatmulV2TransposeFusionPass
    • ZConfusionSoftmaxGradFusionPass
    • ConstToAttrStridedSliceV2Fusion
    • DepthwiseToConv2dFusionPass
    • DWConv2DQuantProcessFusionPass
    • Globalavgpoolpass
  • 图融合:

    非Ascend 950PR/Ascend 950DT支持的图融合规则

    • AABiasaddConvFusion
    • AddNFusionPass
    • AddRmsNormFusionGraphPass
    • ADeformableConv2dPass
    • ADepthwiseFusionPass
    • ALSTMFusionPass
    • ApplyAddOutputPass
    • AReduceMeanFusionPass
    • AReduceSumFusionPass
    • AvgPool3DFusionPass
    • AvgPool3DGradFusionPass
    • AvgPoolGradFusionPass
    • AvgPoolQuantProcessFusionPass
    • BatchMatmulV2QuantProcessFusionPass
    • BatchNormBnInferFusionPass
    • BatchNormGradBnInferGradFusion
    • BatchNormGradInfGradFusion
    • BatchMatMulFusionPass
    • CastRemoveFusionPass
    • ConstToAttrPass
    • ConstToAttrReduceSumFusion
    • Conv2DQuantProcessFusionPass
    • CommonLSTMFusionPass
    • CommonSubexpressionEliminationPass:GE公共表达式消除Pass
    • ConstToAttrGatherV2Fusion
    • ConstToAttrResizeNearestNeighborGradFusion
    • ConstToAttrStridedSliceV2Fusion
    • Conv2DTDQuantProcessFusionPass
    • COPYPass
    • DeConvQuantProcessFusionPass
    • DepthwiseDfFusionPass
    • DepthwiseDwMulFusionPass
    • DepthwiseFusionPass
    • DepthwiseToConv2dFusionPass
    • DreluFusionPass
    • DWConv2DQuantProcessFusionPass
    • DynamicGRUV2GradFusionPass
    • DynamicRNNFusionPass
    • DynamicRNNGradAFusionPass
    • DynamicRNNGradAlignFusionPass
    • DynamicRNNGradDAlignFusionPass
    • DynamicRNNGradDFusionPass
    • DynamicRNNGradFusionPass
    • DynamicRNNInsertTransposePass
    • DynamicRNNSeqFusionPass
    • EinsumPass
    • FCQuantProcessFusionPass
    • FixPipeAbilityProcessPass
    • FlattenV2Pass
    • FusedBatchNormBertFusionPass
    • FusedBatchnormFusionPass
    • FusedBatchNormGradFusionPass
    • Globalavgpoolpass
    • GroupConv2DQuantProcessFusionPass
    • HostBNFusionPass
    • InplaceAddRmsNormFusionPass
    • MapIndexFusionPass
    • MatMul2MatMulV2FusionPass
    • MatmulV2QuantProcessFusionPass
    • MaxPoolWithArgmaxFusionPass
    • PackFusionPass
    • PassThroughFusionPass
    • PassThroughSecondFusionPass
    • PermuteFusionPass
    • PoolingQuantProcessFusionPass
    • PReluGradFusionPass
    • PriorBoxPass
    • ProposalFusionPass
    • RNNFusionPass
    • SingleBatchNormFusion
    • SpatialTransformerDPass
    • SPPPass
    • SoftmaxGradExtFusion
    • TbeAntiquantMaxpoolingFusionPass
    • TbeConvDequantS16FusionPass
    • TfMergeConv2DBackpropInputFusionPass
    • TfTagNoConstFoldingFusionPass
    • TransposedUpdateFusionPass
    • TransdataCastFusionPass
    • UnpackFusionPass
    • V100NotRequantFusionPass
    • V200NotRequantFusionPass
    • WeightQuantBatchMatmulV2TransposeFusionPass
    • YoloPass
    • YoloV2DetectionOutputPass
    • YoloV3DetectionOutputV2Pass
    • ZConcatExt2FusionPass
    • ZConcatDFusionPass
    • ZConfusionSoftmaxGradFusionPass
    • ZSplitVDFusionPass
    • ZSplitVFusionPass
  • UB融合:

    • ArgMaxWithFusionPass
    • clip_by_norm_nodivsquaresum
    • DeformableOffsetsFusionPass
    • DepthwiseInsertTransDataFusionPass
    • HostShapeOptimizationPass:AI CPU断流水pass
    • NormalizeFusionPass
    • TbeConvRequantFusionPass
    • TbeConvCommonRules0FusionPass
    • TbeConvCommonRules2FusionPass
    • TfMergeSubFusionPass

【免费下载链接】geGE(Graph Engine)是面向昇腾的图编译器和执行器,提供了计算图优化、多流并行、内存复用和模型下沉等技术手段,加速模型执行效率,减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力,并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询