PyPI - mindspore - Versions diffs - 2.0.0rc1__cp38-cp38-manylinux1_x86_64.whl → 2.2.0__cp38-cp38-manylinux1_x86_64.whl - Mend

mindspore 2.0.0rc1__cp38-cp38-manylinux1_x86_64.whl → 2.2.0__cp38-cp38-manylinux1_x86_64.whl

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.

Potentially problematic release.

This version of mindspore might be problematic. Click here for more details.

Files changed (884) hide show

mindspore/.commit_id +1 -1
mindspore/Third_Party_Open_Source_Software_Notice +2 -2
mindspore/__init__.py +5 -2
mindspore/_akg/akg/build_module.py +5 -6
mindspore/_akg/akg/composite/build_module.py +49 -16
mindspore/_akg/akg/composite/split_stitch.py +10 -11
mindspore/_akg/akg/config/repository.json +195 -0
mindspore/_akg/akg/global_configs.py +5 -1
mindspore/_akg/akg/ms/info_version_adapt.py +67 -1
mindspore/_akg/akg/tvm/api.py +4 -3
mindspore/_akg/akg/tvm/autotvm/__init__.py +1 -2
mindspore/_akg/akg/tvm/autotvm/graph_tuner/base_graph_tuner.py +1 -5
mindspore/_akg/akg/tvm/autotvm/measure/__init__.py +1 -1
mindspore/_akg/akg/tvm/autotvm/measure/measure.py +1 -10
mindspore/_akg/akg/tvm/autotvm/measure/measure_methods.py +1 -372
mindspore/_akg/akg/tvm/build_module.py +16 -1
mindspore/_akg/akg/tvm/contrib/graph_runtime.py +0 -53
mindspore/_akg/akg/tvm/hybrid/parser.py +7 -6
mindspore/_akg/akg/tvm/ir_builder.py +1 -1
mindspore/_akg/akg/tvm/module.py +1 -2
mindspore/_akg/akg/tvm/stmt.py +2 -2
mindspore/_akg/akg/utils/composite_op_helper.py +9 -10
mindspore/_akg/akg/utils/kernel_exec.py +58 -260
mindspore/_akg/akg/utils/op_dsl.py +17 -1
mindspore/_akg/akg/utils/result_analysis.py +4 -24
mindspore/_akg/akg/utils/tbe_codegen_utils.py +198 -0
mindspore/_c_dataengine.cpython-38-x86_64-linux-gnu.so +0 -0
mindspore/_c_expression.cpython-38-x86_64-linux-gnu.so +0 -0
mindspore/_c_mindrecord.cpython-38-x86_64-linux-gnu.so +0 -0
mindspore/_check_jit_forbidden_api.py +5 -1
mindspore/_checkparam.py +79 -62
mindspore/_extends/graph_kernel/__init__.py +0 -1
mindspore/_extends/graph_kernel/model/graph_split.py +2 -0
mindspore/_extends/graph_kernel/model/model_builder.py +9 -50
mindspore/_extends/graph_kernel/splitter.py +1 -9
mindspore/_extends/parallel_compile/akg_compiler/akg_process.py +128 -21
mindspore/_extends/parallel_compile/akg_compiler/build_tbe_kernel.py +2 -2
mindspore/_extends/parallel_compile/akg_compiler/tbe_topi.py +4 -2
mindspore/_extends/parallel_compile/tbe_compiler/tbe_adapter.py +18 -13
mindspore/_extends/parallel_compile/tbe_compiler/tbe_helper.py +13 -9
mindspore/_extends/parallel_compile/tbe_compiler/tbe_job.py +1 -1
mindspore/_extends/parallel_compile/tbe_compiler/tbe_job_manager.py +1 -1
mindspore/_extends/parse/__init__.py +19 -17
mindspore/_extends/parse/namespace.py +7 -36
mindspore/_extends/parse/parser.py +375 -189
mindspore/_extends/parse/resources.py +36 -41
mindspore/_extends/parse/standard_method.py +350 -245
mindspore/_extends/parse/trope.py +2 -12
mindspore/_extends/remote/kernel_build_server.py +24 -7
mindspore/_extends/remote/kernel_build_server_akg_v2.py +55 -0
mindspore/_install_custom.py +43 -0
mindspore/_mindspore_offline_debug.cpython-38-x86_64-linux-gnu.so +0 -0
mindspore/amp.py +85 -19
mindspore/bin/cache_admin +0 -0
mindspore/bin/cache_server +0 -0
mindspore/boost/base.py +2 -2
mindspore/boost/boost.py +27 -32
mindspore/boost/boost_cell_wrapper.py +37 -13
mindspore/boost/grad_accumulation.py +1 -1
mindspore/boost/grad_freeze.py +34 -6
mindspore/boost/group_loss_scale_manager.py +15 -14
mindspore/boost/less_batch_normalization.py +28 -3
mindspore/common/__init__.py +15 -11
mindspore/common/_auto_dynamic.py +68 -0
mindspore/common/_jit_fallback_utils.py +111 -0
mindspore/common/_register_for_adapter.py +17 -5
mindspore/common/_register_for_tensor.py +2 -2
mindspore/common/_stub_tensor.py +18 -15
mindspore/common/_utils.py +31 -7
mindspore/common/api.py +269 -101
mindspore/common/auto_dynamic_shape.py +498 -0
mindspore/common/dtype.py +61 -21
mindspore/common/dump.py +9 -7
mindspore/common/initializer.py +106 -76
mindspore/common/jit_config.py +35 -14
mindspore/common/lazy_inline.py +187 -0
mindspore/common/mindir_util.py +101 -0
mindspore/common/mutable.py +10 -13
mindspore/common/parameter.py +246 -55
mindspore/common/seed.py +13 -7
mindspore/common/sparse_tensor.py +29 -33
mindspore/common/tensor.py +907 -251
mindspore/communication/__init__.py +7 -4
mindspore/communication/_comm_helper.py +84 -4
mindspore/communication/management.py +160 -88
mindspore/config/op_info.config +99 -75
mindspore/config/super_bar_config.json +36 -4
mindspore/context.py +526 -219
mindspore/dataset/__init__.py +9 -46
mindspore/dataset/audio/__init__.py +4 -19
mindspore/dataset/audio/transforms.py +545 -233
mindspore/dataset/audio/utils.py +21 -18
mindspore/dataset/callback/ds_callback.py +42 -13
mindspore/dataset/core/config.py +158 -100
mindspore/dataset/core/validator_helpers.py +1 -63
mindspore/dataset/debug/debug_hook.py +45 -13
mindspore/dataset/debug/pre_defined_hook.py +5 -5
mindspore/dataset/engine/__init__.py +0 -5
mindspore/dataset/engine/cache_client.py +38 -15
mindspore/dataset/engine/datasets.py +615 -278
mindspore/dataset/engine/datasets_audio.py +154 -283
mindspore/dataset/engine/datasets_standard_format.py +104 -116
mindspore/dataset/engine/datasets_text.py +443 -326
mindspore/dataset/engine/datasets_user_defined.py +251 -164
mindspore/dataset/engine/datasets_vision.py +839 -1443
mindspore/dataset/engine/iterators.py +11 -4
mindspore/dataset/engine/obs/obs_mindrecord_dataset.py +7 -3
mindspore/dataset/engine/obs/util.py +3 -0
mindspore/dataset/engine/offload.py +6 -6
mindspore/dataset/engine/queue.py +15 -14
mindspore/dataset/engine/samplers.py +39 -23
mindspore/dataset/engine/serializer_deserializer.py +22 -6
mindspore/dataset/engine/validators.py +21 -331
mindspore/dataset/text/__init__.py +5 -33
mindspore/dataset/text/transforms.py +334 -165
mindspore/dataset/text/utils.py +215 -145
mindspore/dataset/transforms/__init__.py +1 -1
mindspore/dataset/transforms/c_transforms.py +3 -2
mindspore/dataset/transforms/py_transforms_util.py +40 -12
mindspore/dataset/transforms/transforms.py +174 -71
mindspore/dataset/utils/browse_dataset.py +25 -17
mindspore/dataset/utils/line_reader.py +24 -21
mindspore/dataset/vision/__init__.py +5 -26
mindspore/dataset/vision/c_transforms.py +177 -165
mindspore/dataset/vision/py_transforms.py +114 -119
mindspore/dataset/vision/py_transforms_util.py +54 -51
mindspore/dataset/vision/transforms.py +1127 -381
mindspore/dataset/vision/utils.py +54 -38
mindspore/dataset/vision/validators.py +12 -2
mindspore/experimental/map_parameter.py +38 -4
mindspore/{dataset/datapreprocess → experimental/optim}/__init__.py +14 -4
mindspore/experimental/optim/adam.py +192 -0
mindspore/experimental/optim/adamw.py +181 -0
mindspore/experimental/optim/lr_scheduler.py +1427 -0
mindspore/experimental/optim/optimizer.py +252 -0
mindspore/experimental/optim/sgd.py +147 -0
mindspore/gen_ops.py +273 -0
mindspore/include/OWNERS +1 -2
mindspore/include/api/context.h +21 -1
mindspore/include/api/data_type.h +2 -1
mindspore/include/api/graph.h +0 -15
mindspore/include/api/kernel.h +2 -0
mindspore/include/api/kernel_api.h +37 -12
mindspore/include/api/model.h +29 -42
mindspore/include/api/model_group.h +14 -3
mindspore/include/api/model_parallel_runner.h +18 -2
mindspore/include/api/serialization.h +26 -0
mindspore/include/api/status.h +1 -0
mindspore/include/api/types.h +38 -4
mindspore/include/c_api/ms/abstract.h +67 -0
mindspore/include/c_api/ms/attribute.h +197 -0
mindspore/include/c_api/ms/base/handle_types.h +43 -0
mindspore/include/c_api/ms/base/macros.h +32 -0
mindspore/include/c_api/ms/base/status.h +33 -0
mindspore/include/c_api/ms/base/types.h +282 -0
mindspore/include/c_api/ms/context.h +102 -0
mindspore/include/c_api/ms/graph.h +160 -0
mindspore/include/c_api/ms/node.h +606 -0
mindspore/include/c_api/ms/tensor.h +161 -0
mindspore/include/c_api/ms/value.h +84 -0
mindspore/include/c_api/status_c.h +3 -0
mindspore/include/dataset/constants.h +6 -12
mindspore/include/dataset/execute.h +23 -13
mindspore/include/dataset/text.h +26 -26
mindspore/include/dataset/transforms.h +25 -31
mindspore/include/dataset/vision.h +60 -60
mindspore/include/dataset/vision_ascend.h +5 -6
mindspore/include/dataset/vision_lite.h +17 -17
mindspore/include/mindapi/base/format.h +0 -1
mindspore/include/mindapi/base/type_id.h +2 -1
mindspore/include/mindapi/base/types.h +5 -1
mindspore/lib/libdnnl.so.2 +0 -0
mindspore/lib/libjemalloc.so.2 +0 -0
mindspore/lib/libmindspore.so +0 -0
mindspore/lib/libmindspore_backend.so +0 -0
mindspore/lib/libmindspore_common.so +0 -0
mindspore/lib/libmindspore_core.so +0 -0
mindspore/lib/libmindspore_glog.so.0 +0 -0
mindspore/lib/libmindspore_gpr.so.15 +0 -0
mindspore/lib/libmindspore_grpc++.so.1 +0 -0
mindspore/lib/libmindspore_grpc.so.15 +0 -0
mindspore/lib/libmindspore_shared_lib.so +0 -0
mindspore/lib/libmpi_adapter.so +0 -0
mindspore/lib/libnnacl.so +0 -0
mindspore/lib/libopencv_core.so.4.5 +0 -0
mindspore/lib/libopencv_imgcodecs.so.4.5 +0 -0
mindspore/lib/libopencv_imgproc.so.4.5 +0 -0
mindspore/lib/libps_cache.so +0 -0
mindspore/lib/plugin/ascend/custom_aicpu_ops/op_impl/cpu/aicpu_kernel/impl/libcust_aicpu_kernels.so +0 -0
mindspore/lib/plugin/ascend/custom_aicpu_ops/op_impl/cpu/aicpu_kernel/impl/libcust_cpu_kernels.so +0 -0
mindspore/lib/plugin/ascend/custom_aicpu_ops/op_impl/cpu/config/cust_aicpu_kernel.json +9000 -0
mindspore/lib/plugin/ascend/custom_aicpu_ops/op_proto/libcust_op_proto.so +0 -0
mindspore/lib/plugin/ascend/libakg.so +0 -0
mindspore/lib/plugin/ascend/libascend_collective.so +0 -0
mindspore/lib/plugin/ascend/libdvpp_utils.so +0 -0
mindspore/lib/plugin/ascend/libhccl_plugin.so +0 -0
mindspore/lib/plugin/ascend/libmindspore_aicpu_kernels.so +0 -0
mindspore/lib/plugin/ascend/libmindspore_cpu_kernels.so +0 -0
mindspore/lib/plugin/cpu/libakg.so +0 -0
mindspore/lib/plugin/gpu/libcuda_ops.so.10 +0 -0
mindspore/lib/plugin/gpu/libcuda_ops.so.11 +0 -0
mindspore/lib/plugin/gpu10.1/libakg.so +0 -0
mindspore/lib/plugin/gpu10.1/libnccl.so.2 +0 -0
mindspore/lib/plugin/gpu10.1/libnvidia_collective.so +0 -0
mindspore/lib/plugin/gpu11.1/libakg.so +0 -0
mindspore/lib/plugin/gpu11.1/libnccl.so.2 +0 -0
mindspore/lib/plugin/gpu11.1/libnvidia_collective.so +0 -0
mindspore/lib/plugin/gpu11.6/libakg.so +0 -0
mindspore/lib/plugin/gpu11.6/libnccl.so.2 +0 -0
mindspore/lib/plugin/gpu11.6/libnvidia_collective.so +0 -0
mindspore/lib/plugin/libmindspore_ascend.so.1 +0 -0
mindspore/lib/plugin/libmindspore_ascend.so.2 +0 -0
mindspore/lib/plugin/libmindspore_gpu.so.10.1 +0 -0
mindspore/lib/plugin/libmindspore_gpu.so.11.1 +0 -0
mindspore/lib/plugin/libmindspore_gpu.so.11.6 +0 -0
mindspore/log.py +9 -6
mindspore/mindrecord/filereader.py +33 -4
mindspore/mindrecord/filewriter.py +70 -35
mindspore/mindrecord/mindpage.py +40 -34
mindspore/mindrecord/shardreader.py +1 -1
mindspore/mindrecord/shardsegment.py +1 -1
mindspore/mindrecord/tools/cifar100_to_mr.py +25 -18
mindspore/mindrecord/tools/cifar10_to_mr.py +25 -18
mindspore/mindrecord/tools/csv_to_mr.py +29 -13
mindspore/mindrecord/tools/imagenet_to_mr.py +24 -10
mindspore/mindrecord/tools/mnist_to_mr.py +24 -11
mindspore/mindrecord/tools/tfrecord_to_mr.py +31 -26
mindspore/nn/cell.py +463 -169
mindspore/nn/dynamic_lr.py +47 -43
mindspore/nn/layer/activation.py +225 -82
mindspore/nn/layer/basic.py +121 -79
mindspore/nn/layer/channel_shuffle.py +21 -21
mindspore/nn/layer/combined.py +33 -26
mindspore/nn/layer/container.py +277 -22
mindspore/nn/layer/conv.py +441 -304
mindspore/nn/layer/dense.py +19 -13
mindspore/nn/layer/embedding.py +62 -49
mindspore/nn/layer/flash_attention.py +264 -0
mindspore/nn/layer/image.py +50 -39
mindspore/nn/layer/math.py +62 -51
mindspore/nn/layer/normalization.py +219 -167
mindspore/nn/layer/padding.py +58 -70
mindspore/nn/layer/pooling.py +334 -287
mindspore/nn/layer/rnn_cells.py +53 -38
mindspore/nn/layer/rnns.py +59 -56
mindspore/nn/layer/thor_layer.py +52 -44
mindspore/nn/layer/timedistributed.py +6 -4
mindspore/nn/layer/transformer.py +284 -164
mindspore/nn/learning_rate_schedule.py +34 -25
mindspore/nn/loss/__init__.py +3 -2
mindspore/nn/loss/loss.py +554 -311
mindspore/nn/optim/ada_grad.py +12 -9
mindspore/nn/optim/adadelta.py +14 -11
mindspore/nn/optim/adafactor.py +19 -16
mindspore/nn/optim/adam.py +62 -47
mindspore/nn/optim/adamax.py +13 -10
mindspore/nn/optim/adasum.py +12 -8
mindspore/nn/optim/asgd.py +10 -9
mindspore/nn/optim/ftrl.py +20 -17
mindspore/nn/optim/lamb.py +16 -12
mindspore/nn/optim/lars.py +8 -6
mindspore/nn/optim/lazyadam.py +25 -20
mindspore/nn/optim/momentum.py +10 -7
mindspore/nn/optim/optimizer.py +61 -9
mindspore/nn/optim/proximal_ada_grad.py +14 -13
mindspore/nn/optim/rmsprop.py +17 -13
mindspore/nn/optim/rprop.py +30 -17
mindspore/nn/optim/sgd.py +40 -23
mindspore/nn/optim/thor.py +24 -26
mindspore/nn/probability/bijector/bijector.py +11 -11
mindspore/nn/probability/bijector/exp.py +1 -1
mindspore/nn/probability/bijector/gumbel_cdf.py +3 -3
mindspore/nn/probability/bijector/invert.py +1 -1
mindspore/nn/probability/bijector/power_transform.py +29 -29
mindspore/nn/probability/bijector/scalar_affine.py +3 -3
mindspore/nn/probability/bijector/softplus.py +5 -5
mindspore/nn/probability/bnn_layers/bnn_cell_wrapper.py +4 -2
mindspore/nn/probability/bnn_layers/conv_variational.py +13 -13
mindspore/nn/probability/bnn_layers/dense_variational.py +12 -12
mindspore/nn/probability/bnn_layers/layer_distribution.py +9 -8
mindspore/nn/probability/distribution/_utils/custom_ops.py +19 -3
mindspore/nn/probability/distribution/_utils/utils.py +1 -1
mindspore/nn/probability/distribution/bernoulli.py +9 -9
mindspore/nn/probability/distribution/beta.py +8 -8
mindspore/nn/probability/distribution/categorical.py +23 -15
mindspore/nn/probability/distribution/cauchy.py +5 -6
mindspore/nn/probability/distribution/distribution.py +3 -3
mindspore/nn/probability/distribution/exponential.py +4 -4
mindspore/nn/probability/distribution/gamma.py +10 -10
mindspore/nn/probability/distribution/geometric.py +8 -8
mindspore/nn/probability/distribution/gumbel.py +8 -9
mindspore/nn/probability/distribution/half_normal.py +5 -5
mindspore/nn/probability/distribution/laplace.py +5 -5
mindspore/nn/probability/distribution/log_normal.py +12 -11
mindspore/nn/probability/distribution/logistic.py +8 -8
mindspore/nn/probability/distribution/normal.py +6 -5
mindspore/nn/probability/distribution/poisson.py +10 -11
mindspore/nn/probability/distribution/student_t.py +8 -9
mindspore/nn/probability/distribution/transformed_distribution.py +5 -5
mindspore/nn/probability/distribution/uniform.py +11 -11
mindspore/nn/reinforcement/tensor_array.py +2 -2
mindspore/nn/sparse/sparse.py +9 -9
mindspore/nn/wrap/cell_wrapper.py +188 -63
mindspore/nn/wrap/grad_reducer.py +21 -12
mindspore/nn/wrap/loss_scale.py +136 -49
mindspore/numpy/__init__.py +4 -4
mindspore/numpy/array_creations.py +55 -56
mindspore/numpy/array_ops.py +134 -35
mindspore/numpy/logic_ops.py +66 -20
mindspore/numpy/math_ops.py +142 -139
mindspore/numpy/utils_const.py +2 -2
mindspore/offline_debug/convert_async.py +2 -2
mindspore/ops/_grad_experimental/__init__.py +7 -5
mindspore/ops/_grad_experimental/grad_array_ops.py +231 -348
mindspore/ops/{_grad → _grad_experimental}/grad_base.py +1 -33
mindspore/ops/{_grad → _grad_experimental}/grad_comm_ops.py +25 -13
mindspore/ops/{_grad/__init__.py → _grad_experimental/grad_debug_ops.py} +15 -7
mindspore/ops/{_grad → _grad_experimental}/grad_implementations.py +17 -11
mindspore/ops/_grad_experimental/grad_inner_ops.py +33 -52
mindspore/ops/_grad_experimental/grad_math_ops.py +151 -1224
mindspore/ops/_grad_experimental/grad_nn_ops.py +141 -414
mindspore/ops/{_grad → _grad_experimental}/grad_quant_ops.py +10 -6
mindspore/ops/_grad_experimental/grad_sparse.py +317 -2
mindspore/ops/_grad_experimental/grad_sparse_ops.py +3 -13
mindspore/ops/{_grad → _grad_experimental}/taylor_rule.py +1 -1
mindspore/ops/_op_impl/_custom_op/dsd_back_impl.py +1 -1
mindspore/ops/_op_impl/_custom_op/flash_attention/__init__.py +0 -0
mindspore/ops/_op_impl/_custom_op/flash_attention/attention.py +406 -0
mindspore/{_extends/graph_kernel/expanders/complex/__init__.py → ops/_op_impl/_custom_op/flash_attention/constants.py} +27 -8
mindspore/ops/_op_impl/_custom_op/flash_attention/flash_attention_bwd.py +467 -0
mindspore/ops/_op_impl/_custom_op/flash_attention/flash_attention_fwd.py +563 -0
mindspore/ops/_op_impl/_custom_op/flash_attention/flash_attention_impl.py +193 -0
mindspore/ops/_op_impl/_custom_op/flash_attention/tik_ops_utils.py +435 -0
mindspore/ops/_op_impl/_custom_op/flash_attention/tiling_strategy/__init__.py +0 -0
mindspore/ops/_op_impl/_custom_op/flash_attention/tiling_strategy/sparse_tiling.py +45 -0
mindspore/ops/_op_impl/_custom_op/flash_attention/tiling_strategy/strategy.py +67 -0
mindspore/ops/_op_impl/_custom_op/flash_attention/tiling_strategy/wukong_tiling.py +62 -0
mindspore/ops/_op_impl/_custom_op/matmul_cube_dense_left_impl.py +2 -2
mindspore/ops/_op_impl/aicpu/__init__.py +41 -1
mindspore/ops/_op_impl/aicpu/adaptive_max_pool_2d.py +37 -0
mindspore/ops/_op_impl/aicpu/bias_add_grad.py +0 -1
mindspore/ops/_op_impl/aicpu/cast.py +52 -0
mindspore/ops/_op_impl/aicpu/coalesce.py +2 -0
mindspore/ops/_op_impl/aicpu/col2im.py +3 -1
mindspore/ops/_op_impl/aicpu/count_nonzero.py +43 -0
mindspore/ops/_op_impl/aicpu/dropout_genmask.py +6 -0
mindspore/ops/_op_impl/aicpu/eps.py +32 -0
mindspore/ops/_op_impl/aicpu/eye.py +4 -4
mindspore/ops/_op_impl/aicpu/fft_with_size.py +6 -0
mindspore/ops/_op_impl/aicpu/fill_diagonal.py +5 -0
mindspore/ops/_op_impl/aicpu/gamma.py +2 -2
mindspore/ops/_op_impl/aicpu/im2col.py +3 -5
mindspore/ops/_op_impl/aicpu/lgamma.py +1 -0
mindspore/ops/_op_impl/aicpu/log_uniform_candidate_sampler.py +6 -3
mindspore/ops/_op_impl/aicpu/lu.py +39 -0
mindspore/ops/_op_impl/aicpu/lu_unpack_grad.py +0 -1
mindspore/ops/_op_impl/aicpu/masked_scatter.py +1 -0
mindspore/ops/_op_impl/aicpu/masked_select_grad.py +3 -0
mindspore/ops/_op_impl/aicpu/matrix_band_part.py +59 -0
mindspore/ops/_op_impl/aicpu/matrix_power.py +6 -1
mindspore/ops/_op_impl/aicpu/median.py +1 -0
mindspore/ops/_op_impl/aicpu/multinomial.py +9 -9
mindspore/ops/_op_impl/aicpu/not_equal.py +0 -5
mindspore/ops/_op_impl/aicpu/pad_v3.py +3 -1
mindspore/ops/_op_impl/aicpu/pad_v3_grad.py +2 -0
mindspore/ops/_op_impl/aicpu/parameterized_truncated_normal.py +15 -7
mindspore/ops/_op_impl/aicpu/random_categorical.py +39 -19
mindspore/ops/_op_impl/aicpu/random_choice_with_mask.py +5 -2
mindspore/ops/_op_impl/aicpu/random_poisson.py +103 -52
mindspore/ops/_op_impl/aicpu/random_shuffle.py +17 -15
mindspore/ops/_op_impl/aicpu/resize_bilinear_grad.py +0 -1
mindspore/ops/_op_impl/aicpu/resize_nearest_neighbor_v2.py +0 -6
mindspore/ops/_op_impl/aicpu/resize_nearest_neighbor_v2_grad.py +0 -7
mindspore/ops/_op_impl/aicpu/scatter_nd.py +2 -0
mindspore/ops/_op_impl/aicpu/sequence_concat.py +40 -0
mindspore/ops/_op_impl/aicpu/sequence_stack.py +40 -0
mindspore/ops/_op_impl/aicpu/{sparseaddmm.py → sparse_addmm.py} +2 -2
mindspore/ops/_op_impl/aicpu/{sparsesparsemaximum.py → sparse_sparse_maximum.py} +4 -4
mindspore/ops/_op_impl/aicpu/standard_laplace.py +5 -4
mindspore/ops/_op_impl/aicpu/standard_normal.py +5 -4
mindspore/ops/_op_impl/aicpu/truncated_normal.py +9 -7
mindspore/ops/_op_impl/aicpu/uniform.py +5 -3
mindspore/ops/_op_impl/aicpu/uniform_candidate_sampler.py +8 -4
mindspore/ops/_op_impl/aicpu/uniform_int.py +5 -5
mindspore/ops/_op_impl/aicpu/uniform_real.py +4 -4
mindspore/ops/_op_impl/aicpu/upsample_nearest_3d.py +14 -6
mindspore/ops/_op_impl/aicpu/upsample_nearest_3d_grad.py +22 -8
mindspore/ops/_op_impl/aicpu/upsample_trilinear_3d.py +11 -6
mindspore/ops/_op_impl/aicpu/upsample_trilinear_3d_grad.py +21 -10
mindspore/ops/_op_impl/tbe/__init__.py +6 -4
mindspore/ops/_op_impl/tbe/atomic_addr_clean.py +1 -1
mindspore/ops/_op_impl/tbe/avg_pool.py +2 -2
mindspore/ops/_op_impl/tbe/avg_pool_3d.py +3 -3
mindspore/ops/_op_impl/tbe/avg_pool_3d_grad.py +4 -4
mindspore/ops/_op_impl/tbe/avg_pool_ds.py +2 -2
mindspore/ops/_op_impl/tbe/avg_pool_grad.py +3 -3
mindspore/ops/_op_impl/tbe/avg_pool_grad_vm.py +3 -3
mindspore/ops/_op_impl/tbe/batch_to_space.py +1 -1
mindspore/ops/_op_impl/tbe/batch_to_space_nd.py +2 -2
mindspore/ops/_op_impl/tbe/bn_infer.py +2 -2
mindspore/ops/_op_impl/tbe/bn_infer_ds.py +3 -2
mindspore/ops/_op_impl/tbe/broadcast_to.py +1 -1
mindspore/ops/_op_impl/tbe/depthwise_conv2d.py +3 -3
mindspore/ops/_op_impl/tbe/expand_dims.py +1 -1
mindspore/ops/_op_impl/tbe/gather_v2.py +56 -0
mindspore/ops/_op_impl/tbe/im2col.py +4 -4
mindspore/ops/_op_impl/tbe/inplace_index_add.py +7 -3
mindspore/ops/_op_impl/tbe/mem_set.py +38 -0
mindspore/ops/_op_impl/tbe/scatter_nd_add.py +3 -0
mindspore/ops/_op_impl/tbe/scatter_nd_d.py +1 -1
mindspore/ops/_op_impl/tbe/space_to_batch.py +1 -1
mindspore/ops/_op_impl/tbe/space_to_batch_nd.py +2 -2
mindspore/ops/_op_impl/tbe/trans_data_ds.py +2 -0
mindspore/ops/_primitive_cache.py +1 -1
mindspore/ops/_tracefunc.py +241 -0
mindspore/ops/_utils/utils.py +10 -2
mindspore/ops/_vmap/vmap_array_ops.py +5 -3
mindspore/ops/_vmap/vmap_base.py +5 -4
mindspore/ops/_vmap/vmap_convolution_ops.py +1 -1
mindspore/ops/_vmap/vmap_grad_math_ops.py +6 -4
mindspore/ops/_vmap/vmap_grad_nn_ops.py +11 -6
mindspore/ops/_vmap/vmap_math_ops.py +5 -2
mindspore/ops/_vmap/vmap_nn_ops.py +135 -11
mindspore/ops/arg_dtype_cast.py +54 -0
mindspore/ops/composite/__init__.py +7 -5
mindspore/ops/composite/base.py +78 -34
mindspore/ops/composite/math_ops.py +5 -695
mindspore/ops/composite/multitype_ops/_compile_utils.py +403 -97
mindspore/ops/composite/multitype_ops/_constexpr_utils.py +28 -22
mindspore/ops/composite/multitype_ops/add_impl.py +69 -7
mindspore/ops/composite/multitype_ops/bitwise_and_impl.py +2 -1
mindspore/ops/composite/multitype_ops/bitwise_or_impl.py +2 -1
mindspore/ops/composite/multitype_ops/bitwise_xor_impl.py +2 -0
mindspore/ops/composite/multitype_ops/div_impl.py +1 -0
mindspore/ops/composite/multitype_ops/floordiv_impl.py +1 -0
mindspore/ops/composite/multitype_ops/getitem_impl.py +48 -10
mindspore/ops/composite/multitype_ops/greater_equal_impl.py +2 -0
mindspore/ops/composite/multitype_ops/greater_impl.py +2 -0
mindspore/ops/composite/multitype_ops/left_shift_impl.py +2 -0
mindspore/ops/composite/multitype_ops/less_equal_impl.py +2 -0
mindspore/ops/composite/multitype_ops/less_impl.py +2 -0
mindspore/ops/composite/multitype_ops/logic_not_impl.py +2 -2
mindspore/ops/composite/multitype_ops/mod_impl.py +1 -0
mindspore/ops/composite/multitype_ops/mul_impl.py +1 -0
mindspore/ops/composite/multitype_ops/negative_impl.py +1 -0
mindspore/ops/composite/multitype_ops/not_in_impl.py +1 -0
mindspore/ops/composite/multitype_ops/ones_like_impl.py +6 -0
mindspore/ops/composite/multitype_ops/pow_impl.py +1 -0
mindspore/ops/composite/multitype_ops/right_shift_impl.py +2 -0
mindspore/ops/composite/multitype_ops/setitem_impl.py +10 -7
mindspore/ops/composite/multitype_ops/sub_impl.py +1 -0
mindspore/ops/composite/multitype_ops/uadd_impl.py +2 -0
mindspore/ops/composite/multitype_ops/zeros_like_impl.py +9 -0
mindspore/ops/deprecated.py +304 -0
mindspore/ops/function/__init__.py +41 -4
mindspore/ops/function/array_func.py +1108 -467
mindspore/ops/function/clip_func.py +94 -27
mindspore/ops/function/debug_func.py +3 -1
mindspore/ops/function/grad/grad_func.py +82 -73
mindspore/ops/function/image_func.py +28 -12
mindspore/ops/function/linalg_func.py +135 -39
mindspore/ops/function/math_func.py +3779 -894
mindspore/ops/function/nn_func.py +1584 -657
mindspore/ops/function/parameter_func.py +13 -3
mindspore/ops/function/random_func.py +247 -153
mindspore/ops/function/sparse_func.py +14 -11
mindspore/ops/function/sparse_unary_func.py +173 -47
mindspore/ops/function/spectral_func.py +8 -4
mindspore/ops/function/vmap_func.py +8 -7
mindspore/ops/functional.py +47 -16
mindspore/ops/op_info_register.py +346 -86
mindspore/ops/operations/__init__.py +38 -22
mindspore/ops/operations/_grad_ops.py +145 -149
mindspore/ops/operations/_inner_ops.py +298 -56
mindspore/ops/operations/_ms_kernel.py +3 -3
mindspore/ops/operations/_quant_ops.py +24 -28
mindspore/ops/operations/_rl_inner_ops.py +9 -7
mindspore/ops/operations/_scalar_ops.py +115 -0
mindspore/ops/operations/_sequence_ops.py +148 -10
mindspore/ops/operations/_tensor_array.py +1 -1
mindspore/ops/operations/_thor_ops.py +2 -2
mindspore/ops/operations/array_ops.py +1239 -561
mindspore/ops/operations/comm_ops.py +166 -90
mindspore/ops/operations/control_ops.py +3 -3
mindspore/ops/operations/custom_ops.py +124 -102
mindspore/ops/operations/debug_ops.py +24 -11
mindspore/ops/operations/image_ops.py +86 -71
mindspore/ops/operations/inner_ops.py +18 -13
mindspore/ops/operations/linalg_ops.py +30 -11
mindspore/ops/operations/math_ops.py +1730 -435
mindspore/ops/operations/nn_ops.py +1953 -943
mindspore/ops/operations/other_ops.py +65 -43
mindspore/ops/operations/random_ops.py +258 -98
mindspore/ops/operations/rl_ops.py +4 -36
mindspore/ops/operations/sparse_ops.py +38 -33
mindspore/ops/operations/spectral_ops.py +8 -4
mindspore/ops/primitive.py +66 -44
mindspore/ops/signature.py +5 -5
mindspore/parallel/_auto_parallel_context.py +80 -19
mindspore/parallel/_cost_model_context.py +42 -0
mindspore/parallel/_offload_context.py +162 -72
mindspore/parallel/_parallel_serialization.py +2 -2
mindspore/parallel/_ps_context.py +16 -4
mindspore/parallel/_recovery_context.py +2 -1
mindspore/parallel/_tensor.py +15 -13
mindspore/parallel/_transformer/layers.py +8 -6
mindspore/parallel/_transformer/loss.py +1 -0
mindspore/parallel/_transformer/moe.py +7 -7
mindspore/parallel/_transformer/op_parallel_config.py +12 -1
mindspore/parallel/_transformer/transformer.py +34 -14
mindspore/parallel/_utils.py +36 -14
mindspore/parallel/algo_parameter_config.py +114 -20
mindspore/parallel/checkpoint_transform.py +16 -18
mindspore/parallel/shard.py +16 -13
mindspore/profiler/__init__.py +1 -1
mindspore/profiler/common/struct_type.py +3 -3
mindspore/profiler/common/util.py +3 -2
mindspore/profiler/envprofiling.py +11 -4
mindspore/profiler/parser/aicpu_data_parser.py +5 -3
mindspore/profiler/parser/ascend_flops_generator.py +94 -0
mindspore/profiler/parser/ascend_fpbp_generator.py +76 -0
mindspore/profiler/parser/ascend_hccl_generator.py +288 -0
mindspore/profiler/parser/ascend_msprof_exporter.py +213 -0
mindspore/profiler/parser/ascend_msprof_generator.py +199 -0
mindspore/profiler/parser/ascend_op_generator.py +276 -0
mindspore/profiler/parser/ascend_steptrace_generator.py +94 -0
mindspore/profiler/parser/ascend_timeline_generator.py +110 -54
mindspore/profiler/parser/base_timeline_generator.py +11 -7
mindspore/profiler/parser/cpu_gpu_timeline_generator.py +45 -46
mindspore/profiler/parser/flops_parser.py +15 -11
mindspore/profiler/parser/framework_parser.py +92 -73
mindspore/profiler/parser/hccl_parser.py +16 -12
mindspore/profiler/parser/integrator.py +22 -11
mindspore/profiler/parser/memory_usage_parser.py +36 -11
mindspore/profiler/parser/minddata_analyzer.py +12 -14
mindspore/profiler/parser/minddata_pipeline_parser.py +1 -1
mindspore/profiler/parser/msadvisor_parser.py +8 -4
mindspore/profiler/parser/op_intermediate_parser.py +5 -2
mindspore/profiler/parser/optime_parser.py +1 -1
mindspore/profiler/parser/profiler_info.py +4 -5
mindspore/profiler/parser/step_trace_parser.py +11 -14
mindspore/profiler/profiling.py +678 -377
mindspore/rewrite/api/node.py +211 -54
mindspore/rewrite/api/node_type.py +5 -0
mindspore/rewrite/api/pattern_engine.py +22 -23
mindspore/rewrite/api/scoped_value.py +20 -17
mindspore/rewrite/api/symbol_tree.py +252 -106
mindspore/rewrite/api/tree_node_helper.py +3 -0
mindspore/rewrite/ast_helpers/__init__.py +2 -1
mindspore/rewrite/ast_helpers/ast_finder.py +129 -0
mindspore/rewrite/ast_helpers/ast_modifier.py +116 -104
mindspore/rewrite/ast_transformers/flatten_recursive_stmt.py +97 -46
mindspore/rewrite/common/rewrite_elog.py +5 -1
mindspore/rewrite/namer.py +51 -51
mindspore/rewrite/namespace.py +14 -5
mindspore/{ops/bprop_mindir → rewrite/node}/__init__.py +9 -4
mindspore/rewrite/node/call_function.py +79 -0
mindspore/rewrite/node/cell_container.py +135 -0
mindspore/rewrite/node/control_flow.py +88 -0
mindspore/rewrite/{node.py → node/node.py} +313 -247
mindspore/rewrite/node/node_manager.py +254 -0
mindspore/rewrite/node/node_topological_manager.py +243 -0
mindspore/rewrite/parsers/arguments_parser.py +22 -21
mindspore/rewrite/parsers/assign_parser.py +225 -239
mindspore/rewrite/parsers/attribute_parser.py +9 -7
mindspore/rewrite/parsers/class_def_parser.py +179 -218
mindspore/rewrite/parsers/constant_parser.py +9 -6
mindspore/rewrite/parsers/container_parser.py +9 -7
mindspore/rewrite/parsers/for_parser.py +36 -15
mindspore/rewrite/parsers/function_def_parser.py +23 -20
mindspore/rewrite/parsers/if_parser.py +28 -24
mindspore/rewrite/parsers/module_parser.py +202 -25
mindspore/rewrite/{parser.py → parsers/parser.py} +4 -2
mindspore/rewrite/{parser_register.py → parsers/parser_register.py} +1 -1
mindspore/rewrite/parsers/return_parser.py +6 -6
mindspore/rewrite/sparsify/sparse_transformer.py +12 -3
mindspore/rewrite/sparsify/sparsify.py +4 -1
mindspore/rewrite/sparsify/utils.py +11 -5
mindspore/rewrite/symbol_tree.py +577 -732
mindspore/rewrite/symbol_tree_builder.py +9 -175
mindspore/rewrite/symbol_tree_dumper.py +2 -2
mindspore/run_check/_check_version.py +46 -39
mindspore/run_check/run_check.py +3 -2
mindspore/{scipy/sparse → safeguard}/__init__.py +4 -5
mindspore/safeguard/rewrite_obfuscation.py +517 -0
mindspore/scipy/__init__.py +1 -1
mindspore/scipy/linalg.py +67 -61
mindspore/scipy/ops.py +5 -41
mindspore/scipy/ops_grad.py +3 -2
mindspore/scipy/ops_wrapper.py +5 -5
mindspore/scipy/optimize/line_search.py +8 -8
mindspore/scipy/optimize/linear_sum_assignment.py +4 -4
mindspore/scipy/optimize/minimize.py +16 -12
mindspore/scipy/utils.py +1 -52
mindspore/scipy/utils_const.py +4 -4
mindspore/train/__init__.py +4 -4
mindspore/train/_utils.py +13 -5
mindspore/train/amp.py +410 -148
mindspore/train/anf_ir_pb2.py +16 -4
mindspore/train/callback/_backup_and_restore.py +8 -11
mindspore/train/callback/_callback.py +80 -3
mindspore/train/callback/_checkpoint.py +82 -51
mindspore/train/callback/_early_stop.py +12 -15
mindspore/train/callback/_history.py +1 -1
mindspore/train/callback/_lambda_callback.py +13 -13
mindspore/train/callback/_landscape.py +21 -17
mindspore/train/callback/_loss_monitor.py +9 -10
mindspore/train/callback/_on_request_exit.py +16 -33
mindspore/train/callback/_reduce_lr_on_plateau.py +21 -24
mindspore/train/callback/_summary_collector.py +44 -30
mindspore/train/callback/_time_monitor.py +62 -12
mindspore/train/data_sink.py +10 -16
mindspore/train/dataset_helper.py +154 -86
mindspore/train/loss_scale_manager.py +14 -9
mindspore/train/metrics/__init__.py +10 -2
mindspore/train/metrics/accuracy.py +1 -1
mindspore/train/metrics/auc.py +1 -1
mindspore/train/metrics/bleu_score.py +2 -2
mindspore/train/metrics/confusion_matrix.py +14 -14
mindspore/train/metrics/cosine_similarity.py +3 -3
mindspore/train/metrics/dice.py +1 -1
mindspore/train/metrics/fbeta.py +1 -1
mindspore/train/metrics/hausdorff_distance.py +8 -6
mindspore/train/metrics/mean_surface_distance.py +5 -4
mindspore/train/metrics/metric.py +49 -17
mindspore/train/metrics/occlusion_sensitivity.py +4 -4
mindspore/train/metrics/perplexity.py +1 -1
mindspore/train/metrics/precision.py +2 -2
mindspore/train/metrics/recall.py +2 -3
mindspore/train/metrics/roc.py +7 -7
mindspore/train/metrics/root_mean_square_surface_distance.py +5 -4
mindspore/train/metrics/topk.py +7 -4
mindspore/train/mind_ir_pb2.py +193 -48
mindspore/train/model.py +377 -133
mindspore/train/serialization.py +697 -245
mindspore/train/summary/_summary_adapter.py +5 -2
mindspore/train/summary/_writer_pool.py +4 -3
mindspore/train/summary/summary_record.py +25 -23
mindspore/train/train_thor/convert_utils.py +39 -23
mindspore/train/train_thor/dataset_helper.py +4 -3
mindspore/train/train_thor/model_thor.py +8 -8
mindspore/version.py +1 -1
{mindspore-2.0.0rc1.dist-info → mindspore-2.2.0.dist-info}/METADATA +7 -8
{mindspore-2.0.0rc1.dist-info → mindspore-2.2.0.dist-info}/RECORD +647 -818
{mindspore-2.0.0rc1.dist-info → mindspore-2.2.0.dist-info}/entry_points.txt +0 -1
mindspore/_akg/akg/tvm/contrib/debugger/__init__.py +0 -16
mindspore/_akg/akg/tvm/contrib/debugger/debug_result.py +0 -274
mindspore/_akg/akg/tvm/contrib/debugger/debug_runtime.py +0 -259
mindspore/_akg/akg/tvm/contrib/peak.py +0 -341
mindspore/_akg/akg/tvm/contrib/rpc.py +0 -25
mindspore/_akg/akg/tvm/contrib/xcode.py +0 -257
mindspore/_akg/akg/tvm/exec/__init__.py +0 -17
mindspore/_akg/akg/tvm/exec/autotvm_log_editor.py +0 -60
mindspore/_akg/akg/tvm/exec/measure_peak.py +0 -48
mindspore/_akg/akg/tvm/exec/query_rpc_tracker.py +0 -48
mindspore/_akg/akg/tvm/exec/rpc_proxy.py +0 -98
mindspore/_akg/akg/tvm/exec/rpc_server.py +0 -88
mindspore/_akg/akg/tvm/exec/rpc_tracker.py +0 -62
mindspore/_akg/akg/tvm/rpc/__init__.py +0 -29
mindspore/_akg/akg/tvm/rpc/base.py +0 -182
mindspore/_akg/akg/tvm/rpc/client.py +0 -436
mindspore/_akg/akg/tvm/rpc/proxy.py +0 -595
mindspore/_akg/akg/tvm/rpc/server.py +0 -413
mindspore/_akg/akg/tvm/rpc/tornado_util.py +0 -121
mindspore/_akg/akg/tvm/rpc/tracker.py +0 -431
mindspore/_extends/graph_kernel/expander.py +0 -80
mindspore/_extends/graph_kernel/expanders/__init__.py +0 -57
mindspore/_extends/graph_kernel/expanders/_utils.py +0 -269
mindspore/_extends/graph_kernel/expanders/addn.py +0 -33
mindspore/_extends/graph_kernel/expanders/batchnorm.py +0 -152
mindspore/_extends/graph_kernel/expanders/batchnorm_grad.py +0 -105
mindspore/_extends/graph_kernel/expanders/bias_add_grad.py +0 -49
mindspore/_extends/graph_kernel/expanders/clip_by_norm_no_div_sum.py +0 -33
mindspore/_extends/graph_kernel/expanders/complex/abs.py +0 -30
mindspore/_extends/graph_kernel/expanders/complex/add.py +0 -44
mindspore/_extends/graph_kernel/expanders/complex/div.py +0 -62
mindspore/_extends/graph_kernel/expanders/complex/mul.py +0 -52
mindspore/_extends/graph_kernel/expanders/complex/real_div.py +0 -62
mindspore/_extends/graph_kernel/expanders/complex/sub.py +0 -45
mindspore/_extends/graph_kernel/expanders/conv2d.py +0 -200
mindspore/_extends/graph_kernel/expanders/dropout_grad.py +0 -30
mindspore/_extends/graph_kernel/expanders/equal_count.py +0 -50
mindspore/_extends/graph_kernel/expanders/erfc.py +0 -35
mindspore/_extends/graph_kernel/expanders/expand_dims.py +0 -50
mindspore/_extends/graph_kernel/expanders/fused_adam.py +0 -44
mindspore/_extends/graph_kernel/expanders/fused_adam_weight_decay.py +0 -47
mindspore/_extends/graph_kernel/expanders/fused_mul_add.py +0 -28
mindspore/_extends/graph_kernel/expanders/gather.py +0 -43
mindspore/_extends/graph_kernel/expanders/gelu_grad.py +0 -70
mindspore/_extends/graph_kernel/expanders/gkdropout.py +0 -40
mindspore/_extends/graph_kernel/expanders/identity.py +0 -25
mindspore/_extends/graph_kernel/expanders/layernorm.py +0 -93
mindspore/_extends/graph_kernel/expanders/layernorm_grad.py +0 -113
mindspore/_extends/graph_kernel/expanders/logsoftmax.py +0 -46
mindspore/_extends/graph_kernel/expanders/logsoftmax_grad.py +0 -36
mindspore/_extends/graph_kernel/expanders/matmul.py +0 -80
mindspore/_extends/graph_kernel/expanders/maximum_grad.py +0 -59
mindspore/_extends/graph_kernel/expanders/minimum_grad.py +0 -80
mindspore/_extends/graph_kernel/expanders/oneslike.py +0 -26
mindspore/_extends/graph_kernel/expanders/reduce_mean.py +0 -43
mindspore/_extends/graph_kernel/expanders/relu_grad.py +0 -32
mindspore/_extends/graph_kernel/expanders/sigmoid_cross_entropy_with_logits.py +0 -41
mindspore/_extends/graph_kernel/expanders/sigmoid_cross_entropy_with_logits_grad.py +0 -35
mindspore/_extends/graph_kernel/expanders/sigmoid_grad.py +0 -31
mindspore/_extends/graph_kernel/expanders/slice.py +0 -35
mindspore/_extends/graph_kernel/expanders/softmax_cross_entropy_with_logits.py +0 -42
mindspore/_extends/graph_kernel/expanders/softmax_grad_ext.py +0 -41
mindspore/_extends/graph_kernel/expanders/softsign.py +0 -28
mindspore/_extends/graph_kernel/expanders/sqrt_grad.py +0 -29
mindspore/_extends/graph_kernel/expanders/square_sum_all.py +0 -44
mindspore/_extends/graph_kernel/expanders/square_sum_v1.py +0 -37
mindspore/_extends/graph_kernel/expanders/squared_difference.py +0 -43
mindspore/_extends/graph_kernel/expanders/tanh_grad.py +0 -31
mindspore/_extends/graph_kernel/expanders/tile.py +0 -54
mindspore/_extends/graph_kernel/model/op_infer.py +0 -506
mindspore/_extends/parse/jit_fallback_modules.py +0 -51
mindspore/dataset/datapreprocess/preprocess_imagenet_validate_dataset.py +0 -54
mindspore/dataset/engine/graphdata.py +0 -1586
mindspore/include/api/net.h +0 -142
mindspore/ops/_grad/grad_array_ops.py +0 -1347
mindspore/ops/_grad/grad_clip_ops.py +0 -84
mindspore/ops/_grad/grad_debug_ops.py +0 -68
mindspore/ops/_grad/grad_inner_ops.py +0 -235
mindspore/ops/_grad/grad_math_ops.py +0 -1684
mindspore/ops/_grad/grad_nn_ops.py +0 -1529
mindspore/ops/_grad/grad_other_ops.py +0 -89
mindspore/ops/_grad/grad_sequence_ops.py +0 -296
mindspore/ops/_grad/grad_sparse.py +0 -323
mindspore/ops/_grad_experimental/grad_image_ops.py +0 -249
mindspore/ops/_grad_experimental/grad_linalg_ops.py +0 -195
mindspore/ops/_grad_experimental/grad_scalar_ops.py +0 -112
mindspore/ops/bprop_mindir/AdaptiveAvgPool2D_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/AdaptiveMaxPool2D_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/ApproximateEqual_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/Argmax_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/Argmin_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/AssignSub_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/Assign_bprop.mindir +0 -17
mindspore/ops/bprop_mindir/AvgPool3D_bprop.mindir +0 -150
mindspore/ops/bprop_mindir/AvgPool_bprop.mindir +0 -66
mindspore/ops/bprop_mindir/BCEWithLogitsLoss_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/BNTrainingReduce_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/BatchNormGrad_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/BatchToSpaceND_bprop.mindir +0 -28
mindspore/ops/bprop_mindir/BiasAddGrad_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/BinaryCrossEntropy_bprop.mindir +0 -33
mindspore/ops/bprop_mindir/BroadcastTo_bprop.mindir +0 -306
mindspore/ops/bprop_mindir/Broadcast_bprop.mindir +0 -13
mindspore/ops/bprop_mindir/CTCLoss_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Concat_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Conv2DBackpropFilter_bprop.mindir +0 -240
mindspore/ops/bprop_mindir/Conv2DBackpropInput_bprop.mindir +0 -247
mindspore/ops/bprop_mindir/Conv2DTranspose_bprop.mindir +0 -247
mindspore/ops/bprop_mindir/Conv3DTranspose_bprop.mindir +0 -315
mindspore/ops/bprop_mindir/Conv3D_bprop.mindir +0 -278
mindspore/ops/bprop_mindir/DType_bprop.mindir +0 -14
mindspore/ops/bprop_mindir/DeformableOffsets_bprop.mindir +0 -58
mindspore/ops/bprop_mindir/Depend_bprop.mindir +0 -13
mindspore/ops/bprop_mindir/DepthToSpace_bprop.mindir +0 -23
mindspore/ops/bprop_mindir/DepthwiseConv2dNative_bprop.mindir +0 -138
mindspore/ops/bprop_mindir/DiagPart_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/Dropout2D_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Dropout3D_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/DropoutDoMask_bprop.mindir +0 -25
mindspore/ops/bprop_mindir/DropoutGenMask_bprop.mindir +0 -18
mindspore/ops/bprop_mindir/DropoutGrad_bprop.mindir +0 -27
mindspore/ops/bprop_mindir/Dropout_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/DynamicGRUV2_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/DynamicRNN_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/DynamicShape_bprop.mindir +0 -14
mindspore/ops/bprop_mindir/Elu_bprop.mindir +0 -16
mindspore/ops/bprop_mindir/EmbeddingLookup_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Equal_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/ExpandDims_bprop.mindir +0 -58
mindspore/ops/bprop_mindir/FastGeLU_bprop.mindir +0 -16
mindspore/ops/bprop_mindir/Flatten_bprop.mindir +0 -54
mindspore/ops/bprop_mindir/FloorDiv_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/GatherD_bprop.mindir +0 -26
mindspore/ops/bprop_mindir/GatherNd_bprop.mindir +0 -57
mindspore/ops/bprop_mindir/Gather_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/GreaterEqual_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/Greater_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/HSigmoid_bprop.mindir +0 -16
mindspore/ops/bprop_mindir/HSwish_bprop.mindir +0 -16
mindspore/ops/bprop_mindir/IOU_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/InstanceNorm_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/IsFinite_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/IsInf_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/IsNan_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/KLDivLoss_bprop.mindir +0 -126
mindspore/ops/bprop_mindir/L2Loss_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/L2Normalize_bprop.mindir +0 -30
mindspore/ops/bprop_mindir/LRN_bprop.mindir +0 -43
mindspore/ops/bprop_mindir/LayerNormGrad_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/LessEqual_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/Less_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/LinSpace_bprop.mindir +0 -23
mindspore/ops/bprop_mindir/Load_bprop.mindir +0 -13
mindspore/ops/bprop_mindir/LogSoftmax_bprop.mindir +0 -23
mindspore/ops/bprop_mindir/LogicalAnd_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/LogicalNot_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/MaskedSelect_bprop.mindir +0 -21
mindspore/ops/bprop_mindir/MaxPool3DGradGrad_bprop.mindir +0 -74
mindspore/ops/bprop_mindir/MaxPool3DGrad_bprop.mindir +0 -74
mindspore/ops/bprop_mindir/MaxPool3D_bprop.mindir +0 -75
mindspore/ops/bprop_mindir/MaxPoolGradGrad_bprop.mindir +0 -65
mindspore/ops/bprop_mindir/MaxPoolWithArgmax_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Maximum_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Minimum_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/MirrorPad_bprop.mindir +0 -27
mindspore/ops/bprop_mindir/Mish_bprop.mindir +0 -35
mindspore/ops/bprop_mindir/MulNoNan_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/NLLLoss_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/NonZero_bprop.mindir +0 -14
mindspore/ops/bprop_mindir/NotEqual_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/OneHot_bprop.mindir +0 -26
mindspore/ops/bprop_mindir/OnesLike_bprop.mindir +0 -14
mindspore/ops/bprop_mindir/PReLU_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Pad_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Padding_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/RNNTLoss_bprop.mindir +0 -29
mindspore/ops/bprop_mindir/ROIAlign_bprop.mindir +0 -82
mindspore/ops/bprop_mindir/Range_bprop.mindir +0 -22
mindspore/ops/bprop_mindir/Rank_bprop.mindir +0 -14
mindspore/ops/bprop_mindir/ReLU6_bprop.mindir +0 -16
mindspore/ops/bprop_mindir/ReLUV2_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/ReduceAll_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/ReduceAny_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/ReluGrad_bprop.mindir +0 -20
mindspore/ops/bprop_mindir/Reshape_bprop.mindir +0 -60
mindspore/ops/bprop_mindir/ResizeBilinear_bprop.mindir +0 -29
mindspore/ops/bprop_mindir/ResizeNearestNeighbor_bprop.mindir +0 -89
mindspore/ops/bprop_mindir/ReverseSequence_bprop.mindir +0 -52
mindspore/ops/bprop_mindir/ReverseV2_bprop.mindir +0 -22
mindspore/ops/bprop_mindir/Round_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/ScatterMax_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/ScatterMin_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/ScatterNdUpdate_bprop.mindir +0 -22
mindspore/ops/bprop_mindir/ScatterNd_bprop.mindir +0 -24
mindspore/ops/bprop_mindir/ScatterNonAliasingAdd_bprop.mindir +0 -22
mindspore/ops/bprop_mindir/ScatterUpdate_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/SeLU_bprop.mindir +0 -21
mindspore/ops/bprop_mindir/Select_bprop.mindir +0 -31
mindspore/ops/bprop_mindir/Shape_bprop.mindir +0 -14
mindspore/ops/bprop_mindir/SigmoidCrossEntropyWithLogits_bprop.mindir +0 -21
mindspore/ops/bprop_mindir/SigmoidGrad_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Sigmoid_bprop.mindir +0 -16
mindspore/ops/bprop_mindir/Sign_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/Slice_bprop.mindir +0 -26
mindspore/ops/bprop_mindir/SmoothL1Loss_bprop.mindir +0 -36
mindspore/ops/bprop_mindir/SoftmaxCrossEntropyWithLogits_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Softplus_bprop.mindir +0 -16
mindspore/ops/bprop_mindir/Softsign_bprop.mindir +0 -33
mindspore/ops/bprop_mindir/Sort_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/SpaceToBatchND_bprop.mindir +0 -28
mindspore/ops/bprop_mindir/SpaceToDepth_bprop.mindir +0 -23
mindspore/ops/bprop_mindir/SparseGatherV2_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/SparseSoftmaxCrossEntropyWithLogits_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Split_bprop.mindir +0 -22
mindspore/ops/bprop_mindir/Squeeze_bprop.mindir +0 -54
mindspore/ops/bprop_mindir/StridedSliceGrad_bprop.mindir +0 -95
mindspore/ops/bprop_mindir/StridedSlice_bprop.mindir +0 -98
mindspore/ops/bprop_mindir/Switch_bprop.mindir +0 -29
mindspore/ops/bprop_mindir/TanhGrad_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/Tanh_bprop.mindir +0 -66
mindspore/ops/bprop_mindir/TensorScatterAdd_bprop.mindir +0 -22
mindspore/ops/bprop_mindir/TensorScatterUpdate_bprop.mindir +0 -29
mindspore/ops/bprop_mindir/TensorShape_bprop.mindir +0 -14
mindspore/ops/bprop_mindir/Tile_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/TopK_bprop.mindir +0 -0
mindspore/ops/bprop_mindir/TransShape_bprop.mindir +0 -23
mindspore/ops/bprop_mindir/TruncateDiv_bprop.mindir +0 -19
mindspore/ops/bprop_mindir/TupleGetItem_bprop.mindir +0 -20
mindspore/ops/bprop_mindir/Unique_bprop.mindir +0 -16
mindspore/ops/bprop_mindir/Unstack_bprop.mindir +0 -22
mindspore/ops/bprop_mindir/UpsampleNearest3D_bprop.mindir +0 -32
mindspore/ops/bprop_mindir/UpsampleTrilinear3D_bprop.mindir +0 -38
mindspore/ops/bprop_mindir/ZerosLike_bprop.mindir +0 -15
mindspore/ops/bprop_mindir/generate_mindir.py +0 -114
mindspore/rewrite/node_visitor.py +0 -44
mindspore/rewrite/topological_manager.py +0 -203
mindspore/scipy/sparse/linalg.py +0 -192
{mindspore-2.0.0rc1.dist-info → mindspore-2.2.0.dist-info}/WHEEL +0 -0
{mindspore-2.0.0rc1.dist-info → mindspore-2.2.0.dist-info}/top_level.txt +0 -0

mindspore/ops/_grad/grad_nn_ops.py DELETED Viewed

@@ -1,1529 +0,0 @@
-# Copyright 2020-2022 Huawei Technologies Co., Ltd
-#
-# Licensed under the Apache License, Version 2.0 (the "License");
-# you may not use this file except in compliance with the License.
-# You may obtain a copy of the License at
-#
-# http://www.apache.org/licenses/LICENSE-2.0
-#
-# Unless required by applicable law or agreed to in writing, software
-# distributed under the License is distributed on an "AS IS" BASIS,
-# WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.
-# See the License for the specific language governing permissions and
-# limitations under the License.
-# ============================================================================
-"""Define the grad rules of neural network related operations."""
-from mindspore import context
-from mindspore.common import dtype as mstype
-from mindspore.common.tensor import Tensor
-from mindspore.ops.primitive import _primexpr
-from mindspore.ops.operations import nn_ops as nps
-from mindspore.ops._grad.grad_base import bprop_getters, dyn_size, create_tensor_by_element, dyn_rank
-from mindspore.ops import functional as F
-from mindspore.ops import operations as P
-from mindspore.ops.composite.multitype_ops.zeros_like_impl import zeros_like
-from mindspore.ops.operations import _grad_ops as G
-from mindspore.ops.operations import _inner_ops as inner
-from mindspore.ops.operations import _rl_inner_ops as rl_ops
-from mindspore.ops._utils.utils import range_op, get_1d_shape
-@_primexpr
-def bias_add_gradgrad_helper(shape, bias_shape, data_format):
-    """Helper function of BiasGradGrad to calculate expanded shape."""
-    new_shape = list(shape)
-    new_bias_shape = list(bias_shape)
-    ones_1 = []
-    ones_2 = []
-    for _ in new_shape[2:]:
-        ones_1.append(1)
-    for _ in new_shape[:-1]:
-        ones_2.append(1)
-    if data_format == "NCHW":
-        expanded_shape = [1] + new_bias_shape + ones_1
-        tile_mults = [new_shape[0]] + [1] + new_shape[2:]
-    else:
-        expanded_shape = ones_2 + new_bias_shape
-        tile_mults = new_shape[:-1] + [1]
-    return tuple(expanded_shape), tuple(tile_mults)
-def bias_add_gradgrad_helper_dynamic(shape, bias_shape, data_format):
-    """Helper function of BiasGradGrad to calculate expanded shape(dynamic version)."""
-    if data_format == "NCHW":
-        expanded_shape = P.Concat(0)((P.OnesLike()(shape[:1]), bias_shape, P.OnesLike()(shape[2:])))
-        tile_mults = P.Concat(0)((shape[:1], Tensor([1], dtype=mstype.int64), shape[2:]))
-    else:
-        expanded_shape = P.Concat(0)((P.OnesLike()(shape[:-1]), bias_shape))
-        tile_mults = P.Concat(0)((shape[:-1], Tensor([1], dtype=mstype.int64)))
-    return expanded_shape, tile_mults
-@bprop_getters.register(G.BiasAddGrad)
-def get_bprop_bias_add_grad(self):
-    """Grad definition for `BiasAddGrad` operation."""
-    data_format = self.data_format
-    def bprop(dy, out, dout):
-        reshape = P.Reshape()
-        tile = P.Tile()
-        dyn_shape = P.TensorShape()
-        dy_shape = dy.shape
-        dout_shape = dout.shape
-        if F.is_sequence_value_unknown(dy_shape) or F.is_sequence_value_unknown(dout_shape):
-            dy_shape = dyn_shape(dy)
-            dout_shape = dyn_shape(dout)
-            expanded_shape, tile_mults = bias_add_gradgrad_helper_dynamic(dy_shape, dout_shape, data_format)
-            expanded_grad = reshape(dout, expanded_shape)
-            tiled_grad = tile(expanded_grad, tile_mults)
-        else:
-            expanded_shape, tile_mults = bias_add_gradgrad_helper(dy_shape, dout_shape, data_format)
-            expanded_grad = reshape(dout, expanded_shape)
-            tiled_grad = tile(expanded_grad, tile_mults)
-        return (tiled_grad,)
-    return bprop
-@bprop_getters.register(nps.Conv3D)
-def get_bprop_conv3d(self):
-    """Grad definition for `Conv3D` operation."""
-    input_grad = nps.Conv3DBackpropInput(
-        self.out_channel, self.kernel_size, self.mode, pad_mode=self.pad_mode,
-        pad=self.pad, stride=self.stride, dilation=self.dilation, group=self.group, data_format=self.data_format
-    )
-    filter_grad = G.Conv3DBackpropFilter(
-        self.out_channel, self.kernel_size, self.mode, pad_mode=self.pad_mode,
-        pad=self.pad, stride=self.stride, dilation=self.dilation, group=self.group, data_format=self.data_format
-    )
-    get_shape = P.Shape()
-    get_dyn_shape = P.TensorShape()
-    cast = P.Cast()
-    get_dtype = P.DType()
-    def bprop(x, w, out, dout):
-        if F.is_sequence_value_unknown(get_shape(x)) or F.is_sequence_value_unknown(get_shape(w)):
-            dx = input_grad(w, dout, get_dyn_shape(x))
-            dw = cast(filter_grad(x, dout, get_dyn_shape(w)), get_dtype(x))
-            return dx, dw
-        dx = input_grad(w, dout, get_shape(x))
-        dw = cast(filter_grad(x, dout, get_shape(w)), get_dtype(x))
-        return dx, dw
-    return bprop
-@bprop_getters.register(nps.Conv3DTranspose)
-def get_bprop_conv3d_transpose(self):
-    """Grad definition for `Conv3DTranspose` operation."""
-    stride = (self.stride[2], self.stride[3], self.stride[4])
-    dilation = (self.dilation[2], self.dilation[3], self.dilation[4])
-    pad_list = self.get_attr_dict()['pad_list']
-    input_grad = nps.Conv3D(
-        out_channel=self.in_channel, kernel_size=self.kernel_size, mode=self.mode, pad_mode="pad",
-        pad=pad_list, stride=stride, dilation=dilation, group=self.group, data_format=self.data_format
-    )
-    filter_grad = G.Conv3DBackpropFilter(
-        out_channel=self.in_channel, kernel_size=self.kernel_size, mode=self.mode, pad_mode="pad",
-        pad=pad_list, stride=self.stride, dilation=self.dilation, group=self.group, data_format=self.data_format
-    )
-    get_dyn_shape = P.TensorShape()
-    def bprop(x, w, out, dout):
-        if F.is_sequence_value_unknown(F.shape(w)):
-            dx = input_grad(dout, w)
-            dw = filter_grad(dout, x, get_dyn_shape(w))
-            return dx, dw
-        dx = input_grad(dout, w)
-        dw = filter_grad(dout, x, F.shape(w))
-        return dx, dw
-    return bprop
-@bprop_getters.register(inner.ExtractImagePatches)
-def get_bprop_extract_image_patches(self):
-    """Grad definition for `ExtractImagePatches` operation."""
-    get_shape = P.Shape()
-    reshape = P.Reshape()
-    extract_image_patches = inner.ExtractImagePatches(ksizes=self.ksizes,
-                                                      strides=self.strides,
-                                                      rates=self.rates,
-                                                      padding=self.padding)
-    concat = P.Concat(axis=-1)
-    expand_dims = P.ExpandDims()
-    scatter_nd = P.ScatterNd()
-    dtype = P.DType()
-    fill = P.Fill()
-    slice_op = P.Slice()
-    transpose = P.Transpose()
-    cast = P.Cast()
-    matmul = P.MatMul()
-    range_ = P.Range()
-    dyn_shape_op = P.TensorShape()
-    ones_like = P.OnesLike()
-    _, _, ksizes_row, ksizes_col = self.ksizes
-    def _dyn_extract_image_patched(x, out, dout):
-        x_shape = dyn_shape_op(x)
-        out_shape = dyn_shape_op(out)
-        x_batch, x_depth, x_row, x_col = x_shape[0], x_shape[1], x_shape[2], x_shape[3]
-        x_indices_num = x_row * x_col + 1
-        x_idx = range_(cast(1, mstype.float32), cast(x_indices_num, mstype.float32), cast(1, mstype.float32))
-        x_idx = reshape(x_idx, create_tensor_by_element((1, 1, x_row, x_col)))
-        x_idx_patch = cast(extract_image_patches(x_idx), mstype.int32)
-        x_idx_patch = transpose(x_idx_patch, (0, 2, 3, 1))
-        out_row, out_col = out_shape[2], out_shape[3]
-        out_indices_num = out_row * out_col * ksizes_row * ksizes_col
-        out_idx_ori = range_(cast(0, mstype.int32), cast(out_indices_num, mstype.int32), cast(1, mstype.int32))
-        out_idx = reshape(out_idx_ori, create_tensor_by_element((1, out_row, out_col, ksizes_row * ksizes_col)))
-        idx_tensor = concat((expand_dims(x_idx_patch, -1), expand_dims(out_idx, -1)))
-        idx_tensor = reshape(idx_tensor, (-1, 2))
-        sp_shape = create_tensor_by_element((x_indices_num, out_indices_num))
-        update = cast(ones_like(out_idx_ori), dtype(dout))
-        sp_tensor = scatter_nd(idx_tensor, update, sp_shape)
-        begin = create_tensor_by_element((1, 0))
-        size = create_tensor_by_element((x_indices_num - 1, out_indices_num))
-        sp_tensor = slice_op(sp_tensor, begin, size)
-        grad = transpose(dout, (0, 2, 3, 1))
-        grad = reshape(grad, create_tensor_by_element((x_batch, out_row, out_col, ksizes_row, ksizes_col, x_depth)))
-        grad = transpose(grad, (1, 2, 3, 4, 0, 5))
-        grad = reshape(grad, create_tensor_by_element((out_row * out_col * ksizes_row * ksizes_col, x_batch * x_depth)))
-        jac = matmul(sp_tensor, grad)
-        dx = reshape(jac, create_tensor_by_element((x_row, x_col, x_batch, x_depth)))
-        dx = transpose(dx, (2, 3, 0, 1))
-        return (dx,)
-    def bprop(x, out, dout):
-        x_shape = get_shape(x)
-        out_shape = get_shape(out)
-        if F.is_sequence_value_unknown(x_shape) or F.is_sequence_value_unknown(out_shape):
-            return _dyn_extract_image_patched(x, out, dout)
-        x_batch, x_depth, x_row, x_col = x_shape
-        x_indices_num = x_row * x_col + 1
-        x_idx = cast(F.tuple_to_array(range(1, x_indices_num)), mstype.float32)
-        x_idx = reshape(x_idx, (1, 1, x_row, x_col))
-        x_idx_patch = cast(extract_image_patches(x_idx), mstype.int32)
-        x_idx_patch = transpose(x_idx_patch, (0, 2, 3, 1))
-        _, _, out_row, out_col = out_shape
-        out_indices_num = out_row * out_col * ksizes_row * ksizes_col
-        out_idx = F.tuple_to_array(range(out_indices_num))
-        out_idx = reshape(out_idx, (1, out_row, out_col, ksizes_row * ksizes_col))
-        idx_tensor = concat((expand_dims(x_idx_patch, -1), expand_dims(out_idx, -1)))
-        idx_tensor = reshape(idx_tensor, (-1, 2))
-        sp_shape = (x_indices_num, out_indices_num)
-        sp_tensor = scatter_nd(idx_tensor, fill(dtype(dout), (out_indices_num,), 1), sp_shape)
-        sp_tensor = slice_op(sp_tensor, (1, 0), (x_indices_num - 1, out_indices_num))
-        grad = transpose(dout, (0, 2, 3, 1))
-        grad = reshape(grad, (x_batch, out_row, out_col, ksizes_row, ksizes_col, x_depth))
-        grad = transpose(grad, (1, 2, 3, 4, 0, 5))
-        grad = reshape(grad, (-1, x_batch * x_depth))
-        jac = matmul(sp_tensor, grad)
-        dx = reshape(jac, (x_row, x_col, x_batch, x_depth))
-        dx = transpose(dx, (2, 3, 0, 1))
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.DepthwiseConv2dNative)
-def get_bprop_depthwise_conv2d_native(self):
-    """Grad definition for `DepthwiseConv2dNative` operation."""
-    input_grad = G.DepthwiseConv2dNativeBackpropInput(
-        self.channel_multiplier, self.kernel_size, self.pad_mode, self.pad, self.pad_list, self.mode, self.stride,
-        self.dilation, self.group
-    )
-    filter_grad = G.DepthwiseConv2dNativeBackpropFilter(
-        self.channel_multiplier, self.kernel_size, self.pad_mode, self.pad, self.pad_list, self.mode, self.stride,
-        self.dilation, self.group
-    )
-    get_shape = P.Shape()
-    def bprop(x, w, out, dout):
-        dx = input_grad(get_shape(x), w, dout)
-        dw = filter_grad(x, get_shape(w), dout)
-        return dx, dw
-    return bprop
-@bprop_getters.register(P.MaxPoolWithArgmax)
-def get_bprop_max_pool_with_argmax(self):
-    """Grad definition for `MaxPoolWithArgmax` operation."""
-    maxpool_grad = G.MaxPoolGradWithArgmax(
-        kernel_size=self.kernel_size,
-        strides=self.strides,
-        pad_mode=self.pad_mode)
-    def bprop(x, out, dout):
-        dx = maxpool_grad(x, dout[0], out[1])
-        return (dx,)
-    return bprop
-@bprop_getters.register(G.MaxPoolGrad)
-def get_bprop_max_pool_grad_grad(self):
-    """Grad definition for `MaxPoolGrad` operation."""
-    device_target = context.get_context("device_target")
-    is_ascend = (device_target == "Ascend")
-    if device_target == "Ascend":
-        maxpool_grad_grad = G.MaxPoolGradGrad(
-            kernel_size=self.kernel_size,
-            strides=self.strides,
-            pad_mode=self.pad_mode)
-    elif device_target == "GPU":
-        if self.data_format != "NCHW":
-            raise RuntimeError("MaxPoolGradGrad does not support NHWC!")
-        kernel_size = self.kernel_size
-        if isinstance(kernel_size, tuple) and len(kernel_size) == 4:
-            kernel_size = kernel_size[2:]
-        strides = self.strides
-        if isinstance(strides, tuple) and len(strides) == 4:
-            strides = strides[2:]
-        maxpool_with_argmax = P.MaxPoolWithArgmax(kernel_size=kernel_size, strides=strides, pad_mode=self.pad_mode)
-        gather = P.GatherNd()
-        reshape = P.Reshape()
-    else:
-        raise RuntimeError("MaxPoolGradGrad does not support on CPU!")
-    shape_op = P.Shape()
-    dyn_shape_op = P.TensorShape()
-    op_range = P.Range()
-    dyn_broadcast_op = inner.DynamicBroadcastTo()
-    def bprop(x1, x2, grad, out, dout):
-        dx1 = zeros_like(x1)
-        dx2 = zeros_like(x2)
-        if is_ascend:
-            dgrad = maxpool_grad_grad(x1, x2, dout)
-        else:
-            shape_x2 = shape_op(x2)
-            if F.is_sequence_value_unknown(shape_x2):
-                shape_x2 = dyn_shape_op(x2)
-                b, c, h, w = shape_x2
-                _, ind = maxpool_with_argmax(x1)
-                batch = op_range(F.cast(0, mstype.int32), F.cast(b, mstype.int32), F.cast(1, mstype.int32))
-                batch = dyn_broadcast_op(reshape(batch, (-1, 1)),
-                                         create_tensor_by_element((dyn_size(batch), c * h * w)))
-                gather_ind = P.Stack(-1)((batch, reshape(ind, create_tensor_by_element((b, -1)))))
-                dgrad = reshape(gather(reshape(dout, create_tensor_by_element((b, -1))), gather_ind),
-                                create_tensor_by_element((b, c, h, w)))
-            else:
-                b, c, h, w = shape_x2
-                _, ind = maxpool_with_argmax(x1)
-                batch = F.cast(F.tuple_to_array(range(b)), mstype.int32)
-                batch = P.Tile()(reshape(batch, (-1, 1)), (1, c * h * w))
-                gather_ind = P.Stack(-1)((batch, reshape(ind, (b, -1))))
-                dgrad = reshape(gather(reshape(dout, (b, -1)), gather_ind), (b, c, h, w))
-        return (dx1, dx2, dgrad)
-    return bprop
-@bprop_getters.register(G.MaxPoolGradGrad)
-def get_bprop_max_pool_grad_grad_grad(self):
-    """Grad definition for `MaxPoolGradGrad` operation."""
-    maxpool_grad = G.MaxPoolGrad(
-        kernel_size=self.kernel_size,
-        strides=self.strides,
-        pad_mode=self.pad_mode)
-    def bprop(x1, x2, grad, out, dout):
-        dx1 = zeros_like(x1)
-        dx2 = zeros_like(x2)
-        dgrad = maxpool_grad(x1, x2, dout)
-        return (dx1, dx2, dgrad)
-    return bprop
-@bprop_getters.register(P.MaxPool3D)
-def get_bprop_max_pool3d_grad(self):
-    """Grad definition for `MaxPool3D` operation."""
-    max_pool3d_grad = G.MaxPool3DGrad(
-        kernel_size=self.kernel_size,
-        strides=self.strides,
-        pad_mode=self.pad_mode,
-        pad_list=self.pad_list,
-        data_format=self.data_format)
-    def bprop(x, out, dout):
-        dx = max_pool3d_grad(x, out, dout)
-        return (dx,)
-    return bprop
-@bprop_getters.register(G.MaxPool3DGrad)
-def get_bprop_max_pool3d_grad_grad(self):
-    """Grad definition for `MaxPool3Grad` operation."""
-    max_pool3d_grad_grad = G.MaxPool3DGradGrad(
-        kernel_size=self.kernel_size,
-        strides=self.strides,
-        pad_mode=self.pad_mode,
-        data_format=self.data_format)
-    def bprop(x, y, grad, out, dout):
-        dgrad = max_pool3d_grad_grad(x, y, dout)
-        return zeros_like(x), zeros_like(y), dgrad
-    return bprop
-@bprop_getters.register(G.MaxPool3DGradGrad)
-def get_bprop_max_pool3d_grad_grad_grad(self):
-    """Grad definition for `MaxPool3GradGrad` operation."""
-    max_pool3d_grad = G.MaxPool3DGrad(
-        kernel_size=self.kernel_size,
-        strides=self.strides,
-        pad_mode=self.pad_mode,
-        data_format=self.data_format)
-    def bprop(x, y, grad, out, dout):
-        dgrad = max_pool3d_grad(x, y, dout)
-        return zeros_like(x), zeros_like(y), dgrad
-    return bprop
-@bprop_getters.register(nps.AdaptiveMaxPool2D)
-def get_bprop_adaptive_max_pool2d_grad(self):
-    """Grad definition for `AdaptiveMaxPool2D` operation."""
-    adaptive_maxpool2d_grad = G.AdaptiveMaxPool2DGrad()
-    def bprop(x, out, dout):
-        dy = dout[0]
-        index = out[1]
-        dx = adaptive_maxpool2d_grad(dy, x, index)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.AvgPool)
-def get_bprop_avg_pool_grad(self):
-    """Grad definition for `AvgPool` operation."""
-    avgpool_grad = G.AvgPoolGrad(
-        kernel_size=self.kernel_size,
-        strides=self.strides,
-        pad_mode=self.pad_mode,
-        data_format=self.format)
-    def bprop(x, out, dout):
-        dx = avgpool_grad(x, out, dout)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.AdaptiveAvgPool2D)
-def get_bprop_adaptive_avg_pool2d_grad(self):
-    """Grad definition for `AdaptiveAvgPool2D` operation."""
-    adaptive_avgpool_grad = G.AdaptiveAvgPool2DGrad()
-    shape = P.TensorShape()
-    def bprop(x, out, dout):
-        dx = adaptive_avgpool_grad(dout, shape(x))
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.AvgPool3D)
-def get_bprop_avg_pool_3d_grad(self):
-    """Grad definition for `AvgPool3D` operation."""
-    pad_list = self.get_attr_dict()['pad_list']
-    count_include_pad = self.get_attr_dict()['count_include_pad']
-    avgpool3d_grad = G.AvgPool3DGrad(kernel_size=self.kernel_size,
-                                     strides=self.strides,
-                                     pads=pad_list,
-                                     ceil_mode=self.ceil_mode,
-                                     count_include_pad=count_include_pad,
-                                     divisor_override=self.divisor_override,
-                                     data_format=self.data_format,
-                                     pad_mode=self.pad_mode)
-    def bprop(x, out, dout):
-        x_shape = F.shape(x)
-        if F.is_sequence_value_unknown(x_shape):
-            x_shape = P.TensorShape()(x)
-        dx = avgpool3d_grad(x_shape, dout)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.DropoutGenMask)
-def get_bprop_dropout_gen_mask(self):
-    """Grad definition for `DropoutGenMask` operation."""
-    def bprop(shape, keep_prob, out, dout):
-        return (zeros_like(shape), zeros_like(keep_prob))
-    return bprop
-@bprop_getters.register(P.DropoutDoMask)
-def get_bprop_dropout_do_mask(self):
-    """Grad definition for `DropoutDoMask` operation."""
-    do_mask = P.DropoutDoMask()
-    def bprop(x, y, keep_prob, out, dout):
-        return (do_mask(dout, y, keep_prob), zeros_like(y), zeros_like(keep_prob))
-    return bprop
-@bprop_getters.register(P.Mish)
-def get_bprop_mish(self):
-    """Grad definition for `Mish` operation."""
-    tanh = P.Tanh()
-    tanh_grad = G.TanhGrad()
-    softplus = P.Softplus()
-    softplus_grad = G.SoftplusGrad()
-    def bprop(x, out, dout):
-        dx1 = tanh(softplus(x))
-        dx2 = softplus_grad(tanh_grad(dx1, x * dout), x)
-        dx = (dx1 * dout + dx2)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.SeLU)
-def get_bprop_selu(self):
-    """Grad definition for `SeLU` operation."""
-    scale = 1.0507009873554804934193349852946
-    elu_grad = G.EluGrad()
-    def bprop(x, out, dout):
-        dx = elu_grad(dout, out) * scale
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.MulNoNan)
-def get_bprop_mul_no_nan(self):
-    """Grad definition for `MulNoNan` operation."""
-    mul_no_nan = P.MulNoNan()
-    reduce_sum = P.ReduceSum()
-    reshape = P.Reshape()
-    def bprop(x, y, out, dout):
-        x_shape = F.shape(x)
-        y_shape = F.shape(y)
-        dx = mul_no_nan(dout, y)
-        dy = mul_no_nan(x, dout)
-        broadcast_x, broadcast_y = F.broadcast_gradient_args(x_shape, y_shape)
-        if broadcast_x != ():
-            dx = reshape(reduce_sum(dx, broadcast_x), x_shape)
-        if broadcast_y != ():
-            dy = reshape(reduce_sum(dy, broadcast_y), y_shape)
-        return dx, dy
-    return bprop
-@bprop_getters.register(G.ReluGrad)
-def get_bprop_relu_grad(self):
-    """Grad definition for `ReLUGrad` operation."""
-    input_grad = G.ReluGrad()
-    def bprop(grad, y, out, dout):
-        dgrad = input_grad(dout, y)
-        return dgrad, zeros_like(y)
-    return bprop
-@bprop_getters.register(P.ReLU6)
-def get_bprop_relu6(self):
-    """Grad definition for `ReLU6` operation."""
-    input_grad = G.ReLU6Grad()
-    def bprop(x, out, dout):
-        dx = input_grad(dout, x)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.ReLUV2)
-def get_bprop_relu_v2(self):
-    """Grad definition for `ReLUV2` operation."""
-    input_grad = G.ReluGradV2()
-    def bprop(x, out, dout):
-        mask = out[1]
-        dx = input_grad(dout[0], mask)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.HSwish)
-def get_bprop_hswish(self):
-    """Grad definition for `HSwish` operation."""
-    input_grad = G.HSwishGrad()
-    def bprop(x, out, dout):
-        dx = input_grad(dout, x)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.HSigmoid)
-def get_bprop_hsigmoid(self):
-    """Grad definition for `HSigmoid` operation."""
-    input_grad = G.HSigmoidGrad()
-    def bprop(x, out, dout):
-        dx = input_grad(dout, x)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.Elu)
-def get_bprop_elu(self):
-    """Grad definition for `Elu` operation."""
-    input_grad = G.EluGrad()
-    def bprop(x, out, dout):
-        dx = input_grad(dout, out)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.Sigmoid)
-def get_bprop_sigmoid(self):
-    """Grad definition for `Sigmoid` operation."""
-    input_grad = G.SigmoidGrad()
-    def bprop(x, out, dout):
-        dx = input_grad(out, dout)
-        return (dx,)
-    return bprop
-@bprop_getters.register(G.SigmoidGrad)
-def get_bprop_sigmoid_grad(self):
-    """Grad definition for `SigmoidGrad` operation."""
-    sigmoid_grad = G.SigmoidGrad()
-    def bprop(y, grad, out, dout):
-        dy = dout * grad * (1. - 2 * y)
-        dgrad = sigmoid_grad(y, dout)
-        return dy, dgrad
-    return bprop
-@_primexpr
-def _get_transpose_axis(x_shp, axis):
-    rank = len(x_shp)
-    if axis < 0:
-        axis += rank
-    reverse_axis = [i for i in range(rank)]
-    reverse_axis[axis] = rank - 1
-    reverse_axis[rank - 1] = axis
-    return tuple(reverse_axis)
-def _get_dyn_transpose_axis(x, axis, is_ascend):
-    """Get transpose axis"""
-    if F.is_sequence_shape_unknown(P.Shape()(x)):
-        rank = dyn_rank(x)
-        start = Tensor(0, dtype=mstype.int64)
-        delta = Tensor(1, dtype=mstype.int64)
-    else:
-        rank = P.Cast()(len(P.Shape()(x)), mstype.int64)
-        start = P.Cast()(0, mstype.int64)
-        delta = P.Cast()(1, mstype.int64)
-    if axis < 0:
-        axis += rank
-    range_ops = P.Range()
-    reverse_axis = range_ops(start, rank, delta)
-    if is_ascend:
-        reverse_axis = P.Cast()(reverse_axis, mstype.int8)
-        axis = P.Cast()(axis, mstype.int32)
-        reverse_axis[axis] = rank - 1
-        rank = P.Cast()(rank, mstype.int32)
-    else:
-        reverse_axis[axis] = rank - 1
-    reverse_axis[rank - 1] = axis
-    return reverse_axis
-@bprop_getters.register(P.Softmax)
-def get_bprop_softmax(self):
-    """Grad definition for `Softmax` operation."""
-    sum_func = P.ReduceSum(keep_dims=True)
-    sub = P.Sub()
-    mul = P.Mul()
-    get_shape = P.Shape()
-    transpose = P.Transpose()
-    axis = self.axis
-    if not isinstance(axis, int):
-        axis = axis[0]
-    device_target = context.get_context("device_target")
-    is_ascend = (device_target == "Ascend")
-    def bprop(x, out, dout):
-        # dx can be expressed as (dout - sum(dout * out)) * out
-        # This formula is correct only when the `axis` is the last dimension.
-        # In order to support the scenario where the `axis` is other values,
-        # we transpose the data of the `axis` dimension to the last dimension for calculation,
-        # and then transpose it back after the calculation.
-        shp = get_shape(x)
-        if F.is_sequence_value_unknown(shp):
-            reverse_axis = _get_dyn_transpose_axis(x, axis, is_ascend)
-            if is_ascend:
-                reverse_axis = P.Cast()(reverse_axis, mstype.int32)
-        else:
-            reverse_axis = _get_transpose_axis(get_shape(x), axis)
-        out = transpose(out, reverse_axis)
-        dout = transpose(dout, reverse_axis)
-        dx = mul(out, sub(dout, sum_func(mul(out, dout), -1)))
-        dx = transpose(dx, reverse_axis)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.LogSoftmax)
-def get_bprop_log_softmax(self):
-    """Grad definition for `LogSoftmax` operation."""
-    logsoftmax_grad = G.LogSoftmaxGrad(self.axis)
-    def bprop(x, out, dout):
-        dx = logsoftmax_grad(out, dout)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.Softplus)
-def get_bprop_softplus(self):
-    """Grad definition for `Softplus` operation."""
-    softplus_grad = G.SoftplusGrad()
-    def bprop(x, out, dout):
-        dx = softplus_grad(dout, x)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.Softsign)
-def get_bprop_softsign(self):
-    """Grad definition for `Softsign` operation."""
-    mul = P.Mul()
-    absolute = P.Abs()
-    div = P.Div()
-    square = P.Square()
-    def bprop(x, out, dout):
-        dx = mul(dout, div(1, square(1 + absolute(x))))
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.Tanh)
-def get_bprop_tanh(self):
-    """Grad definition for `Tanh` operation."""
-    tanh_grad = G.TanhGrad()
-    conj = P.Conj()
-    def bprop(x, out, dout):
-        if x.dtype in (mstype.complex64, mstype.complex128):
-            dout = conj(dout)
-            dx = tanh_grad(out, dout)
-            dx = conj(dx)
-        else:
-            dx = tanh_grad(out, dout)
-        return (dx,)
-    return bprop
-@bprop_getters.register(G.TanhGrad)
-def get_bprop_tanh_grad(self):
-    """Grad definition for `TanhGrad` operation."""
-    tanh_grad = G.TanhGrad()
-    def bprop(y, grad, out, dout):
-        dy = dout * -2.0 * grad * y
-        dgrad = tanh_grad(y, dout)
-        return dy, dgrad
-    return bprop
-@bprop_getters.register(P.FastGeLU)
-def get_bprop_fast_gelu(self):
-    """Grad definition for `FastGeLU` operation."""
-    input_grad = G.FastGeLUGrad()
-    def bprop(x, out, dout):
-        dx = input_grad(dout, x)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.FastGelu)
-def get_bprop_fast_gelu_2(self):
-    """Grad definition for `FastGeLU` operation."""
-    input_grad = G.FastGeLUGrad()
-    def bprop(x, out, dout):
-        dx = input_grad(dout, x)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.InstanceNorm)
-def get_bprop_instance_norm(self):
-    """Grad definition for `InstanceNorm` operation."""
-    input_grad = G.InstanceNormGrad(self.epsilon, self.momentum)
-    def bprop(x, gamma, beta, mean, variance, out, dout):
-        saved_mean = out[1]
-        saved_variance = out[2]
-        out = input_grad(dout[0], x, gamma, saved_mean, saved_variance)
-        dx = out[0]
-        dgamma = out[1]
-        dbeta = out[2]
-        return dx, dgamma, dbeta, zeros_like(mean), zeros_like(variance)
-    return bprop
-@bprop_getters.register(G.BatchNormGrad)
-def get_bprop_batch_norm_grad(self):
-    """Grad definition for `BatchNorm` operation."""
-    grad_op = G.BatchNormGradGrad(self.is_training, self.epsilon, self.data_format)
-    def bprop(dy, x, scale, mean, variance, reserve, out, dout):
-        dx, ddy, dscale = grad_op(x, dy, scale, mean, variance, dout[0], dout[1], dout[2])
-        return ddy, dx, dscale, zeros_like(mean), zeros_like(variance), zeros_like(reserve)
-    return bprop
-@bprop_getters.register(G.LayerNormGrad)
-def get_bprop_layer_norm_grad(self):
-    """Grad definition for `LayerNormGrad` operation."""
-    layer_norm_grad_grad = G.LayerNormGradGrad(self.begin_norm_axis, self.begin_params_axis)
-    def bprop(x, dy, variance, mean, gamma, out, dout):
-        d_x, d_dy, d_gamma = layer_norm_grad_grad(
-            x, dy, variance, mean, gamma, dout[0], dout[1], dout[2])
-        return d_x, d_dy, zeros_like(variance), zeros_like(mean), d_gamma
-    return bprop
-@bprop_getters.register(P.L2Normalize)
-def get_bprop_l2normalize(self):
-    """Grad definition for `L2Normalize` operation."""
-    input_grad = G.L2NormalizeGrad(self.axis, self.epsilon)
-    def bprop(x, out, dout):
-        dx = input_grad(x, out, dout)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.SoftmaxCrossEntropyWithLogits)
-def get_bprop_softmax_cross_entropy_with_logits(self):
-    """Grad definition for `SoftmaxCrossEntropyWithLogits` operation."""
-    expand = P.ExpandDims()
-    def bprop(logits, labels, out, dout):
-        grad = out[1]
-        grad = grad * expand(dout[0], -1)
-        return grad, zeros_like(labels)
-    return bprop
-@bprop_getters.register(P.NLLLoss)
-def get_bprop_nll_loss(self):
-    """Grad definition for `NLLLoss` operation."""
-    nll_loss_grad = G.NLLLossGrad(reduction=self.reduction)
-    def bprop(x, target, weight, out, dout):
-        total_weight = out[1]
-        dout_x = dout[0]
-        dx = nll_loss_grad(x, dout_x, target, weight, total_weight)
-        return dx, zeros_like(target), zeros_like(weight)
-    return bprop
-@bprop_getters.register(P.SparseSoftmaxCrossEntropyWithLogits)
-def get_bprop_sparse_softmax_cross_entropy_with_logits(self):
-    """Grad definition for `SparseSoftmaxCrossEntropyWithLogits` operation."""
-    is_grad = self.is_grad
-    grad_op = P.SparseSoftmaxCrossEntropyWithLogits(is_grad=True)
-    def bprop(logits, labels, out, dout):
-        grad = out[0]
-        if not is_grad:
-            # if construct use loss
-            grad = grad_op(logits, labels)
-            grad = F.depend(grad, out)
-            grad = grad * dout
-        return grad, zeros_like(labels)
-    return bprop
-@bprop_getters.register(P.ResizeBilinear)
-def get_bprop_resize_bilinear(self):
-    """Grad definition for `ResizeBilinear` operation."""
-    resize_grad = G.ResizeBilinearGrad(self.align_corners, self.half_pixel_centers)
-    def bprop(x, out, dout):
-        dx = resize_grad(dout, x)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.OneHot)
-def get_bprop_onehot(self):
-    """Grad definition for `OneHot` operation."""
-    def bprop(indices, depth, on_value, off_value, out, dout):
-        return zeros_like(indices), zeros_like(depth), zeros_like(on_value), zeros_like(off_value)
-    return bprop
-@bprop_getters.register(P.TopK)
-def get_bprop_top_kv2(self):
-    """Grad definition for `TopK` operation."""
-    scatter = P.ScatterNd()
-    expand_dims = P.ExpandDims()
-    shape_op = P.Shape()
-    dyn_shape = P.TensorShape()
-    reshape_op = P.Reshape()
-    dtype = P.DType()
-    cast = P.Cast()
-    def _bprop_static(input_x, k, out, dout):
-        in_shape = shape_op(input_x)
-        in_lastdim = in_shape[-1]
-        indices = out[1]
-        ind_shape = shape_op(indices)
-        ind_lastdim = ind_shape[-1]
-        ind_2d = reshape_op(indices, (-1, ind_lastdim))
-        outerdim = shape_op(ind_2d)[0]
-        # range_flatten_index can be expressed as: [0, outterdim, 2*outerdim, ..., (k-1)*outerdim]
-        indices_dtype = dtype(indices)
-        range_flatten_index = range_op(0, outerdim * in_lastdim, in_lastdim, indices_dtype)
-        # expand_dims to (k, 1), then broadcast
-        ind = reshape_op(ind_2d + expand_dims(range_flatten_index, -1), (-1,))
-        in_shape_1d = get_1d_shape(in_shape)
-        out_grad = reshape_op(
-            scatter(
-                expand_dims(ind, -1),
-                reshape_op(dout[0], (-1,)),
-                in_shape_1d),
-            in_shape)
-        return out_grad, zeros_like(k)
-    def _bprop_dynshape(input_x, k, out, dout):
-        in_shape = dyn_shape(input_x)
-        in_lastdim = in_shape[-1]
-        indices = out[1]
-        ind_shape = dyn_shape(indices)
-        ind_lastdim = ind_shape[-1]
-        ind_2d = reshape_op(indices, create_tensor_by_element((-1, ind_lastdim)))
-        outerdim = dyn_shape(ind_2d)[0]
-        # range_flatten_index can be expressed as: [0, outterdim, 2*outerdim, ..., (k-1)*outerdim]
-        range_flatten_index = P.Range()(cast(0, mstype.int64), outerdim * in_lastdim, in_lastdim)
-        # expand_dims to (k, 1), then broadcast
-        ind = reshape_op(ind_2d + expand_dims(range_flatten_index, -1), create_tensor_by_element((-1,)))
-        in_shape_1d = expand_dims(dyn_size(input_x, mstype.int64), -1)
-        out_grad = reshape_op(
-            scatter(
-                expand_dims(ind, -1),
-                reshape_op(dout[0], create_tensor_by_element((-1,))),
-                in_shape_1d),
-            in_shape)
-        return out_grad, zeros_like(k)
-    def bprop(input_x, k, out, dout):
-        if F.is_sequence_value_unknown(shape_op(input_x)):
-            return _bprop_dynshape(input_x, k, out, dout)
-        return _bprop_static(input_x, k, out, dout)
-    return bprop
-@bprop_getters.register(P.SmoothL1Loss)
-def get_bprop_smooth_l1_loss(self):
-    """Grad definition for `SmoothL1Loss` operation."""
-    grad = G.SmoothL1LossGrad(self.beta, self.reduction)
-    def bprop(prediction, target, out, dout):
-        dx = grad(prediction, target, dout)
-        dy = grad(target, prediction, dout)
-        return dx, dy
-    return bprop
-@bprop_getters.register(P.L2Loss)
-def get_bprop_l2_loss(self):
-    """Grad definition for `L2Loss` operation."""
-    def bprop(x, out, dout):
-        dx = x * dout
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.RNNTLoss)
-def get_bprop_rnnt_loss(self):
-    """Grad definition for `RNNTLoss` operation."""
-    def bprop(acts, labels, act_lens, label_lens, out, dout):
-        grad = out[1]
-        return grad, zeros_like(labels), zeros_like(act_lens), zeros_like(label_lens)
-    return bprop
-@bprop_getters.register(P.PReLU)
-def get_bprop_prelu(self):
-    """Grad definition for `PReLU` operation."""
-    grad = G.PReLUGrad()
-    def bprop(x, w, out, dout):
-        dx, dw = grad(dout, x, w)
-        return dx, dw
-    return bprop
-@bprop_getters.register(P.LSTM)
-def get_bprop_lstm(self):
-    """Grad definition for `LSTM` operation."""
-    lstm_grad_data = G.LSTMGradData(
-        input_size=self.input_size,
-        hidden_size=self.hidden_size,
-        num_layers=self.num_layers,
-        has_bias=self.has_bias,
-        bidirectional=self.bidirectional,
-        dropout=self.dropout
-    )
-    lstm_grad_weight = G.LSTMGradWeight(
-        input_size=self.input_size,
-        hidden_size=self.hidden_size,
-        num_layers=self.num_layers,
-        has_bias=self.has_bias,
-        bidirectional=self.bidirectional,
-        dropout=self.dropout
-    )
-    lstm_grad = G.LSTMGrad(
-        input_size=self.input_size,
-        hidden_size=self.hidden_size,
-        num_layers=self.num_layers,
-        has_bias=self.has_bias,
-        bidirectional=self.bidirectional,
-        dropout=self.dropout
-    )
-    def bprop(x, hx, cx, w, out, dout):
-        y, _, _, reserve, state = out
-        dy, dhy, dcy, _, _ = dout
-        dx, dhx, dcx = lstm_grad_data(y, dy, dhy, dcy, w, hx, cx, reserve, state)
-        dw = lstm_grad_weight(F.depend(x, dx), hx, y, reserve, state)
-        return dx, dhx, dcx, dw
-    #
-    def bprop_cpu(x, hx, cx, w, out, dout):
-        y, hy, cy, reserve, _ = out
-        dy, dhy, dcy, _, _ = dout
-        dx, dhx, dcx, dw = lstm_grad(x, hx, cx, w, y, hy, cy, dy, dhy, dcy, reserve)
-        return dx, dhx, dcx, dw
-    if context.get_context('device_target') == "CPU":
-        self.add_prim_attr("is_training", True)
-        return bprop_cpu
-    return bprop
-@bprop_getters.register(rl_ops.GRUV2)
-def get_bppro_gru_v2(self):
-    """Grad definition for `GRUV2` operation."""
-    gru_grad_v2 = G.GRUV2Grad(
-        self.input_size,
-        self.hidden_size,
-        self.num_layers,
-        self.has_bias,
-        self.bidirectional,
-        self.dropout
-    )
-    def bpro(x, hx, w, seq_length, out, dout):
-        y, hy, reverse, _ = out
-        dy, dhy, _, _ = dout
-        dx, dhx, dw = gru_grad_v2(x, hx, w, seq_length, y, hy, dy, dhy, reverse)
-        return dx, dhx, dw, (0)
-    return bpro
-@bprop_getters.register(rl_ops.CudnnGRU)
-def get_bprop_gru(self):
-    """Grad definition for `GRU` operation."""
-    gru_grad_data = G.GruGradData(
-        input_size=self.input_size,
-        hidden_size=self.hidden_size,
-        num_layers=self.num_layers,
-        has_bias=self.has_bias,
-        bidirectional=self.bidirectional,
-        dropout=self.dropout
-    )
-    gru_grad_weight = G.GruGradWeight(
-        input_size=self.input_size,
-        hidden_size=self.hidden_size,
-        num_layers=self.num_layers,
-        has_bias=self.has_bias,
-        bidirectional=self.bidirectional,
-        dropout=self.dropout
-    )
-    def bprop(x, hx, w, out, dout):
-        y, _, reserve, state = out
-        dy, dhy, _, _ = dout
-        dx, dhx = gru_grad_data(y, dy, dhy, w, hx, reserve, state)
-        dw = gru_grad_weight(F.depend(x, dx), hx, y, reserve, state)
-        return dx, dhx, dw
-    return bprop
-@bprop_getters.register(P.DynamicRNN)
-def get_bprop_dynamic_rnn(self):
-    """Grad definition for `DynamicRNN` operation."""
-    dynamic_rnn_grad = G.DynamicRNNGrad(cell_type=self.cell_type,
-                                        direction=self.direction,
-                                        cell_depth=self.cell_depth,
-                                        use_peephole=self.use_peephole,
-                                        keep_prob=self.keep_prob,
-                                        cell_clip=self.cell_clip,
-                                        num_proj=self.num_proj,
-                                        time_major=self.time_major,
-                                        forget_bias=self.forget_bias)
-    expand_dims = P.ExpandDims()
-    def bprop(x, w, b, seq_length, init_h, init_c, out, dout):
-        dy, dh, dc, _, _, _, _, _, = dout
-        dh = dh[-1]
-        dc = dc[-1]
-        y, h, c, i, j, f, o, tanhct = out
-        dw, db, dx, dh_prev, dc_prev = dynamic_rnn_grad(x, w, b, y, init_h[0], init_c[0], h,
-                                                        c, dy, dh, dc, i, j, f, o, tanhct)
-        dh_prev = expand_dims(dh_prev, 0)
-        dc_prev = expand_dims(dc_prev, 0)
-        return dx, dw, db, (0), dh_prev, dc_prev
-    return bprop
-@bprop_getters.register(P.DynamicGRUV2)
-def get_bprop_dynamic_gru_v2(self):
-    """Grad definition for `DynamicGRUV2` operation."""
-    dynamic_gru_v2_grad = G.DynamicGRUV2Grad(self.direction, self.cell_depth, self.keep_prob, self.cell_clip,
-                                             self.num_proj, self.time_major, self.gate_order,
-                                             self.reset_after)
-    def bprop(x, winput, whidden, binput, bhidden, seq, init_h, out, dout):
-        y, out_h, update, reset, new, hidden_new = out
-        dy, dout_h, _, _, _, _ = dout
-        dw_input, dw_hidden, db_input, db_hidden, dx, dh_prev = dynamic_gru_v2_grad(x, winput, whidden, y, init_h,
-                                                                                    out_h, dy, dout_h[-1], update,
-                                                                                    reset, new, hidden_new, None, None)
-        return dx, dw_input, dw_hidden, db_input, db_hidden, (0), dh_prev
-    return bprop
-@bprop_getters.register(P.SigmoidCrossEntropyWithLogits)
-def get_bprop_sigmoid_crossentropy_with_logits(self):
-    """Grad definition for `SigmoidCrossEntropyWithLogits` operation."""
-    op = G.SigmoidCrossEntropyWithLogitsGrad()
-    def bprop(x, y, out, dout):
-        dx = op(x, y, dout)
-        return (dx, zeros_like(y))
-    return bprop
-@bprop_getters.register(P.Pad)
-def get_bprop_pad(self):
-    """Grad definition for `Pad` operation."""
-    shape_op = P.Shape()
-    dyn_shape_op = P.TensorShape()
-    paddings = self.paddings
-    def bprop(x, out, dout):
-        begin = ()
-        for item in paddings:
-            begin += (item[0],)
-        shp = shape_op(x)
-        if F.is_sequence_value_unknown(shp):
-            shp = dyn_shape_op(x)
-        dx = P.Slice()(dout, begin, shp)
-        return (dx,)
-    return bprop
-@bprop_getters.register(P.MirrorPad)
-def get_bprop_mirror_pad(self):
-    """Grad definition for `MirrorPad` operation."""
-    mirror_pad_grad = G.MirrorPadGrad(self.mode)
-    def bprop(x, paddings, out, dout):
-        dx = mirror_pad_grad(dout, paddings)
-        return (dx, zeros_like(paddings))
-    return bprop
-@bprop_getters.register(P.ROIAlign)
-def get_bprop_roi_align(self):
-    """Grad definition for `ROIAlign` operation."""
-    shape_op = P.Shape()
-    dyn_shape = P.TensorShape()
-    pooled_height = self.pooled_height
-    pooled_width = self.pooled_width
-    spatial_scale = self.spatial_scale
-    sample_num = self.sample_num
-    def bprop(inputs, rois, out, dout):
-        inputs_shape = shape_op(inputs)
-        if F.is_sequence_value_unknown(inputs_shape):
-            inputs_shape = dyn_shape(inputs)
-        dx = G.ROIAlignGrad(pooled_height, pooled_width, spatial_scale, sample_num)(dout, rois, inputs_shape)
-        return dx, zeros_like(rois)
-    return bprop
-@bprop_getters.register(P.Conv2DTranspose)
-@bprop_getters.register(P.Conv2DBackpropInput)
-def get_bprop_conv2d_backprop_input(self):
-    """Grad definition for `Conv2DBackpropInput` operation."""
-    pad_list = self.get_attr_dict()['pad_list']
-    out_channel = self.get_attr_dict()['out_channel']
-    filter_grad = G.Conv2DBackpropFilter(
-        out_channel, self.kernel_size, self.pad_mode, self.pad, pad_list, mode=self.mode,
-        dilation=self.dilation, stride=self.stride, group=self.group, data_format=self.format
-    )
-    input_grad = P.Conv2D(
-        out_channel, self.kernel_size, pad_mode=self.pad_mode.lower(), pad=self.pad,
-        dilation=self.dilation, stride=self.stride, group=self.group, data_format=self.format
-    )
-    get_shape = P.Shape()
-    get_dyn_shape = P.TensorShape()
-    def bprop(x, w, f_sizes, out, dout):
-        w_shape = get_shape(w)
-        if F.is_sequence_value_unknown(w_shape):
-            w_shape = get_dyn_shape(w)
-        dx = input_grad(dout, w)
-        dw = filter_grad(x, dout, w_shape)
-        return dx, dw, zeros_like(f_sizes)
-    return bprop
-@bprop_getters.register(P.BinaryCrossEntropy)
-def get_bprop_binary_cross_entropy(self):
-    """Grad definition for `BinaryCrossEntropy` operation."""
-    grad = G.BinaryCrossEntropyGrad(self.reduction)
-    def bprop(x, y, weight, out, dout):
-        dx = grad(x, y, dout, weight)
-        return dx, zeros_like(y), zeros_like(weight)
-    return bprop
-@bprop_getters.register(P.BCEWithLogitsLoss)
-def get_bprop_bce_with_logits_loss(self):
-    """Grad definition for `BCEWithLogitsLoss` operation."""
-    reduction = self.reduction
-    mul = P.Mul()
-    sigmoid = P.Sigmoid()
-    add = P.Add()
-    sub = P.Sub()
-    size = P.Size()
-    neg = P.Neg()
-    log = P.Log()
-    shape = P.Shape()
-    def bprop(predict, target, weight, pos_weight, out, dout):
-        sigmoid_input = sigmoid(predict)
-        if pos_weight is not None:
-            t = mul(target, pos_weight)
-            dx = mul(sub(mul(sub(add(t, 1), target), sigmoid_input), t), dout)
-            grad_target = mul(sub(log(sub(1, sigmoid_input)), mul(pos_weight, log(sigmoid_input))), dout)
-        else:
-            dx = mul((sigmoid_input - target), dout)
-            grad_target = mul(predict, neg(dout))
-        if weight is not None:
-            dx = mul(dx, weight)
-            grad_target = mul(grad_target, weight)
-        if reduction == 'mean':
-            dx_size = dyn_size(dx) if F.is_sequence_value_unknown(shape(dx)) else size(dx)
-            target_size = dyn_size(target) if F.is_sequence_value_unknown(shape(target)) else size(target)
-            dx = dx / dx_size
-            grad_target = grad_target / target_size
-        return dx, grad_target, zeros_like(weight), zeros_like(pos_weight)
-    return bprop
-@bprop_getters.register(P.KLDivLoss)
-def get_bprop_kl_div_loss(self):
-    """Grad definition for `KLDivLoss` operation."""
-    reduce_type = self.reduction
-    size = P.Size()
-    shape = P.Shape()
-    def bprop(x, y, out, dout):
-        if reduce_type == "mean":
-            grad = G.KLDivLossGrad("sum")
-        else:
-            grad = G.KLDivLossGrad(self.reduction)
-        dx = grad(dout, x, y)
-        if reduce_type == "mean":
-            x_size = dyn_size(x) if F.is_sequence_value_unknown(shape(x)) else size(x)
-            return dx / x_size, zeros_like(y)
-        return dx, zeros_like(y)
-    return bprop
-@bprop_getters.register(P.Dropout)
-def get_bprop_dropout(self):
-    """Grad definition for `Dropout` operation."""
-    grad = G.DropoutGrad(self.keep_prob)
-    def bprop(x, out, dout):
-        _, mask = out
-        dy, _ = dout
-        dx = grad(dy, mask)
-        return (dx,)
-    return bprop
-@bprop_getters.register(G.DropoutGrad)
-def get_bprop_dropout_grad(self):
-    """Grad definition for `DropoutGrad` operation."""
-    grad = G.DropoutGrad(self.keep_prob)
-    def bprop(x, mask, out, dout):
-        dy = dout
-        dx = grad(dy, mask)
-        return dx, zeros_like(mask)
-    return bprop
-@bprop_getters.register(P.Dropout2D)
-@bprop_getters.register(P.Dropout3D)
-def get_bprop_dropout3d(self):
-    """Grad definition for `Dropout2D` and `Dropout3D` operation."""
-    dtype = P.DType()
-    cast = P.Cast()
-    mul = P.Mul()
-    keep_prob = self.keep_prob
-    def bprop(x, out, dout):
-        _, mask = out
-        dy, _ = dout
-        mask = cast(mask, mstype.float32)
-        if keep_prob != 0:
-            dy = dy * (1 / keep_prob)
-        dy = mul(mask, dy)
-        dy = cast(dy, dtype(x))
-        return (dy,)
-    return bprop
-@bprop_getters.register(P.CTCLoss)
-def get_bprop_ctc_loss(self):
-    """Grad definition for `CTCLoss` operation"""
-    expand = P.ExpandDims()
-    def bprop(inputs, labels_indices, labels_values, sequence_length, out, dout):
-        grad_loss = out[1]
-        grad = grad_loss * expand(dout[0], -1)
-        return grad, zeros_like(labels_indices), zeros_like(labels_values), zeros_like(sequence_length)
-    return bprop
-@bprop_getters.register(P.BasicLSTMCell)
-def get_bprop_basic_lstm_cell(self):
-    """Grad definition for `BasicLSTMCell` operation."""
-    basic_lstm_cell_cstate_grad = G.BasicLSTMCellCStateGrad(
-        forget_bias=self.forget_bias,
-        activation=self.activation
-    )
-    basic_lstm_cell_weight_grad = G.BasicLSTMCellWeightGrad()
-    basic_lstm_cell_input_grad = G.BasicLSTMCellInputGrad(keep_prob=self.keep_prob)
-    def bprop(x, h, c, w, b, out, dout):
-        _, _, it, jt, ft, ot, tanhct = out
-        dct, dht, _, _, _, _, _ = dout
-        dgate, dct_1 = basic_lstm_cell_cstate_grad(c, dht, dct, it, jt, ft, ot, tanhct)
-        dxt, dht = basic_lstm_cell_input_grad(dgate, w)
-        dw, db = basic_lstm_cell_weight_grad(F.depend(x, dxt), h, dgate)
-        return dxt, dht, dct_1, dw, db
-    return bprop
-@bprop_getters.register(nps.DeformableOffsets)
-def get_bprop_deformable_offsets(self):
-    """Grad definition for `DeformableOffsets` operation."""
-    grad = G.DeformableOffsetsGrad(self.strides, self.pads, self.ksize, self.dilations, self.data_format,
-                                   self.deformable_groups, self.modulated)
-    def bprop(x, offsets, out, dout):
-        out_grad = grad(dout, x, offsets)
-        return out_grad
-    return bprop
-@bprop_getters.register(P.LRN)
-def get_bprop_lrn(self):
-    """Grad definition for `LRN` operation."""
-    grad = G.LRNGrad(self.depth_radius, self.bias, self.alpha, self.beta)
-    def bprop(x, out, dout):
-        dx = grad(dout, x, out)
-        return (dx,)
-    return bprop
-@bprop_getters.register(G.Conv2DBackpropFilter)
-def get_bprop_conv2d_backprop_filter(self):
-    """Grad definition for `Conv2DBackpropFilter` operation."""
-    input_grad = P.Conv2DBackpropInput(
-        self.out_channel, self.kernel_size, self.pad_mode, self.pad, self.pad_list, mode=self.mode,
-        dilation=self.dilation, stride=self.stride, group=self.group, data_format=self.format
-    )
-    filter_grad = P.Conv2D(
-        self.out_channel, self.kernel_size, pad_mode=self.pad_mode.lower(), pad=self.pad,
-        dilation=self.dilation, stride=self.stride, group=self.group, data_format=self.format
-    )
-    get_shape = P.Shape()
-    get_dyn_shape = P.TensorShape()
-    def bprop(dy, x, filter_size, out, dout):
-        x_shape = get_shape(x)
-        if F.is_sequence_value_unknown(x_shape):
-            x_shape = get_dyn_shape(x)
-        dw_dx = input_grad(dy, dout, x_shape)
-        dw_dy = filter_grad(x, dout)
-        return dw_dy, dw_dx, zeros_like(filter_size)
-    return bprop
-@bprop_getters.register(nps.UpsampleNearest3D)
-def get_bprop_upsample_nearest_3d_grad(self):
-    """Grad definition for `UpsampleNearest3D` operation."""
-    get_shape = P.Shape()
-    output_size = self.output_size
-    scales = self.scales
-    def bprop(input_x, out, dout):
-        input_grad = G.UpsampleNearest3DGrad(get_shape(input_x), output_size, scales)
-        dx = input_grad(dout)
-        return (dx,)
-    return bprop
-@bprop_getters.register(nps.UpsampleTrilinear3D)
-def get_bprop_upsample_trilinear_3d_grad(self):
-    """Grad definition for `UpsampleTrilinear3D` operation."""
-    get_shape = P.Shape()
-    output_size = self.output_size
-    scales = self.scales
-    align_corners = self.align_corners
-    def bprop(input_x, out, dout):
-        input_grad = G.UpsampleTrilinear3DGrad(get_shape(input_x), output_size, scales, align_corners)
-        dx = input_grad(dout)
-        return (dx,)
-    return bprop