i-robot
7f4d32800d
!25633 Solve Operator Memory Leakage
Merge pull request !25633 from zong_shuai/FixBug
4 years ago
i-robot
1cd6573bff
!25406 Fix bug for GPU Pipeline
Merge pull request !25406 from Cononlly/gpu-moe
4 years ago
zong-shuai
07dc66892e
OperateMemLeak
4 years ago
i-robot
e80639357d
!25374 Adapt Custom Op to Pyfunc Kernel
Merge pull request !25374 from jiaoy1224/arithmetic
4 years ago
Yang Jiao
9bcf28d15d
adapt custom op to pyfunc kernel
4 years ago
i-robot
f0b38f53e8
!25660 update dynamic stitch
Merge pull request !25660 from VectorSL/dynamic_stitch-2
4 years ago
zhujingxuan
fb1805de30
add GPU trsm 2d matrix support
4 years ago
VectorSL
6d2704b227
change test level
4 years ago
i-robot
5f9ae3ec34
!25356 Add gpu kernel dynamicstitch
Merge pull request !25356 from VectorSL/dynmic_stitch
4 years ago
VectorSL
2d87da9a08
add dynamic stitch gpu kernel
4 years ago
i-robot
bf54552228
!25355 environment factory
Merge pull request !25355 from chenweifeng/environment-register
4 years ago
i-robot
ba0e1a810e
!25457 add broadcast GPU float64 registration
Merge pull request !25457 from zhujingxuan/master
4 years ago
wilfChen
3c7dbdd7e6
rl environment register
4 years ago
zhujingxuan
7441353d9e
add unit_diagonal option for solve triangular
4 years ago
zhujingxuan
8f45ddf39d
add float64 registration
4 years ago
i-robot
475777af3f
!25341 Add concat op dtype.
Merge pull request !25341 from liangchenghui/add_concat_dtype
4 years ago
cononlly
cc83b8064f
Fix code for GPU Pipeline
4 years ago
i-robot
b27991a2af
!25245 Move TypeId2String and DtypeToTypeId to dtype_extends.cc
Merge pull request !25245 from DeshiChen/1019_typeid2string
4 years ago
i-robot
a26958dc48
!25370 add trsm GPU
Merge pull request !25370 from zhujingxuan/master
4 years ago
dayschan
6a26d7f6d9
Move TypeId2String from kernel_compiler/ to ir/dtype_extends.cc
changed the function to "TypeIdToString", and use the Type::ToString() function,
instead of TypeId-String map.
changed the DtypeToTypeId together, the original StringToType can be used.
added a new interface StringToTypeId.
4 years ago
i-robot
19b04d3ff3
!24074 Support AOT Operator for GPU/CPU Backend
Merge pull request !24074 from jiaoy1224/pyfunc
4 years ago
zhujingxuan
28987d787d
add trsm
4 years ago
liangchenghui
7a6607a6a8
Add concat op dtype.
4 years ago
wangshuide2020
1c7e94862e
support -1 for the args of size of slice operator.
4 years ago
Yang Jiao
40b648b873
add aot
4 years ago
i-robot
0495ed8630
!25119 add cholesky factorization for gpu backend
Merge pull request !25119 from zhuzhongrui/pub_master
4 years ago
z00512249
a125654fbc
add cholesky && lu factorization for gpu backend
4 years ago
zhunaipan
8ce4e62725
optimize the comment and log description
修改: ops/operations/_inner_ops.py
修改: ops/operations/_quant_ops.py
修改: ops/operations/array_ops.py
修改: ops/operations/comm_ops.py
修改: ops/operations/math_ops.py
修改: ops/operations/quantum_ops.py
修改: ops/operations/rl_ops.py
修改: ops/operations/sponge_ops.py
修改: ops/operations/sponge_update_ops.py
修改: train/__init__.py
修改: common/tensor.py
修改: train/serialization.py
修改: ccsrc/pipeline/jit/parse/parse.h
修改: explainer/benchmark/_attribution/metric.py
修改: ops/composite/multitype_ops/_constexpr_utils.py
修改: ops/operations/comm_ops.py
修改: RELEASE.md
修改: mindspore/_extends/parse/standard_method.py
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/concat_offset_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/dynamic_shape_cpu_kernel.cc
修改: mindspore/ccsrc/frontend/parallel/ops_info/reshape_info.cc
修改: mindspore/ccsrc/frontend/parallel/ops_info/tile_info.cc
修改: mindspore/ccsrc/frontend/parallel/ops_info/transpose_info.cc
修改: mindspore/ccsrc/frontend/parallel/strategy.h
修改: mindspore/common/tensor.py
修改: mindspore/core/abstract/prim_arrays.cc
修改: mindspore/core/abstract/prim_nn.cc
修改: mindspore/core/ops/conv2d.cc
修改: mindspore/core/ops/logical_and.h
修改: mindspore/core/ops/logical_not.h
修改: mindspore/core/ops/logical_or.h
修改: mindspore/core/ops/reduce_all.h
修改: mindspore/core/ops/reduce_any.h
修改: mindspore/lite/src/runtime/kernel/arm/fp32_grad/sgd.cc
修改: mindspore/nn/layer/quant.py
修改: mindspore/nn/optim/sgd.py
修改: mindspore/nn/sparse/sparse.py
修改: mindspore/numpy/array_creations.py
修改: mindspore/numpy/array_ops.py
修改: mindspore/numpy/logic_ops.py
修改: mindspore/numpy/math_ops.py
修改: mindspore/ops/operations/_inner_ops.py
修改: mindspore/ops/operations/array_ops.py
修改: mindspore/ops/operations/rl_ops.py
修改: mindspore/train/_utils.py
修改: tests/ut/python/model/test_lenet_core_after_exception.py
修改: mindspore/_extends/parse/standard_method.py
修改: mindspore/ops/operations/rl_ops.py
修改: mindspore/core/abstract/prim_nn.cc
修改: mindspore/core/ops/conv2d.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/ctcloss_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/fl/fused_pull_weight_kernel.h
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/fl/fused_push_weight_kernel.h
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/mkldnn/conv2d_grad_filter_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/mkldnn/conv2d_grad_input_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/ps/sparse_apply_ftrl_ps_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/ps/sparse_apply_lazy_adam_ps_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/rolling_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/scatter_arithmetic_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/split_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/update_cache_cpu_kernel.cc
修改: mindspore/ccsrc/backend/kernel_compiler/gpu/arrays/split_gpu_kernel.h
修改: mindspore/ccsrc/backend/kernel_compiler/gpu/math/broadcast_gpu_kernel.h
修改: mindspore/ccsrc/backend/kernel_compiler/gpu/nn/conv2d_grad_input_gpu_kernel.h
修改: mindspore/ccsrc/fl/server/server.cc
修改: mindspore/ccsrc/frontend/optimizer/ad/kpynative.cc
修改: mindspore/ccsrc/frontend/optimizer/irpass/incorporate_getitem.h
修改: mindspore/ccsrc/frontend/optimizer/irpass/inline.h
修改: mindspore/ccsrc/minddata/dataset/core/device_tensor.cc
修改: mindspore/ccsrc/minddata/dataset/core/tensor.cc
修改: mindspore/ccsrc/minddata/dataset/engine/datasetops/source/emnist_op.cc
修改: mindspore/ccsrc/minddata/dataset/engine/datasetops/source/mnist_op.cc
修改: mindspore/ccsrc/minddata/dataset/engine/datasetops/source/qmnist_op.cc
修改: mindspore/ccsrc/minddata/dataset/engine/ir/datasetops/dataset_node.cc
修改: mindspore/ccsrc/minddata/dataset/engine/opt/pre/epoch_ctrl_pass.cc
修改: mindspore/ccsrc/minddata/dataset/kernels/image/lite_image_utils.cc
修改: mindspore/ccsrc/pipeline/jit/action.cc
修改: mindspore/ccsrc/pipeline/jit/static_analysis/evaluator.cc
修改: mindspore/ccsrc/runtime/device/ascend/executor/tiling/op_tiling_adapter.cc
修改: mindspore/compression/quant/quant_utils.py
修改: mindspore/core/abstract/prim_nn.cc
修改: mindspore/dataset/engine/validators.py
修改: mindspore/lite/micro/coder/opcoders/nnacl/fp32/affine_fp32_coder.cc
修改: mindspore/lite/micro/coder/opcoders/nnacl/int8/affine_int8_coder.cc
修改: mindspore/lite/src/runtime/kernel/ascend310/src/custom_kernel.cc
修改: mindspore/lite/src/runtime/kernel/opencl/kernel/matmul.cc
修改: mindspore/lite/src/runtime/kernel/opencl/kernel/strassen.cc
修改: mindspore/lite/tools/common/graph_util.h
修改: mindspore/lite/tools/optimizer/fisson/fisson_util.cc
修改: mindspore/ops/composite/math_ops.py
修改: mindspore/ops/operations/_inner_ops.py
修改: mindspore/ops/operations/array_ops.py
修改: mindspore/ops/operations/math_ops.py
修改: mindspore/ops/operations/other_ops.py
修改: mindspore/boost/boost_cell_wrapper.py
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/update_cache_cpu_kernel.cc
修改: mindspore/ccsrc/common/trans.cc
修改: mindspore/ccsrc/frontend/parallel/cache_embedding/cache_embedding.cc
修改: mindspore/ccsrc/frontend/parallel/ops_info/gather_info.cc
修改: mindspore/lite/src/common/log_util.h
修改: mindspore/nn/wrap/loss_scale.py
修改: mindspore/parallel/nn/moe.py
修改: tests/mindspore_test_framework/mindspore_test.py
修改: mindspore/ccsrc/backend/kernel_compiler/cpu/split_cpu_kernel.cc
修改: mindspore/lite/tools/common/graph_util.h
修改: mindspore/ccsrc/frontend/parallel/ops_info/gather_info.cc
修改: mindspore/core/ops/conv2d.cc
修改: tests/ut/python/model/test_lenet_core_after_exception.py
4 years ago
i-robot
8ea7a420e6
!24957 fix the broadcast size problem of meshgrid for gpu.
Merge pull request !24957 from wangshuide/wsd_master
4 years ago
hezhenhao1
ebcdbdc64a
Support int64 as input type for GPU OP TensorScatterUpdate.
4 years ago
wangshuide2020
8276309cb7
fix the broadcast size problem of meshgrid for gpu.
4 years ago
i-robot
093aa3b7a0
!24867 Fix AllGather Recompute Cycled Graph for GPU
Merge pull request !24867 from Cononlly/master
4 years ago
cononlly
1b119ced2b
Add a pass for allgather_recompute
4 years ago
i-robot
d21a1cd481
!24722 some bugfix for parameter server cache
Merge pull request !24722 from zyli2020/ps_cache_feature
4 years ago
i-robot
2a3bd85a7f
!24770 Solve ResizeBilinear_nn operator has precision problem when input dtype is fp16 at GPU.
Merge pull request !24770 from zong_shuai/resize_bilinear_grad_precise
4 years ago
zong-shuai
0853c86e03
resize_bilinear_precise
4 years ago
lizhenyu
29982ecdd7
some bugfix for parameter server cache
4 years ago
wilfChen
54761ecccc
codedex
4 years ago
liangyongxiong
e04ce642a7
RDR exports collected data on dataset_iterator_kernel error
4 years ago
zhangyihui
a94b3dbcfe
clean up the static alarms of the second batch of operator groups
4 years ago
i-robot
25812728d8
!24496 Remove the scalar constraint of SliceGrad in CPU/GPU.
Merge pull request !24496 from hezhenhao1/slice
4 years ago
i-robot
4c8854ac02
!24403 Clean up the static alarms of the first batch of operator groups
Merge pull request !24403 from 张毅辉/static_alarms_of_operator_group_for_the_first_batch
4 years ago
i-robot
2c1d3baace
!24269 add vector size check, input shape check and divide by zero check for gpu operators.
Merge pull request !24269 from wangshuide/wsd_master
4 years ago
Peilin Wang
59631807be
initial commit: revert back to explicit implementation
initial commit revert variadic template
add missing instantiations fix ci
fix ci
4 years ago
markuskunej
abdba421e5
added GetReductionInt to common_utils.h and replaced duplicated code in all loss with reduction gpu op kernels (nll loss, kl div loss, and binary cross entropy)
4 years ago
hezhenhao1
5505d4b774
Remove the scalar constraint of SliceGrad in CPU/GPU.
4 years ago
zhangyihui
27a80a75c0
Clean up the first batch of static alarms of operator group
4 years ago
wangshuide2020
7a1862a6e6
add vector size check, input shape check and divide by zero check for gpu operators.
4 years ago
i-robot
e81476d1b0
!24257 erase warning
Merge pull request !24257 from zong_shuai/erase_warning
4 years ago
zong_shuai
417096ddcc
erase_warning_1
4 years ago