From e80badd278f54e8cde64243aa56687f8e6e32cc2 Mon Sep 17 00:00:00 2001 From: Navan Chauhan Date: Sat, 1 Aug 2020 15:34:22 +0530 Subject: added alpha model --- .../Jiamin.local.input_pipeline.pb | Bin 2499 -> 0 bytes .../Jiamin.local.kernel_stats.pb | 0 .../Jiamin.local.overview_page.pb | Bin 3383 -> 0 bytes .../Jiamin.local.tensorflow_stats.pb | Bin 56401 -> 0 bytes .../2020_07_13_20_57_01/Jiamin.local.trace.json.gz | Bin 244284 -> 0 bytes .../37a527ad9b57.input_pipeline.pb | Bin 0 -> 2544 bytes .../37a527ad9b57.kernel_stats.pb | 313 +++++++++++++++++++++ .../37a527ad9b57.overview_page.pb | Bin 0 -> 4233 bytes .../37a527ad9b57.tensorflow_stats.pb | Bin 0 -> 39302 bytes .../2020_08_01_08_34_48/37a527ad9b57.trace.json.gz | Bin 0 -> 72545 bytes 10 files changed, 313 insertions(+) delete mode 100644 app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.input_pipeline.pb delete mode 100644 app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.kernel_stats.pb delete mode 100644 app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.overview_page.pb delete mode 100644 app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.tensorflow_stats.pb delete mode 100644 app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.trace.json.gz create mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.input_pipeline.pb create mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.kernel_stats.pb create mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.overview_page.pb create mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.tensorflow_stats.pb create mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.trace.json.gz (limited to 'app/prod/logs/train/plugins/profile') diff --git a/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.input_pipeline.pb b/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.input_pipeline.pb deleted file mode 100644 index 2555aa7..0000000 Binary files a/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.input_pipeline.pb and /dev/null differ diff --git a/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.kernel_stats.pb b/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.kernel_stats.pb deleted file mode 100644 index e69de29..0000000 diff --git a/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.overview_page.pb b/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.overview_page.pb deleted file mode 100644 index 18cffd7..0000000 Binary files a/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.overview_page.pb and /dev/null differ diff --git a/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.tensorflow_stats.pb b/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.tensorflow_stats.pb deleted file mode 100644 index 8c5eb9e..0000000 Binary files a/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.tensorflow_stats.pb and /dev/null differ diff --git a/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.trace.json.gz b/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.trace.json.gz deleted file mode 100644 index 9e4ffce..0000000 Binary files a/app/prod/logs/train/plugins/profile/2020_07_13_20_57_01/Jiamin.local.trace.json.gz and /dev/null differ diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.input_pipeline.pb b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.input_pipeline.pb new file mode 100644 index 0000000..eff4713 Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.input_pipeline.pb differ diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.kernel_stats.pb b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.kernel_stats.pb new file mode 100644 index 0000000..8a8d5f3 --- /dev/null +++ b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.kernel_stats.pb @@ -0,0 +1,313 @@ + +e +volta_sgemm_128x32_sliced1x4_nn*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph +; +volta_sgemm_128x64_nn*28̱ @HbCudnnRNNh +Z +volta_sgemm_64x64_nt*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph +Z +volta_sgemm_128x64_nn*28थ@ +H +b(gradients/CudnnRNN_grad/CudnnRNNBackproph@ + +void LSTM_elementWise_fp(int, int, int, int, float const*, float const*, float const*, float const*, cudnn::reduced_divisor, float*, float*, float*, float const*, float*, bool, int, cudnnRNNClipMode_t, cudnnNanPropagation_t, float, float)*28@HbCudnnRNNh + +void LSTM_elementWise_bp1(int, int, float*, float*, float*, float*, float*, float*, float*, float*, float*, int, int, cudnnRNNClipMode_t, cudnnNanPropagation_t, float, float)*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph +c +volta_sgemm_32x32_sliced1x4_nn*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph@ +9 +volta_sgemm_64x64_nn*28@HbCudnnRNNh@ +b +volta_sgemm_32x32_sliced1x4_nt*28}@}H}b(gradients/CudnnRNN_grad/CudnnRNNBackproph + +void GENERIC_elementWise_bp2(int, int, float*, float*, cudnn::reduced_divisor, float*)*28o@7H7b(gradients/CudnnRNN_grad/CudnnRNNBackproph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*285@ؼHb$gradients/transpose_9_grad/transposeh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*284@Hb transpose_9h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*283@Hbgradients/AddNh +R +volta_sgemm_32x128_nn*28)@)H)b!sequential/dense/Tensordot/MatMulh +r +volta_sgemm_32x32_sliced1x4_nt*28!@!H!b8gradient_tape/sequential/dense/Tensordot/MatMul/MatMul_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb transpose_0h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb"gradients/transpose_grad/transposeh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm_1/dropout/Mul_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb'gradient_tape/sequential/lstm_1/mul/Mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm_1/mulh +h +volta_sgemm_128x128_tn*28@Hb6gradient_tape/sequential/dense/Tensordot/MatMul/MatMulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@ H b-gradients/strided_slice_grad/StridedSliceGradh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/lstm_1/dropout/Mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm_1/dropout/Casth + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28 @ H b&sequential/lstm_1/dropout/GreaterEqualh + +void tensorflow::functor::FillPhiloxRandomKernelLaunch >(tensorflow::random::PhiloxRandom, tensorflow::random::UniformDistribution::ResultElementType*, long long, tensorflow::random::UniformDistribution)*28 +@ +H +b6sequential/lstm_1/dropout/random_uniform/RandomUniformh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28ɘ +@ɘ +Hɘ +bsequential/lstm_1/ones_likeh + +void tensorflow::concat_variable_kernel(tensorflow::GpuDeviceArrayStruct, tensorflow::GpuDeviceArrayStruct, int, int, float*)*28@Hb +concat_1_0h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb6gradient_tape/categorical_crossentropy/truediv/RealDivh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb&gradient_tape/sequential/dense/truedivh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28ċ@ċHċbAddN_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@HbAddNh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb.gradient_tape/categorical_crossentropy/mul/Mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@HbAddN_2h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb2gradient_tape/categorical_crossentropy/truediv/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb*gradient_tape/categorical_crossentropy/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbcategorical_crossentropy/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb"gradient_tape/sequential/dense/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb*gradient_tape/sequential/dense/truediv/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm/mulh + + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long)*28@Hb=gradient_tape/categorical_crossentropy/clip_by_value/SelectV2h + + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long)*28@Hb?gradient_tape/categorical_crossentropy/clip_by_value/SelectV2_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb$gradient_tape/sequential/dense/Equalh + +void tensorflow::(anonymous namespace)::SplitOpKernel(float const*, int, int, int, tensorflow::GpuDeviceArrayStruct)*28@H bsplit_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb categorical_crossentropy/truedivh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb8gradient_tape/categorical_crossentropy/truediv/RealDiv_2h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb0gradient_tape/sequential/dense/truediv/RealDiv_2h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/dense/truedivh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb8gradient_tape/categorical_crossentropy/truediv/RealDiv_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb.gradient_tape/sequential/dense/truediv/RealDivh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb0gradient_tape/sequential/dense/truediv/RealDiv_1h + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hbcategorical_crossentropy/Sumh + +void tensorflow::functor::RowReduceKernel(float*, float*, int, int, cub::Max, std::iterator_traits::value_type)*28@Hbsequential/dense/Maxh + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hb(gradient_tape/sequential/dense/sub/Sum_1h + +Tvoid tensorflow::BiasNHWCKernel(int, float const*, float const*, float*, int)*28@Hbsequential/dense/BiasAddh + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hb"gradient_tape/sequential/dense/Sumh + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hbcategorical_crossentropy/Sum_1h + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hbsequential/dense/Sumh + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hb4gradient_tape/categorical_crossentropy/truediv/Sum_1h + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hb,gradient_tape/sequential/dense/truediv/Sum_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbcategorical_crossentropy/Logh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/dense/Exph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb2gradient_tape/categorical_crossentropy/truediv/Negh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28ô@ôHôb1gradient_tape/categorical_crossentropy/Reciprocalh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28ò@òHòb&gradient_tape/sequential/dense/sub/Negh + +void tensorflow::(anonymous namespace)::SplitOpKernel(float const*, int, int, int, tensorflow::GpuDeviceArrayStruct)*28@H…bsplith + +void tensorflow::functor::ColumnReduceKernel(float const*, float*, int, int, cub::Sum, std::iterator_traits::value_type)*28@Hb2gradient_tape/sequential/dense/BiasAdd/BiasAddGradh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28ï@ïHïbsequential/lstm/dropout/Mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28Ü@ÜHÜb$gradient_tape/sequential/dense/mul_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/dense/subh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb&categorical_crossentropy/clip_by_valueh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28Ê@ÊHÊb.categorical_crossentropy/clip_by_value/Minimumh +b +volta_sgemm_64x32_sliced1x4_nn*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb>gradient_tape/categorical_crossentropy/clip_by_value/LessEqualh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb$sequential/lstm/dropout/GreaterEqualh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb*gradient_tape/sequential/dense/truediv/Negh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@HbAgradient_tape/categorical_crossentropy/clip_by_value/GreaterEqualh + +void Eigen::internal::EigenMetaKernel const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int)*28@'H0bgradients/split_1_grad/concath + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb#gradient_tape/sequential/dense/Casth + +void transpose_readWrite_alignment_kernel(cublasTransposeParams, float const*, float*, float const*)*28@IH`bCudnnRNNh + +void Eigen::internal::EigenMetaKernel const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int)*28@ H8bgradients/split_grad/concath + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@HbXsequential/lstm/dropout/ArithmeticOptimizer/ReorderCastLikeAndValuePreserving_float_Casth + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb$Adam/Adam/update_3/ResourceApplyAdamh + +void tensorflow::functor::FillPhiloxRandomKernelLaunch >(tensorflow::random::PhiloxRandom, tensorflow::random::UniformDistribution::ResultElementType*, long long, tensorflow::random::UniformDistribution)*28@Hb4sequential/lstm/dropout/random_uniform/RandomUniformh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb$Adam/Adam/update_4/ResourceApplyAdamh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb$Adam/Adam/update_1/ResourceApplyAdamh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb*gradient_tape/sequential/dense/BroadcastToh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb4gradient_tape/categorical_crossentropy/BroadcastTo_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb2gradient_tape/categorical_crossentropy/BroadcastToh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@HbAgradient_tape/categorical_crossentropy/clip_by_value/zeros_like_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb?gradient_tape/categorical_crossentropy/clip_by_value/zeros_likeh +9 +volta_sgemm_128x32_nn*28@HbCudnnRNNh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/lstm/ones_likeh + +void tensorflow::(anonymous namespace)::SplitOpKernel(float const*, int, int, int, tensorflow::GpuDeviceArrayStruct)*28@MHPbsplit_2h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@:HYb$gradients/transpose_3_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@?HRb$gradients/transpose_5_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@=HOb$gradients/transpose_8_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@?HHb transpose_5h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@?H@b transpose_7h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@@H@b transpose_8h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28~@>H@b transpose_6h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28|@2HJb$gradients/transpose_1_grad/transposeh + +void Eigen::internal::EigenMetaKernel const, Eigen::DSizes const, Eigen::DSizes const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator const, Eigen::DSizes const, Eigen::DSizes const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, long)*28|@(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28|@(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28x@9H?b$gradients/transpose_2_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28v@6H@b$gradients/transpose_7_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28q@/HAb$gradients/transpose_4_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28o@0H?b transpose_4h + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28o@oHob"Adam/Adam/update/ResourceApplyAdamh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28j@3H6b transpose_1h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28e@2H3b transpose_2h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28d@2H2b transpose_3h + +void tensorflow::(anonymous namespace)::DynamicStitchKernel(int, int, tensorflow::GpuDeviceArrayStruct, tensorflow::GpuDeviceArrayStruct, int*)*28[@[H[b4gradient_tape/categorical_crossentropy/DynamicStitchh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28M@MHMb;gradient_tape/categorical_crossentropy/weighted_loss/Tile_1h + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28D@DHDb$Adam/Adam/update_5/ResourceApplyAdamh + +void tensorflow::functor::CleanupSegments(float*, float*, int, int, int, cub::Sum, std::iterator_traits::value_type)*28B@BHBb2gradient_tape/sequential/dense/BiasAdd/BiasAddGradh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@@@H@b$Adam/Adam/update_2/ResourceApplyAdamh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28?@?H?b$Adam/Adam/update_6/ResourceApplyAdamh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28?@?H?b$Adam/Adam/update_7/ResourceApplyAdamh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*285@5H5bsequential/lstm_1/zerosh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*281@1H1b zeros_like_5h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*280@0H0b zeros_like_4h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*280@0H0bcategorical_crossentropy/Negh + +void tensorflow::functor::BlockReduceKernel >(float*, float*, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*280@0H0b*categorical_crossentropy/weighted_loss/Sumh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28/@/H/b +Adam/Pow_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28.@.H.bsequential/lstm/zerosh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28-@-H-b Adam/Cast_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28,@,H,bAdam/addh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28,@,H,b,categorical_crossentropy/weighted_loss/valueh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28,@,H,bAdam/Powh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28,@,H,b*gradient_tape/categorical_crossentropy/Negh + +void tensorflow::functor::BlockReduceKernel >(int*, int*, int, tensorflow::functor::Prod, std::iterator_traits::value_type)*28+@+H+bsequential/dense/Tensordot/Prodh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28+@+H+bAdam/Adam/AssignAddVariableOph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28)@)H)b +div_no_nanh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28(@(H(b +zeros_likeh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28(@(H(bMulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28'@'H'b zeros_like_3h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28'@'H'b zeros_like_1h + +yvoid tensorflow::GatherOpKernel(int const*, int const*, int*, long long, long long, long long, long long)*28'@'H'b#sequential/dense/Tensordot/GatherV2h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28&@&H&bEgradient_tape/categorical_crossentropy/weighted_loss/value/div_no_nanh + +yvoid tensorflow::GatherOpKernel(int const*, int const*, int*, long long, long long, long long, long long)*28$@$H$b%sequential/dense/Tensordot/GatherV2_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28#@#H#bAssignAddVariableOph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28!@!H!b8categorical_crossentropy/weighted_loss/num_elements/Casth + +void tensorflow::functor::CleanupSegments >(float*, float*, int, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28!@!H!b*categorical_crossentropy/weighted_loss/Sumh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28!@!H!bAssignAddVariableOph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28 @ H bCasth + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28 @ H b zeros_like_2h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28 @ H b GreaterEqualh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28 @ H bAssignAddVariableOp_1h \ No newline at end of file diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.overview_page.pb b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.overview_page.pb new file mode 100644 index 0000000..2adb64d Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.overview_page.pb differ diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.tensorflow_stats.pb b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.tensorflow_stats.pb new file mode 100644 index 0000000..c1093f2 Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.tensorflow_stats.pb differ diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.trace.json.gz b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.trace.json.gz new file mode 100644 index 0000000..c3d1c0f Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.trace.json.gz differ -- cgit v1.2.3