From 7e9940d6c7fcca0109e90b3d68ecd68676635119 Mon Sep 17 00:00:00 2001 From: Navan Chauhan Date: Thu, 24 Sep 2020 16:11:25 +0530 Subject: replaced dataset with one trained on 1.5 mil compounds --- .../37a527ad9b57.input_pipeline.pb | Bin 2544 -> 0 bytes .../37a527ad9b57.kernel_stats.pb | 313 --------------------- .../37a527ad9b57.overview_page.pb | Bin 4233 -> 0 bytes .../37a527ad9b57.tensorflow_stats.pb | Bin 39302 -> 0 bytes .../2020_08_01_08_34_48/37a527ad9b57.trace.json.gz | Bin 72545 -> 0 bytes .../117f39df235a.input_pipeline.pb | Bin 0 -> 2671 bytes .../117f39df235a.kernel_stats.pb | 301 ++++++++++++++++++++ .../117f39df235a.memory_profile.json.gz | Bin 0 -> 12124 bytes .../117f39df235a.overview_page.pb | Bin 0 -> 4609 bytes .../117f39df235a.tensorflow_stats.pb | Bin 0 -> 39796 bytes .../2020_09_24_06_12_50/117f39df235a.trace.json.gz | Bin 0 -> 495326 bytes .../2020_09_24_06_12_50/117f39df235a.xplane.pb | Bin 0 -> 1813717 bytes 12 files changed, 301 insertions(+), 313 deletions(-) delete mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.input_pipeline.pb delete mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.kernel_stats.pb delete mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.overview_page.pb delete mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.tensorflow_stats.pb delete mode 100644 app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.trace.json.gz create mode 100644 app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.input_pipeline.pb create mode 100644 app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.kernel_stats.pb create mode 100644 app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.memory_profile.json.gz create mode 100644 app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.overview_page.pb create mode 100644 app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.tensorflow_stats.pb create mode 100644 app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.trace.json.gz create mode 100644 app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.xplane.pb (limited to 'app/prod/logs/train/plugins') diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.input_pipeline.pb b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.input_pipeline.pb deleted file mode 100644 index eff4713..0000000 Binary files a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.input_pipeline.pb and /dev/null differ diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.kernel_stats.pb b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.kernel_stats.pb deleted file mode 100644 index 8a8d5f3..0000000 --- a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.kernel_stats.pb +++ /dev/null @@ -1,313 +0,0 @@ - -e -volta_sgemm_128x32_sliced1x4_nn*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph -; -volta_sgemm_128x64_nn*28̱ @HbCudnnRNNh -Z -volta_sgemm_64x64_nt*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph -Z -volta_sgemm_128x64_nn*28थ@ -H -b(gradients/CudnnRNN_grad/CudnnRNNBackproph@ - -void LSTM_elementWise_fp(int, int, int, int, float const*, float const*, float const*, float const*, cudnn::reduced_divisor, float*, float*, float*, float const*, float*, bool, int, cudnnRNNClipMode_t, cudnnNanPropagation_t, float, float)*28@HbCudnnRNNh - -void LSTM_elementWise_bp1(int, int, float*, float*, float*, float*, float*, float*, float*, float*, float*, int, int, cudnnRNNClipMode_t, cudnnNanPropagation_t, float, float)*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph -c -volta_sgemm_32x32_sliced1x4_nn*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph@ -9 -volta_sgemm_64x64_nn*28@HbCudnnRNNh@ -b -volta_sgemm_32x32_sliced1x4_nt*28}@}H}b(gradients/CudnnRNN_grad/CudnnRNNBackproph - -void GENERIC_elementWise_bp2(int, int, float*, float*, cudnn::reduced_divisor, float*)*28o@7H7b(gradients/CudnnRNN_grad/CudnnRNNBackproph - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*285@ؼHb$gradients/transpose_9_grad/transposeh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*284@Hb transpose_9h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*283@Hbgradients/AddNh -R -volta_sgemm_32x128_nn*28)@)H)b!sequential/dense/Tensordot/MatMulh -r -volta_sgemm_32x32_sliced1x4_nt*28!@!H!b8gradient_tape/sequential/dense/Tensordot/MatMul/MatMul_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb transpose_0h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb"gradients/transpose_grad/transposeh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm_1/dropout/Mul_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb'gradient_tape/sequential/lstm_1/mul/Mulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm_1/mulh -h -volta_sgemm_128x128_tn*28@Hb6gradient_tape/sequential/dense/Tensordot/MatMul/MatMulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@ H b-gradients/strided_slice_grad/StridedSliceGradh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/lstm_1/dropout/Mulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm_1/dropout/Casth - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28 @ H b&sequential/lstm_1/dropout/GreaterEqualh - -void tensorflow::functor::FillPhiloxRandomKernelLaunch >(tensorflow::random::PhiloxRandom, tensorflow::random::UniformDistribution::ResultElementType*, long long, tensorflow::random::UniformDistribution)*28 -@ -H -b6sequential/lstm_1/dropout/random_uniform/RandomUniformh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28ɘ -@ɘ -Hɘ -bsequential/lstm_1/ones_likeh - -void tensorflow::concat_variable_kernel(tensorflow::GpuDeviceArrayStruct, tensorflow::GpuDeviceArrayStruct, int, int, float*)*28@Hb -concat_1_0h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb6gradient_tape/categorical_crossentropy/truediv/RealDivh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb&gradient_tape/sequential/dense/truedivh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28ċ@ċHċbAddN_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@HbAddNh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb.gradient_tape/categorical_crossentropy/mul/Mulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@HbAddN_2h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb2gradient_tape/categorical_crossentropy/truediv/mulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb*gradient_tape/categorical_crossentropy/mulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbcategorical_crossentropy/mulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb"gradient_tape/sequential/dense/mulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb*gradient_tape/sequential/dense/truediv/mulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm/mulh - - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long)*28@Hb=gradient_tape/categorical_crossentropy/clip_by_value/SelectV2h - - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long)*28@Hb?gradient_tape/categorical_crossentropy/clip_by_value/SelectV2_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb$gradient_tape/sequential/dense/Equalh - -void tensorflow::(anonymous namespace)::SplitOpKernel(float const*, int, int, int, tensorflow::GpuDeviceArrayStruct)*28@H bsplit_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb categorical_crossentropy/truedivh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb8gradient_tape/categorical_crossentropy/truediv/RealDiv_2h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb0gradient_tape/sequential/dense/truediv/RealDiv_2h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/dense/truedivh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb8gradient_tape/categorical_crossentropy/truediv/RealDiv_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb.gradient_tape/sequential/dense/truediv/RealDivh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb0gradient_tape/sequential/dense/truediv/RealDiv_1h - -void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hbcategorical_crossentropy/Sumh - -void tensorflow::functor::RowReduceKernel(float*, float*, int, int, cub::Max, std::iterator_traits::value_type)*28@Hbsequential/dense/Maxh - -void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hb(gradient_tape/sequential/dense/sub/Sum_1h - -Tvoid tensorflow::BiasNHWCKernel(int, float const*, float const*, float*, int)*28@Hbsequential/dense/BiasAddh - -void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hb"gradient_tape/sequential/dense/Sumh - -void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hbcategorical_crossentropy/Sum_1h - -void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hbsequential/dense/Sumh - -void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hb4gradient_tape/categorical_crossentropy/truediv/Sum_1h - -void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28@Hb,gradient_tape/sequential/dense/truediv/Sum_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbcategorical_crossentropy/Logh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/dense/Exph - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb2gradient_tape/categorical_crossentropy/truediv/Negh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28ô@ôHôb1gradient_tape/categorical_crossentropy/Reciprocalh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28ò@òHòb&gradient_tape/sequential/dense/sub/Negh - -void tensorflow::(anonymous namespace)::SplitOpKernel(float const*, int, int, int, tensorflow::GpuDeviceArrayStruct)*28@H…bsplith - -void tensorflow::functor::ColumnReduceKernel(float const*, float*, int, int, cub::Sum, std::iterator_traits::value_type)*28@Hb2gradient_tape/sequential/dense/BiasAdd/BiasAddGradh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28ï@ïHïbsequential/lstm/dropout/Mulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28Ü@ÜHÜb$gradient_tape/sequential/dense/mul_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/dense/subh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb&categorical_crossentropy/clip_by_valueh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28Ê@ÊHÊb.categorical_crossentropy/clip_by_value/Minimumh -b -volta_sgemm_64x32_sliced1x4_nn*28@Hb(gradients/CudnnRNN_grad/CudnnRNNBackproph - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb>gradient_tape/categorical_crossentropy/clip_by_value/LessEqualh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb$sequential/lstm/dropout/GreaterEqualh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb*gradient_tape/sequential/dense/truediv/Negh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@HbAgradient_tape/categorical_crossentropy/clip_by_value/GreaterEqualh - -void Eigen::internal::EigenMetaKernel const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int)*28@'H0bgradients/split_1_grad/concath - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb#gradient_tape/sequential/dense/Casth - -void transpose_readWrite_alignment_kernel(cublasTransposeParams, float const*, float*, float const*)*28@IH`bCudnnRNNh - -void Eigen::internal::EigenMetaKernel const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int)*28@ H8bgradients/split_grad/concath - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@HbXsequential/lstm/dropout/ArithmeticOptimizer/ReorderCastLikeAndValuePreserving_float_Casth - -void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb$Adam/Adam/update_3/ResourceApplyAdamh - -void tensorflow::functor::FillPhiloxRandomKernelLaunch >(tensorflow::random::PhiloxRandom, tensorflow::random::UniformDistribution::ResultElementType*, long long, tensorflow::random::UniformDistribution)*28@Hb4sequential/lstm/dropout/random_uniform/RandomUniformh - -void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb$Adam/Adam/update_4/ResourceApplyAdamh - -void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb$Adam/Adam/update_1/ResourceApplyAdamh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb*gradient_tape/sequential/dense/BroadcastToh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb4gradient_tape/categorical_crossentropy/BroadcastTo_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb2gradient_tape/categorical_crossentropy/BroadcastToh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@HbAgradient_tape/categorical_crossentropy/clip_by_value/zeros_like_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb?gradient_tape/categorical_crossentropy/clip_by_value/zeros_likeh -9 -volta_sgemm_128x32_nn*28@HbCudnnRNNh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/lstm/ones_likeh - -void tensorflow::(anonymous namespace)::SplitOpKernel(float const*, int, int, int, tensorflow::GpuDeviceArrayStruct)*28@MHPbsplit_2h - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@:HYb$gradients/transpose_3_grad/transposeh - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@?HRb$gradients/transpose_5_grad/transposeh - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@=HOb$gradients/transpose_8_grad/transposeh - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@?HHb transpose_5h - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@?H@b transpose_7h - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@@H@b transpose_8h - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28~@>H@b transpose_6h - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28|@2HJb$gradients/transpose_1_grad/transposeh - -void Eigen::internal::EigenMetaKernel const, Eigen::DSizes const, Eigen::DSizes const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator const, Eigen::DSizes const, Eigen::DSizes const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, long)*28|@(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28|@(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28x@9H?b$gradients/transpose_2_grad/transposeh - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28v@6H@b$gradients/transpose_7_grad/transposeh - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28q@/HAb$gradients/transpose_4_grad/transposeh - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28o@0H?b transpose_4h - -void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28o@oHob"Adam/Adam/update/ResourceApplyAdamh - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28j@3H6b transpose_1h - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28e@2H3b transpose_2h - -void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28d@2H2b transpose_3h - -void tensorflow::(anonymous namespace)::DynamicStitchKernel(int, int, tensorflow::GpuDeviceArrayStruct, tensorflow::GpuDeviceArrayStruct, int*)*28[@[H[b4gradient_tape/categorical_crossentropy/DynamicStitchh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28M@MHMb;gradient_tape/categorical_crossentropy/weighted_loss/Tile_1h - -void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28D@DHDb$Adam/Adam/update_5/ResourceApplyAdamh - -void tensorflow::functor::CleanupSegments(float*, float*, int, int, int, cub::Sum, std::iterator_traits::value_type)*28B@BHBb2gradient_tape/sequential/dense/BiasAdd/BiasAddGradh - -void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@@@H@b$Adam/Adam/update_2/ResourceApplyAdamh - -void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28?@?H?b$Adam/Adam/update_6/ResourceApplyAdamh - -void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28?@?H?b$Adam/Adam/update_7/ResourceApplyAdamh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*285@5H5bsequential/lstm_1/zerosh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*281@1H1b zeros_like_5h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*280@0H0b zeros_like_4h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*280@0H0bcategorical_crossentropy/Negh - -void tensorflow::functor::BlockReduceKernel >(float*, float*, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*280@0H0b*categorical_crossentropy/weighted_loss/Sumh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28/@/H/b -Adam/Pow_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28.@.H.bsequential/lstm/zerosh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28-@-H-b Adam/Cast_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28,@,H,bAdam/addh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28,@,H,b,categorical_crossentropy/weighted_loss/valueh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28,@,H,bAdam/Powh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28,@,H,b*gradient_tape/categorical_crossentropy/Negh - -void tensorflow::functor::BlockReduceKernel >(int*, int*, int, tensorflow::functor::Prod, std::iterator_traits::value_type)*28+@+H+bsequential/dense/Tensordot/Prodh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28+@+H+bAdam/Adam/AssignAddVariableOph - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28)@)H)b -div_no_nanh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28(@(H(b -zeros_likeh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28(@(H(bMulh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28'@'H'b zeros_like_3h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28'@'H'b zeros_like_1h - -yvoid tensorflow::GatherOpKernel(int const*, int const*, int*, long long, long long, long long, long long)*28'@'H'b#sequential/dense/Tensordot/GatherV2h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28&@&H&bEgradient_tape/categorical_crossentropy/weighted_loss/value/div_no_nanh - -yvoid tensorflow::GatherOpKernel(int const*, int const*, int*, long long, long long, long long, long long)*28$@$H$b%sequential/dense/Tensordot/GatherV2_1h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28#@#H#bAssignAddVariableOph - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28!@!H!b8categorical_crossentropy/weighted_loss/num_elements/Casth - -void tensorflow::functor::CleanupSegments >(float*, float*, int, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28!@!H!b*categorical_crossentropy/weighted_loss/Sumh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28!@!H!bAssignAddVariableOph - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28 @ H bCasth - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28 @ H b zeros_like_2h - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28 @ H b GreaterEqualh - -void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28 @ H bAssignAddVariableOp_1h \ No newline at end of file diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.overview_page.pb b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.overview_page.pb deleted file mode 100644 index 2adb64d..0000000 Binary files a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.overview_page.pb and /dev/null differ diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.tensorflow_stats.pb b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.tensorflow_stats.pb deleted file mode 100644 index c1093f2..0000000 Binary files a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.tensorflow_stats.pb and /dev/null differ diff --git a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.trace.json.gz b/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.trace.json.gz deleted file mode 100644 index c3d1c0f..0000000 Binary files a/app/prod/logs/train/plugins/profile/2020_08_01_08_34_48/37a527ad9b57.trace.json.gz and /dev/null differ diff --git a/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.input_pipeline.pb b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.input_pipeline.pb new file mode 100644 index 0000000..eff0442 Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.input_pipeline.pb differ diff --git a/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.kernel_stats.pb b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.kernel_stats.pb new file mode 100644 index 0000000..e4a9bea --- /dev/null +++ b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.kernel_stats.pb @@ -0,0 +1,301 @@ + +i + sgemm_sm35_ldg_nn_64x16x64x16x16*28@HXb(gradients/CudnnRNN_grad/CudnnRNNBackproph! +H +!sgemm_sm35_ldg_nn_128x8x128x16x16*28隤@H bCudnnRNNh! +j +!sgemm_sm35_ldg_nt_128x8x128x16x16*28Ơ@ +HKXb(gradients/CudnnRNN_grad/CudnnRNNBackproph + +void LSTM_elementWise_fp(int, int, int, int, float const*, float const*, float const*, float const*, cudnn::reduced_divisor, float*, float*, float*, float const*, float*, bool, int, cudnnRNNClipMode_t, cudnnNanPropagation_t, float, float)*281@HbCudnnRNNh + +void LSTM_elementWise_bp1(int, int, float*, float*, float*, float*, float*, float*, float*, float*, float*, int, int, cudnnRNNClipMode_t, cudnnNanPropagation_t, float, float)*28ƥ/@HXb(gradients/CudnnRNN_grad/CudnnRNNBackproph + +void sgemm_largek_lds64(float*, float const*, float const*, int, int, int, int, int, int, float const*, float const*, float, float, int, int, int*, int*)*28#@#H#Xb(gradients/CudnnRNN_grad/CudnnRNNBackproph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb transpose_9h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb$gradients/transpose_9_grad/transposeh + +void GENERIC_elementWise_bp2(int, int, float*, float*, cudnn::reduced_divisor, float*)*28 @HXb(gradients/CudnnRNN_grad/CudnnRNNBackproph + +void sgemm_largek_lds64(float*, float const*, float const*, int, int, int, int, int, int, float const*, float const*, float, float, int, int, int*, int*)*28 @ H b8gradient_tape/sequential/dense/Tensordot/MatMul/MatMul_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28Ύ @Hb transpose_0h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28 @Hbgradients/AddNh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorShufflingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb"gradients/transpose_grad/transposeh +x +!sgemm_sm35_ldg_tn_128x8x256x16x32*28™@™H™Xb6gradient_tape/sequential/dense/Tensordot/MatMul/MatMulh +b + sgemm_sm35_ldg_nn_64x16x64x16x16*28@HXb!sequential/dense/Tensordot/MatMulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm_1/dropout/Mul_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm_1/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb'gradient_tape/sequential/lstm_1/mul/Mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb&sequential/lstm_1/dropout/GreaterEqualh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/lstm_1/dropout/Mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hb-gradients/strided_slice_grad/StridedSliceGradh + +void tensorflow::functor::FillPhiloxRandomKernelLaunch >(tensorflow::random::PhiloxRandom, tensorflow::random::UniformDistribution::ResultElementType*, long long, tensorflow::random::UniformDistribution)*28٫@٫H٫b6sequential/lstm_1/dropout/random_uniform/RandomUniformh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28@Hbsequential/lstm_1/dropout/Casth + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/lstm_1/ones_likeh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28@Hb$gradient_tape/sequential/dense/Equalh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28k@kHkb&gradient_tape/sequential/dense/truedivh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28k@kHkb6gradient_tape/categorical_crossentropy/truediv/RealDivh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28e@eHeb"gradient_tape/sequential/dense/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28e@eHebAddN_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28e@eHeb*gradient_tape/sequential/dense/truediv/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28e@eHeb*gradient_tape/categorical_crossentropy/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28e@eHebsequential/lstm/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28e@eHebAddN_2h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28d@dHdb.gradient_tape/categorical_crossentropy/mul/Mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28d@dHdbAddNh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28d@dHdb2gradient_tape/categorical_crossentropy/truediv/mulh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28c@cHcbcategorical_crossentropy/mulh + + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long)*28_@_H_b?gradient_tape/categorical_crossentropy/clip_by_value/SelectV2_1h + + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorSelectOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, long)*28^@^H^b=gradient_tape/categorical_crossentropy/clip_by_value/SelectV2h + +Tvoid tensorflow::BiasNHWCKernel(int, float const*, float const*, float*, int)*28]@]H]bsequential/dense/BiasAddh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28T@THTb0gradient_tape/sequential/dense/truediv/RealDiv_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28T@THTb8gradient_tape/categorical_crossentropy/truediv/RealDiv_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28ΤT@ΤTHΤTb8gradient_tape/categorical_crossentropy/truediv/RealDiv_2h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28T@THTb.gradient_tape/sequential/dense/truediv/RealDivh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28T@THTb categorical_crossentropy/truedivh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28T@THTbsequential/dense/truedivh + +void tensorflow::functor::RowReduceKernel(float*, float*, int, int, cub::Max, std::iterator_traits::value_type)*28S@SHSbsequential/dense/Maxh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28S@SHSb0gradient_tape/sequential/dense/truediv/RealDiv_2h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28S@SHSb$sequential/lstm/dropout/GreaterEqualh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28S@SHSb>gradient_tape/categorical_crossentropy/clip_by_value/LessEqualh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28S@SHSbAgradient_tape/categorical_crossentropy/clip_by_value/GreaterEqualh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const> const, Eigen::GpuDevice>, int)*28O@OHObsequential/dense/subh + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28϶O@϶OH϶Obsequential/dense/Sumh + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28O@OHOb"gradient_tape/sequential/dense/Sumh + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28O@OHOb(gradient_tape/sequential/dense/sub/Sum_1h + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28O@OHOb,gradient_tape/sequential/dense/truediv/Sum_1h + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28ϝO@ϝOHϝObcategorical_crossentropy/Sumh + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28O@OHOb4gradient_tape/categorical_crossentropy/truediv/Sum_1h + +void tensorflow::functor::RowReduceKernel >(float*, float*, int, int, tensorflow::functor::Sum, std::iterator_traits::value_type)*28O@OHObcategorical_crossentropy/Sum_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28J@JHJb$gradient_tape/sequential/dense/mul_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28C@CHCbsequential/dense/Exph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28C@CHCbcategorical_crossentropy/Logh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28C@CHCb1gradient_tape/categorical_crossentropy/Reciprocalh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28B@BHBb&categorical_crossentropy/clip_by_valueh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28B@BHBb.categorical_crossentropy/clip_by_value/Minimumh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28B@BHBb&gradient_tape/sequential/dense/sub/Negh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28B@BHBb*gradient_tape/sequential/dense/truediv/Negh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28үB@үBHүBb2gradient_tape/categorical_crossentropy/truediv/Negh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, false>, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28B@BHBbsequential/lstm/dropout/Mulh + +void tensorflow::functor::ColumnReduceKernel(float const*, float*, int, int, cub::Sum, std::iterator_traits::value_type)*28=@=H=b2gradient_tape/sequential/dense/BiasAdd/BiasAddGradh + +void tensorflow::functor::FillPhiloxRandomKernelLaunch >(tensorflow::random::PhiloxRandom, tensorflow::random::UniformDistribution::ResultElementType*, long long, tensorflow::random::UniformDistribution)*287@7H7b4sequential/lstm/dropout/random_uniform/RandomUniformh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28/@/H/b#gradient_tape/sequential/dense/Casth + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28/@/H/bXsequential/lstm/dropout/ArithmeticOptimizer/ReorderCastLikeAndValuePreserving_float_Casth + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28&@&H&b*gradient_tape/sequential/dense/BroadcastToh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28&@&H&b2gradient_tape/categorical_crossentropy/BroadcastToh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28&@&H&b4gradient_tape/categorical_crossentropy/BroadcastTo_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28 @ H bAgradient_tape/categorical_crossentropy/clip_by_value/zeros_like_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28ٌ @ٌ Hٌ b?gradient_tape/categorical_crossentropy/clip_by_value/zeros_likeh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbsequential/lstm/ones_likeh + +void tensorflow::concat_variable_kernel(tensorflow::GpuDeviceArrayStruct, tensorflow::GpuDeviceArrayStruct, int, int, float*)*28ޑ@߼Hb +concat_1_0h + +void tensorflow::(anonymous namespace)::SplitOpKernel(float const*, int, int, int, tensorflow::GpuDeviceArrayStruct)*28@Hbsplit_1h + +void transpose_readWrite_alignment_kernel(cublasTransposeParams, float const*, float*, float const*)*28@HbCudnnRNNh + +void Eigen::internal::EigenMetaKernel const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int)*28@?HQbgradients/split_1_grad/concath + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb$Adam/Adam/update_4/ResourceApplyAdamh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb$Adam/Adam/update_1/ResourceApplyAdamh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb$Adam/Adam/update_3/ResourceApplyAdamh + +void Eigen::internal::EigenMetaKernel const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator const, Eigen::array const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, int)*28@1Hgbgradients/split_grad/concath + +void tensorflow::(anonymous namespace)::SplitOpKernel(float const*, int, int, int, tensorflow::GpuDeviceArrayStruct)*28@Hbsplith + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorBroadcastingOp const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hb;gradient_tape/categorical_crossentropy/weighted_loss/Tile_1h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@dHb$gradients/transpose_5_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@pHb$gradients/transpose_1_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@dHkb transpose_5h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@cHfb$gradients/transpose_7_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@cHfb transpose_6h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@LH}b transpose_1h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@dHeb$gradients/transpose_8_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@cHeb transpose_8h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@aHdb$gradients/transpose_6_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@bHcb transpose_7h + +void Eigen::internal::EigenMetaKernel const, Eigen::DSizes const, Eigen::DSizes const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator const, Eigen::DSizes const, Eigen::DSizes const, Eigen::TensorMap, 16, Eigen::MakePointer> >, Eigen::TensorMap, 16, Eigen::MakePointer> const> const, Eigen::GpuDevice>, long)*28ߵ@ZHZb-gradients/strided_slice_grad/StridedSliceGradh + +void tensorflow::(anonymous namespace)::SplitOpKernel(float const*, int, int, int, tensorflow::GpuDeviceArrayStruct)*28@XH[bsplit_2h + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28@Hb"Adam/Adam/update/ResourceApplyAdamh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@KHcb transpose_2h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@KHcb transpose_4h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@JHcb transpose_3h + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@CHdb$gradients/transpose_3_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28ߦ@DHbb$gradients/transpose_4_grad/transposeh + +void tensorflow::functor::SwapDimension1And2InTensor3UsingTiles(unsigned int const*, tensorflow::functor::Dimension<3>, unsigned int*)*28@DHbb$gradients/transpose_2_grad/transposeh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28@Hbcategorical_crossentropy/Negh + +void cub::DeviceReduceKernel >::Policy600, float*, float*, int, tensorflow::functor::Sum >(float*, float*, int, cub::GridEvenShare, tensorflow::functor::Sum)*28x@xHxb*categorical_crossentropy/weighted_loss/Sumh + +void tensorflow::(anonymous namespace)::DynamicStitchKernel(int, int, tensorflow::GpuDeviceArrayStruct, tensorflow::GpuDeviceArrayStruct, int*)*28n@nHnb4gradient_tape/categorical_crossentropy/DynamicStitchh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseUnaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28k@kHkb*gradient_tape/categorical_crossentropy/Negh + +vvoid scal_kernel(cublasTransposeParams, float const*, float*, float const*)*28j@jHjXb(gradients/CudnnRNN_grad/CudnnRNNBackproph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28g@gHgbMulh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28c@cHcb$Adam/Adam/update_5/ResourceApplyAdamh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28_@_H_b$Adam/Adam/update_2/ResourceApplyAdamh + +void tensorflow::functor::CleanupSegments(float*, float*, int, int, int, cub::Sum, std::iterator_traits::value_type)*28_@_H_b2gradient_tape/sequential/dense/BiasAdd/BiasAddGradh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28[@[H[b$Adam/Adam/update_7/ResourceApplyAdamh + +void tensorflow::functor::ApplyAdamKernel(int, float*, float*, float*, float const*, float const*, float const*, float const*, float const*, float const*, float const*, bool)*28X@XHXb$Adam/Adam/update_6/ResourceApplyAdamh + +void cub::DeviceReduceSingleTileKernel >::Policy600, float*, float*, int, tensorflow::functor::Sum, float>(float*, float*, int, tensorflow::functor::Sum, float)*28L@LHLb*categorical_crossentropy/weighted_loss/Sumh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28J@JHJbAdam/Powh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28G@GHGbsequential/lstm/zerosh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28F@FHFbsequential/lstm_1/zerosh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28C@CHCbEgradient_tape/categorical_crossentropy/weighted_loss/value/div_no_nanh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28C@CHCb +zeros_likeh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28?@?H?b zeros_like_3h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28?@?H?b zeros_like_2h + +void tensorflow::functor::BlockReduceKernel >(int*, int*, int, tensorflow::functor::Prod, std::iterator_traits::value_type)*28>@>H>bsequential/dense/Tensordot/Prodh + +uvoid scal_kernel(cublasTransposeParams, float const*, float*, float const*)*28<@(int const*, int const*, int*, long long, long long, long long, long long)*28;@;H;b#sequential/dense/Tensordot/GatherV2h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28;@;H;b zeros_like_4h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28;@;H;b zeros_like_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseNullaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, int)*28:@:H:b zeros_like_5h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28:@:H:b +div_no_nanh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*288@8H8b +LogicalAndh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*288@8H8bAssignAddVariableOph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*287@7H7b,categorical_crossentropy/weighted_loss/valueh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*286@6H6bAdam/addh + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*285@5H5b +Adam/Pow_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*284@4H4bAdam/Adam/AssignAddVariableOph + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*284@4H4b Adam/Cast_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*283@3H3bCasth + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*283@3H3bAssignAddVariableOp_2h + +yvoid tensorflow::GatherOpKernel(int const*, int const*, int*, long long, long long, long long, long long)*283@3H3b%sequential/dense/Tensordot/GatherV2_1h + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorConversionOp, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*281@1H1b8categorical_crossentropy/weighted_loss/num_elements/Casth + +void Eigen::internal::EigenMetaKernel, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long>(Eigen::TensorEvaluator, 16, Eigen::MakePointer>, Eigen::TensorCwiseBinaryOp, Eigen::TensorMap, 16, Eigen::MakePointer> const, Eigen::TensorMap, 16, Eigen::MakePointer> const> const> const, Eigen::GpuDevice>, long)*28/@/H/bAssignAddVariableOp_1h \ No newline at end of file diff --git a/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.memory_profile.json.gz b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.memory_profile.json.gz new file mode 100644 index 0000000..9f386da Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.memory_profile.json.gz differ diff --git a/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.overview_page.pb b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.overview_page.pb new file mode 100644 index 0000000..7a9a67a Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.overview_page.pb differ diff --git a/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.tensorflow_stats.pb b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.tensorflow_stats.pb new file mode 100644 index 0000000..15bb3f3 Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.tensorflow_stats.pb differ diff --git a/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.trace.json.gz b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.trace.json.gz new file mode 100644 index 0000000..011c02c Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.trace.json.gz differ diff --git a/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.xplane.pb b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.xplane.pb new file mode 100644 index 0000000..cab863b Binary files /dev/null and b/app/prod/logs/train/plugins/profile/2020_09_24_06_12_50/117f39df235a.xplane.pb differ -- cgit v1.2.3