~speedprog/mtg/mtg_card_detector.git

			@@ -174,6 +174,9 @@
			cudnnSetTensor4dDescriptor(l->srcTensorDesc, CUDNN_TENSOR_NCHW, data_type, l->batch, l->c, l->h, l->w);
			cudnnSetTensor4dDescriptor(l->dstTensorDesc, CUDNN_TENSOR_NCHW, data_type, l->batch, l->out_c, l->out_h, l->out_w);
			cudnnSetFilter4dDescriptor(l->weightDesc, data_type, CUDNN_TENSOR_NCHW, l->n, l->c, l->size, l->size);

			// batch norm
			cudnnSetTensor4dDescriptor(l->normTensorDesc, CUDNN_TENSOR_NCHW, CUDNN_DATA_FLOAT, 1, l->out_c, 1, 1);
			#if(CUDNN_MAJOR >= 6)
			cudnnSetConvolution2dDescriptor(l->convDesc, l->pad, l->pad, l->stride, l->stride, 1, 1, CUDNN_CROSS_CORRELATION, CUDNN_DATA_FLOAT); // cudnn >= 6.0
			#else
			@@ -305,8 +308,8 @@

			l.weights_gpu = cuda_make_array(l.weights, cnsize*size);
			#ifdef CUDNN_HALF
			l.weights_gpu16 = cuda_make_array(l.weights, cnsize*size / 2);
			l.weight_updates_gpu16 = cuda_make_array(l.weight_updates, cnsize*size / 2);
			l.weights_gpu16 = cuda_make_array(NULL, cnsizesize / 2); //cuda_make_array(l.weights, cnsizesize / 2);
			l.weight_updates_gpu16 = cuda_make_array(NULL, cnsizesize / 2); //cuda_make_array(l.weight_updates, cnsizesize / 2);
			#endif
			l.weight_updates_gpu = cuda_make_array(l.weight_updates, cnsize*size);

			@@ -341,6 +344,7 @@
			l.x_norm_gpu = cuda_make_array(l.output, l.batchout_hout_w*n);
			}
			#ifdef CUDNN
			cudnnCreateTensorDescriptor(&l.normTensorDesc);
			cudnnCreateTensorDescriptor(&l.srcTensorDesc);
			cudnnCreateTensorDescriptor(&l.dstTensorDesc);
			cudnnCreateFilterDescriptor(&l.weightDesc);