AlexeyAB
2018-03-28 d014f7530f3043da5fe2030666e07aefa2efc71a
src/gemm.c
@@ -177,6 +177,7 @@
        float *C_gpu, int ldc)
{
    cublasHandle_t handle = blas_handle();
   cudaError_t stream_status = cublasSetStream(handle, get_cuda_stream());
    cudaError_t status = cublasSgemm(handle, (TB ? CUBLAS_OP_T : CUBLAS_OP_N), 
            (TA ? CUBLAS_OP_T : CUBLAS_OP_N), N, M, K, &ALPHA, B_gpu, ldb, A_gpu, lda, &BETA, C_gpu, ldc);
    check_error(status);