Alexey
2018-03-04 09fdb67d66b7d405a02fc5e73b13b0e4a08583a2
src/gemm.c
@@ -177,6 +177,7 @@
        float *C_gpu, int ldc)
{
    cublasHandle_t handle = blas_handle();
   cudaError_t stream_status = cublasSetStream(handle, get_cuda_stream());
    cudaError_t status = cublasSgemm(handle, (TB ? CUBLAS_OP_T : CUBLAS_OP_N), 
            (TA ? CUBLAS_OP_T : CUBLAS_OP_N), N, M, K, &ALPHA, B_gpu, ldb, A_gpu, lda, &BETA, C_gpu, ldc);
    check_error(status);