AlexeyAB
2018-05-20 4403e71b330b42d3cda1e0721fb645cf41bac14f
src/detector.c
@@ -21,10 +21,10 @@
#ifndef CV_VERSION_EPOCH
#include "opencv2/videoio/videoio_c.h"
#define OPENCV_VERSION CVAUX_STR(CV_VERSION_MAJOR)""CVAUX_STR(CV_VERSION_MINOR)""CVAUX_STR(CV_VERSION_REVISION)
#define OPENCV_VERSION CVAUX_STR(CV_VERSION_MAJOR)"" CVAUX_STR(CV_VERSION_MINOR)"" CVAUX_STR(CV_VERSION_REVISION)
#pragma comment(lib, "opencv_world" OPENCV_VERSION ".lib")
#else
#define OPENCV_VERSION CVAUX_STR(CV_VERSION_EPOCH)""CVAUX_STR(CV_VERSION_MAJOR)""CVAUX_STR(CV_VERSION_MINOR)
#define OPENCV_VERSION CVAUX_STR(CV_VERSION_EPOCH)"" CVAUX_STR(CV_VERSION_MAJOR)"" CVAUX_STR(CV_VERSION_MINOR)
#pragma comment(lib, "opencv_core" OPENCV_VERSION ".lib")
#pragma comment(lib, "opencv_imgproc" OPENCV_VERSION ".lib")
#pragma comment(lib, "opencv_highgui" OPENCV_VERSION ".lib")
@@ -132,6 +132,8 @@
         int random_val = rand() % 12;
         int dim_w = (random_val + (init_w / 32 - 5)) * 32; // +-160
         int dim_h = (random_val + (init_h / 32 - 5)) * 32; // +-160
         if (dim_w < 32) dim_w = 32;
         if (dim_h < 32) dim_h = 32;
         printf("%d x %d \n", dim_w, dim_h);
         args.w = dim_w;
@@ -425,7 +427,7 @@
      fprintf(fp, "\n]\n");
      fclose(fp);
   }
   fprintf(stderr, "Total Detection Time: %f Seconds\n", time(0) - start);
   fprintf(stderr, "Total Detection Time: %f Seconds\n", (double)time(0) - start);
}
void validate_detector_recall(char *datacfg, char *cfgfile, char *weightfile)
@@ -472,13 +474,7 @@
      if (nms) do_nms_obj(dets, nboxes, 1, nms);
      char labelpath[4096];
      find_replace(path, "images", "labels", labelpath);
      find_replace(labelpath, "JPEGImages", "labels", labelpath);
      find_replace(labelpath, ".jpg", ".txt", labelpath);
      find_replace(labelpath, ".png", ".txt", labelpath);
      find_replace(labelpath, ".bmp", ".txt", labelpath);
      find_replace(labelpath, ".JPG", ".txt", labelpath);
      find_replace(labelpath, ".JPEG", ".txt", labelpath);
      replace_image_to_label(path, labelpath);
      int num_labels = 0;
      box_label *truth = read_boxes(labelpath, &num_labels);
@@ -629,13 +625,7 @@
         if (nms) do_nms_sort(dets, nboxes, l.classes, nms);
         char labelpath[4096];
         find_replace(path, "images", "labels", labelpath);
         find_replace(labelpath, "JPEGImages", "labels", labelpath);
         find_replace(labelpath, ".jpg", ".txt", labelpath);
         find_replace(labelpath, ".png", ".txt", labelpath);
         find_replace(labelpath, ".bmp", ".txt", labelpath);
         find_replace(labelpath, ".JPG", ".txt", labelpath);
         find_replace(labelpath, ".JPEG", ".txt", labelpath);
         replace_image_to_label(path, labelpath);
         int num_labels = 0;
         box_label *truth = read_boxes(labelpath, &num_labels);
         int i, j;
@@ -651,11 +641,8 @@
            char *path_dif = paths_dif[image_index];
            char labelpath_dif[4096];
            find_replace(path_dif, "images", "labels", labelpath_dif);
            find_replace(labelpath_dif, "JPEGImages", "labels", labelpath_dif);
            find_replace(labelpath_dif, ".jpg", ".txt", labelpath_dif);
            find_replace(labelpath_dif, ".JPEG", ".txt", labelpath_dif);
            find_replace(labelpath_dif, ".png", ".txt", labelpath_dif);
            replace_image_to_label(path_dif, labelpath_dif);
            truth_dif = read_boxes(labelpath_dif, &num_labels_dif);
         }
@@ -892,13 +879,8 @@
   for (i = 0; i < number_of_images; ++i) {
      char *path = paths[i];
      char labelpath[4096];
      find_replace(path, "images", "labels", labelpath);
      find_replace(labelpath, "JPEGImages", "labels", labelpath);
      find_replace(labelpath, ".jpg", ".txt", labelpath);
      find_replace(labelpath, ".png", ".txt", labelpath);
      find_replace(labelpath, ".bmp", ".txt", labelpath);
      find_replace(labelpath, ".JPG", ".txt", labelpath);
      find_replace(labelpath, ".JPEG", ".txt", labelpath);
      replace_image_to_label(path, labelpath);
      int num_labels = 0;
      box_label *truth = read_boxes(labelpath, &num_labels);
      //printf(" new path: %s \n", labelpath);
@@ -1051,7 +1033,7 @@
#endif // OPENCV
void test_detector(char *datacfg, char *cfgfile, char *weightfile, char *filename, float thresh,
               float hier_thresh, int dont_show, int ext_output)
               float hier_thresh, int dont_show, int ext_output, int save_labels)
{
    list *options = read_data_cfg(datacfg);
    char *name_list = option_find_str(options, "names", "data/names.list");
@@ -1104,12 +1086,38 @@
      detection *dets = get_network_boxes(&net, im.w, im.h, thresh, hier_thresh, 0, 1, &nboxes, letterbox);
      if (nms) do_nms_sort(dets, nboxes, l.classes, nms);
      draw_detections_v3(im, dets, nboxes, thresh, names, alphabet, l.classes, ext_output);
      free_detections(dets, nboxes);
        save_image(im, "predictions");
      if (!dont_show) {
         show_image(im, "predictions");
      }
      // pseudo labeling concept - fast.ai
      if(save_labels)
      {
         char labelpath[4096];
         replace_image_to_label(input, labelpath);
         FILE* fw = fopen(labelpath, "wb");
         int i;
         for (i = 0; i < nboxes; ++i) {
            char buff[1024];
            int class_id = -1;
            float prob = 0;
            for (j = 0; j < l.classes; ++j) {
               if (dets[i].prob[j] > thresh && dets[i].prob[j] > prob) {
                  prob = dets[i].prob[j];
                  class_id = j;
               }
            }
            if (class_id >= 0) {
               sprintf(buff, "%d %2.4f %2.4f %2.4f %2.4f\n", class_id, dets[i].bbox.x, dets[i].bbox.y, dets[i].bbox.w, dets[i].bbox.h);
               fwrite(buff, sizeof(char), strlen(buff), fw);
            }
         }
         fclose(fw);
      }
      free_detections(dets, nboxes);
        free_image(im);
        free_image(sized);
        //free(boxes);
@@ -1158,6 +1166,7 @@
   // extended output in test mode (output of rect bound coords)
   // and for recall mode (extended output table-like format with results for best_class fit)
   int ext_output = find_arg(argc, argv, "-ext_output");
   int save_labels = find_arg(argc, argv, "-save_labels");
    if(argc < 4){
        fprintf(stderr, "usage: %s %s [train/test/valid] [cfg] [weights (optional)]\n", argv[0], argv[1]);
        return;
@@ -1194,7 +1203,7 @@
      if(strlen(weights) > 0)
         if (weights[strlen(weights) - 1] == 0x0d) weights[strlen(weights) - 1] = 0;
    char *filename = (argc > 6) ? argv[6]: 0;
    if(0==strcmp(argv[2], "test")) test_detector(datacfg, cfg, weights, filename, thresh, hier_thresh, dont_show, ext_output);
    if(0==strcmp(argv[2], "test")) test_detector(datacfg, cfg, weights, filename, thresh, hier_thresh, dont_show, ext_output, save_labels);
    else if(0==strcmp(argv[2], "train")) train_detector(datacfg, cfg, weights, gpus, ngpus, clear, dont_show);
    else if(0==strcmp(argv[2], "valid")) validate_detector(datacfg, cfg, weights, outfile);
    else if(0==strcmp(argv[2], "recall")) validate_detector_recall(datacfg, cfg, weights);