AlexeyAB
2018-05-06 c9b8bdee1886df5f83973d91c3597c28f99a9e0c
src/detector.c
@@ -1,3 +1,8 @@
#ifdef _DEBUG
#include <stdlib.h>
#include <crtdbg.h>
#endif
#include "network.h"
#include "region_layer.h"
#include "cost_layer.h"
@@ -86,6 +91,7 @@
    args.n = imgs;
    args.m = plist->size;
    args.classes = classes;
    args.flip = net.flip;
    args.jitter = jitter;
    args.num_boxes = l.max_boxes;
   args.small_object = net.small_object;
@@ -99,7 +105,7 @@
    args.hue = net.hue;
#ifdef OPENCV
   args.threads = 7;
   args.threads = 3;
   IplImage* img = NULL;
   float max_img_loss = 5;
   int number_of_lines = 100;
@@ -460,6 +466,9 @@
      find_replace(path, "images", "labels", labelpath);
      find_replace(labelpath, "JPEGImages", "labels", labelpath);
      find_replace(labelpath, ".jpg", ".txt", labelpath);
      find_replace(labelpath, ".png", ".txt", labelpath);
      find_replace(labelpath, ".bmp", ".txt", labelpath);
      find_replace(labelpath, ".JPG", ".txt", labelpath);
      find_replace(labelpath, ".JPEG", ".txt", labelpath);
      int num_labels = 0;
@@ -484,7 +493,7 @@
            ++correct;
         }
      }
      fprintf(stderr, " %s - %s - ", paths[i], labelpath);
      //fprintf(stderr, " %s - %s - ", paths[i], labelpath);
      fprintf(stderr, "%5d %5d %5d\tRPs/Img: %.2f\tIOU: %.2f%%\tRecall:%.2f%%\n", i, correct, total, (float)proposals / (i + 1), avg_iou * 100 / total, 100.*correct / total);
      free(id);
      free_image(orig);
@@ -614,8 +623,10 @@
         find_replace(path, "images", "labels", labelpath);
         find_replace(labelpath, "JPEGImages", "labels", labelpath);
         find_replace(labelpath, ".jpg", ".txt", labelpath);
         find_replace(labelpath, ".JPEG", ".txt", labelpath);
         find_replace(labelpath, ".png", ".txt", labelpath);
         find_replace(labelpath, ".bmp", ".txt", labelpath);
         find_replace(labelpath, ".JPG", ".txt", labelpath);
         find_replace(labelpath, ".JPEG", ".txt", labelpath);
         int num_labels = 0;
         box_label *truth = read_boxes(labelpath, &num_labels);
         int i, j;
@@ -639,6 +650,8 @@
            truth_dif = read_boxes(labelpath_dif, &num_labels_dif);
         }
         const int checkpoint_detections_count = detections_count;
         for (i = 0; i < nboxes; ++i) {
            int class_id;
@@ -689,7 +702,13 @@
                  // calc avg IoU, true-positives, false-positives for required Threshold
                  if (prob > thresh_calc_avg_iou) {
                     if (truth_index > -1) {
                     int z, found = 0;
                     for (z = checkpoint_detections_count; z < detections_count-1; ++z)
                        if (detections[z].unique_truth_index == truth_index) {
                           found = 1; break;
                        }
                     if(truth_index > -1 && found == 0) {
                        avg_iou += max_iou;
                        ++tp_for_thresh;
                     }
@@ -709,7 +728,8 @@
      }
   }
   avg_iou = avg_iou / (tp_for_thresh + fp_for_thresh);
   if((tp_for_thresh + fp_for_thresh) > 0)
      avg_iou = avg_iou / (tp_for_thresh + fp_for_thresh);
   
   // SORT(detections)
@@ -841,6 +861,11 @@
void calc_anchors(char *datacfg, int num_of_clusters, int width, int height, int show)
{
   printf("\n num_of_clusters = %d, width = %d, height = %d \n", num_of_clusters, width, height);
   if (width < 0 || height < 0) {
      printf("Usage: darknet detector calc_anchors data/voc.data -num_of_clusters 9 -width 416 -height 416 \n");
      printf("Error: set width and height \n");
      return;
   }
   //float pointsdata[] = { 1,1, 2,2, 6,6, 5,5, 10,10 };
   float *rel_width_height_array = calloc(1000, sizeof(float));
@@ -861,8 +886,10 @@
      find_replace(path, "images", "labels", labelpath);
      find_replace(labelpath, "JPEGImages", "labels", labelpath);
      find_replace(labelpath, ".jpg", ".txt", labelpath);
      find_replace(labelpath, ".JPEG", ".txt", labelpath);
      find_replace(labelpath, ".png", ".txt", labelpath);
      find_replace(labelpath, ".bmp", ".txt", labelpath);
      find_replace(labelpath, ".JPG", ".txt", labelpath);
      find_replace(labelpath, ".JPEG", ".txt", labelpath);
      int num_labels = 0;
      box_label *truth = read_boxes(labelpath, &num_labels);
      //printf(" new path: %s \n", labelpath);
@@ -1036,7 +1063,8 @@
    while(1){
        if(filename){
            strncpy(input, filename, 256);
         if (input[strlen(input) - 1] == 0x0d) input[strlen(input) - 1] = 0;
         if(strlen(input) > 0)
            if (input[strlen(input) - 1] == 0x0d) input[strlen(input) - 1] = 0;
        } else {
            printf("Enter Image Path: ");
            fflush(stdout);
@@ -1046,8 +1074,8 @@
        }
        image im = load_image_color(input,0,0);
      int letterbox = 0;
        image sized = resize_image(im, net.w, net.h);
      //image sized = letterbox_image(im, net.w, net.h); letterbox = 1;
        //image sized = resize_image(im, net.w, net.h);
      image sized = letterbox_image(im, net.w, net.h); letterbox = 1;
        layer l = net.layers[net.n-1];
        //box *boxes = calloc(l.w*l.h*l.n, sizeof(box));
@@ -1057,7 +1085,7 @@
        float *X = sized.data;
        time= what_time_is_it_now();
        network_predict(net, X);
      //network_predict_image(&net, im);
      //network_predict_image(&net, im); letterbox = 1;
        printf("%s: Predicted in %f seconds.\n", input, (what_time_is_it_now()-time));
        //get_region_boxes(l, 1, 1, thresh, probs, boxes, 0, 0);
      // if (nms) do_nms_sort_v2(boxes, probs, l.w*l.h*l.n, l.classes, nms);
@@ -1084,6 +1112,22 @@
#endif
        if (filename) break;
    }
   // free memory
   free_ptrs(names, net.layers[net.n - 1].classes);
   free_list(options);
   int i;
   const int nsize = 8;
   for (j = 0; j < nsize; ++j) {
      for (i = 32; i < 127; ++i) {
         free_image(alphabet[j][i]);
      }
      free(alphabet[j]);
   }
   free(alphabet);
   free_network(net);
}
void run_detector(int argc, char **argv)
@@ -1099,8 +1143,8 @@
    int cam_index = find_int_arg(argc, argv, "-c", 0);
    int frame_skip = find_int_arg(argc, argv, "-s", 0);
   int num_of_clusters = find_int_arg(argc, argv, "-num_of_clusters", 5);
   int width = find_int_arg(argc, argv, "-width", 13);
   int heigh = find_int_arg(argc, argv, "-heigh", 13);
   int width = find_int_arg(argc, argv, "-width", -1);
   int height = find_int_arg(argc, argv, "-height", -1);
    if(argc < 4){
        fprintf(stderr, "usage: %s %s [train/test/valid] [cfg] [weights (optional)]\n", argv[0], argv[1]);
        return;
@@ -1134,21 +1178,23 @@
    char *cfg = argv[4];
    char *weights = (argc > 5) ? argv[5] : 0;
   if(weights)
      if (weights[strlen(weights) - 1] == 0x0d) weights[strlen(weights) - 1] = 0;
      if(strlen(weights) > 0)
         if (weights[strlen(weights) - 1] == 0x0d) weights[strlen(weights) - 1] = 0;
    char *filename = (argc > 6) ? argv[6]: 0;
    if(0==strcmp(argv[2], "test")) test_detector(datacfg, cfg, weights, filename, thresh, hier_thresh, dont_show);
    else if(0==strcmp(argv[2], "train")) train_detector(datacfg, cfg, weights, gpus, ngpus, clear, dont_show);
    else if(0==strcmp(argv[2], "valid")) validate_detector(datacfg, cfg, weights, outfile);
    else if(0==strcmp(argv[2], "recall")) validate_detector_recall(datacfg, cfg, weights);
   else if(0==strcmp(argv[2], "map")) validate_detector_map(datacfg, cfg, weights, thresh);
   else if(0==strcmp(argv[2], "calc_anchors")) calc_anchors(datacfg, num_of_clusters, width, heigh, show);
   else if(0==strcmp(argv[2], "calc_anchors")) calc_anchors(datacfg, num_of_clusters, width, height, show);
    else if(0==strcmp(argv[2], "demo")) {
        list *options = read_data_cfg(datacfg);
        int classes = option_find_int(options, "classes", 20);
        char *name_list = option_find_str(options, "names", "data/names.list");
        char **names = get_labels(name_list);
      if(filename)
         if (filename[strlen(filename) - 1] == 0x0d) filename[strlen(filename) - 1] = 0;
         if(strlen(filename) > 0)
            if (filename[strlen(filename) - 1] == 0x0d) filename[strlen(filename) - 1] = 0;
        demo(cfg, weights, thresh, hier_thresh, cam_index, filename, names, classes, frame_skip, prefix, out_filename,
         http_stream_port, dont_show);
    }