YOLO Caffe模型转换BN的坑

栏目: 数据库 · 发布时间: 7年前

内容简介：YOLO虽好，但是Darknet框架实在是小众，有必要在Inference阶段将其转换为其他框架，以便后续统一部署和管理。Caffe作为小巧灵活的老资格框架，使用灵活，方便魔改，所以尝试将Darknet训练的YOLO模型转换为Caffe。这里简单记录下YOLO V3 原始Darknet模型转换为Caffe模型过程中的一个坑。以CPU代码为例，在Darknet中，BN做normalization的操作如下，可以看到，Darknet中的BN计算如下：

YOLO虽好，但是Darknet框架实在是小众，有必要在Inference阶段将其转换为其他框架，以便后续统一部署和管理。Caffe作为小巧灵活的老资格框架，使用灵活，方便魔改，所以尝试将Darknet训练的YOLO模型转换为Caffe。这里简单记录下YOLO V3 原始Darknet模型转换为Caffe模型过程中的一个坑。

Darknet中BN的计算

以CPU代码为例，在Darknet中，BN做normalization的操作如下， normalize_cpu

void normalize_cpu(float *x, float *mean, float *variance, int batch, int filters, int spatial)
{
    int b, f, i;
    for(b = 0; b < batch; ++b){
        for(f = 0; f < filters; ++f){
            for(i = 0; i < spatial; ++i){
                int index = b*filters*spatial + f*spatial + i;
                x[index] = (x[index] - mean[f])/(sqrt(variance[f]) + .000001f);
            }
        }
    }
}

可以看到，Darknet中的BN计算如下：

而且，$\epsilon$参数是固定的，为$1\times 10^{-6}$。

问题和解决

然而，在Caffe（以及大部分其他框架）中，$\epsilon$的位置是在根号里面的，也就是：

另外，查看 caffe.proto 可以知道，Caffe默认的$\epsilon$值为$1\times 10^{-5}$。

所以，在转换为caffe prototxt时，需要设置 batch_norm_param 如下：

batch_norm_param {
  use_global_stats: true
  eps: 1e-06
}

另外，需要重新求解$\sigma^2$，按照layer输出要相等的等量关系，可以求得：

def convert_running_var(var, eps=DARKNET_EPS):
    return np.square(np.sqrt(var) + eps) - eps

这里调整之后，转换后的Caffe模型和原始Darknet模型的输出误差已经是$1\times 10^{-7}$量级，可以认为转换成功。

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持码农网

查看所有标签

猜你喜欢:

本站部分资源来源于网络，本站转载出于传递更多信息之目的，版权归原作者或者来源机构所有，如转载稿涉及版权问题，请联系我们。

码农书籍

如何不在网上虚度人生

[美] 肯尼思·戈德史密斯 / 刘畅 / 北京联合出版公司 / 2017-9 / 39.80元

我们平时上网多大程度上是浪费时间，多大程度是在学习、关心社会、激发创造力？我们真能彻底断网，逃离社交网络吗？手机把都市人变成一群电子僵尸，是福是祸？浏览记录就是我们将来的回忆录吗？文件归档属于一种现代民间艺术？不自拍、P图、发朋友圈，我还是我吗？美国知名概念艺术家戈德史密斯认为：上网绝不是浪费时间，而是一种创造性的活动。在本书中他以跨学科角度、散文式语言进行论证，涉及大众传播学、计算......一起来看看《如何不在网上虚度人生》这本书的介绍吧!

码农工具

YOLO Caffe模型转换BN的坑

Darknet中BN的计算

问题和解决

如何不在网上虚度人生

图片转BASE64编码

XML 在线格式化

UNIX 时间戳转换