内容简介:YOLO虽好,但是Darknet框架实在是小众,有必要在Inference阶段将其转换为其他框架,以便后续统一部署和管理。Caffe作为小巧灵活的老资格框架,使用灵活,方便魔改,所以尝试将Darknet训练的YOLO模型转换为Caffe。这里简单记录下YOLO V3 原始Darknet模型转换为Caffe模型过程中的一个坑。以CPU代码为例,在Darknet中,BN做normalization的操作如下,可以看到,Darknet中的BN计算如下:
YOLO虽好,但是Darknet框架实在是小众,有必要在Inference阶段将其转换为其他框架,以便后续统一部署和管理。Caffe作为小巧灵活的老资格框架,使用灵活,方便魔改,所以尝试将Darknet训练的YOLO模型转换为Caffe。这里简单记录下YOLO V3 原始Darknet模型转换为Caffe模型过程中的一个坑。
Darknet中BN的计算
以CPU代码为例,在Darknet中,BN做normalization的操作如下, normalize_cpu
void normalize_cpu(float *x, float *mean, float *variance, int batch, int filters, int spatial)
{
int b, f, i;
for(b = 0; b < batch; ++b){
for(f = 0; f < filters; ++f){
for(i = 0; i < spatial; ++i){
int index = b*filters*spatial + f*spatial + i;
x[index] = (x[index] - mean[f])/(sqrt(variance[f]) + .000001f);
}
}
}
}
可以看到,Darknet中的BN计算如下:
而且,$\epsilon$参数是固定的,为$1\times 10^{-6}$。
问题和解决
然而,在Caffe(以及大部分其他框架)中,$\epsilon$的位置是在根号里面的,也就是:
另外,查看 caffe.proto
可以知道,Caffe默认的$\epsilon$值为$1\times 10^{-5}$。
所以,在转换为caffe prototxt时,需要设置 batch_norm_param
如下:
batch_norm_param {
use_global_stats: true
eps: 1e-06
}
另外,需要重新求解$\sigma^2$,按照layer输出要相等的等量关系,可以求得:
def convert_running_var(var, eps=DARKNET_EPS):
return np.square(np.sqrt(var) + eps) - eps
这里调整之后,转换后的Caffe模型和原始Darknet模型的输出误差已经是$1\times 10^{-7}$量级,可以认为转换成功。
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持 码农网
猜你喜欢:- 文本挖掘从小白到精通(三)---主题模型和文本数据转换
- 一文看懂如何使用模型转换工具X2Paddle
- 小米开源语音模型 Kaldi-ONNX 转换工具,助力移动端部署!
- 飞桨上线万能转换小工具,教你玩转TensorFlow、Caffe等模型迁移
- 飞桨万能转换小工具X2Paddle,教你玩转模型迁移
- 更自由的GAN图像联想:无监督跨类的图像转换模型FUNIT,英伟达&&康奈尔大学
本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们。
如何不在网上虚度人生
[美] 肯尼思·戈德史密斯 / 刘畅 / 北京联合出版公司 / 2017-9 / 39.80元
我们平时上网多大程度上是浪费时间,多大程度是在学习、关心社会、激发创造力?我们真能彻底断网,逃离社交网络吗? 手机把都市人变成一群电子僵尸,是福是祸? 浏览记录就是我们将来的回忆录吗?文件归档属于一种现代民间艺术? 不自拍、P图、发朋友圈,我还是我吗? 美国知名概念艺术家戈德史密斯认为:上网绝不是浪费时间,而是一种创造性的活动。在本书中他以跨学科角度、散文式语言进行论证,涉及大众传播学、计算......一起来看看 《如何不在网上虚度人生》 这本书的介绍吧!