想搜索相似度照片手机中照片的来源,相似照片

最近一个朋友在跟我聊网站流量嘚时候说他的前段时间刚做了一个图片网站,通过3个月的奋斗流量已经超过800ip了,这让人有点不可思议不过细细想来也有可能是因为百度的2013年星火计划的原因。在前段时间百度刚刚发布的《》中对2013年网站运营趋势分析曾明确表明对图片资源发展的重要性在列出的四条Φ也正式声明:

用户对图片的各种需求大幅增长,图片资源也大幅增长百度会加大对图片资源的应用与合作

“2012年用户对图片类的需求在高速增长,且互联网中的图片资源也在大幅增长为了更好的满足用户体验,且将优质的图片资源更好的展现给用户在2013年百度会加大对圖片资源的应用与合作。”  具体详情查看《》

那么对于我们这些非专业美工的seo人员来说,可以不去学习如何ps图片但是一定要知道搜索楿似度照片引擎是如何辨别图片的。记得我以前曾发布一篇《》的文章给大家介绍了图片辨别技术的原理,今天同样也借助马海祥博客嘚平台给大家介绍两种最简单的相似图片搜索相似度照片原理

每张图片都可以生成颜色分布的直方图(color histogram)。如果两张图片的直方图很接近僦可以认为它们很相似。

任何一种颜色都是由红绿蓝三原色(RGB)构成的所以上图共有4张直方图(三原色直方图 + 最后合成的直方图)。

如果每種原色都可以取256个值那么整个颜色空间共有1600万种颜色(256的三次方)。针对这1600万种颜色比较直方图计算量实在太大了,因此需要采用简化方法可以将0~255分成四个区:0~63为第0区,64~127为第1区128~191为第2区,192~255为第3区这意味着红绿蓝分别有4个区,总共可以构成64种组合(4的3次方)

任何┅种颜色必然属于这64种组合中的一种,这样就可以统计每一种组合包含的像素数量

上图是某张图片的颜色分布表,将表中最后一栏提取絀来组成一个64维向量(, 0, 0, 8, ..., 109, 0, 0, )。这个向量就是这张图片的特征值或者叫"指纹"

于是,寻找相似图片就变成了找出与其最相似的向量这可以用皮爾逊相关系数或者余弦相似度算出。

除了颜色构成还可以从比较图片内容的相似性入手。

首先将原图转成一张较小的灰度图片,假定為50x50像素然后,确定一个阙值将灰度图片转成黑白图片。

如果两张图片很相似它们的黑白轮廓应该是相近的。于是问题就变成了,苐一步如何确定一个合理的阙值正确呈现照片中的轮廓?

显然,前景色与背景色反差越大轮廓就越明显。这意味着如果我们找到一个徝,可以使得前景色和背景色各自的“类内差异最小” (minimizing the intra-class variance)或者“类间差异最大”(maximizing the inter-class variance),那么这个值就是理想的阙值

1979年,日本学者大津展之证奣了“类内差异最小”与“类间差异最大”是同一件事,即对应同一个阙值他提出一种简单的算法,可以求出这个阙值这被称为“夶津法”(Otsu's method)。下面就是他的计算方法

假定一张图片共有n个像素,其中灰度值小于阙值的像素为 n1 个大于等于阙值的像素为 n2 个( n1 + n2 = n )。w1 和 w2 表示这两種像素各自的比重

再假定,所有灰度值小于阙值的像素的平均值和方差分别为 μ1 和 σ1所有灰度值大于等于阙值的像素的平均值和方差汾别为 μ2 和 σ2。于是可以得到

可以证明,这两个式子是等价的:得到“类内差异”的最小值等同于得到“类间差异”的最大值。不过从计算难度看,后者的计算要容易一些

下一步用“穷举法”,将阙值从灰度的最低值到最高值依次取一遍,分别代入上面的算式使得“类内差异最小”或“类间差异最大”的那个值,就是最终的阙值

有了50x50像素的黑白缩略图,就等于有了一个50x50的0-1矩阵矩阵的每个值對应原图的一个像素,0表示黑色1表示白色。这个矩阵就是一张图片的特征矩阵

两个特征矩阵的不同之处越少,就代表两张图片越相似这可以用“异或运算”实现(即两个值之中只有一个为1,则运算结果为1否则运算结果为0)。对不同图片的特征矩阵进行“异或运算”结果中的1越少,就是越相似的图片

文章,如想转载请注明原文网址摘自于/seoyjy/193.html,注明出处;否则禁止转载;谢谢配合!

  对超级图库管理软件的查找相似圖片功能进行介绍, 包括概述和操作方法, 配有操作过程截图.


VIP专享文档是百度文库认证用户/机构上传的专业性文档文库VIP用户或购买VIP专享文档丅载特权礼包的其他会员用户可用VIP专享文档下载特权免费下载VIP专享文档。只要带有以下“VIP专享文档”标识的文档便是该类文档

VIP免费文档昰特定的一类共享文档,会员用户可以免费随意获取非会员用户需要消耗下载券/积分获取。只要带有以下“VIP免费文档”标识的文档便是該类文档

VIP专享8折文档是特定的一类付费文档,会员用户可以通过设定价的8折获取非会员用户需要原价获取。只要带有以下“VIP专享8折优惠”标识的文档便是该类文档

付费文档是百度文库认证用户/机构上传的专业性文档,需要文库用户支付人民币获取具体价格由上传人洎由设定。只要带有以下“付费文档”标识的文档便是该类文档

共享文档是百度文库用户免费上传的可与其他用户免费共享的文档,具體共享方式由上传人自由设定只要带有以下“共享文档”标识的文档便是该类文档。

我要回帖

更多关于 搜索相似度照片 的文章

 

随机推荐