Saliency Detection是指检测一副图像/视频截图中最能吸引人注意力的区域的技术,通常基于某区域与周围区域的差别的程度来定义saliency值的大小。不同模型中的saliency值定义不一样,主要有以下几个大类的模型:
1.基于各个特征(比如颜色、灰度、方向)center-surround contrast的大小来定义。
2.基于图像的复杂度来定义。
3.基于频谱分析的方法。
以下为参考的资料:
Scholapedia
http://www.scholarpedia.org/article/Visual_salience
computational modelling of visual attention. Itti.
www.cnbc.cmu.edu/~tai/readings/tom/itti_attention.pdf
Saliency Based on Information Maximization. Bruce
www.citeulike.org/user/jborn/article/3366681
Saliency Detection: A Spectral Residual Approach
bcmi.sjtu.edu.cn/~houxiaodi/papers/cvpr07.pdf
2009年4月27日星期一
2009年4月20日星期一
Manifold Alignment Using Procrustes Analysis
icml08的文章,作者将统计学中做形状分析的一种叫Procrustes analysis的方法用于流形对齐 - 基于流形的两组数据通过一定数量标定点的训练,形成两组数据在整个流形上的对应关系。这种方法可以运用在知识的迁移(例如基于不同语言文档的对应查询、马尔可夫决策过程等等)。
Procrustes Analysis的主要思想就是将一组数据通过旋转、放缩、平移等变换使它和另一组数据形成最优的对应,它的特点是计算量较小,并且保持了流形的基本结构。
文章还详细介绍了几个应用:跨语言文档查询,马尔科夫决策过程中的迁移学习。
Procrustes Analysis 常用于步态识别.
相关文献可参阅: http://icml2008.cs.helsinki.fi/papers/229.pdf
Procrustes Analysis的主要思想就是将一组数据通过旋转、放缩、平移等变换使它和另一组数据形成最优的对应,它的特点是计算量较小,并且保持了流形的基本结构。
文章还详细介绍了几个应用:跨语言文档查询,马尔科夫决策过程中的迁移学习。
Procrustes Analysis 常用于步态识别.
相关文献可参阅: http://icml2008.cs.helsinki.fi/papers/229.pdf
Human Gait Recognition With Matrix Representation
PCA作为模式识别的常用方法,也存在着诸多不足之处。比如依然存在curse of dimensionality。又比如说在生物识别诸如人脸识别,步态识别等应用中,常遇到小样本问题,而要处理的数据维数又比较大,PCA有时不能有效地提取主要特征。
本篇论文中【1】,作者提出了一个CSA+DATER的scheme,替代传统的PCA+LDA的scheme,并成功地应用于人脸识别、步态识别等领域。这个方法组合的一个很重要的观点就是用矩阵(二阶张量)来表示原始数据——而不是如PCA常见的那样,用一个列向量来表示原始数据——这样,可以缓解“维数灾”带来的影响,以及在小样本的条件下更有效的提取主要信息。在论文最后的实验中,我们也可以看到,这种方法识别效果也是不错的。
[1]IEEE TRANSACTIONS ON CIRCUITS AND SYSTEMS FOR VIDEO TECHNOLOGY, VOL. 16, NO. 7, JULY 2006
Human Gait Recognition With Matrix Representation
Dong Xu, Shuicheng Yan, Dacheng Tao, Lei Zhang, Xuelong Li, and Hong-Jiang Zhang
本篇论文中【1】,作者提出了一个CSA+DATER的scheme,替代传统的PCA+LDA的scheme,并成功地应用于人脸识别、步态识别等领域。这个方法组合的一个很重要的观点就是用矩阵(二阶张量)来表示原始数据——而不是如PCA常见的那样,用一个列向量来表示原始数据——这样,可以缓解“维数灾”带来的影响,以及在小样本的条件下更有效的提取主要信息。在论文最后的实验中,我们也可以看到,这种方法识别效果也是不错的。
[1]IEEE TRANSACTIONS ON CIRCUITS AND SYSTEMS FOR VIDEO TECHNOLOGY, VOL. 16, NO. 7, JULY 2006
Human Gait Recognition With Matrix Representation
Dong Xu, Shuicheng Yan, Dacheng Tao, Lei Zhang, Xuelong Li, and Hong-Jiang Zhang
2009年4月19日星期日
2009年4月13日星期一
Fast Image/Video Upsampling
本文发表于sa08,文章提出了一种基于图像成像过程(Image Formation Process)的提升采样算法,可以应用于图像与视频超分。文章主要的idea是使用一个反馈网络(包括逆卷积,重新计算卷积,像素替换,其中像素替换过程是本文的一个创新点)对原始图像进行迭代计算,文中提出的算法可以较好的保持原图的局部结构信息。与其他的算法相比,本文的算法有如下好处:
- 不需要额外的训练数据来学习一些结构特征,因此应用范围较广,但是与基于学习的算法相比对原始图像的要求更高;
- 尽管算法设计是基于图像成像过程的提升采样,但是算法对其他模型的效果也很好,甚至可以直接应用到视频的提升采样中,并且在保持连贯性上表现十分出色;
- 这个算法的效率很高,可以推广到实时计算上。
2009年4月9日星期四
增加 LaTeX 公式支持
现在可以使用如下方式插入
\text{\LaTeX} 公式,- 使用行间公式可以用 HTML 的 pre 环境,<pre lang="eq.latex">Your Equation Here</pre>,如
(a + b)^n = \sum_{i = 0}^n \binom{n}{i} a^i b^{n - i}. - 使用行内公式可以用 HTML 的 code 环境,<code lang="eq.latex">Your Equation Here</code>,如
\inline \sum_{n = 1}^\infty \frac{1}{n^2} = \frac{\pi^2}{6}。
订阅:
博文 (Atom)