2008年10月19日 星期日

OpenCV統計應用-CvHistogram直方圖資料結構

CvHistogram可以提供直方圖的計算,並且可以支援多個維度的直方圖設計,但是在繪製直方圖圖形的時候就需要自己用繪圖函式來繪製,CvHistogram算是一個比較複雜的資料結構,由於它在維度小於二的可以用密集的資料結構,CvMatND來設計,可以當它的直方圖維度大於二的時候,就必須要用到稀疏矩陣,CvSparseMat的方式,下面就是用CvHistogram結構計算一維直方圖的例子

CvHistogram一維設計
#include <cv.h>
#include <highgui.h>
#include <stdio.h>


int HistogramBins = 256;
float HistogramRange1[2]={0,255};
float *HistogramRange[1]={&HistogramRange1[0]};

int main()
{
    IplImage *Image1;
    CvHistogram *Histogram1;
    IplImage *HistogramImage1;

    Image1=cvLoadImage("Riverbank.jpg",0);

    Histogram1 = cvCreateHist(1,&HistogramBins,CV_HIST_ARRAY,HistogramRange);
    HistogramImage1 = cvCreateImage(cvSize(256,300),8,3);
    HistogramImage1->origin=1;

    cvCalcHist(&Image1,Histogram1);

    printf("type is : %d\n",Histogram1->type);
    printf("Low Bound is : %.f\n",Histogram1->thresh[0][0]);
    printf("Up Bound is : %.f\n",Histogram1->thresh[0][1]);
    printf("The Bins are : %d\n",((CvMatND *) Histogram1->bins)->dim[0].size);

    printf("\nGray Level Values:\n");
    for(int i=0;i<HistogramBins;i++)
    {
        printf("%.f \n",((CvMatND *) Histogram1->bins)->data.fl[i]);
        cvLine(HistogramImage1,cvPoint(i,0),cvPoint(i,(int)(cvQueryHistValue_1D(Histogram1,i)/10)),CV_RGB(127,127,127));
    }

    cvNamedWindow("Histogram",1);
    cvNamedWindow("Riverbank",1);
    cvShowImage("Riverbank",Image1);
    cvShowImage("Histogram",HistogramImage1);
    cvWaitKey(0);
}

原始圖片:


執行結果:


跟前面直接用矩陣累加設計出的統計直方圖一樣,到最後還是要自己用繪圖函式自己畫,CvHistogram這個資料結構的特色,它可以設定要用幾個區塊來呈現,這邊設立為256個區塊,而實際上,它可以用比較模糊的方式設定直方圖的區域,也就是可以小於256個的區塊數,是利用切割成n等分的方式,然後它可以自行設定上界(Up Bound)以及下界(Low Bound),在灰階圖裡面數據的範圍為0~255,而CvHistogram資料結構可以設立為上界30,下界200這樣的方式縮小範圍,而0~29,201~266這範圍內的數據將不會被計算,下面是CvHistogram資料結構的內容,分別為CV_HIST_ARRAY及CV_HIST_SPARSE兩種

1.


2.


CvHistogram的type固定都為CV_HIST_MAGIC_VAL這的參數,與上面程式cvCreateHist()所設定的CV_HIST_ARRAY無關,這也許是OpenCV裡面對於CvHistogram這個結構設計不良的地方,而對於CvHistogram資料結構的參數,定義如下

#define CV_HIST_ARRAY 0
#define CV_HIST_SPARSE 1
#define CV_HIST_TREE CV_HIST_SPARSE


因此,它的參數只有CV_HIST_ARRAY的多維矩陣CvMatND以及CV_HIST_SPARSE的稀疏矩陣CvSparseMat資料結構,而它的thresh是放上下界的資料,thresh2是放動態的維度上下界資料,而一般的直方圖數據資料都是放在bins裡面.而CvHistogram內的CvMatND結構則是在做快速初始化,bins以及mat都是使用同一個記憶體空間,而將直方圖資料的提取就要用到cvQueryHistValue_1D()這個函式了.

接著是將直方圖的空間分區塊的方式實作,將它分為50塊,並且上界為30,下界為200

CvHistogram結構區塊與上下界
#include <cv.h>
#include <highgui.h>
#include <stdio.h>


int HistogramBins = 50;
int HistogramBinWidth;
float HistogramRange1[2]={30,200};
float *HistogramRange[1]={&HistogramRange1[0]};

int main()
{
    IplImage *Image1;
    CvHistogram *Histogram1;
    IplImage *HistogramImage1;
    CvPoint Point1;
    CvPoint Point2;

    Image1=cvLoadImage("Riverbank.jpg",0);

    Histogram1 = cvCreateHist(1,&HistogramBins,CV_HIST_ARRAY,HistogramRange);
    HistogramImage1 = cvCreateImage(cvSize(256,300),8,3);
    cvSetZero(HistogramImage1);
    HistogramImage1->origin=1;
    HistogramBinWidth=256/HistogramBins;
    printf("The Bolck Width is : %d\n",HistogramBinWidth);
    cvCalcHist(&Image1,Histogram1);

    printf("Gray Level Values:\n");
    for(int i=0;i<HistogramBins;i++)
    {
        printf("%.f \n",((CvMatND *) Histogram1->bins)->data.fl[i]);
        Point1=cvPoint(i*HistogramBinWidth,0);
        Point2=cvPoint((i+1)*HistogramBinWidth,(int)cvQueryHistValue_1D(Histogram1,i)/50);

        cvRectangle(HistogramImage1,Point1,Point2,CV_RGB(127,127,127));
    }

    cvNamedWindow("Histogram",1);
    cvNamedWindow("Riverbank",1);
    cvShowImage("Riverbank",Image1);
    cvShowImage("Histogram",HistogramImage1);
    cvWaitKey(0);
}

執行結果:


因此,這邊就用cvRectangle()的方式來表達,對於CvHistogram這個資料結構,為什麼可以任意定義上下界以及區塊的個數呢?因為CvHistogram使用的是Look-up table(LUT)的方式,也就是查表法,開一個256大小空間的陣列,利用比例的縮放,縮放的數據存入Look-up table裡面,在利用索引的方式對應,而使用Look-up table最大的缺點為,無法取得很精確的數據,由於它是被比例縮放過的,因此除了範圍為256的可以求的完整的數值,LUT的用法會在後面使用到.

對於其他維度的直方圖,它的做法如下

三維直方圖擷取
#include <cv.h>
#include <highgui.h>
#include <stdio.h>


int Histogram3DBins[3] = {256,256,256};
float HistogramRange1[6]={0,255,0,255,0,255};
float *HistogramRange[3]={&HistogramRange1[0],&HistogramRange1[2],&HistogramRange1[4]};

void Print3DHistogram(CvHistogram *Histogram,int BinSize);

int main()
{
    CvHistogram *Histogram1;
    IplImage *Image1=cvLoadImage("Riverbank.jpg",1);
    IplImage *RedImage=cvCreateImage(cvGetSize(Image1),8,1);
    IplImage *GreenImage=cvCreateImage(cvGetSize(Image1),8,1);
    IplImage *BlueImage=cvCreateImage(cvGetSize(Image1),8,1);
    IplImage *ImageArray[3]={RedImage,GreenImage,BlueImage};

    cvSplit(Image1,BlueImage,GreenImage,RedImage,0);
    Histogram1 = cvCreateHist(3,Histogram3DBins,CV_HIST_SPARSE,HistogramRange);

    cvCalcHist(ImageArray,Histogram1);

    printf("3D Historgram Data\n");
    Print3DHistogram(Histogram1,256);

    cvNamedWindow("Riverbank",1);
    cvShowImage("Riverbank",Image1);

    cvWaitKey(0);
}

void Print3DHistogram(CvHistogram *Histogram,int BinSize)
{
    for(int i=0;i<BinSize;i++)
    {
        for(int j=0;j<BinSize;j++)
        {
            for(int k=0;k<BinSize;k++)
            {
                if(cvQueryHistValue_3D(Histogram,i,j,k)>10)
                {
                    printf("%.f\n",cvQueryHistValue_3D(Histogram,i,j,k));
                }
            }
        }
    }
}

執行結果:


上面是三個維度的統計直方圖,分別為R維度,G維度,B維度,並且分別被量化成256等分的區塊,同樣的,也是使用LUT的方法,由於這個統計直方圖非常的大,它所佔的區域為256*256*256的大小,而實際上累積的分佈只有一點點,所以說,對於高維度的統計直方圖就要用到稀疏矩陣,要不然會浪費大量的記憶體空間,但是對於多維度的圖表呈現,OpenCV最多也只能支援到一維的方式,二維的方式可以用OpenGL(glut)呈現,當然高的維度本來就很難用視覺化的方式呈現.

cvCreateHist()
初始化CvHistogram資料結構,可以選擇密集矩陣(CvMatND)CV_HIST_ARRAY以及稀疏矩陣(CvSparseMat)CV_HIST_SPARSE,第一個引數為維度的選擇,第二個引數為要將直方圖切割為多少區塊,第三個引數為選擇cvCreateHist()函數的參數或代號,第四個引數為每一個維度的上下界
cvCreateHist(輸入int型別直方圖維度,輸入int型別直方圖區塊數,輸入參數或代號,輸入每個維度的上下界數據)

cvCalcHist()
計算直方圖累積數據,第一個引數為輸入目標IplImage圖形陣列資料結構,第二個引數輸出為CvHistogram資料結構
cvCalcHist(輸入目標IplImage圖形陣列資料結構,輸出為CvHistogram資料結構)

cvQueryHistValue_1D()
讀取CvHistogram資料結構一維空間的圖形直方圖資料,它在OpenCV的"cvcompat.h"函式庫被定義為

#define cvQueryHistValue_1D( hist, idx0 ) ((float)cvGetReal1D( (hist)->bins, (idx0)))

因此回傳的是float型別的資料,輸入CvHistogram資料結構,以及輸入一維資料結構的Index索引數據
cvQueryHistValue_1D(輸入CvHistogram資料結構,輸入一維int型別數據索引)

cvQueryHistValue_2D()
讀取CvHistogram資料結構二維空間的圖形直方圖資料,它在OpenCV的"cvcompat.h"函式庫被定義為

#define cvQueryHistValue_2D( hist, idx0, idx1 ) ((float)cvGetReal2D( (hist)->bins, (idx0), (idx1)))

回傳float型別的資料,第一個引數為輸入CvHistogram資料結構,第二個引數為輸入二維資料結構的x軸索引數據,第三個引數為y軸索引數據
cvQueryHistValue_2D(輸入CvHistogram資料結構,輸入二維int型別x軸數據索引,輸入二維int型別y軸數據索引)

cvQueryHistValue_3D()
讀取CvHistogram資料結構三維空間的圖形直方圖資料,它在OpenCV的"cvcompat.h"函式庫被定義為

#define cvQueryHistValue_3D( hist, idx0, idx1, idx2 ) ((float)cvGetReal3D( (hist)->bins, (idx0), (idx1), (idx2)))

回傳float型別的資料,第一個引數為輸入CvHistogram資料結構,第二個引數為輸入三維資料結構的x軸索引數據,第三個引數為輸入y軸索引數據,第四個引數為輸入z軸索引數據
cvQueryHistValue_3D(輸入CvHistogram資料結構,輸入三維int型別x軸數據索引,輸入三維int型別y軸數據索引,輸入三維int型別z軸數據索引)



2008年10月11日 星期六

OpenCV統計應用-極端值,cvReduce

在統計模型裡面,總是會有一些特別高或特別低的數值,這個數值已經脫離了統計分配的假設,不符合統計的模型,通常會有這種極大或是極小的極端值(outlier)有可能是因為量測誤差,或是在統計模型中那0.0001的機率發生,因此,在統計學裡,挑出極端值來做最精簡的量測也是很重要的,就好比一群低收入戶的人裡面出現了一位身價上億的人而拉高了一群人的平均所得,使得低收入戶的族群變成中高收入的族群,這邊要抓取那個最大最小值就用到了cvMinMaxLoc()的函式啦.在圖片裡面,也許很難有如此極端的事件產生,cvMinMaxLoc()可以處理一般的數據,亦可以處理圖片找出它最大最小值以及它的位置.

cvMinMaxLoc()的實作
#include <cv.h>
#include <highgui.h>
#include <stdio.h>


int main()
{
    IplImage *Image1=cvLoadImage("grotto.jpg",1);

    double MinValue;
    double MaxValue;

    CvPoint MinLocation;
    CvPoint MaxLocation;

    cvSetImageCOI(Image1,1);
    cvMinMaxLoc(Image1,&MinValue,&MaxValue,&MinLocation,&MaxLocation);

    printf("The Min number is : %.f\n",MinValue);
    printf("The position is : ( %d , %d )\n",MinLocation.x,MinLocation.y);
    printf("The Max number is : %.f\n",MaxValue);
    printf("The position is : (%d , %d )\n",MaxLocation.x,MaxLocation.y);

    cvNamedWindow("grotto",1);
    cvShowImage("grotto",Image1);
    cvWaitKey(0);
}

執行結果:


上面的結果是抓出這張圖片最大最小值的數據,選擇綠色這個通道,雖然這已經不算是極端值的意義了,不過它仍然是可以對一般圖形做處理,cvMinMaxLoc()可以同時找出最大最小值,也可以指出最大值的位置跟最小值的位置,而cvMinMaxLoc()必須對單通道做處理因此必須要用,cvSetImageCOI選定顏色,也可以支援ROI,甚至,cvMinMaxLoc()可以用遮罩的方式實作,使用的方法如下

#include <cv.h>
#include <highgui.h>
#include <stdio.h>


int main()
{
    IplImage *Image1=cvLoadImage("grotto.jpg",1);
    IplImage *MaskImage1=cvLoadImage("grotto_Threshold.bmp",0);
    double MinValue;
    double MaxValue;

    CvPoint MinLocation;
    CvPoint MaxLocation;

    cvSetImageCOI(Image1,1);
    cvMinMaxLoc(Image1,&MinValue,&MaxValue,&MinLocation,&MaxLocation,MaskImage1);

    printf("The Min number is : %.f\n",MinValue);
    printf("The position is : ( %d , %d )\n",MinLocation.x,MinLocation.y);
    printf("The Max number is : %.f\n",MaxValue);
    printf("The position is : (%d , %d )\n",MaxLocation.x,MaxLocation.y);

    cvNamedWindow("grotto",1);
    cvShowImage("grotto",Image1);
    cvWaitKey(0);
}

執行結果:


上面的程式也只對grotto_Threshold.bmp白色的部份做處理,從白色區域找出它的最大最小值以及它的位置,跟前面的程式差不多.

cvReduce()為將矩陣維度降低為向量的維度,也就勢將該行或該列做加總,平均,找出最大,最小值,cvReduce()可使用的參數或代號如下

#define CV_REDUCE_SUM 0
#define CV_REDUCE_AVG 1
#define CV_REDUCE_MAX 2
#define CV_REDUCE_MIN 3


而它的數據要從圖形縮成行或縮成列,則輸入的向量就必須要跟它的行或列相等長度,而且是一維的形式,下面這個是求出每一列的RGB值的平均數,並且用圖表的方式

cvReduce()平均數向量
#include <cv.h>
#include <highgui.h>
#include <stdio.h>


int main()
{
    IplImage *Image1=cvLoadImage("grotto.jpg",1);
    IplImage *AVGImage=cvCreateImage(cvSize(Image1->width,255),IPL_DEPTH_8U,3);
    CvMat *AVGVector=cvCreateMat(1,Image1->width,CV_32FC3);

    cvReduce(Image1,AVGVector,0,CV_REDUCE_AVG);


    for(int i=0;i<Image1->width;i++)
    {
        printf("%f\t%f\t%f\t\n",cvGet1D(AVGVector,i).val[0],cvGet1D(SumVector,i).val[1],cvGet1D(SumVector,i).val[2]);
        if(i!=Image1->width-1)
        {
            cvLine(AVGImage,cvPoint(i,(int)cvGet1D(AVGVector,i).val[0]),cvPoint(i+1,(int)cvGet1D(AVGVector,i+1).val[0]),CV_RGB(0,0,255));
            cvLine(AVGImage,cvPoint(i,(int)cvGet1D(AVGVector,i).val[1]),cvPoint(i+1,(int)cvGet1D(AVGVector,i+1).val[1]),CV_RGB(0,255,0));
            cvLine(AVGImage,cvPoint(i,(int)cvGet1D(AVGVector,i).val[2]),cvPoint(i+1,(int)cvGet1D(AVGVector,i+1).val[2]),CV_RGB(255,0,0));
        }

    }

    cvNamedWindow("grotto",1);
    cvShowImage("grotto",Image1);
    cvNamedWindow("AVG Image",1);
    cvShowImage("AVG Image",AVGImage);

    cvWaitKey(0);
}

執行結果:



cvReduce()可以支援多通道,而AVGVector則是通道三的向量,然後圖表的呈現以cvLine()實作,cvReduce()第一個引數為目標要被統計的圖片,第二個引數為要被計算出來的向量,而第二個引數有一些特殊的規定,它的使用條件如下

1.通道數必須與輸入圖片的數目相同
2.所需要計算的列或欄的長度必須要與輸入圖片
3.一定要用浮點數型別來輸入,如CV_32FC3,CV64FC3,CV_32FC1等,由於uchar型別在做像是CV_REDUCE_SUM時數據一定會超過,因此cvReduce()會做檢查驗證

而且而CV_REDUCE_SUM則是在二值化的圖片的計算比較具有意義,它可以求出二值化圖片的投影向量,並且以圖表的方式呈現.下面就是以列投影以及欄投影的方式來做圖表的呈現.

二值化圖形投影計算
#include <cv.h>
#include <highgui.h>
#include <stdio.h>

int main()
{
    IplImage *Image1=cvLoadImage("grotto_Threshold.bmp",0);
    IplImage *RowProjectionImage=cvCreateImage(cvSize(Image1->width,300),IPL_DEPTH_8U,3);
    IplImage *ColumnProjectionImage=cvCreateImage(cvSize(300,Image1->height),IPL_DEPTH_8U,3);
    CvMat *RowSumVector=cvCreateMat(1,Image1->width,CV_32FC1);
    CvMat *ColumnSumVector=cvCreateMat(Image1->height,1,CV_32FC1);

    RowProjectionImage->origin=1;
    cvReduce(Image1,RowSumVector,0,CV_REDUCE_SUM);
    cvReduce(Image1,ColumnSumVector,1,CV_REDUCE_SUM);

    for(int i=0;i<Image1->width;i++)
    {
        cvLine(RowProjectionImage,cvPoint(i,(int)cvGet1D(RowSumVector,i).val[0]/(2*255)),cvPoint(i,0),CV_RGB(255,255,255));
    }
    for(int i=0;i<Image1->height;i++)
    {
        cvLine(ColumnProjectionImage,cvPoint((int)cvGet1D(ColumnSumVector,i).val[0]/(2*255),i),cvPoint(0,i),CV_RGB(255,255,255));
    }

    cvNamedWindow("grotto Threshold",1);
    cvShowImage("grotto Threshold",Image1);

    cvNamedWindow("Row Projection Image",1);
    cvShowImage("Row Projection Image",RowProjectionImage);

    cvNamedWindow("Column Projection Image",1);
    cvShowImage("Column Projection Image",ColumnProjectionImage);
    cvWaitKey(0);
}

執行結果:


上面的程式,由於是二值化的圖片,只有0跟255,所以必須要將累加的數值除以255才能知道它所累積的個數,在將該數目除以二平移,使他在圖表呈現上不會太大,對於投影的實作,可以藉由選取較高的區間,提出二值化裡面有意義的資料區塊,在人臉辨識可以藉由這種方法提取特定臉部器官的特徵.

cvMinMaxLoc()
找出圖片或一組數據中最大值及最小值的數據,以及最大值及最小值的位置,第一個引數為輸入IplImage資料結構或CvMat資料結構,第二個引數為輸出最小值double型別數據,第三個引數為輸出最大值double型別數據,第四個引數為輸出最小值位置CvPoint資料結構,第五個引數為輸出最大值位置CvPoint資料結構.
cvMinMaxLoc(輸入IplImage或CvMat資料結構,輸出double型別最小值數據,輸出double型別最大值數據,輸出最小值CvPoint資料結構,輸出最大值CvPoint資料結構)

cvReduce()
將二維圖形縮減成列向量或欄向量,cvReduce()具有四個參數,分別為CV_REDUCE_SUM總和,CV_REDUCE_AVG平均,CV_REDUCE_MAX最大值,CV_REDUCE_MIN最小值,可以由多通道的輸入,但輸出的行向量或欄向量一定要符合圖形的長度.第一個引數為輸入目標IplImage資料結構或CvMat資料結構,第二個引數為輸出目標CvMat結構向量,第三個引數為縮減為列向量或欄向量,0為欄向量,1為列向量,第四個引數為cvReduce()的參數或代號.
cvReduce(輸入IplImage或CvMat資料結構,輸出CvMat向量資料結構,輸入縮減欄向量或列向量代號,目標參數或代號)



Copyright 2008-2009,yester