科研常用的實驗數據分析與處理方法
對于每個科研工作者而言,對實驗數據進行處理是在開始論文寫作之前十分常見的工作之一。但是,常見的數據分析方法有哪些呢?常用的數據分析方法有:聚類分析、因子分析、相關分析、對應分析、回歸分析、方差分析。
1、聚類分析(Cluster Analysis)
聚類分析指將物理或抽象對象的集合分組成為由類似的對象組成的多個類的分析過程。聚類是將數據分類到不同的類或者簇這樣的一個過程,所以同一個簇中的對象有很大的相似性,而不同簇間的對象有很大的相異性。聚類分析是一種探索性的分析,在分類的過程中,人們不必事先給出一個分類的標準,聚類分析能夠從樣本數據出發,自動進行分類。聚類分析所使用方法的不同,常常會得到不同的結論。不同研究者對于同一組數據進行聚類分析,所得到的聚類數未必一致。
2、因子分析(Factor Analysis)
因子分析是指研究從變量群中提取共性因子的統計技術。因子分析就是從大量的數據中尋找內在的聯系,減少決策的困難。因子分析的方法約有10多種,如重心法、影像分析法,最大似然解、最小平方法、阿爾發抽因法、拉奧典型抽因法等等。這些方法本質上大都屬近似方法,是以相關系數矩陣為基礎的,所不同的是相關系數矩陣對角線上的值,采用不同的共同性□2估值。在社會學研究中,因子分析常采用以主成分分析為基礎的反覆法。
3、相關分析(Correlation Analysis)
相關分析(correlation analysis),相關分析是研究現象之間是否存在某種依存關系,并對具體有依存關系的現象探討其相關方向以及相關程度。相關關系是一種非確定性的關系,例如,以X和Y分別記一個人的身高和體重,或分別記每公頃施肥量與每公頃小麥產量,則X與Y顯然有關系,而又沒有確切到可由其中的一個去精確地決定另一個的程度,這就是相關關系。
4、對應分析(Correspondence Analysis)
對應分析(Correspondence analysis)也稱關聯分析、R-Q型因子分析,通過分析由定性變量構成的交互匯總表來揭示變量間的聯系。可以揭示同一變量的各個類別之間的差異,以及不同變量各個類別之間的對應關系。對應分析的基本思想是將一個聯列表的行和列中各元素的比例結構以點的形式在較低維的空間中表示出來。
5、回歸分析
研究一個隨機變量Y對另一個(X)或一組(X1,X2,?,Xk)變量的相依關系的統計分析方法。回歸分析(regression analysis)是確定兩種或兩種以上變數間相互依賴的定量關系的一種統計分析方法。運用十分廣泛,回歸分析按照涉及的自變量的多少,可分為一元回歸分析和多元回歸分析;按照自變量和因變量之間的關系類型,可分為線性回歸分析和非線性回歸分析。
6、方差分析(ANOVA/Analysis of Variance)
又稱“變異數分析”或“F檢驗”,是R.A.Fisher發明的,用于兩個及兩個以上樣本均數差別的顯著性檢驗。由于各種因素的影響,研究所得的數據呈現波動狀。造成波動的原因可分成兩類,一是不可控的隨機因素,另一是研究中施加的對結果形成影響的可控因素。方差分析是從觀測變量的方差入手,研究諸多控制變量中哪些變量是對觀測變量有顯著影響的變量。
列表法
實驗數據的處理自然離不開繪制成表。那么,常見的實驗數據處理表格體現方式分為兩種:列表法和作圖法。
列表法就是將一組實驗數據和計算的中間數據依據一定的形式和順序列成表格。列表法可以簡單明確地表示出物理量之間的對應關系,便于分析和發現資料的規律性,也有助于檢查和發現實驗中的問題,這就是列表法的優點。設計記錄表格時要做到:
(1)表格設計要合理,以利于記錄、檢查、運算和分析。
(2)表格中涉及的各物理量,其符號、單位及量值的數量級均要表示清楚。但不要把單位寫在數字后。
(3)表中數據要正確反映測量結果的有效數字和不確定度。列入表中的除原始數據外,計算過程中的一些中間結果和最后結果也可以列入表中。
(4)表格要加上必要的說明。實驗室所給的數據或查得的單項數據應列在表格的上部,說明寫在表格的下部。
作圖法
作圖法是在坐標紙上用圖線表示物理量之間的關系,揭示物理量之間的聯系。作圖法既有簡明、形象、直觀、便于比較研究實驗結果等優點,它是一種最常用的數據處理方法。作圖法的基本規則是:
(1)根據函數關系選擇適當的坐標紙(如直角坐標紙,單對數坐標紙,雙對數坐標紙,極坐標紙等)和比例,畫出坐標軸,標明物理量符號、單位和刻度值,并寫明測試條件。
(2)坐標的原點不一定是變量的零點,可根據測試范圍加以選擇。,坐標分格最好使最低數字的一個單位可靠數與坐標最小分度相當。縱橫坐標比例要恰當,以使圖線居中。
(3)描點和連線。根據測量數據,用直尺和筆尖使其函數對應的實驗點準確地落在相應的位置。一張圖紙上畫上幾條實驗曲線時,每條圖線應用不同的標記如“+”、“×”、“·”、“Δ”等符號標出,以免混淆。連線時,要顧及到數據點,使曲線呈光滑曲線(含直線),并使數據點均勻分布在曲線(直線)的兩側,且盡量貼近曲線。個別偏離過大的點要重新審核,屬過失誤差的應剔去。
(4)標明圖名,即做好實驗圖線后,應在圖紙下方或空白的明顯位置處,寫上圖的名稱、作者和作圖日期,有時還要附上簡單的說明,如實驗條件等,使讀者一目了然。作圖時,一般將縱軸代表的物理量寫在前面,橫軸代表的物理量寫在后面,中間用“~”聯接。