詞彙假說的基本想法
詞彙假說 (Lexical Hypothesis) 是一種取向的理論基礎:把自然語言當成理解人類性格的起點。它的核心主張是「在人類社會生活中重要的個別差異,會被說該語言的人們察覺,最終編碼進語言,成為一個個的詞」。換句話說,某項性格特質對人愈重要,用來表達它的詞彙就應該愈多。這個假說可以追溯到 Francis Galton (1884 年),不過首度把它落實為系統性研究的,是 Gordon Allport 與 Henry Odbert (1936 年)。他們從《韋氏新國際辭典》中抽出約 4,500 個描述性格的詞,而這批詞成了後來五大人格特質研究的起點。
從 Allport 與 Odbert 到 Goldberg
Allport 與 Odbert 抽出的約 4,500 個詞,就這樣直接拿去做因子分析實在太多。1940 年代,Raymond Cattell 把它們整理成約 171 個特質群集,再以因子分析抽出 16 個因子 (16PF)。然而 Cattell 的 16 因子在再現性上有問題;1960 年代,Ernest Tupes 與 Raymond Christal 重新分析 Cattell 的資料,報告了 5 因子結構。這項發現在當時並未受到重視,直到 1980 年代 Lewis Goldberg 獨立進行詞彙研究,確認了同樣的 5 因子結構,並將其命名為「五大人格特質」。Goldberg 的貢獻在於把依循詞彙假說的取向系統化,並推動了英語之外語言的同類研究。此後,德語、荷蘭語、義大利語、日語、中文等許多語言都做過詞彙研究,也一再得到接近 5 因子的結構。不過有些語言報告的是 6 因子或 7 因子的解,因此還不能說任何語言都會出現同樣的 5 個因子。
詞彙假說的意義與批評
詞彙假說最大的意義,在於它提供了一條途徑:性格的結構不是從某位理論家的假設推演出來,而是從人類的集體知識 (也就是語言) 歸納出來。如此一來,建構不受研究者理論偏見左右、以資料為驅動的人格模型才成為可能。不過批評也確實存在。第一,可能有重要的性格特質並未編碼進語言 (例如性取向或某些特定的認知風格)。第二,把研究限定在形容詞,會漏掉那些以動詞或名詞表達的性格面向。第三,語言是文化的產物,因此在某個文化裡不被看重的特質,也就不容易反映在詞彙上。Ashton 與 Lee 的 HEXACO 模型 (6 因子) 便是一例:他們把詞彙研究的範圍拉寬,額外找出了五大模型無法完全捕捉的「誠實-謙遜」因子。從詞彙假說長出來的模型讀起來特別好懂,是因為它本來就是用日常的語言拼起來的。當你讀到關於自己或對方性格的描述,覺得「這樣說好像沒錯」,那也是因為那些字眼原本就出自人們彼此觀察時所使用的詞彙。