設萬維讀者為首頁 廣告服務 聯繫我們 關於萬維
簡體 繁體 手機版
首頁 新聞 視頻 博客 論壇 分類廣告 購物
版主:奇異恩典
萬維讀者網 > 彩虹之約 > 帖子
“表意文字”與“表音文字”
送交者: xunc 2004年11月03日12:09:57 於 [彩虹之約] 發送悄悄話

談到漢語與英語的優劣問題,首先就會想到“表意文字”與“表音文字”的區別。前面已經講到隨着漢字的演變,漢字已不再是純粹的表意文字了。存在着大量形聲字。歷史上隨着文明的不斷發展,語言所要表達的概念不斷增加,表意文字要求漢字擁有了一個數量龐大的字符集,但現代漢語已經不用增加字符來表達新的概念,而是創造新詞,加上對漢字漢語的規範化,這已經基本上達到了減少了使用字數的目的。

與漢字相反,英語名為“表音文字”,其實並不能真正的表音;英語正詞法中比較嚴重的問題就是如何解決英語的書面拼寫形式和讀音之間的矛盾問題。由於文藝復興時期印刷術的推廣和教育的普及,英語的書面拼寫形式逐漸統一,形成了規範的形式,而這些規範的形式又通過印刷的方式進一步固定下來。但與此同時,英語的語音發生了很大的變化。例如,gnash(咬牙)和 gnat(小昆蟲)中,g不發音,knight (騎士)和 know (知道)中,k不發音,而在中古英語中,這幾個字母全都要發音。又如,輔音字母前的 r (如 arm)和詞尾的 r (如 father)不發音,詞尾的 e(如 live)不發音,而在中古英語中,它們都是要發音的。這種情況,使得規範的書面形式與實際的發音之間出現了很大的矛盾。這也是中國人學習英語時遇到的一個難點:學習一種“表音文字”如果不查字典、不看國際音標,也不一定能準確發音,是不是好笑?

18世紀開始,英國強調語言的規範化,要求語言準確有力。1755年,約翰遜(Samuel Johnson) 編寫了第一部英語詞典,把英語詞的拼寫形式固定了下來。這樣,英語的正詞法就能夠以詞典作為規範的根據。這很象中國秦朝時將小篆的書寫規範化,但是卻沒能阻止漢字語音的變化。

這就提出了第二個問題:所謂拼音文字也有一個大問題,就是許多拼音文字,由於千百年來口語的不斷變化,它的書面文字與讀音往往相去甚遠。法語也一樣,它的書面語言表達的還是四、五百年以前的發音,不發音的元音彼彼皆是,象hommes讀為um,aiment讀為em。
事實上,現在的書面英語、法語,已經有很大“表意文字”的成分了。歷史上的漢字作為表意文字(ideograph),文字與語音沒有直接關係,無論用哪種語言或方言去讀,意義沒有變化。這是幾千年來各種口語分化交熔變遷,而漢字一直作為一種統一的文字被所有人認同的原因。漢字使操不同口語的人互相交流成為可能,而隔膜是統一的主要障礙。所以在“表意”、“表音”這一點上,漢字並不比英語劣勢。

現在普遍認為漢字的龐大的字符集使它顯得非常複雜:難學、難記、難用。但是這裡面需要搞清一個前提:那就是漢字的“字”與英文的“word”是不同的概念。現在的中小學教育需要掌握2000—3000個漢字,才能夠滿足日常閱讀。但這不僅僅是學習2000—3000個“字”,而是學習2000—3000個概念。一個人一天之內可以學習26個英文字母,但是他能閱讀英文嗎?由於英文已經不是典型的“表音文字”,學會26個字母甚至連準確的單詞發音都沒有掌握。到頭來,在以英文為母語的國家中小學中,仍然要進行大量的單詞拼寫訓練。掌握2000—3000英文單詞是什麼水平?能應付日常閱讀嗎?學習過英語的人都明白!

研究表明:漢字作為一個複雜的文字符號系統,其信息熵很高。研究的基本方法是:逐漸擴大漢字容量,隨着漢字容量增大,信息熵的增加趨緩;漢字增加到12370以後,不再使信息熵有明顯的增加。我國科學家指出:漢字的容量極限是12366個漢字,漢字靜態平均信息熵的值 (平均信息量)是9.65比特。通過數理語言學中著名的齊普夫定律(ZIPF’SLAW)核算,這是當今世界上信息量最大的文字符號系統。聯合國五種工作語言文字的信息熵的比較如下:

法文:3.98比特
西班牙文:4.01比特
英文:4.03比特
俄文:4.35比特
中文:9.65比特

可以看出,拼音文字的信息熵小,差別不大。漢字的信息量最大。

漢字對拼音文字的這種信息熵優勢是什麼概念?簡單的比喻就是十進制數與二進制數的差別。十進制數字系統需要人記憶0—9,10個符號,二進制只需要記憶0和1兩個符號。十進制乘除要記憶9X9表,二進制只需要學會與、或、非的簡單邏輯。但是,人類在日常生活中為什麼不使用二進制數字系統呢?因為那樣很浪費,一個數字“7”表示成二進制就成了“111”,記個大數不把人累死?反過來,人類為什麼不用十六進制,或更高的進制呢?一方面是人腦智力的限制,另一方面,十六進制也未必能大幅度提高信息熵。這種信息熵反映在文字上,就是聯合國文件中,中文版本一定是最薄的。信息熵高是不是就不利於計算機處理呢?這方面恐怕還很難下結論。簡單的比較漢與英文的輸入速度是不能說明問題的,因為“字”與“word”是不同的概念。要比較只能比較同一內容的中英文兩個不同文本,計算擊鍵數的差值。在“詞”的單位基礎上,現代漢語與英語是可以進行比較的。現代英語為了應付不斷湧現的新事物、新思想、新科技、新概念,也在不斷地造詞。無非是藉助拉丁詞根、或重新組合已有單詞,結果越是專業科技的詞彙,就越長、越難記。或者是大量使用縮寫:如WTO、FBI、IBM、UFO等等,縮寫一多就容易混淆、難以理解。在這方面,現代漢語造詞的優勢就十分突出了。這就是漢字字符集信息熵高的優勢。

用現代計算機技術作為信息化的標準,來衡量漢字與英文字母的優劣是件很荒誕的事情。現代計算機技術說到底就是基於“二極管”的技術,將來的發展很難預料。難道要人類高度智能的思維模式,去模仿“二極管”式的思維?那是典型的削足適履。試想,難道當年就因為發明了黑白照像術,人們就該廢掉油畫的色彩?難道當年就因為摩爾斯電碼適合新發明的電報,人們的語言就都應該改成“嘀嘀嗒”?

漢字在應用中遇到的一些困難,我們不應該忽視,但是沒必要過分誇大。當年中國人發明了活字印刷術之後,在很長一段時間內一直沒有得到真正的應用。直到清朝末年中國還在大量使用雕版印刷術。其原因就是漢字數量太大,要製造一套足夠印書的字模難度太大,也不經濟。最後還是20世紀初,西方人引入了機制字模,中國才實現了活字印刷。在20世紀,人類進入計算機時代的初期,漢字處理軟件的缺乏也曾經是一種阻礙,但是很快也就解決了。現在在計算機技術的幫助下,漢字的傳播比以往更方便了。

真正阻礙中國進步的並不是技術,而是人們思想的禁錮。在西洋活字傳入中國之前,利馬竇、徐光啟翻譯的歐洲文藝復興思想書籍,已經通過古老的雕版印刷出來了。但是在當時及後世很長時間內,卻得不到國人重視。這是一件很悲哀的事情。在落後思想的禁錮下,即便我們象伊朗、土耳其那樣把自己的文字全部改成先進的阿拉伯文或拉丁文拼寫,我們也無法逃避象古波斯和奧斯曼帝國那樣的衰敗。

0%(0)
標 題 (必選項):
內 容 (選填項):
實用資訊
回國機票$360起 | 商務艙省$200 | 全球最佳航空公司出爐:海航獲五星
海外華人福利!在線看陳建斌《三叉戟》熱血歸回 豪情築夢 高清免費看 無地區限制
一周點擊熱帖 更多>>
一周回復熱帖