Sunday, June 13, 2004

「神鬼傳奇」與古埃及文

「神鬼傳奇」(The Mummy) 是一部挺有趣的美國電影。這部電影裡,有想發財的人,也有對古埃及歷史有研究的專家,當然,也有藝高膽大的英雄人物。他們共同前往一個埋藏無數寶藏的古埃及遺跡,並遇到了三千年前被下詛咒的木乃伊。

在劇中,有一個能解讀古埃及文字的人,用手指著器物上的文字,然後順利地將該段文字翻譯了出來。令我感到興趣的,是他閱讀的方向。

仔細端詳該器物上最上方的的文字,可以發現有兩個書寫方向。左半邊的文字,動物和人物的頭都是朝右,而右半邊的是朝左。根據今人的研究,古埃及文的書寫和閱讀的方向並不固定,有時是由右至左,有時是由左至右,而決定的因素,就是人物和動物的方向。若頭朝右,則必須由右至左讀,若頭朝左,則必須由左至右讀。

影片中器物上方的文字顯然有兩種書寫方向,左半邊既然動物朝右,就應由右念起,而右半邊的文字動物朝左,則應由左念起。不過劇中的「專家」在翻譯時,卻用手指著最左邊的字,然後慢慢地移向最右邊,顯然他一律都由左念起。這就與我們所認識的古埃及文書寫規則有所違背了。

看來那些電影工作者還要更考究一點,以免被我這種無聊的人抓包。

本文同步刊登於符號工作站


Friday, May 28, 2004

微軟辦公室二○○四

微軟公司終於推出了 Office 2004 for Mac。在台灣是定於六月上市。它過去幾個版本的中文相容性實在令人不敢領教,幸好這次終於與中文比較契合了。

可惜在玩過試用版後,還是發現 Excel 有中文方面的問題。Excel 裡的中文在拷貝到其他軟體裡之後都會變成亂碼。不過這情形只發生在拷貝到 Carbon 軟體時,若是拷貝到 Cocoa 軟體裡就沒問題。Excel 英文版及日文版都有這種現象。至於 Word 則沒這樣的問題。

若是使用英文版 Word,可能會碰到直排的問題,因為字會被不正確地轉九十度。另外使用者也無法用拖拉的方式把英文拉到中文字之間。不過這些問題在日文版裡都不存在。比方說在附圖中我們可以發現日文版的書寫方向選項比英文版多了一個:就是直排時文字不被轉動九十度。聽說英文正式版的使用者可以使用 Language Register 來解決前述英文版中的問題,而且也能增加日文版獨有的功能,像是加注音等。

不過,我還是會繼續用「文字編輯」(TextEdit) 來開啟別人寄來的 Word 檔。


附記:原來「OK」在日文裡是不用翻的。

本文同步刊登於符號工作站


Tuesday, May 18, 2004

終端機也把漢字變羅馬字了

上次我們提到在 Mac OS X Panther 裡,在為一個使用者命名時,系統會自動將漢字轉成日文的羅馬字。這次本人也發現,在終端機(Terminal)裡,電腦名稱也會被轉成日文羅馬字。

只要打開系統所附的 Terminal(在應用程式->Utilities檔案夾裡)或其他終端機軟體,就可以看到這樣的情況。右圖是我的 Terminal。因為我把自己的電腦命名為「阿傑仔的電腦」,所以就看到每行的提示文字成了:

aketsukomatodennou:~ rj$

顯然「阿傑仔的電腦」被硬轉成日文羅馬字了。原來我叫あけつこ。是不是很像女人的名字啊?

註:透明的 Terminal 還真有趣。

本文同步刊登於符號工作站


Saturday, May 1, 2004

Mac OS X 把日文變羅馬字了

>Mac OS X 10.3 裡有一項挺有趣的功能,可以把日文漢字自動轉成羅馬字。

請從左上角的蘋果選單裡選擇「系統偏好設定」 (System Preferences),然後點一下「帳號」。接著按左下角的加號來增加一個新的帳號,並在右方的「名稱」欄位中打入一個名字。我們在此打入「柳澤」(對不起,柳澤先生,借一下當例子 :P),然後按 Tab 鍵把游標移到「簡稱」這個欄位,就會發現「柳澤」的羅馬拼音「yanagisawa」被自動加到「簡稱」欄位裡。這算是一個對日本人來說很方便的功能。不過為什麼簡稱就要轉成羅馬字呢?因為一個帳號的簡稱只能包含羅馬字和阿拉伯數字。

有人可能會認為把漢字轉成拼音沒什麼了不起的。敝人也寫了一個小軟體,可用來將漢字轉成中文拼音。不過在國語裡,漢字的應用「大致上」還是一字一音的(當然也有很多例外)。但在日文裡,一個漢字對應很多個不同讀音的情況是很明顯的。而日本姓氏的念法更是千奇百怪,常常沒什麼規則可循。所以 Mac OS X 顯然具備了一個較完整的對應表,才能做到自動轉譯的功能。(不知是否和輸入法有共用的關係?)

當然站在中文使用者的立場,對於這種只適用於日文而無法支援中文的情況會有點抱怨。不過在現實上,中文的拼音種類多寡、 大眾運用拼音的傳統,都可能和日文不盡相同,所以也不一定能要求比照辦理。只是一般的中文使用者若發現自己的名字被轉成日語發音,可能頭上要打一個大問號。

後記:「柳澤」的「澤」在日文中通常是寫成另一個簡體的字型,但是打成「澤」仍然可以轉譯,挺有趣的。

本文同步刊登於符號工作站


Thursday, April 15, 2004

影像:海邊的告示牌

我們曾經說到異體字的問題。有些異體字是因為部首位置(或者說是聲符和意符的相對位置)的不同而產生的。像是「峰」與「峯」這兩個字都是由「山」與「夆」組成的,不過相對位置並不同,只是到頭來仍可當成同一字來用。但並不是說聲符和意符相同的字就可以算成同一字。像「暉」和「暈」兩字雖然組成的部件都一樣,但彼此並非異體字的關係,而是不同的兩個字,其讀音和語意都不相同。

拜 Unicode 之賜,這篇文章可以打出一些不被視為「正字」的異體字(例如「峯」字)。右邊這張照片裡的「㟁」字顯然是「岸」字的異體,Unicode 也收錄了這個字。

至於這張照片在哪裡拍的呢?答案是:綠島。照片裡的人顯然十分大膽,無視於告示牌上的警語,正靠近一個被認為具危險性的環境...。

本文同步刊登於符號工作站


Wednesday, April 7, 2004

影像:台南的藏廟

這張照片也是在台南拍的。這是一個位於台南市郊區的藏廟。在高處寫著一行藏文和一行英文翻譯。

最左方的༄༄།不代表任何的詞,只是句子開頭的標記。各音節之間是以點隔開。第一個音節གངས་直接用羅馬字轉寫是 gangs,是「雪」的意思,第二個音節དཀར་轉寫為 dkar, 是「白」的意思。至於後兩個音節དགོན་པ་是一個詞,轉寫成羅馬字為 dgon pa,是寺院的意思。

不過我們對照英文,會發現上述羅馬字轉寫和英文裡用的拼音略有出入。這是因為 gangs 一詞雖然在文字中記出了 s 的音,但這個屬於「再後加」的 s 在實際語言裡卻不發音,只對聲調有影響。而 dkar 一詞裡的 d 屬於「前加」,在這裡也不發音。

在過去的一篇文章裡我們曾經說到 Mac OS X 10.3 已經解決了藏文元音符號不能正確地加在輔音字母上的問題,不過 Safari 瀏覽器在顯示本篇文章的དགོན་པ་這個詞時, 卻仍不能在正確的位置上顯示元音符號(正確位置請參閱照片裡的文字)。只是在「文字編輯」(TextEdit) 裡這類元音符號的位置還是正常的,所以大概在一般的 Cocoa 文字編輯軟體裡是沒問題的,但在 Safari 瀏覽器和 Carbon 還有問題。

*要正常閱讀本網頁裡的藏文,您必須安裝 Unicode 藏文字體。


本文同步刊登於符號工作站


Tuesday, March 23, 2004

我被 Panther 的倉頡輸入法耍了

這兩天我被 Mac OS X 的倉頡耍了。在前面的一篇文章裡我們討論過 Mac OS X 10.3 Panther 裡的倉頡輸入法存在些許多令人發狂的問題。而這次使用它時,我不是打出亂碼或打不好字,而是被它愚弄了一番。話說本人在 Google 用一個包含「顏」這個字的名詞來搜尋網站時,竟然發現找不到東西,或只能找到一兩筆資料。我很確定我搜尋的詞不至於冷門到這種令人心寒的地步,所以心想 Google 竟然也有秀逗的時候。

不過我仍然不太願意相信 Google 會出這種問題。在試著增加字詞來重新搜尋幾次後,Google 告訴我繁體中文的網站都沒有符合我的搜尋條件的,反倒有不少日文網站符合條件。這使我想到:我該不會用到了什麼日本才會用到的漢字吧?於是我把我在 Google 打的「顏」給拉到「字元面板」裡,發現有兩個很相似的「顏」,糟糕的是我打出來的那個「顏」是一個未收錄於 Big 5 的字 。真正的 Big 5 編碼的「顏」是它左邊的那個。

我打「顏」這個字時,是輸入「卜竹一月金」的倉頡碼,然後按空白鍵。之後螢幕上出現兩個同碼的字可供選擇,第一個是「頻」,而第二個是「顔」。這時我當然是按下 2,並且也以為自己輸入了一般的「顏」字。但是這個字其實是一個日文的「顏」,而一般繁體中文網頁用的「顏」則是 Big 5 所收錄的,它們兩者雖然很像,但在字形上略有不同,在 Unicode 裡也被視為不同的字。我用一個日文的「顏」去搜尋繁體中文的「顏」,自然是找不到東西了。至於 Big 5 的「顏」到哪裡去了呢?為什麼在打倉頡時沒有列出來?在試驗之後我發現它必須輸入「X卜竹一月」的倉頡碼,也就是在前面加一個「X」,才能被打出來。

為什麼用倉頡輸入法會打出日文專用的「顏」呢?因為在 Mac OS X 10.3 Panther 裡的倉頡輸入法支援了 Big 5E 這種編碼,因此除了可以打出 Big 5 裡的漢字,還可以打出 Big 5E 所支援的各種罕用字、簡體字、異體字、和日文漢字等。

我們可能還想問一個問題。既然這兩個字這麼像且彼此相通,為什麼系統不當把它們成同一個字來處理呢?因為 Big 5E 為了能轉換到 Unicode,在漢字的收錄上是以 Unicode 為根據。而 Unicode 在收錄漢字時,只要各個漢字在字形上有差異,就把它們當做不同的字,並各自給予不同的內碼,而不管它們是否在字音、字義、和實際用法上可能根本沒有差別。

看到這裡可能有人會說,這種打錯字的情形應該是編碼本身的問題,而不能歸咎系統倉頡輸入法。但是事實上 Panther 還是要負很大的負任,因為既然兩種「顏」它都支援,而且兩者的倉頡碼都一樣,那麼在使用者輸入「卜竹一月金」並按空白鍵後,兩種「顏」都應該出現讓使用者選擇,而不是只有其中一個會出現供選擇,另一個卻非要在倉頡碼前加一個「X」才能打出。更何況它列出供選擇的根本竟是一個平常在繁體中文所不採用的日文漢字。在兩者字型這麼相似的情形下,自然會造成使用者莫大的困擾。

本文同步刊登於符號工作站