2009年3月31日星期二

新成語

互动百科:崭露头脚

TOM科技:“月球车”崭露头脚

新浪網:手機變身背投電視 三星W7900嶄露頭腳
1月8日開展的CES2009上,投影手機開始嶄露頭腳
21世紀經濟報道:西藏登山隊的市場化轉型攀登
在中國登山協會公佈的護送聖火上珠峰的隊員名單中,一大批新人開始嶄露頭腳,甚至包括來自中國農業大學的大專登山隊員。
cctv.com: 只有情侣才敢观看的经典情色电影
只是莫妮卡‥贝鲁奇那时不时崭露头脚的波澜壮阔的大胸脯总是让人走神。

伸延閱讀
未必正讀:嶄;正讀™?點讀!

2009年3月30日星期一

從諸事八卦變事事關心

《東張西望》是無綫的娛樂新聞節目,但是今晚的《東張西望》卻於末段異常地播出兩節與娛樂界無關的新聞。

首先是近日的「粗口」事件。主持人說有「議員高官」在議會講粗口,但節日片段卻只播出社民連的幾位議員於立法會大罵「仆街」的片段,而沒有播政務司長如何講「吊吊 fing」以及行政長官大講「狗噏」。最特別的,是無綫播出社民連片段的時候,只播影像而不播議員的聲音,而主持人的旁白則解釋原因是議員在講粗口。之後節目還訪問了某大學一位姓歐陽的講師,他解釋,粗口應界定為涉及性器官或性行為,兼冒犯別人的語言。「仆街」不涉性事,而「吊吊 fing」的 "fing" 正字為「揈」,乃搖搖欲墜的意思,也不是粗口云云。此講師謂,重要的不是某人的用語是否粗口,而是該用語會否冒犯人。

《東張西望》不是新聞節目,本來我們毋須以新聞節目的標準觀之,但是這次該節目對事件的處理甚為偏頗,令我懷疑無綫是否刻意要討好官方:
  1. 主持人說有「議員高官」在議會講粗口,是掉轉了時序。先引起爭論的其實是去年六月政務司長於漢普頓酒店結業時以「吊吊 fing」來形容已抵酒店但無處落腳的住客,再而是本年一月立法會秘書處卻刻意更改會議記錄,以「鬥噏」代替行政長官講「狗噏」的醜聞。社民連三子於議會上鬧官員「仆街」、「臭四」,只是上星期的事。無綫掉轉事件時序,有針對社民連三子之嫌。
  2. 節目只播社民連片段,不播政務司長及行政長官的片段,甚至以旁白說社民連三子講粗口,更是隻眼開隻眼閉了。
  3. 「仆街」本來是由罵人「仆街死」而來,屬於咒罵而不是粗話。「吊吊 fing」的 "fing",如該講師所說,並非粗話,但「吊吊 fing」的「吊」,其實是「屌」(港語指陽具)的變音,而「狗噏」的狗,也有說是 gau1 (「夠」陰平聲,港語亦指陽具)的變音。粗話的變音算不算粗話,我不打算在此討論,但要說事件三方誰的用語最接近粗口,則當屬政務司長及行政長官的言詞無疑。立法會秘書處更改會議記錄,以及行政長官睜大眼說瞎話,說自己從不講粗話,這本來已屬醜聞,可是政府跟建制派恬不知恥,不提自己的醜事,反而炒作議員的咒罵,試圖轉移視線,連消帶打。媒體對此本應譴責,但無綫現在卻將以新聞採訪的包裝,抬出大學講師將社民連與政府高官各打五十大版,貌似公平,實際上是偏幫政府。
粗口事件之後,《東張西望》還播出了民建聯的記者會,講未成年媽媽的問題。《東張西望》由諸事八卦變為事事關心,未嘗不是好事,不過為甚麼一關心就是貶社民連而抬政府及建制派,十分耐人尋味。無綫是非常賺錢的電視台,就算是賣人情給建制人士,亦不必做得像今次這麼着跡,可是「屈」社民連議員講粗口與報道民建聯記者會此等小事,建制人士似無必要拍膊頭叫無綫「識做」。究竟這是否與無綫的未來買主有關,就非我等外人所能瞭解了。

附註:有近人認為「吊吊 fing」的 "fing" 正字為「揈」,但查字典,「揈」字粵音為 「轟」(gwang1),而且其字亦好像不是擺動的意思。"Fing" 為「揈」之說源出何處,讀者如果知道,煩請告之。

補充(四月三日):彭志銘所著的《正字審查》(香港 次文化堂出版,2007 年)及中文大學的「現代標準漢語與粵語對照資料庫
(IE browser only) 均指「揈」的其中一個讀音為 fing6,惟兩者均無注明此說之出處,不能盡信。

伸延閱讀
彭志銘:一個沒仆街的香港 ── 論患上語文恐懼症的傳媒

2009年3月25日星期三

R 令人好氣餒

我不是統計學人,但間中都要用統計軟件,所以電腦裏自然裝了免費的 R。雖說 R 理論上可以作一般的數、理或工程用途,但它的根源始終在統計學,亦因此,R 對我等 casual users 相當難上手。

如果只是拿它在做一兩個 linear regressions,R 的確很好用,單是它的 read.table function 已經很就手。換了是 C/C++ 或 Matlab,就要自己寫程式來區分 headers 與真正的 data 了,不過亦正因為 R 源自統計用途,所以它的設計到處都有統計味,令其他範疇的用家非常不自在。電鋸說 R 有 Unix 那種 KISS 哲學,但見諸 R 的 data structures,卻完全不是這回事。舉個例,R 的 vector 與 matrix 其實不是數學上的 vector 與 matrix,而是近似於 Matlab 的 cell array,亦即是說它們所裝載的不一定是數字,也可以是 heterogeneous data types,包括不同類型的資料甚至是 data structures。此外,它們的每一行或每一列也可以有自己的名稱,因此它們比 Matlab 的 cell array 更為複雜。若我要用 R 來寫一個快速的算法,那麼我就要關心它複製小物件的速度是否夠快,有時還要關心記憶體是否夠用。如果我明明只需要 vectors 與 matrices,但 R 卻一抽二連地附加一大堆資訊在這兩種 data structures 中,這難言是理想狀況。

更令我不自在的是 R 濫用一些數學名詞。Vector, matrix 與 cross product 是其中幾個例子。這些名詞本身有特定意義,R 改了它們的內涵,令人好生混淆。其他語言亦有這種情況,例如 standard C++ 亦稱 dynamic array 為 vector,不過 R 特別離譜。

不過最糟的,還是 R 的 documentation 不夠清楚。如果是說統計方面的,例如在 R 中如何執行某個 statistical test,那麼 R 確是一流的,但是非統計的部份,就沒有那麼幸運了,甚至在官方文件 "An Introduction to R" 之中,你也可以不時看到作者只能夠揣測 R 到底怎樣詮釋某些算式,例如在 5.4.1,作者說:
The precise rule affecting element by element mixed calculations with vectors and arrays is somewhat quirky and hard to find in the references. From experience we have found the following to be a reliable guide.
在 5.7.1 之中又說:
Note that x %*% x is ambiguous, as it could mean either x'x or xx', where x is the column form. In such cases the smaller matrix seems implicitly to be the interpretation adopted, so the scalar x'x is in this case the result.
感覺不是很可靠。我認為除非只用 R 來做一些簡單的事情,否則學習 R 的門檻一點也不低。我間中才用 R,以前學過的很快就忘掉,每次都要重新學習 R 那種一抽二連的資料結構,感覺十分氣餒。

呻完。繼續同 R 搏鬥。

**************
給新手(包括在下這個「永遠新手」)的 R 入門:
附註:在中文版 Windows 中安裝 R,請於安裝後右擊 R 的 shortcut,揀選「內容」,然後在「捷徑」那個 tab 的「目標(T)」一項中,將
"C:\Program Files\R\R-2.7.0\bin\Rgui.exe"
改為
"C:\Program Files\R\R-2.7.0\bin\Rgui.exe" --no-restore-data LC_ALL=en
否則 R 可能無法正常運作。