用緬甸文寫小說
用緬甸文寫作虛構作品:上下堆疊的附加符號、Unicode 與舊字型的問題、行高、詞間無空格、失靈的字數統計,以及發表注意事項。
發布於 27 Sept 2026 · 1 分鐘閱讀
在網路上用緬甸文寫虛構作品,意味著與一種大多數寫作軟體從未為它設計的文字周旋。緬文緊湊、圓潤、裝飾繁複:子音自帶隱含母音,成串的記號往上與往下堆疊,而詞與詞之間沒有任何東西標記一個詞在哪裡結束、下一個從哪裡開始。這些對語言本身都不是問題;它乘載小說、詩與報紙已經很久了。它對為英文而建的工具、計數器與平台才是問題,而它獎賞的,是確切知道哪些預設會失靈的寫作者。
這套文字如何運作
緬甸文以一種元音附標文字(abugida)書寫:每個子音字母自帶一個隱含母音,其餘母音「以出現在子音上方、下方、前方、後方或環繞子音的獨立字母或附加符號標示」(Omniglot)。這種語言有聲調,而聲調也寫出來,「以附加符號或特殊字母在書面上標示」。要壓掉隱含母音或構成子音叢,文字把子音垂直堆疊,於是一個基礎字符可能頭上頂著一整列記號,腳下還踩著一疊。那份垂直的庫存,就是下面大部分排版麻煩的根源。
Unicode、字體與 Zawgyi 的遺產
這套文字自 1999 年的 Unicode 3.0 起就在標準裡,其後又陸續加入擴充。複雜之處在於歷史:在 Unicode 字體普及之前,緬甸用戶用 Zawgyi 與 Win Innwa 這類取巧字型書寫,用維基百科的摘要說,它們在緬甸文區塊裡「使用未配置的碼位」來「手動處理整形」。那些編碼裡的文字不是 Unicode,在只認 Unicode 的系統上會渲染成亂碼或空框。
對今天的小說作者,規則很簡單:用 Unicode 寫,沒有第二句話。然後挑一款真正的緬甸文字體。Pyidaungsu 是緬甸書籍的國家標準字體,而開源字體 Padauk 的打造目的,正是讓堆疊的子音與聲調記號完整渲染,而不是被裁掉。發表時,請在手機上測試章節,而不只是你自己的筆電:讀者裝置上的字體覆蓋參差不齊,而一個字體堆疊裡沒有緬文的平台,會讓你的讀者在故事該在的地方看見一個個空框。
行高,或附加符號為何被切到
因為記號在基礎子音的上下堆疊,緬甸文需要的行間垂直空間比拉丁文字多。在英文網頁預設的行高下,上母音符號與下方的堆疊會撞上一行,或整個被切掉。Kanonara 自家的字體排印研究,以所需的垂直空間而言,把緬甸文排在它支援的十一種文字的第一位。實務上:永遠不要接受緬甸文散文的拉丁預設行高。給它寬裕的行距,並檢查最壞情況,一個把能掛的記號全掛上的子音,而不是平均的那一行。
沒有空格,以及它弄壞了什麼
Unicode 的斷行規格把泰文、寮文、高棉文與緬甸文歸入同一個「複雜情境相依(東南亞)」類別,並說這些文字「不以任何方式標記詞界」,於是成串的文字「需要形態分析來判定斷行機會」。對寫作者,這有三個具體後果:
- 字數統計是虛構的。 一個按空格切分的計數器,會把一整段回報成一個「詞」。以詞設定的最低長度規則,無論是平台要求、比賽規則或你自己的目標,都會失靈。改用字數或閱讀時間衡量長度(見網路小說一章該多長)。
- 斷行是引擎的工作。 閱讀程式必須切分音節才能找到斷行點;切分能力弱的地方,行就斷在奇怪的位置。這一點你無法在文字層修復;你能做的是選擇渲染得好的工具。
- 詞級工具失靈。 建立在以空格切詞之上的搜尋、拼字檢查與取代都不可靠。搜片語,不要搜單詞。
發表的考量
- 投入之前先測試平台。 網路連載的生死在讀者的手機上,所以發一章測試章節,在應用程式裡檢查它,而不只是網頁版,並確認留言的渲染也正確。
- 當心混合編碼。 有些讀者仍然用 Zawgyi 書寫。你的手稿保持 Unicode;引用任何內容時刻意轉換,而且永遠不要讓混合編碼的文字進入你的筆記或故事聖經紀錄。
- 電子書與印刷匯出用同樣的方式檢查:匯出字體必須涵蓋完整的記號庫存,行高必須先放寬,堆疊的記號才活得過這趟旅程。
軟體問題一如既往,是如何挑選寫作軟體:挑正確渲染這套文字、明智計數、並把檔案交給你的工具。至於緬甸文虛構作品能在網路上住在哪裡,從連載平台地景開始,並自行查證每個平台的文字支援。
來源
- Unicode Standard Annex #14: Line Breaking Property Myanmar in the SA class; no marked word boundaries.
- Omniglot: Burmese script Diacritic positions, tones, rounded letters.
- Wikipedia: Burmese script Unicode history and the legacy font problem.
本文中的寫作技法論斷均可在下列來源查證;屬於從業者共識而非定論的內容,正文均已註明。