可讀性分數
Flesch 要數音節,中文沒有 —— 所以我們就這樣講。
本機處理完全在你的瀏覽器裡執行 —— 打開開發者工具的 Network 分頁就能驗證
最長的句子
| # | 長度 | 句子 |
|---|
還沒有內容 —— 輸入或貼上一些文字。
貼上一段或整篇文章。英文會得到三個標準可讀性公式的結果;中文會得到一個用「中文真的有的東西」建立的指標,並且明確標示它不能拿去跟 Flesch 分數比較。
那些標準公式實際上在量什麼
Flesch 易讀分數把兩個比例組合起來:每句幾個單字、每個單字幾個音節。Flesch-Kincaid 用同樣兩個輸入換算成美國學制的年級;Gunning Fog 則把「每字音節數」換成「三音節以上單字的比例」。三個都是同一個直覺的代理指標 —— 句子長、字長就難 —— 而三個都是在二十世紀中期用英文散文校準出來的。
它們有用,恰恰是因為粗糙。公式裡沒有任何東西理解你的論點、結構或用詞選擇,所以高分並不是在說你寫得好,只是在說你的句子短、你的字在語音上簡單。拿它跟自己前一版草稿比,是有資訊的;把它當成要最佳化的目標,就會產出分數很好但什麼都沒說的文字。
為什麼它們在中文上不可能成立
兩個輸入都沒有定義。中文沒有公式所需要的那種音節數 —— 一個字唸出來就是一個音節,所以「每字音節數」塌縮成一個常數,完全不帶難度資訊。而中文也沒有用空白分隔的「單字」可以拿來當分母,所以連詞數本身都得先被發明出來,公式才跑得動。
多數工具面對中文輸入時做的並不是拒絕。它們照樣把同一套算術套在自家斷詞器吐出來的東西上,然後回傳 NaN、一個很大的負數,或者對一篇真的很難的文章給出高得荒謬的分數。那比沒有答案更糟,因為螢幕上的數字會被拿去做決定。這一頁在文字以中文為主時,Flesch、Flesch-Kincaid 與 Gunning Fog 一律寫「不適用」—— 我們寧可給你這個,也不給一個編出來的數字。
中文我們改成量什麼
量三件中文真的有的事。平均句長(以字元計),因為句長是唯一能跨書寫系統轉移的難度訊號 —— 一路串三個子句才句號的中文很難讀,跟英文難讀的原因是同一個。常用字覆蓋率,也就是有多少比例的字取自高頻字表,因為罕用字就是中文版的罕用詞。以及標點密度,因為幾乎沒有標點的段落,等於要讀者自己去斷句。
指標的權重分別是 45%、40%、15%,而三個原始數字都列在上面,你看得出來是哪一項在動。兩個必須誠實說明的限制:中文沒有業界公認的可讀性量表可以校準;而我們的常用字表是自行整理的高頻字集,不是官方字表。請把這個指標當成「比較自己兩個版本的草稿」的工具,不要當年級對照,更不要拿去跟 Flesch 比。
句子層級的輸出怎麼用
「最長的句子」那張表,通常比任何單一分數更能拿來動手改。可讀性數字是平均值,而平均值會藏起那句真正讓讀者放棄的話。依長度排序就把那句話擺在你面前,而把一個四十字的長句拆成兩句,效果比在指標上省一分大得多。
數字看起來很怪的時候先檢查一件事:如果你的文字沒有句末標點,整段會被當成一句,所有「每句」的數字就都沒有意義。我們會在說明區直接標出這件事,而不是安靜地把算出來的荒謬數字報給你。
沒有任何東西被上傳
公式跑在這個分頁裡。這件事在這裡特別重要,因為會被拿來測可讀性的內容通常還不公開:投稿前的稿件、藥品與衛教說明、政策文件、考卷,以及還在禁發期的行銷文案。
打字的時候打開開發者工具盯著 Network 分頁,或者乾脆把網路斷掉再重新整理。頁面照樣算得出來 —— 因為它從來不需要伺服器。
常見問題
為什麼我的中文的 Flesch 分數顯示「不適用」?
因為那個公式要除以「每個單字的音節數」,而中文既沒有那種意義的音節數,也沒有用空白分隔的單字。對中文回傳數字的工具,是在對「發明出來的輸入」做算術。
中文指標可以跟 Flesch 分數比較嗎?
不行。兩者的輸入不同、尺度不同。中文指標只有在跟另一段用同一把尺量過的中文比較時才有意義。
可讀性分數多少算好?
完全取決於你的讀者。給一般大眾看的英文散文常以 Flesch 60 到 70 為目標。與其追一個數字,不如拿改完的版本跟第一版比。
常用字表是哪裡來的?
是我們自己依高頻字整理的,屬於估計值而不是官方標準。頁面上就這樣寫 —— 因為把一個沒有來源的數字講得很權威,比標明是估計值更糟。
我的文章會被上傳嗎?
不會。全部在你的瀏覽器裡計算,而且第一次造訪之後可以離線使用。