關鍵字密度檢查
兩個分母 —— 因為其中一個在中文上會壞掉。
本機處理完全在你的瀏覽器裡執行 —— 打開開發者工具的 Network 分頁就能驗證
密度最高的詞組
| # | 詞組 | 出現次數 | 密度(以字元計) | 密度(以詞計) |
|---|
還沒有內容 —— 輸入或貼上一些文字。
貼上頁面文案,看你實際上倚賴哪些詞與詞組:同時以「佔字元的比例」與「佔詞組數的比例」兩種口徑呈現。也可以直接輸入某一個關鍵字,只看它。
密度是什麼,不是什麼
關鍵字密度就是一個數除以另一個數:某個詞出現幾次,除以文字有多少。它作為一面鏡子確實有用 —— 它告訴你這一頁實際上在講什麼,而那經常不是你照著需求單寫的時候以為的那件事。
它不是一個有目標值的排名因素。沒有哪個門檻會觸發獎勵,早年 SEO 建議裡流傳的「理想值 2% 到 3%」從來就只是個經驗法則。真正該盯著它的理由剛好相反:密度異常高,是「這一頁讀起來很糟」的可靠症狀 —— 而那是真的問題,跟搜尋引擎怎麼看這個數字無關。
常見的分母在中文上是怎麼壞掉的
幾乎每個密度工具都是除以「詞數」,而幾乎每個詞數都是用空白斷詞算出來的。中文的詞與詞之間沒有空白,所以切出來的結果是「整段就是一個巨大的詞」。分母變成 1。那個等於你整篇文章的「詞」得到 100% 的密度,而你真正想檢查的每一個詞都得到 0% —— 或者工具除以零,直接顯示 NaN。
這不是影響少數頁面的邊緣案例。對每一個用中文、日文、韓文寫的頁面來說,這就是標準實作的預設行為;而因為輸出是一張看起來很合理的百分比表格,沒有人會發現那些百分比毫無意義。
這一頁的兩個數字
「以字元計」是把你的詞所佔的字元數,除以內容字元總數(中日韓字元加上英文字母,不含空白與標點)。它對兩種文字的行為完全一致,是你想知道「這個詞佔了這一頁多少版面」時該看的數字。一個兩字詞在一千字的文章裡出現十次,就是佔 2% —— 那也正是一般人會給的答案。
「以詞計」是把出現次數除以詞組總數:英文算單字位置,中日韓算 n-gram 視窗數。它比較接近傳統以詞數為分母的百分比,所以當別人用一般意義問你「關鍵字密度多少」時,報這個數字。兩個數字不一樣,而「同時有兩個」正是重點 —— 一個講的是可見版面的佔比,另一個講的是重複的頻率。
怎麼用它而不毀掉文案
看這張表是為了找意外,不是為了達標。一個你根本沒有刻意用的詞排在前面,通常代表某個填充語接管了整篇;而你真正的主題沒出現在前十名,通常代表這一頁是在繞著它講而不是在講它。這兩件事都是可以動手處理的編輯發現,而且都不需要你去湊某個百分比。
如果某個詞組佔了大約 6% 以上的詞組數,我們會在說明區直接講出來。到那個程度,人類讀者就會察覺到重複 —— 而那才是它開始讓你付出代價的點,遠早於任何演算法介入。解法從來不是機械地刪掉幾次,而是把那句話真正想說的意思寫出來。
你的草稿文案不會被上傳
分析就是這個分頁裡的字串運算。沒有任何東西被傳出去,所以還沒上線的到達頁、有保密合約的客戶文案、你正在拆解的競品內容,都留在原地。
這對 SEO 工具來說不是小事。頁面文案通常是在上線前檢查的 —— 而那正是它最機密的時候。而多數密度檢查工具,本質上是把你的文案 POST 到別人的伺服器上。
常見問題
關鍵字密度多少才理想?
沒有這個數字。密度是診斷指標不是目標值。用它來發現「這一頁很囉唆」或「真正的主題沒有出現在前面」。
為什麼別的工具對我的中文頁面算出 100% 或 0%?
因為它們的分母是用空白斷詞算出來的詞數,而中文沒有空白,整段被算成一個詞。這一頁的兩個分母分別由字元數與 n-gram 視窗數算出來。
為什麼有兩欄密度?
一欄量的是這個詞佔了多少可見字元,另一欄量的是它相對於所有詞組位置出現得多頻繁。兩者回答不同的問題,後者是一般意義上的那個數字。
中文的詞組是真正的詞嗎?
它們是 n-gram,所以有些是相鄰兩個詞的片段,屬於估計值。如果你要確認某個特定詞有沒有過度重複,把它填進「檢查特定關鍵字」欄位 —— 那一項是精確計算的。
文字會離開瀏覽器嗎?
不會。沒有上傳,也沒有任何請求夾帶你的文案。可以在開發者工具的 Network 分頁確認,或直接把網路斷掉試試。