字元頻率分析 使用指南
統計文本中每個字元出現的次數與佔比並可視化排序,適用於詞頻分析、密碼強度檢查與日誌特徵提取,純前端執行不洩露輸入內容。
功能說明
統計文本中每個字元出現的次數與佔比並可視化排序,適用於詞頻分析、密碼強度檢查與日誌特徵提取,純前端執行不洩露輸入內容。
使用步驟
- 填寫「顯示前 N 個」。
- 填寫「忽略大小寫」。
- 結果區會即時更新;可一鍵複製結果用於記錄或彙報。
典型使用場景
- 密碼學/資訊理論教學:統計一段明文的字母頻率,直觀看到英文 e/t/a 高頻、中文按字頻分佈的規律。
- 文本熵粗估:用字元分佈估算壓縮潛力或隨機性,輔助判斷是否為加密/亂碼。
- 詞頻與用詞習慣分析:統計稿件中高頻字,發現重複用詞以便潤色。
算例參考
- 統計 abracadabra:字元 a 出現 5 次、b 2 次、r 2 次、c 1 次、d 1 次,共 11 字元;a 頻率 45.5%。這正好對應凱撒/維吉尼亞密碼頻率分析中『高頻字母暴露』的教學點。
注意事項
本工具在瀏覽器本地執行,輸入內容不會上傳伺服器;結果為模型估算,工程決策請結合實測資料複核。
- 統計時區分大小寫嗎?
- 預設區分,因密碼分析常需保留大小寫差異;如需語言字頻對比,先統一大小寫再統計,否則 A 與 a 會被算成兩個字元。
- 空格和標點算字元嗎?
- 可選。做資訊理論熵估計時通常計入空格;做純用詞分析時建議排除標點與空白,只留有效字元。