Twitter(X)字數統計-全形字元按2字計算
遵循Twitter(X)加權計數規則的字數統計工具。全形字元按2個字元計算,半形字元按1個字元計算,即時顯示距離280字上限還剩多少字元。
X(原Twitter)字數統計是什麼
X(原Twitter)字數統計是根據X平台特有的加權計數規則,判斷發文內容是否在280字上限之內的工具。日語、中文、韓語(CJK)字元及全形符號會被計為2個字元,因此僅憑肉眼看到的字元數無法準確得知實際剩餘字數。
本工具會對輸入內容進行即時加權計數,採用與實際發文介面相同的標準顯示剩餘字數,可在發文前提前避免意外超出字數限制的情況,尤其適合以中文為主的內容創作。
使用方法
- 輸入想要發布的文本 將計劃發布的文本貼到輸入框中。
- 查看計數結果 肉眼可見的字元數與按X加權規則計算的加權字元數會同時顯示。
- 查看剩餘字數 距280字上限的剩餘字數會即時更新。
- 超出上限時調整文本 超出的字元數會顯示出來,可據此縮短文本內容。
用好本工具的小技巧
- X的字數統計並非「視覺上的字元數」,而是採用加權規則:中日韓(CJK)文字和全形符號按2個字元計算,因此與單純的字元數會有出入。
- 同樣是30個字元,純英數字帖文尚有餘裕,而純中文帖文按加權規則相當於60個字元,很快就會逼近280字的上限。
- 無論實際長度如何,URL統一按23個字元計算(t.co短連結長度),因此本工具僅作為純文本的大致參考,含URL的帖文請在實際發帖介面中最終確認。
- 每個表情符號本身是1個碼點,但按加權規則大多不屬於「寬字元」範圍,因此通常只按1個字元計算,視覺上很醒目卻不會大量佔用字數。
- 如需檢視各編碼下的位元組數,請使用姊妹工具「字串位元組數統計」;如需檢測字元編碼,請使用「字元編碼檢測」工具。
使用場景
調整中文發文的字數
由於中文的加權字數消耗通常高於英文,發文前確認加權字數有助於恰到好處地控制在上限之內。
事先核對中英文混排的發文
對於半形與全形字元混排的文本,無需開啟實際發文介面即可確認是否超字數。
核對企業帳號的範本文案
社群媒體經營人員在製作發文範本時,可快速比較多種文案的字數。
預估含URL發文的字數
掌握除URL外正文部分的字數,再結合t.co縮短後固定的23個字元,估算整體字數平衡。
術語表
- 加權字元數
- X用於判定發文是否超出上限的獨特計數方式,將CJK字元和全形符號計為2個字元。
- CJK
- 中文(Chinese)、日語(Japanese)、韓語(Korean)的統稱。X的加權規則將這些文字計為2個字元。
- twitter-text
- X(原Twitter)公開的開源字數計算演算法,本工具也基於該規範進行計算。
- t.co縮短連結
- X上自動縮短URL的機制。無論原始URL長度如何,一律計為23個字元。
常見問題
閒話 ― 為什麼X要對字元進行「加權」計數
Twitter(X的前身)最初採用140字元上限時,英語使用者經常抱怨140個字元太短了。因為一個字母所承載的資訊量遠小於一個漢字,同樣是140個字元,中文可以描寫小說中的一個完整場景,而英文卻只能寫出20到30個單詞左右。為了消除這種不公平,Twitter於2017年將英語等「單位元組」語言的上限翻倍至280個字元,同時將中日韓(CJK)語言實際上維持在相當於140個字元(加權280字元)的水平,這是考慮到不同語言資訊密度差異所做的調整。
這種「加權字元數」的理念其實早在簡訊(SMS)領域就已存在。標準GSM編碼的簡訊通常上限為160個字元,但只要包含一個不屬於標準7位GSM字元集的表情符號或中文字元,編碼方式就會切換為UCS-2,上限驟降至70個字元。「使用某種語言的一個字元就會使可用字數減半」這一現象,與X的字元加權規則一樣,都體現了內部文字編碼與使用者體驗之間有趣的聯絡。
此外,加權規則也適用於表情符號:大多數表情符號只計為1個字元,但通過零寬連線符(Zero Width Joiner)組合膚色或性別修飾符的合成表情符號,在內部由多個Unicode碼點構成,因此外觀上是一個表情符號,計數時卻可能算作多個字元。在社交媒體發帖時留意這種「視覺字數」與「系統計數」之間的差異,有助於避免意外超出字數上限。