你實際使用電腦時,記住這一句就夠了
新檔案 → UTF-8
尤其是:
- HTML
- 網頁
- CSV
- TXT
- JSON
- 程式碼
- 資料庫
- API
- 跨平台檔案
優先使用 UTF-8。
舊系統 → 可能遇到 ANSI / Big5
例如你在台灣遇到很舊的:
.txt.csv.srt.bat
如果打開變成:
���
很可能就是:
檔案原本是 Big5,但你的程式用 UTF-8 去讀。
反過來也可能發生。
「不是 Unicode 的系統預設文字編碼」
叫做 ANSI。
例如:
- 台灣 Windows → 常見 Big5 / CP950
- 簡體中文 Windows → GBK / CP936
- 日本 Windows → Shift-JIS / CP932
- 西歐 Windows → Windows-1252
所以:
ANSI 在台灣可能是 Big5,在日本可能是 Shift-JIS。
這就是 ANSI 最大的問題:
同一個檔案,在不同國家的電腦上,可能會被解讀成不同文字。
2>UTF-8 - unicode
「亂碼」
UTF-8 的目的就是讓不同系統對同一組 Unicode 字元有一致的表示方式。
因此:
Windows → Mac → Linux → Android → iPhone → 網頁
都可以使用同一套 Unicode。
3>ANSI vs UTF-8 的比較