ASCII · Unicode · UTF-8 字符编码查询与转换
ASCII(American Standard Code for Information Interchange,美国信息交换标准代码)是基于拉丁字母的一套字符编码系统,制定于 1963 年,是计算机领域最基础、使用最广泛的字符编码标准。ASCII 码使用 7 位二进制数表示一个字符,共可表示 128 个字符,包括 33 个控制字符和 95 个可打印字符(含字母、数字、标点符号)。
前 32 个编码(0x00-0x1F)和最后一个编码(0x7F)为控制字符,用于控制打印机等设备的操作,不可打印显示。其中常用的包括:
NUL (0x00):空字符,字符串结束标志LF (0x0A):换行符,Unix/Linux 系统行尾CR (0x0D):回车符,与 LF 组合为 Windows 行尾 CRLFTAB (0x09):水平制表符ESC (0x1B):转义字符,终端控制序列起始DEL (0x7F):删除字符从空格(0x20)到波浪号(0x7E)共 95 个可打印字符,包括:
标准 ASCII 只定义了 7 位编码,当使用 8 位字节存储时,最高位为 1 的 128 个编码(128-255)成为扩展 ASCII。不同系统使用不同的编码页(Code Page)来解释这些字符,如 Windows-1252、ISO-8859-1 等。由于扩展 ASCII 存在兼容性问题,现代系统已普遍采用 Unicode 替代。
| 编码标准 | 发布时间 | 位数 | 字符数 | 特点 |
|---|---|---|---|---|
| ASCII | 1963 年 | 7 位 | 128 | 仅支持英文及基本符号 |
| 扩展 ASCII | 1980 年代 | 8 位 | 256 | 不同编码页解释不同,兼容性差 |
| Unicode | 1991 年 | 16/32 位 | 149,000+ | 全球统一字符集,涵盖所有书写系统 |
| UTF-8 | 1993 年 | 变长 1-4 字节 | 同 Unicode | ASCII 兼容,互联网标准编码 |
UTF-8 是 Unicode 的一种变长编码实现,其设计巧妙之处在于与 ASCII 完全兼容:
ch | 0x20 即可转小写%XX 十六进制形式\d 匹配 0-9(48-57),\w 匹配字母数字下划线| 缩写 | 十进制 | 十六进制 | 转义序列 | 说明 |
|---|---|---|---|---|
| NUL | 0 | 0x00 | \0 | 空字符,字符串结束 |
| BEL | 7 | 0x07 | \a | 响铃 |
| BS | 8 | 0x08 | \b | 退格 |
| TAB | 9 | 0x09 | \t | 水平制表符 |
| LF | 10 | 0x0A | \n | 换行(Unix) |
| VT | 11 | 0x0B | \v | 垂直制表符 |
| FF | 12 | 0x0C | \f | 换页 |
| CR | 13 | 0x0D | \r | 回车(配合 LF 为 Windows 换行) |
| ESC | 27 | 0x1B | \e | 转义,ANSI 控制序列 |
| SP | 32 | 0x20 | 空格 | 空格字符 |
| DEL | 127 | 0x7F | 删除 |
本 ASCII 码表工具基于 JavaScript 原生 API 实现,支持完整 Unicode 字符查询与 UTF-8 编码转换。数据覆盖标准 ASCII(0-127)、扩展 ASCII(128-255)及常用控制字符说明。工具界面针对程序员使用习惯优化,提供十进制、十六进制、八进制、二进制、Unicode、UTF-8 字节、HTML 实体等多维度编码信息,便于开发调试时快速查阅。
数据更新于 2026 年 7 月 23 日。如在使用过程中发现问题或有功能建议,欢迎反馈邮箱:contact@gymcalc.cn
数据更新于:2026年7月23日