UTF-8 编码 / 解码工具
文本与 UTF-8 编码互转,支持十六进制、\x 转义、URL 编码、十进制、Unicode 码点等多种格式,数据仅在本地运算
输入
输出(十六进制)
快捷示例
UTF-8 编码说明
UTF-8(8-bit Unicode Transformation Format)是一种针对 Unicode 的可变长度字符编码,也是互联网上使用最广泛的 Unicode 实现方式。
编码规则:
特点:
• 变长编码:ASCII 字符(如英文、数字)仅占 1 字节;中文常用字占 3 字节;Emoji 等占 4 字节
• 向后兼容 ASCII:所有 ASCII 字符(0-127)的 UTF-8 编码与 ASCII 完全一致
• 自同步:从任意字节开始最多 3 个字节内即可找到字符边界
• 无字节序问题:UTF-8 以字节为单位,无需 BOM(字节序标记)
常见用途:
• Web 页面编码(HTML、CSS、JavaScript 文件的默认编码)
• JSON 数据交换标准编码(RFC 8259)
• 数据库存储和 API 数据传输
• 操作系统和文件系统的默认编码
• 编程语言内部字符串表示(如 Go、Rust、Python 3 等)
本工具支持的输入格式(解码时自动识别):
•
•
•
•
•
编码规则:
| Unicode 范围(十六进制) | UTF-8 字节序列(二进制) | 字节数 |
|---|---|---|
| U+0000 ~ U+007F | 0xxxxxxx | 1 |
| U+0080 ~ U+07FF | 110xxxxx 10xxxxxx | 2 |
| U+0800 ~ U+FFFF | 1110xxxx 10xxxxxx 10xxxxxx | 3 |
| U+10000 ~ U+10FFFF | 11110xxx 10xxxxxx 10xxxxxx 10xxxxxx | 4 |
特点:
• 变长编码:ASCII 字符(如英文、数字)仅占 1 字节;中文常用字占 3 字节;Emoji 等占 4 字节
• 向后兼容 ASCII:所有 ASCII 字符(0-127)的 UTF-8 编码与 ASCII 完全一致
• 自同步:从任意字节开始最多 3 个字节内即可找到字符边界
• 无字节序问题:UTF-8 以字节为单位,无需 BOM(字节序标记)
常见用途:
• Web 页面编码(HTML、CSS、JavaScript 文件的默认编码)
• JSON 数据交换标准编码(RFC 8259)
• 数据库存储和 API 数据传输
• 操作系统和文件系统的默认编码
• 编程语言内部字符串表示(如 Go、Rust、Python 3 等)
本工具支持的输入格式(解码时自动识别):
•
E4 BD A0 E5 A5 BD — 十六进制(空格分隔)•
E4BDA0E5A5BD — 十六进制(无空格)•
\xE4\xBD\xA0\xE5\xA5\xBD — \x 转义格式•
%E4%BD%A0%E5%A5%BD — URL 编码格式•
228 189 160 229 165 189 — 十进制字节