Unicode编码/解码

在线Unicode编码与解码工具,支持中文转Unicode转义序列(\uXXXX)、HTML实体编码(&#NN;)以及反向解码。自动识别多种格式,一键完成转换。适用于前端开发、国际化处理、JSON调试等场景。

输入字符数
0
输出字符数
0
编码差异
0
输入文本
输出结果
输入文本后点击「Unicode编码」或「Unicode解码」按钮

功能特性

双向编解码

支持Unicode编码与解码双向转换,一键将文本转为\uXXXX转义序列或HTML实体,或将编码还原为可读文本。

多种编码模式

支持\uXXXX转义序列和&#NN; HTML实体两种编码格式,切换模式即可输出不同格式。

智能自动识别

解码时自动识别\uXXXX\xXX&#NN;&#xNN;等多种格式,无需手动切换。

全字符支持

正确处理中文、日文、韩文、Emoji等所有Unicode字符,可选编码全部字符或仅非ASCII字符。

交换与复制

一键交换输入输出内容,方便连续编解码操作;结果支持一键复制到剪贴板,无缝衔接开发工作流。

安全本地

编解码操作优先后端处理,失败自动回退浏览器本地JavaScript,不持久化数据,保护隐私。

使用说明

如何使用Unicode编码解码工具?

  • 在输入框中粘贴要处理的文本或编码字符串。
  • 选择编码模式:「\uXXXX 转义」输出\u4e16\u754c格式,「HTML实体」输出世界格式。
  • 如需将ASCII字符也编码,勾选「编码全部字符」选项(默认仅编码非ASCII字符)。
  • 点击「Unicode编码」按钮将文本转为编码格式,点击「Unicode解码」按钮将编码还原为文本。
  • 点击「交换」按钮可将输出内容移至输入框,方便连续编解码操作。

编码模式说明

  • \uXXXX 转义:将每个字符转为\u加4位十六进制码点,如「中」转为\u4e2d。常用于JavaScript字符串、JSON中的非ASCII字符编码。
  • HTML实体:将每个字符转为&#NNN;十进制实体,如「中」转为中。常用于HTML文档中的字符编码。
  • 编码全部字符:默认仅编码码点大于127的非ASCII字符。勾选后ASCII字符(a-z, 0-9等)也会被编码。

解码支持的格式

  • \uXXXX - Unicode转义序列(4位十六进制),如\u4e2d\u6587
  • \xXX - 十六进制转义(2位),如\xe4\xb8\xad
  • &#NNNN; - 十进制HTML实体,如中
  • &#xXXXX; - 十六进制HTML实体,如中

典型使用场景

  • 前端开发:将中文文本转为\uXXXX格式用于JavaScript字符串,避免编码问题。
  • 国际化(i18n):查看和编辑国际化资源文件中的Unicode转义字符。
  • JSON调试:解码JSON中被转义的中文内容,或编码特殊字符确保JSON传输安全。
  • HTML开发:将特殊字符转为HTML实体,确保跨浏览器兼容显示。
  • 跨平台编码:在不同编码环境间安全传递文本数据。

常见问题

\uXXXX和HTML实体有什么区别?
\uXXXX是编程语言中的Unicode转义序列,使用4位十六进制码点表示一个字符,主要用于JavaScript、Java、Python等编程语言的字符串中。&#NNN;是HTML实体编码,使用十进制码点表示字符,主要用于HTML/XML文档中。两者表示相同的Unicode字符,只是应用场景和语法不同。例如「中」字可以表示为\u4e2d(转义序列)或中(HTML实体)。
为什么默认只编码非ASCII字符?
ASCII字符(码点0-127)在大多数编码环境中都能正确显示,无需转义。默认仅编码非ASCII字符(如中文、日文、Emoji等)可以保持编码结果的可读性,同时减少输出体积。如果需要纯编码输出(如某些加密或混淆场景),可以勾选「编码全部字符」选项。
解码时能自动识别格式吗?
是的。解码功能会自动扫描输入文本,依次匹配\uXXXX\xXX&#NNN;&#xNNN;格式并转换为对应字符。未匹配到的文本保持原样输出,因此可以处理混合文本(如Hello \u4e16\u754c解码为Hello 世界)。
支持Emoji和生僻字吗?
支持。本工具使用UTF-16编码,对于基本多文种平面(BMP)内的字符(包括大部分中文、日文、韩文),使用\uXXXX格式即可表示。对于BMP之外的字符(如部分Emoji),JavaScript会使用代理对(两个\uXXXX)表示,解码时也能正确还原。
Unicode编码和UTF-8编码有什么区别?
Unicode是字符集标准,为每个字符分配唯一的码点(如「中」的码点是U+4E2D)。\uXXXX转义是Unicode码点的一种文本表示形式。UTF-8是Unicode的编码实现方式,将码点转为1-4字节的字节序列。本工具处理的是\uXXXX转义序列和HTML实体,而非UTF-8字节编码。如需UTF-8字节查看,可使用Base64工具配合处理。
本工具是免费的吗?数据会被存储吗?
完全免费,无需注册登录。编解码操作通过后端API处理,但仅在请求过程中传输数据,不会被持久化存储。后端不可用时,工具会自动回退到浏览器本地JavaScript编解码,确保功能始终可用。