Base64、URL编码、Unicode、HTML实体、十六进制,这5种编码格式最常用的在线转换工具各有哪款免费的?拿同一组数据看速度和中文支持
前两天朋友吐槽,从API拿回的数据是一串\u7528\u6237\u540d,完全看不懂。旁边人说这是Unicode,找工具转一下就行。他随手搜了一个在线工具,复制进去点解码,出来的结果是三个问号——中文全丢了。又试了两个,一个弹了三个广告,一个直接让注册登录。
编码转换工具不缺数量,缺的是"用得住的"。下面把最常见的5种编码格式各自找了几款免费在线工具,拿同一组数据对比,整理如下。
编码转换工具选型:四个硬指标
| 1 | 中文不乱码:硬门槛,处理中文出问号或方块直接pass |
| 2 | 数据本地计算:粘贴的内容不上传服务器,浏览器里直接完成 |
| 3 | 多格式支持:一个工具覆盖多种编码,不用开五六个标签页 |
| 4 | 无广告无注册:打开即用,不弹窗不跳转不要登录 |
一、Base64编码解码:中文支持是最常见的翻车点
Base64是日常使用频率最高的编码格式。API认证token、图片Data URL、JWT的payload全都离不开它。最大的坑:不同工具对UTF-8中文的处理方式不一样。同样一段"你好世界",A工具编码后是5L2g5aW95LiW55WM,B工具可能是另一串完全不同的东西——因为B工具没用UTF-8字节先编码,而是用Latin1处理了。
拿同一段包含中英文的文本跑了几个主流工具,结果如下:
| 工具 | 中文不乱码 | Base64URL | 本地计算 | 广告 |
|---|---|---|---|---|
| CyberChef (gchq.github.io) | 完美 | 是 | 纯本地 | 零 |
| Base64.sh | 完美 | 是 | 浏览器 | 零 |
| CloverTools (xsanye.cn) | 完美 | 是 | 浏览器 | 零 |
| Base64.guru | 一般 | 是 | 部分 | 少量 |
| Base64encode.org | 有问题 | 否 | 未知 | 有 |
结论:日常主力选CyberChef,开源纯本地。偶尔用选Base64.sh或CloverTools,打开即用。避开Base64encode.org处理中文。

二、URL编码解码:encodeURI和encodeURIComponent的区别很多人搞混
URL编码可能是踩坑频率最高的。中文URL转码、空格转%20还是+、&符号被当成参数分隔符——这些坑几乎每个做开发的人都踩过。关键区别:encodeURI保留URL结构字符(/、?、&),encodeURIComponent对所有特殊字符都编码。
举个实际的例子:整个URL https://example.com/搜索?q=你好 用encodeURI编码后变成 https://example.com/%E6%90%9C%E7%B4%A2?q=%E4%BD%A0%E5%A5%BD,路径中的中文被编码了但?和=保留。而参数值"你好&世界"用encodeURIComponent编码后变成%E4%BD%A0%E5%A5%BD%26%E4%B8%96%E7%95%8C,连&都被转成了%26。
| 工具 | 区分两种模式 | GBK支持 | 批量处理 |
|---|---|---|---|
| ToolTool.net | 支持 | UTF-8/GBK | 是 |
| ToolsKit.cc | 支持 | UTF-8 | 否 |
| YuTools.cn | 基础 | UTF-8 | 否 |
容易忽略的细节:有些老系统(政府网站、银行接口)用的还是GBK编码。把GBK编码的URL放到UTF-8工具里解码,中文全是乱码。经常对接国内传统系统的话,选支持GBK/UTF-8双编码的工具——ToolTool.net明确标注了这个能力。
做SEO的朋友还有另一个场景:sitemap.xml里的中文URL需要统一编码。网站上展示的是/产品/手机,sitemap里写了/%E4%BA%A7%E5%93%81/%E6%89%8B%E6%9C%BA,搜索引擎会认为是两个不同URL,权重就分散了。用URL编码工具统一处理一遍即可。
三、Unicode编码转换:\uXXXX格式不是乱码,是标准编码
\u4f60\u597d这种字符串在JSON数据、JavaScript代码、API响应中非常常见。Unicode工具的差异在于支持多少种格式:\uXXXX(JS/JSON常用)、XXXX(HTML十六进制实体)、DDDD(HTML十进制实体)、U+XXXX(Unicode码点标准)。
同一个"你好",在这四种格式下分别是:\u4f60\u597d、你好、你好、U+4F60 U+597D。如果你从不同系统拿到的数据格式不一样,就需要一个能自动识别并转换的工具。
| 工具 | 支持格式 | 自动识别 | 推荐度 |
|---|---|---|---|
| Tools.beer | 5种 | 智能 | 强烈推荐 |
| Tandaima.com | 4种 | 手动选择 | 推荐 |
| YuTools.cn | 3种 | 基础 | 可用 |
技巧:经常处理不同来源的Unicode数据,优先选支持自动识别格式的工具。粘贴进去就自动判断类型并转换。Tools.beer这方面体验最好,支持5种格式且自动识别。
四、HTML实体编码:Meta标签和JSON-LD结构化数据绕不开的转义
HTML实体编码在SEO场景里用得非常多。Meta description里写了&未转义成&,搜索引擎可能截断你的描述;JSON-LD结构化数据里包含HTML标签没转义,Google富媒体测试工具直接报错。
三个最常见的转义遗漏场景
场景一 Meta Description:"价格<100元",<未转义,搜索引擎可能从这里截断内容。
场景二 JSON-LD:"JavaScript & TypeScript",&未转义为&,结构化数据验证不通过。
场景三 代码展示:文章里展示HTML代码时,<div>未转义会被浏览器当成标签渲染。
HTML实体编码工具本身差异不大——绝大多数都能正确处理五个核心字符(&、<、>、"、')。值得留意的是两个加分项:是否支持全部HTML实体名称(©→©、®→®),以及是否支持批量多行处理。
推荐工具:Lanren-tools.com全字符实体支持最全面,emoji也能正确转换;YuTools.cn集成在编码面板里,URL/Base64/HTML/Unicode一个页面全搞定;Ciphp.com分类清晰,每种编码有独立工具页;Lazytools.com.cn六合一(URL/Base64/HTML/Unicode/ASCII/Hex),适合不想记多个网址的人。

五、十六进制编码:调颜色、看内存地址、处理二进制数据
十六进制(Hex)编码的使用场景比前四种少,但特定场景下不可或缺:前端调颜色值(#FF6600)、查看内存地址和字符编码、处理二进制数据的十六进制表示。关键差异在于支持的进制范围——有些工具只做Hex转文本,有些集成了二进制、八进制、十进制等多进制转换。
另一个容易被忽略的细节:Hex格式的空格分隔问题。有些系统输出的Hex带空格(48 65 6C 6C 6F),有些则连续(48656C6C6F)。工具不支持两种格式切换的话,每次都要手动处理空格。
| 工具 | 多进制 | 空格切换 | 跨编码转换 |
|---|---|---|---|
| ToolJSON.com | 全 | 是 | UTF-8/GBK/Big5 |
| QR9.net | 基础 | 否 | UTF-8/UTF-16LE |
| LufsX Lab | 16种 | 是 | Base64/Base32等 |
结论:日常使用推荐ToolJSON.com,跨编码转换最全面,支持UTF-8/GBK/Big5多编码互转。需要16种编码格式切换选LufsX Lab。
六、五种编码格式横向对比 + 按需求选工具
把上面五种编码格式的最佳选择汇总到一起,按不同使用场景给出推荐:
| 你的需求 | 推荐工具 | 理由 |
|---|---|---|
| 我要一个工具搞定所有编码 | YuTools.cn 或 Lazytools.com.cn | URL/Base64/HTML/Unicode/Hex多合一,一个页面切换 |
| 我要最强的Base64工具 | CyberChef | 开源纯本地,200+种编码算法,可搭流水线 |
| 我要处理GBK老系统接口 | ToolTool.net / ToolJSON.com | 支持UTF-8/GBK双编码,GBK解码不翻车 |
| 我要处理各种Unicode格式 | Tools.beer | 5种格式自动识别,粘贴即用 |
| 我要批量URL编码 | ToolTool.net | 支持批量处理+两种模式切换+GBK |
| 我要处理HTML实体(SEO用) | Lanren-tools.com | 全字符实体支持,emoji也能正确转换 |
两个大多数人没意识到的编码转换安全问题
1. 不要在任何在线工具里粘贴生产环境的密钥和token。有些在线工具的编码转换请求是发到服务端处理的,你的API密钥、JWT token、数据库密码可能在服务器日志里明文存储。处理敏感数据时,优先选标注"本地计算"或"纯浏览器端处理"的工具(如CyberChef、Base64.sh)。
2. 编码不等于加密。Base64编码的字符串任何人都可以解码,它不是加密手段。不要把敏感信息Base64编码后就直接放在公开页面上,这和明文几乎没有区别。
最后说一句:编码转换工具这个东西,用得顺手的往往就是打开最快的那个。上面列的这些工具全部免费、浏览器打开即用、不需要注册。如果你每天都要处理各种编码格式,建议把YuTools.cn或Lazytools.com.cn加到浏览器书签栏,一个页面覆盖五六种编码,比每次现搜快得多。涉及敏感数据时切换到CyberChef的本地模式,密钥不出浏览器。
用UC建站系统做站群的朋友,日常批量处理sitemap URL编码、结构化数据JSON-LD转义这些SEO技术细节时,系统内置的编码处理模块可以自动完成URL标准化和HTML实体转义,不用手动一个页面一个页面去检查。
七、开发者和运营人员日常最容易遇到的三个编码转换场景
API返回的数据全是乱码。调用第三方接口,response里中文变成了\uXXXX格式,或者整个返回体是Base64编码的。先用Unicode工具解码看原始数据,再决定下一步怎么处理。如果API文档明确说是Base64编码,直接用CyberChef加一个"From Base64"模块,再加一个"Decode text (UTF-8)"模块,两步流水线搞定。
Excel导出的CSV文件打开中文乱码。这是因为Excel默认用系统编码(中文Windows是GBK)保存CSV,而你用UTF-8打开。解决方法是先把CSV文件内容用Hex或编码转换工具看一下实际编码是什么,再用对应的编码格式打开。ToolJSON.com支持GBK/UTF-8/Big5多编码互转,把乱码文本粘贴进去选GBK转UTF-8即可。
网站搬家后数据库中文全部变成问号。这是典型的数据库字符集不匹配问题——原来数据库用的是utf8mb4,新环境默认latin1,导入后所有中文都变成了问号。排查思路:先用Hex工具看一段乱码数据的实际字节值,确认原始编码是什么。如果是latin1存储了UTF-8字节,需要用编码转换工具做两次转换:先按latin1读出字节,再按UTF-8解释。这个操作在ToolJSON.com上可以直接完成。
这几个场景的共同点是:看起来是"乱码问题",本质上都是编码识别和转换问题。手边备好几个顺手的编码转换工具,遇到乱码不用慌,先判断编码再转换,大部分问题十分钟内能解决。
顺便提一句,如果你用的是Windows系统,记事本另存为的时候可以选编码格式,但很多人不知道"UTF-8"和"UTF-8 with BOM"的区别。BOM是文件开头的几个隐藏字节,用来标识编码格式。用记事本存成"UTF-8"实际上会加上BOM头,而很多Linux系统和编程语言不认BOM,解析时会多出几个乱码字符。要存纯UTF-8不带BOM,可以用VS Code或Sublime Text,或者用在线编码转换工具把带BOM的文件内容转一遍,去掉开头的BOM字节。
