← 返回首页
乱码生成器
功能亮点
8种经典乱码
覆盖 UTF-8→GBK、GBK→UTF-8、Latin-1、日文 Shift-JIS、繁体 Big5 等日常编码事故场景。
一次输入全模式出
输入文字立刻看到所有模式的乱码效果,不用切来切去点按钮。
纯本地运行
所有编码转换都在你浏览器里做,文本不会上传到任何服务器。
一键复制
每条乱码结果都有独立复制按钮,复制到聊天里恶搞朋友或测试编码兼容性。
使用步骤
- 在输入框粘贴或输入想变成乱码的文本(推荐含中文效果最明显);
- 查看下方 8 种乱码模式的实时输出;
- 点每条结果旁边的「复制」按钮,粘贴到你想用的地方。
乱码是怎么产生的?
乱码的本质是「编码和解码用了两套不同的字符集」。计算机存储文字时存的是字节(0 和 1),展示时要查字典把字节翻译成字形——如果存的时候用 UTF-8 字典、读的时候拿 GBK 字典去翻,翻出来的就是牛头不对马嘴的乱码。常见事故:① Windows 记事本「ANSI 保存」就是 GBK,拿到 Mac/Linux 用 UTF-8 打开就乱码;② 数据库连接串没指定 charset=utf8mb4,存进去的中文读出来是「???」或各种奇怪符号;③ 邮件/HTTP 头漏写 Content-Type: text/html; charset=utf-8,浏览器用默认编码渲染导致乱码。这个工具就是把这些经典的「翻错字典」过程模拟出来,让你看到不同编码错误会产生什么样的乱码。
常见问题
- 为什么有些模式输出的是方框问号 ?
- 不是所有字节组合在所有编码里都有合法字形。当某种编码的解码字典里找不到对应字节时,浏览器会显示替换字符 (U+FFFD)或方框。这正是真实编码错误场景下会出现的现象——有些乱码干脆就显示成一堆问号。
- 为什么英文和数字基本不乱码?
- 因为 UTF-8、GBK、Latin-1、Shift-JIS、Big5 这些主流编码都兼容 ASCII(0x00-0x7F),所以 A-Z、a-z、0-9 和常见英文标点在任何编码下字节值都一样,怎么翻字典都不会翻错。只有中文、日文、韩文这些多字节字符才是乱码重灾区。
- 能不能反向解码——把乱码还原回原文?
- 理论上知道「源编码」和「被错误当成了什么编码」就能逆向还原,但实际中信息可能已经丢失(比如替换字符 吞掉了原始字节)。本工具专注于「生成乱码」用于测试和恶搞;如需还原,常见思路是把乱码文本用错误的那套编码重新编码回字节,再用正确编码解码回来。