文本文件编码转换
文本文件编码识别与转换,UTF-8 BOM 与换行符处理。
拖入文件,或点击选择
文本类文件(.txt / .md / .log / .csv / .json 等);文件只在本地读取
选择文本文件后自动检测编码并解码预览;也可在上方 accept 之外手动输入任意文件名(拖拽不受过滤限制)。
- 检测顺序:BOM(UTF-8 / UTF-16LE / UTF-16BE)→ 严格 UTF-8 验证 → 失败则标示「非 UTF-8,猜测可能为 GBK 等」并默认按 GBK 解码供预览,由你手动确认。
- 目标编码可真实输出的有:UTF-8(TextEncoder)、UTF-16LE / UTF-16BE(本工具按码元逐个编码)、ISO-8859-1(Latin-1,本工具按 charCode 逐个编码,只覆盖 U+0000–U+00FF)。GBK / GB18030 / Shift_JIS / Big5 不作为目标编码——浏览器没有可靠的本地编码器,不做假的“支持”;它们仅可作为源编码读取。
- 目标编码选 ISO-8859-1 且文本含 U+00FF 以上的字符(中文、emoji 等)时,会逐条给出「第几行第几列、是什么字符、码点与类型」,并阻止导出;原输入保持不变,只有你点「替换为 ? 后导出」才会把无法表示的字符写成 ?(0x3F)。
- 输出 BOM 会把对应字节(UTF-8: EF BB BF;UTF-16LE: FF FE;UTF-16BE: FE FF)写到文件最前面;ISO-8859-1 没有标准 BOM,该选项对其不可用。
- 出现替换字符(�)说明原数据在当前源编码下无法对上字节,多为编码选错或文件损坏。
什么时候用「文本文件编码转换」
从老系统导出的文件打开是乱码,需要判断编码并转成 UTF-8。
使用要点
- 支持编码识别与转换,并处理 UTF-8 BOM 与换行符。
- 转换后可下载新文件,原文件不会被修改。
- 先确认源编码再转换,避免二次损坏。
相关工具
文本文件编码转换与其他 44 个工具一样,全部计算都在你的浏览器里完成:输入、密钥与文件不会发送到服务器,页面首次加载后可离线使用。