工具会在浏览器支持时,把同一段 bytes 分别当作 UTF-8、Big5、GB18030、Shift_JIS 与 Windows-1252 解读。核对姓名、标点和字段边界,通常比接受自动猜测可靠。
匹配的 BOM 是明确迹象;替代字符、控制字符与可疑序列能排除部分错误解码,但多种编码仍可能同时看似可读,最后由你确认。
只有选定编码会应用到完整文件。CSV 与 TSV 下载会加 UTF-8 BOM 方便电子表格打开,TXT 则输出纯 UTF-8;文本不会上传。
关于这个主题的常见疑问与实用解答。
添加原始 CSV,比较候选预览并核对熟悉的姓名与字段,选定可读编码后下载 UTF-8 副本。确认结果前请保留原文件。
有匹配的 BOM 时可优先参考,接着核对实际内容。合适候选应保留预期的姓名、标点和分隔符,且少有或没有替代字符;排序本身不是证明。
不能。XLSX 是结构化的二进制工作簿,不是纯文本文件。请先把工作表导出为 CSV,或使用能在导入时选择源编码的电子表格软件。
直接打开 CSV 或 TSV 时,BOM 能帮助电子表格软件识别 UTF-8。TXT 输出保持纯 UTF-8,因为文本编辑器通常不需要这个标记。
不会。读取、预览与 UTF-8 转换都在这个浏览器执行,原文件不会上传或覆盖;关闭或刷新页面会清除工作状态。
不能。工具只能重新解读现有 bytes,并把选定内容保存为 UTF-8;如果字符在这个文件创建前就已被替换、删除或错误导出,无法重建。