跳到主要内容

CSV 编码 · EXCEL

Excel 打开 CSV 乱码怎么办?UTF-8、GB18030 与 GBK

打开编码转换工具

Excel 打开 CSV 后中文变成乱码、出现 �,或者所有内容挤在一列时,不要直接覆盖原文件。本文按日常操作说明如何选择 UTF-8 或 GB18030、重新导入并安全保存。

发布日期:

更新日期:

适用工具: 字符编码与格式转换

UTF-8、GB18030、GBK 应该怎么选?

编码由接收系统的要求决定,而不是只看 Excel 的界面语言。没有明确要求时,面向 Excel 首先选择 UTF-8 BOM。

简体中文 CSV 常用编码对比
编码适用场景Excel 打开方式注意事项
UTF-8(带 BOM)现代 Excel、对外共享、多语言数据通常可以直接双击正确打开确认导入系统是否禁止 BOM
UTF-8(不带 BOM)网站、数据库、指定 UTF-8 的接口建议通过数据 > 从文本/CSV 导入旧版 Excel 可能猜错编码
GB18030旧版中国大陆 Windows 与业务系统导入时手动选择简体中文编码只在接收系统明确要求时使用
Shift_JIS/CP949/Big5/Windows-1252日本、韩国、台湾或西欧旧文件按文件来源手动选择简体中文文件不应随意选择这些编码
ISO-8859-1明确要求 Latin-1 的旧系统按来源规范手动选择与 Windows-1252 是不同的编码
  • UTF-8(带 BOM)

    适用场景
    现代 Excel、对外共享、多语言数据
    Excel 打开方式
    通常可以直接双击正确打开
    注意事项
    确认导入系统是否禁止 BOM
  • UTF-8(不带 BOM)

    适用场景
    网站、数据库、指定 UTF-8 的接口
    Excel 打开方式
    建议通过数据 > 从文本/CSV 导入
    注意事项
    旧版 Excel 可能猜错编码
  • GB18030

    适用场景
    旧版中国大陆 Windows 与业务系统
    Excel 打开方式
    导入时手动选择简体中文编码
    注意事项
    只在接收系统明确要求时使用
  • Shift_JIS/CP949/Big5/Windows-1252

    适用场景
    日本、韩国、台湾或西欧旧文件
    Excel 打开方式
    按文件来源手动选择
    注意事项
    简体中文文件不应随意选择这些编码
  • ISO-8859-1

    适用场景
    明确要求 Latin-1 的旧系统
    Excel 打开方式
    按来源规范手动选择
    注意事项
    与 Windows-1252 是不同的编码

使用 LocaCSV 转换 CSV 编码

LocaCSV 在浏览器中读取和转换 CSV,不会把文件上传到服务器。Free 版支持单个输入文件,大小上限为 50MiB。

  1. 打开字符编码与格式转换,选择原始 CSV。
  2. 从自动、UTF-8、GB18030 等输入编码中选择,确认简体中文预览。
  3. 确认逗号、分号、制表符或竖线等输入分隔符。
  4. Excel 使用 UTF-8 BOM,明确要求的旧中国大陆系统才选择 GB18030。
  5. 检查转换后的文字和数据行数,再保存 CSV。
字符编码与格式转换

在 Excel 中正确打开 CSV,避免中文乱码

乱码状态下不要直接保存,否则错误字符可能覆盖原始字节。先保留原文件副本,再通过 Excel 导入功能指定编码。

  1. 在 Excel 中打开空白工作簿,选择数据 > 获取数据 > 从文件 > 从文本/CSV。不同版本的菜单名称可能略有差异。
  2. 选择 CSV,在文件原始格式或编码中切换 UTF-8(65001)与 GB18030/简体中文选项,直到预览正确。
  3. 选择实际分隔符,例如逗号、分号或制表符。所有内容都在一列通常是分隔符问题。
  4. 邮编、商品编号、电话等需要保留前导 0 的列,应设置为文本。
  5. 确认姓名、地址、标点和列划分后再加载。

从 Excel 保存 CSV 时要注意什么

编辑后通过文件 > 另存为选择“CSV UTF-8(逗号分隔)(*.csv)”,更容易保留完整字符。CSV 只保存当前工作表的纯值,不会保留多工作表、格式、图表等 Excel 功能。

  • 确认当前工作表就是要导出的内容
  • 检查日期、长编号和前导 0 是否被 Excel 改变
  • 接收系统明确要求 GB18030 时再转换
  • 保存后再次预览文字、列和数据行数

已经出现乱码时的修复顺序

中文乱码通常是用错误编码读取了字节。回到未修改的原始 CSV,切换 UTF-8 与 GB18030 查看预览,确认姓名和生僻字正确后再转换。

  • 出现 Ã、Â 等拉丁符号:UTF-8 可能被当成西欧编码
  • 出现 �:非法或不完整字节可能已经被替换
  • 英文数字正常但中文错误:重新确认 UTF-8 与 GB18030
  • 所有数据在同一列:先检查逗号、分号或制表符

中国大陆简体中文 CSV 的 GB18030 与 GBK

GB18030 是中国大陆简体中文系统常见的兼容编码,覆盖范围比传统 GBK 更广。LocaCSV 提供 GB18030 选项,没有单独的 GBK 选项;处理旧简体中文 CSV 时优先按接收系统说明选择 GB18030。

  • 现代 Excel 与一般共享:UTF-8 BOM
  • 指定 UTF-8 的接口:按要求选择带 BOM 或不带 BOM
  • 旧中国大陆业务系统:GB18030
  • 有 emoji、生僻字或多语言数据:保留 UTF-8

敏感 CSV 与电子表格公式风险

CSV 可能包含客户姓名、电话、地址或经营数据。使用在线转换服务前,先确认是否会上传文件。LocaCSV 不会把 CSV 内容、文件名、表头或单元格值发送到外部 API。

在 Excel 中打开时,也要注意以 =、+、-、@ 开头的单元格可能被当成公式。不要轻易启用来源不明文件的外部内容,并留意公式风险警告。