csv文件EXCEL默认打开乱码问题

这里讨论的问题是,当用记事本打开带有中文字符的csv正常时,用excel打开却是乱码。

简单概括就是:编码问题,windows的 excel打开csv文本文件时,默认使用的是系统内的ANSI,在中文环境下就是GB2312。如果写文件时,用的编码格式是UTF-8那么excel用GB2312打开肯定是乱码。

一般两种方法,在文件创建时指定让Excel默认打开不乱码的编码,或者加BOM 标记(Byte Order Mark 字节顺序标记),让excel用指定的编码打开。

所以解决的思路就很清晰:

1.使用GB2312,gbk,gb18030这类windows下中文默认的编码。

2.使用utf-8-sig即在文件头写入 0xEF、0xBB、0xBF,让excel识别出这是utf-8编码,用utf-8编码打开csv文件。

实例:

python 写csv文件时指定编码格式,如gb2312 ,gbk ,gb18030 ,python的csv包不需要再文件头写入0xEF、0xBB、0xBF,直接指定utf-8-sig就可以。

复制代码
with open('file.csv', 'w', newline='', encoding='gb18030', mode='wb') as file:  
    writer = csv.writer(file)  
    # 写入数据到CSV文件

如果是数据流返回,可以指定编码格式

复制代码
"Content-Type": "application/octet-stream; charset=utf-8-sig"

写入utf-bom的csv

没有bom的utf

go 在文件头写入 BOM

复制代码
func generateCSV(data [][]string) []byte {
	var buffer bytes.Buffer
	writer := csv.NewWriter(&buffer)
	for index, row := range data {
		if index == 0 {
			if len(row) > 0 {
				// 写入 UTF-8 BOM让excel自己识别csv
				row[0] = "\xEF\xBB\xBF" + row[0]
			}
		}
		writer.Write(row)
	}

	writer.Flush()
	return buffer.Bytes()
}

参考:

Windows 记事本的 ANSI、Unicode、UTF-8 这三种编码模式有什么区别? - 知乎

ASCII、GB2312、GBK、GB18030、Unicode、UTF-8、BIG5 编码分析_gb18030和gbk-CSDN博客

csv 文件打开乱码,有哪些方法可以解决? - 知乎

encoding - Microsoft Excel mangles Diacritics in .csv files? - Stack Overflow

相关推荐
叫我:松哥34 分钟前
基于大数据和深度学习的智能空气质量监测与预测平台,采用Spark数据预处理,利用TensorFlow构建LSTM深度学习模型
大数据·python·深度学习·机器学习·spark·flask·lstm
吃茄子的猫7 小时前
quecpython中&的具体含义和使用场景
开发语言·python
じ☆冷颜〃7 小时前
黎曼几何驱动的算法与系统设计:理论、实践与跨领域应用
笔记·python·深度学习·网络协议·算法·机器学习
数据大魔方7 小时前
【期货量化实战】日内动量策略:顺势而为的短线交易法(Python源码)
开发语言·数据库·python·mysql·算法·github·程序员创富
APIshop7 小时前
Python 爬虫获取 item_get_web —— 淘宝商品 SKU、详情图、券后价全流程解析
前端·爬虫·python
风送雨8 小时前
FastMCP 2.0 服务端开发教学文档(下)
服务器·前端·网络·人工智能·python·ai
效率客栈老秦8 小时前
Python Trae提示词开发实战(8):数据采集与清洗一体化方案让效率提升10倍
人工智能·python·ai·提示词·trae
哈里谢顿8 小时前
一条 Python 语句在 C 扩展里到底怎么跑
python
znhy_238 小时前
day46打卡
python
Edward.W9 小时前
Python uv:新一代Python包管理工具,彻底改变开发体验
开发语言·python·uv