Python拆分列中文和 字符

需求描述:我们日常实际的工作中经常需要把一列数据按中文和 数字或者字母单独拆分出来

导入所需的库:

复制代码
import pandas as pd

定义函数 extract_characters,该函数接受三个参数:file_path(Excel文件路径)、sheet_name(工作表名称)和 column_name(列名)。

复制代码
def extract_characters(file_path, sheet_name, column_name):

读取Excel文件并将其存储到DataFrame中:

复制代码
df = pd.read_excel(file_path, sheet_name=sheet_name)

创建两个新的列 '中文''其他字符',并将它们添加到DataFrame中:

复制代码
df['中文'] = ''
df['其他字符'] = ''

遍历DataFrame的每一行数据:

复制代码
for index, row in df.iterrows():

获取指定列的值,并将其转换为字符串:

复制代码
text = str(row[column_name])

初始化两个空字符串变量 chineseother,用于存储中文字符和其他字符:

复制代码
chinese = ''
other = ''

遍历每个字符:

复制代码
for char in text:

判断当前字符是否为中文字符(Unicode范围为\u4e00\u9fff):

复制代码
if '\u4e00' <= char <= '\u9fff':

如果是中文字符,则将其添加到 chinese 字符串中:

复制代码
chinese += char

如果不是中文字符,则将其添加到 other 字符串中:

复制代码
other += char

将中文字符集合添加到新的 '中文' 列中:

复制代码
df.at[index, '中文'] = chinese

将其他字符集合添加到新的 '其他字符' 列中:

复制代码
df.at[index, '其他字符'] = other

返回处理后的DataFrame对象:

复制代码
return df

定义测试示例的文件路径、工作表名称和列名:

复制代码
file_path = r'测试.xlsx'
sheet_name = 'Sheet1'
column_name = '店铺销售sku'

调用 extract_characters 函数,并将结果存储在 result_df 中:

复制代码
result_df = extract_characters(file_path, sheet_name, column_name)

将处理后的DataFrame保存为Excel文件:

复制代码
result_df.to_excel('result.xlsx', index=False)

完整代码:

相关推荐
水兵没月17 分钟前
钉钉群机器人设置——python版本
python·机器人·钉钉
我想学LINUX1 小时前
【2024年华为OD机试】 (A卷,100分)- 微服务的集成测试(JavaScript&Java & Python&C/C++)
java·c语言·javascript·python·华为od·微服务·集成测试
数据小爬虫@4 小时前
深入解析:使用 Python 爬虫获取苏宁商品详情
开发语言·爬虫·python
健胃消食片片片片4 小时前
Python爬虫技术:高效数据收集与深度挖掘
开发语言·爬虫·python
ℳ₯㎕ddzོꦿ࿐7 小时前
解决Python 在 Flask 开发模式下定时任务启动两次的问题
开发语言·python·flask
CodeClimb7 小时前
【华为OD-E卷 - 第k个排列 100分(python、java、c++、js、c)】
java·javascript·c++·python·华为od
一水鉴天7 小时前
为AI聊天工具添加一个知识系统 之63 详细设计 之4:AI操作系统 之2 智能合约
开发语言·人工智能·python
Channing Lewis8 小时前
什么是 Flask 的蓝图(Blueprint)
后端·python·flask
B站计算机毕业设计超人8 小时前
计算机毕业设计hadoop+spark股票基金推荐系统 股票基金预测系统 股票基金可视化系统 股票基金数据分析 股票基金大数据 股票基金爬虫
大数据·hadoop·python·spark·课程设计·数据可视化·推荐算法
觅远8 小时前
python+playwright自动化测试(四):元素操作(键盘鼠标事件)、文件上传
python·自动化