【Python】数据导入

Python数据导入的方法有很多,以下是八种常见的方法:

  1. 使用Pandas read函数

Pandas库提供了一种通用的方式来导入各种数据类型,如CSV,Excel,JSON,SQL,等等。

复制代码
import pandas as pd
 
# 导入CSV文件
df = pd.read_csv('filename.csv')
 
# 导入Excel文件
df = pd.read_excel('filename.xlsx')
 
# 导入JSON文件
df = pd.read_json('filename.json')
  1. 使用Python内置的open和csv模块

Python的内置模块提供了基本的文件读写能力,配合csv模块可以读取CSV文件。

复制代码
import csv
 
with open('filename.csv', mode='r') as file:
    reader = csv.reader(file)
    for row in reader:
        print(row)
  1. 使用Python的numpy.loadtxt或numpy.genfromtxt函数

这两个函数可以读取数据,并可选择性地转换数据类型。

复制代码
import numpy as np
 
# 读取CSV文件
data = np.loadtxt('filename.csv', dtype=np.float, delimiter=',')
  1. 使用SQLAlchemy模块

SQLAlchemy是Python的一个数据库工具。它允许你使用Python的语法连接和操作数据库。

复制代码
from sqlalchemy import create_engine
 
engine = create_engine('sqlite:///database.db')
 
# 导入CSV文件到SQL数据库
df = pd.read_csv('filename.csv')
df.to_sql(name='table_name', con=engine, if_exists='replace', index=False)
  1. 使用Python的pickle模块

pickle模块可以用来序列化和反序列化Python的对象结构。

复制代码
import pickle
 
# 写入对象到文件
with open('filename.pkl', 'wb') as file:
    pickle.dump({'key': 'value'}, file)
 
# 从文件读取对象
with open('filename.pkl', 'rb') as file:
    data = pickle.load(file)
  1. 使用Python的sqlite3模块

sqlite3是Python的内置数据库,适用于简单的数据存储。

复制代码
import sqlite3
 
conn = sqlite3.connect('database.db')
 
# 创建一个Cursor:
cursor = conn.cursor()
 
# 执行一条SQL语句:
cursor.execute('SELECT * FROM table_name')
 
# 使用fetchall()获取所有数据:
values = cursor.fetchall()
 
cursor.close()
  1. 使用Python的h5py模块

h5py是用于读取和写入HDF5文件的Python库,HDF5是一种用于存储和组织大量数据的文件格式。

复制代码
import h5py
 
# 写入数据到HDF5文件
with h5py.File('filename.h5', 'w') as file:
    file.create_dataset('dataset_name', data=[1, 2, 3, 4, 5])
 
# 读取HDF5文件的数据
with h5py.File('filename.h5', 'r') as file:
    print(file['dataset_name'][:])
  1. 使用Python的pymysql模块

pymysql是用于Python中与MySQL数据库进行交互的一个库。

复制代码
import pymysql
 
# 连接数据库
conn = pymysql.connect(host='localhost', user='user', password='passwd', db='db', charset='utf8')
 
# 创建游标对象
cursor = conn.cursor()
相关推荐
Flynt14 分钟前
Astra 自主跑了 35 小时烧掉 40 亿 token,产出为零:我给 Agent 加了三道闸
python·aigc·agent
mldong17 分钟前
Python 开发者也有自己的轻量工作流引擎了:pip install 一行,5 分钟跑通一条审批流
后端·python·架构
weixin199701080161 小时前
《跨境二手ERP的3种对接模式:自研API / SaaS中间件 / 平台认证服务商,怎么选?》(附Python源码)
开发语言·python·中间件
B2_Proxy1 小时前
Python 爬虫代理中间件开发:统一处理 403、429 与自动重试机制
python
学代码的CJY1 小时前
Python序列类型详解
python
529宝宝起名网1 小时前
用 Python 爬取古籍文献中的名字用例数据库:从二十四史到诗词文集的历史名字采集与分析
python
颜颜yan_9 小时前
ESP-IDF 鸿蒙 PC 适配全记录:打通 Python、构建工具链与 ESP32-P4 固件生成
python·华为·harmonyos
言乐69 小时前
Python加速器4跨境网络加速器
运维·服务器·开发语言·网络·python
weixin_440730509 小时前
线程02-并发串行-互斥锁-Semaphore-Event
python·thread
张小凡vip10 小时前
python--爬虫--经验积累的遇到的坑
开发语言·爬虫·python