Qt+sqlite3使用事务提升插入效率

参考:

【精选】SQLite批量插入效率_sqlite 批量插入_PengX_Seek的博客-CSDN博客

(1)不使用事务时:

cpp 复制代码
	clock_t t_start = clock();
	QSqlQuery query(db);
	QString sql("insert into test(col1,col2) values(1,2);");
	for (int i = 0; i < 1000; i++)
	{
		query.exec(sql);
		//qDebug() << query.lastError();
	}
	clock_t t_stop = clock();
	std::cout << "cost time " << (t_stop - t_start) << " ms" << std::endl;

cost time 22566 ms

每次使用SQL语句,都会打开和关闭数据库文件(共1000次)。

(2)使用事务时:

cpp 复制代码
	clock_t t_start = clock();

	QSqlQuery begin(db);
	begin.exec("begin;");
	QSqlQuery query(db);

	QString sql("insert into test(col1,col2) values(1,2);");
	for (int i = 0; i < 1000; i++)
	{
		query.exec(sql);
		//qDebug() << query.lastError();
	}
	QSqlQuery commit(db);
	commit.exec("commit;");
	//commit.exec("end;");
    //使用end;效果一样
	clock_t t_stop = clock();
	std::cout << "cost time " << (t_stop - t_start) << " ms" << std::endl;

cost time 67 ms

只打开和关闭了一次数据库文件。

(3)我想导入数据库3500万条数据。(Qt)

cpp 复制代码
	clock_t t_start = clock();
	//3500万
	for (int j = 0; j < 3500; j++)
	{
		QSqlQuery begin(db);
		begin.exec("begin;");
		QSqlQuery query(db);
		for (int i = 0; i < 10000; i++)
		{
			QString sql = QString("insert into test(col1,col2) values(%1,2);").arg(j*10000+i);
			query.exec(sql);
		}
		qDebug() << j;
		QSqlQuery commit(db);
		commit.exec("commit;");
	}
	//commit.exec("end;");
	clock_t t_stop = clock();
	std::cout << "cost time " << (t_stop - t_start) << " ms" << std::endl;

cost time 813590 ms

时间有点久。

之前尝试只begin,commit一次,但感觉效果不好(猜测可能是一次提交的数据太多了)。

(4)依然是导入3500万数据。(Qt---prepare)

参考这篇文章:

Qt 使用SQLite的性能优化的亿点点记录-云社区-华为云 (huaweicloud.com)

cpp 复制代码
	clock_t t_start = clock();
	//3500万
	for (int j = 0; j < 3500; j++)
	{
		QSqlQuery begin(db);
		begin.prepare("begin;");
		begin.exec();
		QSqlQuery query(db);
		for (int i = 0; i < 10000; i++)
		{
			query.prepare("insert into test(col1,col2) values(%1,2);");
			query.bindValue(":1", j * 10000 + i);
			query.exec();
		}
		qDebug() << j;
		QSqlQuery commit(db);
		commit.prepare("commit");
		commit.exec();
	}
	//commit.exec("end;");
	clock_t t_stop = clock();
	std::cout << "cost time " << (t_stop - t_start) << " ms" << std::endl;

cost time 951928 ms

速度也不快!

(5)依然导入3500万数据(C++,执行准备)

参考:

Sqlite3写性能优化-每秒百万条写入 - 陈小蓝 - 博客园 (cnblogs.com)

cpp 复制代码
	clock_t t_start = clock();
	sqlite3* db;
	char* zErrMsg = 0;
	int rc;
	rc = sqlite3_open("test.db", &db);
	if (rc) {
		fprintf(stderr, "Can't open database: %s\n", sqlite3_errmsg(db));
		exit(0);
	}
	else {
		fprintf(stderr, "Open database successfully\n");
	}
	sqlite3_exec(db, "CREATE TABLE Test(ID INTEGER,var0 INTEGER,var1 REAL,var2 TEXT);", 0, 0, 0);
	sqlite3_stmt* pPrepare = nullptr;
	auto sql = "INSERT INTO Test (ID,var0,var1,var2) VALUES (?,?,?,?);";
	sqlite3_prepare_v2(db, sql, strlen(sql), &pPrepare, 0);
	sqlite3_exec(db, "BEGIN", 0, 0, 0);
	const int maxcount = 3500*10000;
	for (int i = 0; i < maxcount; i++)
	{
		sqlite3_reset(pPrepare);
		sqlite3_bind_int(pPrepare, 1, 0);
		sqlite3_bind_int(pPrepare, 2, 1);
		sqlite3_bind_double(pPrepare, 3, 2.0);
		const char* str = "hello sqlite3";
		sqlite3_bind_text(pPrepare, 4, str, strlen(str), 0);
		sqlite3_step(pPrepare);
		int err = sqlite3_step(pPrepare);
		assert(SQLITE_DONE == err);
		if (i % 10000 == 9999)
		{
			qDebug() << i;
			sqlite3_exec(db, "COMMIT", 0, 0, 0);
			sqlite3_exec(db, "BEGIN", 0, 0, 0);
		}
	}
	sqlite3_exec(db, "COMMIT", 0, 0, 0);
	sqlite3_finalize(pPrepare);
	sqlite3_close(db);
	clock_t t_stop = clock();
	std::cout << "cost time " << (t_stop - t_start) << " ms" << std::endl;

cost time 198837 ms

3500*10000/(20*10000)=350/2=175

即175条数据/ms

感觉好像快了,但是因为表结构变化了,就不互相比较了。

相关环境的搭建(vs2019下引入sqlite3)参考:

主要是第二篇文章:

C/C++ SQLite3安装及使用 - _Return - 博客园 (cnblogs.com)

VS2019下Sqlite3数据库的环境搭建及简单应用_sqlite3_exec vs2019 csdn-CSDN博客

6.在其中加入这句:(c++,关闭写同步)

cpp 复制代码
sqlite3_exec(db, "PRAGMA synchronous = OFF", 0, 0, 0);

cost time 137753 ms

3500*10000/137753约为254

254条数据/ms

相关推荐
Bioinfo Guy8 分钟前
高分Panel复现系列|转录因子网络太乱?用模块框把重点圈出来
数据库·生物信息学·生信可视化
ltl1 小时前
Disaggregated DB 合集:Socrates、PolarDB、Taurus 的共同模式
数据库
Blossom i3 小时前
大数据预处理与采集实验一:使用Python操作MySQL数据库
数据库·mysql
雾时之林4 小时前
Linux--软件管理、源码包安装
linux·服务器·数据库
老纪的技术唠嗑局6 小时前
超级干货分享:中小企业使用 OceanBase 实践经验汇总
数据库
CLOUD ACE6 小时前
谷歌云代理|零售商Target 如何利用 Spanner Graph 提升零售发现体验并将数据库维护成本降低 50%
数据库·零售
AI大模型-小雄6 小时前
Codex写分页接口为什么越翻越慢?用Cursor Pagination解决重复与漏数据
大数据·数据库·elasticsearch·搜索引擎·chatgpt·后端开发·codex
少晓年7 小时前
从 MySQL 迁移到人大金仓 KingbaseES:完整指南与实践
数据库·mysql
SelectDB8 小时前
Apache Doris AI RAG 实战:从基础 RAG 到知识图谱增强的技术能力与选型
数据库
SelectDB8 小时前
电商企业 PostgreSQL 迁移 Apache Doris:80TB 分析数据统一平台技术能力与实践
数据库