StarRocks导出ddl

python 复制代码
import pymysql
import pandas as pd

# --- 请在此处填写您的StarRocks连接信息 ---
host = '172.31.0.1'  # StarRocks FE 主机地址
port = 9030                   # StarRocks FE 查询端口,默认为 9030
user = 'xxx'        # StarRocks 用户名
password = 'xxx'    # StarRocks 密码
# --- 连接信息填写完毕 ---

def export_starrocks_ddl_to_excel():
    """
    连接到StarRocks集群,获取所有库和表的DDL,并将其导出到Excel文件。
    """
    connection = None
    try:
        # 1. 连接到StarRocks
        connection = pymysql.connect(
            host=host,
            port=port,
            user=user,
            password=password,
            charset='utf8mb4'
        )
        print("已成功连接到StarRocks。")

        all_tables_ddl = []
        
        with connection.cursor() as cursor:
            # 2. 获取所有数据库
            cursor.execute("SHOW DATABASES")
            databases = [row[0] for row in cursor.fetchall()]

            # 排除系统数据库
            excluded_dbs = {'information_schema', '_statistics_','sr_dump_test','sys'}
            databases_to_scan = [db for db in databases if db not in excluded_dbs]
            print(f"将要扫描的数据库: {databases_to_scan}")

            file = open('show_create_table.sql', 'w',encoding='utf-8') 

            # 3. 遍历数据库和表,获取DDL
            for db_name in databases_to_scan:
                cursor.execute(f"USE `{db_name}`")
                cursor.execute("SHOW TABLES")
                tables = [row[0] for row in cursor.fetchall()]
                
                file.write(f"use {db_name};\n")
                
                for table_name in tables:
                    try:
                        cursor.execute(f"SHOW CREATE TABLE `{db_name}`.`{table_name}`")
                        ddl_result = cursor.fetchone()
                        # 'SHOW CREATE TABLE' 的结果是 (Table, Create Table)
                        if ddl_result and len(ddl_result) > 1:
                            ddl_statement = ddl_result[1]
                            all_tables_ddl.append({
                                '库名': db_name,
                                '表名': table_name,
                                'ddl': ddl_statement
                            })
                            print(f"成功获取 `{db_name}`.`{table_name}` 的DDL。")
                            file.write(ddl_statement+'\n')
                    except Exception as e:
                        print(f"获取 `{db_name}`.`{table_name}` DDL失败: {e}")
            file.close()
        # 4. 将数据转换为DataFrame并导出到Excel
        if all_tables_ddl:
            df = pd.DataFrame(all_tables_ddl)
            output_filename = 'show_create_table.csv'
            df.to_csv(output_filename,  index=False, encoding='utf-8')
            print(f"\n所有DDL已成功导出到 '{output_filename}'。")
        else:
            print("未找到任何用户表,无法生成Excel文件。")

    except pymysql.MySQLError as e:
        print(f"数据库连接或操作失败: {e}")
    except Exception as e:
        print(f"发生未知错误: {e}")
    finally:
        if connection:
            connection.close()
            print("数据库连接已关闭。")

if __name__ == '__main__':
    export_starrocks_ddl_to_excel()
相关推荐
凌虚16 小时前
面向 MySQL 用户的 PostgreSQL 快速上手指南
数据库·后端·架构
五阿哥永琪17 小时前
MySQL中操作json的函数!
数据库·mysql·json
来者皆善17 小时前
了解Mysql优化吗?如何优化索引?
数据库·mysql
赤壁小虾19 小时前
【渲染流水线】[逐片元阶段]-[透明度测试]以UnityURP为例
java·前端·数据库
MC皮蛋侠客19 小时前
SQLAlchemy 系列(七):高级建模与高效写入——批量 DML、方言与扩展
数据库·python
奈斯先生Vector20 小时前
把 Midjourney 二次编辑做成生产系统:customId 能力令牌、Action Graph 与 WebUI 精修工作台
数据库·人工智能·架构·aigc·音视频·midjourney
Lethehong21 小时前
双擎并驱·全链路并行:KFS让TB级异构增量同步秒级到达
数据库
MC皮蛋侠客21 小时前
SQLAlchemy 系列(八):AsyncIO、并发与 Web 生命周期——让每个并发任务持有自己的 Session
数据库·python
一水21 小时前
Redis实战:一个AI工作流系统里的五个应用场景,从传参到限流的完整链路
数据库·redis·wpf
枫叶v.1 天前
Prompt Injection 防不住怎么办?从 Source-Sink 模型设计 Agent 安全边界
数据库·安全·prompt