Neo4j批量导入数据

导入大量数据时使用CSV 文件比较方便。下面分导入节点导入关系两部分说明。

1 节点信息导入

首先导入岗位信息,这里我们用id来标识,其中id对于每一个岗位来说是唯一的。

id信息我们已经事先处理好保存在了csv文件中,格式如下,其中第一行是列名。

csv 复制代码
id
0
1
2
3
4
5

我们首先要把这个csv 文件复制到 Neo4jimport 文件夹下。(具体:在我的机器中为'D:\App\neo4j\Data\relate-data\dbmss\dbms-278f05b5-0b41-40cf-883f-a5617288cb48\import',里面的dbms-278f05b5-0b41-40cf-883f-a5617288cb48对应着希望导入节点的项目。

导入的Cypher语句为:

Cypher 复制代码
LOAD CSV WITH HEADERS FROM 'file:///node_id.csv' AS line FIELDTERMINATOR ','
CREATE (:Job { name: line.id})

看一下添加后的结果。 按照同样的方法添加公司、平均工资、岗位名和教育背景

Cypher 复制代码
LOAD CSV WITH HEADERS FROM 'file:///node_salary.csv' AS line FIELDTERMINATOR ','
CREATE (:Salary { name: line.salary})

LOAD CSV WITH HEADERS FROM 'file:///node_title.csv' AS line FIELDTERMINATOR ','
CREATE (:Title { name: line.title})

LOAD CSV WITH HEADERS FROM 'file:///node_company.csv' AS line FIELDTERMINATOR ','
CREATE (:Company { name: line.company})

LOAD CSV WITH HEADERS FROM 'file:///node_education.csv' AS line FIELDTERMINATOR ','
CREATE (:Education { name: line.education})

characters、duties和skills 数据是使用 entity extraction 技术对岗位描述进行提取得到的,我们首先把每一个处理后的数据保存到 json 文件中。

json 复制代码
{
    "skill": [
        "前端",
        "CSS3",
        "Sass",
        "Less",
        "Vue",
        "JavaScript",
        "HTML5;"
    ],
    "character": [
        "None;"
    ],
    "duty": [
        "前端模块化,组件化开发",
        "Vue",
        "element",
        "UI",
        "Sass",
        "Less",
        "CSS3",
        "HTML5",
        "uni-app",
        "flex/grid布局",
        "项目经验者优先;"
    ]
}

然后遍历文件夹下所有 json 文件,保持数据唯一之后存至 csv 文件中。

Cypher 复制代码
LOAD CSV WITH HEADERS FROM 'file:///unique_characters.csv' AS line FIELDTERMINATOR ','
CREATE (:Characters { name: line.Data})

LOAD CSV WITH HEADERS FROM 'file:///unique_duties.csv' AS line FIELDTERMINATOR ','
CREATE (:Duties { name: line.Data})

LOAD CSV WITH HEADERS FROM 'file:///unique_skills.csv' AS line FIELDTERMINATOR ','
CREATE (:Skills { name: line.Data})

同样查看一下 技能 的节点添加情况:

注意:由于这些节点信息在保存到csv 文件的过程中我就已经去重了,如果没有提前去重,可以把上面的 Cypher 语句中的所有 CREATE 替换为 MERGE 从而实现添加&&去重。

2 关系信息导入

现在有格式如下的csv 文件:

csv 复制代码
id,company,title,education,salary
0,广东倾云科技有限公司,【初级】web前端开发工程师,大专,39.0
1,火眼科技(天津)有限公司,IT运维工程师,大专,36.0
2,郑州玉带信息技术有限责任公司,实习web前端开发工程师,大专,42.0

同样首先把文件复制到项目对应文件夹下的import 文件夹中,然后使用Cypher 语句实现数据导入BELONG关 系:

Cypher 复制代码
LOAD CSV WITH HEADERS FROM 'file:///relation1.csv' AS row
MATCH (a:Job {name: row.id})
MATCH (b:Company {name: row.company})
MERGE (a)-[:BELONG]->(b);

看一下岗位和公司之间的关系 添加 ideducationsalary 之间的关系

Cypher 复制代码
LOAD CSV WITH HEADERS FROM 'file:///relation1.csv' AS row
MATCH (a:Job {name: row.id})
MATCH (b:Education {name: row.education})
MERGE (a)-[:NEED]->(b);

LOAD CSV WITH HEADERS FROM 'file:///relation1.csv' AS row
MATCH (a:Job {name: row.id})
MATCH (b:Salary {name: row.salary})
MERGE (a)-[:OFFER]->(b);

添加 idskilldutycharacter 之间的关系

Cypher 复制代码
LOAD CSV WITH HEADERS FROM 'file:///relation_characters.csv' AS row
MATCH (a:Job {name: row.id})
MATCH (b:Characters {name: row.character})
MERGE (a)-[:REQUIRE]->(b);

LOAD CSV WITH HEADERS FROM 'file:///relation_skills.csv' AS row
MATCH (a:Job {name: row.id})
MATCH (b:Skills {name: row.skill})
MERGE (a)-[:MASTER]->(b);

LOAD CSV WITH HEADERS FROM 'file:///relation_duties.csv' AS row
MATCH (a:Job {name: row.id})
MATCH (b:Duties {name: row.duty})
MERGE (a)-[:RESPONSIBEL]->(b);

idduty 之间的关系

相关推荐
咚咚王者4 分钟前
人工智能之数学基础 概率论与统计:第二章 核心定理
人工智能·概率论
小徐Chao努力6 分钟前
Spring AI Alibaba A2A 使用指南
java·人工智能·spring boot·spring·spring cloud·agent·a2a
啊阿狸不会拉杆6 分钟前
《数字图像处理》第7章:小波变换和其他图像变换
图像处理·人工智能·python·算法·机器学习·计算机视觉·数字图像处理
yiersansiwu123d7 分钟前
生成式AI重构内容生态,人机协同定义创作新范式
大数据·人工智能·重构
老蒋新思维9 分钟前
创客匠人:从个人IP到知识变现,如何构建可持续的内容生态?
大数据·网络·人工智能·网络协议·tcp/ip·创客匠人·知识变现
HyperAI超神经14 分钟前
GPT-5全面领先,OpenAI发布FrontierScience,「推理+科研」双轨检验大模型能力
人工智能·gpt·ai·openai·benchmark·基准测试·gpt5.2
老蒋新思维19 分钟前
创客匠人洞察:从“个人品牌”到“系统物种”——知识IP的终极进化之路
网络·人工智能·网络协议·tcp/ip·重构·创客匠人·知识变现
阿杰学AI21 分钟前
AI核心知识57——大语言模型之MoE(简洁且通俗易懂版)
人工智能·ai·语言模型·aigc·ai-native·moe·混合专家模型
珠海西格电力25 分钟前
零碳园区边缘计算节点规划:数字底座的硬件部署与能耗控制方案
运维·人工智能·物联网·能源·边缘计算
臼犀29 分钟前
孩子,那不是说明书,那是祈祷文
人工智能·程序员·markdown