在PAI-DSW中连接Neo4J,并批量创建知识图谱

我在 阿里云DSW实例中安装并运行Neo4J 中提到过,由于PAI-DSW的专有网络配置不能确保百分之百成功,因而很难实现通过本地的浏览器登录在PAI-DSW中启动的Neo4J图数据库。

我当时想出的一个解决办法是使用./cypher-shell语句在命令行登录neo4j,然后使用Cypher语句在命令行实现节点的增删改查。然而,如果我们想要批量创建大量的节点及关系,这种方法也很不现实。

我今天想到的一个新的解决方法是:在PAI-DSW的命令行使用./cypher-shell语句登录neo4j,然后在PAI-DSW的NoteBook中使用neo4j模块或者py2neo模块连接(在PAI-DSW的命令行中)已启动的neo4j,进行批量的节点和关系创建。这样的做法就类似于在本地的命令行启动neo4j,然后再在本地的NoteBook中使用neo4j模块或py2neo模块连接(本地命令行中启动的)neo4j,在命令行和NoteBook中登录的neo4j都处于同一局域网中。

除了需要命令行和Notebook都处于同一局域网中,该方案的另一个前提 是:命令行和Notebook都需要使用同一个Python环境,具体做法详见博客 PAI-DSW中对齐NoteBook和命令行的Python环境

1. 在命令行登录neo4j

(1)先使用下面的代码启动neo4j

python 复制代码
neo4j start

运行结果如下:

(2)然后进入neo4j安装文件夹的bin文件,运行./cypher-shell,并输入用户名和密码进行登录。

运行结果如下:

(3)使用Cypher语句查询所登录的Neo4J的图数据库中的节点数量(方便之后验证)

python 复制代码
MATCH(n) RETURN count(n) AS totalNodes

运行结果如下:

2. 在NoteBook中使用neo4j模块连接neo4j图数据库

python 复制代码
from neo4j import GraphDatabase

class Neo4jService(object):
    def __init__(self, uri, auth):
        self._driver = GraphDatabase.driver(uri, auth = auth)

    def close(self):
        self._driver.close()

    def run_query(self, query):
        with self._driver.session() as session:
            result = session.run(query)
            return result.values()

username = 'neo4j'
password = 'xxxx' # your password
auth = (username, password)
neo4j = Neo4jService("bolt://localhost:7687", auth)
answer1 = 'MATCH(n) RETURN count(n) AS totalNodes'
result = neo4j.run_query(answer1)

上面的代码运行结果如下,可知在NoteBook中能连接在命令行中启动的那个neo4j数据库。

然后使用neo4j.close()关闭与数据库的连接。

3. 在NoteBook中使用py2neo模块连接neo4j图数据库

(1)使用下面的代码先连接neo4j数据库,然后再新增一个节点

python 复制代码
from py2neo import Graph,Node,Relationship,NodeMatcher

graph=Graph("bolt://localhost:7687", auth = auth) #连接

book_node=Node('经名',name='十三经') 
graph.create(book_node) #新增节点

(2)在命令行查看节点数是否加1

这是的节点总数变成了32,较之之前多一个,所以py2neo也是能成功连接neo4j的。

在NoteBook中使用neo4j模块或py2neo模块连接neo4j数据库的过程中需要注意的是,命令行中start的neo4j数据库要一直保持运行状态

PS:

在后面使用p2neo批量创建节点和关系的时候,需要调用到xlrd第三方库,碰到了如下报错:

XLRDError: Excel xlsx file; not supported

参考博客 python xlrd库报错AttributeError 进行了解决。

最后使用py2neo迅速地创建了1000多个节点。关于如何使用py2neo批量创建节点,我这里就不再介绍了,网上也很多相关的代码。

相关推荐
m0_650108241 天前
【论文精读】CMD:迈向高效视频生成的新范式
人工智能·论文精读·视频扩散模型·高效生成·内容 - 运动分解·latent 空间
电鱼智能的电小鱼1 天前
基于电鱼 AI 工控机的智慧工地视频智能分析方案——边缘端AI检测,实现无人值守下的实时安全预警
网络·人工智能·嵌入式硬件·算法·安全·音视频
年年测试1 天前
AI驱动的测试:用Dify工作流实现智能缺陷分析与分类
人工智能·分类·数据挖掘
唐兴通个人1 天前
人工智能Deepseek医药AI培训师培训讲师唐兴通讲课课程纲要
大数据·人工智能
共绩算力1 天前
Llama 4 Maverick Scout 多模态MoE新里程碑
人工智能·llama·共绩算力
DashVector1 天前
向量检索服务 DashVector产品计费
数据库·数据仓库·人工智能·算法·向量检索
AI纪元故事会1 天前
【计算机视觉目标检测算法对比:R-CNN、YOLO与SSD全面解析】
人工智能·算法·目标检测·计算机视觉
音视频牛哥1 天前
从协议规范和使用场景探讨为什么SmartMediaKit没有支持DASH
人工智能·音视频·大牛直播sdk·dash·dash还是rtmp·dash还是rtsp·dash还是hls
赞奇科技Xsuperzone1 天前
DGX Spark 实战解析:模型选择与效率优化全指南
大数据·人工智能·gpt·spark·nvidia
音视频牛哥1 天前
SmartMediaKit:如何让智能系统早人一步“跟上现实”的时间架构--从实时流媒体到系统智能的演进
人工智能·计算机视觉·音视频·音视频开发·具身智能·十五五规划具身智能·smartmediakit