Ubuntu 24.04 LTS源码安装doccano

引言

doccano 是一款面向机器学习从业者的开源数据标记工具。您可以使用 doccano 执行不同类型的标记任务,支持多种数据格式。要了解 doccano 的功能,请试用doccano 演示版

1.软件下载

复制代码
git clone https://github.com/doccano/doccano.git
cd doccano

2.前后端依赖下载

doccano 后端内置于 Python 3.8+ 中,并使用Poetry作为依赖项管理器。首先我们下载Poetry。

我们使用pipx安装Poetry,如果没有安装pipx,请运行以下命令安装:

复制代码
sudo apt update
sudo apt install pipx
pipx ensurepath
#允许全局范围内的 pipx 操作。
sudo pipx ensurepath --global
#查看版本
pipx --version

如果apt更新失败,修改以下文件

复制代码
sudo nano /etc/apt/sources.list.d/ubuntu.sources

在文件中,将 cn.archive.ubuntu.com 替换为其他可靠的镜像源,例如 mirrors.ustc.edu.cnmirrors.aliyun.com

接下来安装Poetry

复制代码
pipx install poetry
#让 pipx 自动将 ~/.local/bin 添加到你的 PATH 环境变量中
pipx ensurepath
复制代码
需要 打开一个新的终端窗口。

后端依赖安装

复制代码
#先使用anaconda3创建一个虚拟环境
source ~/anaconda3/bin/activate
#python版本选择3.10不会有依赖冲突
conda create -n doccano python=3.10
conda activate doccano
​
#进入后端
cd backend
poetry install
#已经有创建的虚拟环境doccano,不需要运行了
poetry shell

前端依赖安装

先安装yarn

复制代码
curl -sS https://dl.yarnpkg.com/debian/pubkey.gpg | sudo apt-key add -
echo "deb https://dl.yarnpkg.com/debian/ stable main" | sudo tee /etc/apt/sources.list.d/yarn.list
sudo apt update
sudo apt install yarn
​
#验证安装
yarn --version
​
#安装前端依赖
cd frontend
yarn install
​
复制代码

3.启动项目

后端:

复制代码
cd backend
python manage.py migrate
python manage.py create_roles
python manage.py create_admin --noinput --username "admin" --email "admin@example.com" --password "password"
python manage.py runserver

在另一个终端中,您需要运行 Celery 来使用导入/导出数据集功能:

复制代码
cd backend
celery --app=config worker --loglevel=INFO --concurrency=1

前端:

复制代码
yarn dev

直接访问:

源码有一个问题,创建项目会报错,因为跨域问题:

需要修改doccano/doccano-master/backend/config/settings/base.py

把前端的IP地址和端口号加进去CSRF_TRUSTED_ORIGINS。

最后

如果不需要改源码建议pip直接安装

官方文档:Install and upgrade doccano - doccano

安装命令:

要使用 pip 安装 doccano,您需要 Python 3.8+。运行以下命令:

复制代码
pip install doccano

安装 doccano 后,使用以下命令启动服务器:

复制代码
# Initialize database. First time only.
doccano init
# Create a super user. First time only.
doccano createuser --username admin --password pass
# Start a web server.
doccano webserver --port 8000

在另一个终端中,运行以下命令:

复制代码
# Start the task queue to handle file upload/download.
doccano task

打开http://localhost:8000/

相关推荐
LaughingZhu1 天前
Product Hunt 每日热榜 | 2026-06-12
人工智能·经验分享·深度学习·神经网络·产品运营
数据门徒1 天前
神经网络原理 第十一章:植根于统计力学的随机机器和它们的逼近
人工智能·深度学习·神经网络
沪漂阿龙1 天前
LangChain 系列之 Messages:为什么大模型对话不是简单字符串?
人工智能·深度学习·langchain
DXM05211 天前
第13期|遥感语义分割模型:U-Net核心原理+遥感落地优势
人工智能·python·深度学习·目标检测·随机森林·机器学习·支持向量机
叫我:松哥1 天前
基于Python的共享单车租赁数据分析与预测系统,技术栈flask+boostrap+随机森林+XGBoost
人工智能·python·深度学习·算法·随机森林·数据分析·flask
王小王-1231 天前
基于深度学习的个性化音乐推荐系统的设计与开发
人工智能·深度学习·mysql·vue·推荐算法·个性化音乐推荐系统·音乐预测
现代野蛮人1 天前
【深度学习】 —— 几种优化器对比实验
人工智能·深度学习·分类·tensorflow
YOLO视觉与编程1 天前
jetson orin nano烧录jetpack7.2系统
人工智能·深度学习·yolo·目标检测·机器学习
DeniuHe1 天前
什么是嵌入空间?听起来高大上,其实。。。
深度学习
qq_291579251 天前
电商主图优化实战指南:AI工具如何提升点击率与转化率
大数据·人工智能·深度学习