django通过关联表字段进行排序并去重

在 Django 中,要通过关联模型(Pathogen 表)的 pathogen_name 字段对 Sample 表的 queryset 进行排序,可以使用 Django ORM 的 annotateorder_by 方法。

以下是具体的实现方式:

假设的模型结构

python 复制代码
class Sample(models.Model):
    name = models.CharField(max_length=100)

class Pathogen(models.Model):
    pathogen_name = models.CharField(max_length=100)
    sample = models.ForeignKey(
        Sample, 
        on_delete=models.SET_NULL, 
        verbose_name='样品编号', 
        null=True, 
        related_name='virus'
    )

问题?

Sample.objects.order_by('virus__pathogen_name') 返回的结果有重复的sample_id,如何去掉他们?

在 Django ORM 中,order_by('virus__pathogen_name') 会导致重复的 Sample 对象出现,因为它基于关联表的多对一关系。如果你想去掉重复的 Sample 对象,可以使用 .distinct() 方法。不过,distinct() 的行为依赖于数据库后端。

以下是解决重复 sample_id 的方法:

方法 1:使用 .distinct() 去重

python 复制代码
Sample.objects.order_by('virus__pathogen_name').distinct()
  • 解释distinct() 会去掉重复的 Sample 实例(基于主键)。此方法在大多数情况下有效,但如果排序字段涉及多表 JOIN,一些数据库(例如 MySQL)可能不支持完全去重,尤其是当使用 order_by 时。

方法 2:通过 annotate 获取第一个关联的 Pathogen 并排序

如果 .distinct() 无法正常去重,你可以通过 annotate 方式解决,只取与 Sample 关联的第一个 Pathogen.pathogen_name

python 复制代码
from django.db.models import Min

Sample.objects.annotate(
    first_pathogen_name=Min('virus__pathogen_name')
).order_by('first_pathogen_name')
  • 解释
    • Min('virus__pathogen_name') 获取与每个 Sample 关联的最小(按字母排序第一个)pathogen_name
    • 这样每个 Sample 只会出现一次,且按照 first_pathogen_name 排序。

方法 3:使用子查询避免重复

使用 Subquerydistinct 结合可以更灵活地解决问题:

python 复制代码
from django.db.models import Subquery, OuterRef

Sample.objects.filter(
    pk__in=Subquery(
        Pathogen.objects.filter(
            sample=OuterRef('pk')
        ).order_by('pathogen_name').values('sample').distinct()
    )
).order_by('virus__pathogen_name')
  • 解释
    • 使用 Subquery 获取去重后的 Sample 主键。
    • 确保最终只返回唯一的 Sample 对象。

总结

  • 如果 .distinct() 能够满足需求,直接使用是最简单的方式。
  • 如果需要更精确的控制,annotateSubquery 提供更灵活的解决方案。推荐结合你的排序逻辑和数据库类型测试最佳方法。
相关推荐
SimonKing23 分钟前
聊聊Spring里那个不打扰Controller就能统一改响应的“神器”
java·后端·程序员
TDengine (老段)30 分钟前
TDengine 数学函数 TRUNCATE 用户手册
大数据·数据库·物联网·时序数据库·iot·tdengine·涛思数据
鹓于34 分钟前
Excel图片批量插入与文件瘦身
java·服务器·数据库
Moment35 分钟前
Soul 发布超强端侧语音模型,没错,就是你想的那个 Soul 😍😍😍
前端·后端·github
TDengine (老段)35 分钟前
TDengine 数据函数 CORR 用户手册
大数据·数据库·物联网·时序数据库·tdengine·1024程序员节
鬼火儿37 分钟前
Redis Desktop Manager(Redis可视化工具)安装
java·后端
逻极1 小时前
Rust之旅的起点:为什么选择Rust?
开发语言·后端·rust
摸鱼的春哥1 小时前
组合为啥比继承更高级?以构建buff系统为例
前端·javascript·后端
Tony Bai1 小时前
从 Python 到 Go:我们失去了什么,又得到了什么?
开发语言·后端·python·golang
华如锦1 小时前
使用SSE进行实时消息推送!替换WebSocket,轻量好用~
java·开发语言·网络·spring boot·后端·websocket·网络协议