数据挖掘

十三画者11 小时前
人工智能·深度学习·数据挖掘·数据分析·数据可视化
【文献分享】abCRISPR:基于深度学习的脱碱基gRNA理性设计框架CRISPR-Cas9系统已成为广泛使用的基因组编辑工具,通过设计一段与靶位点(20 nt)互补的gRNA引导序列,即可轻松编程切割任何DNA序列。然而,一个关键局限始终存在:gRNA与基因组中部分匹配的序列(最多6个错配)也会诱导非预期的脱靶切割,这严重限制了CRISPR在临床和精准研究中的应用。近年来,基于CRISPR RNA在噬菌体感染过程中天然发生的脱碱基氧化可降低脱靶活性的观察,研究者开发了gRNA的脱碱基修饰(OXO)——将gRNA的18-19位(相对于PAM)替换为dSpacer(脱碱基脱氧
小小测试开发15 小时前
人工智能·数据挖掘·回归·kotlin
RAG评测:把忠实度、检索命中率、噪声敏感度做成可回归的流水线RAG 应用上线三个月后,最常见的问题不是模型不够强,而是"不知道它什么时候变差了":检索命中率悄悄掉了 8 个点、回答开始出现资料里没有的内容、往知识库加了一批新文档后噪声明显变多。这些靠人肉看案例根本发现不了。把 RAG 评测做成流水线,核心就三件事:一组可重复的黄金评测集、一套能自动打分的指标(忠实度/检索命中率/噪声敏感度)、一条挂在 CI 上的回归任务。下面是我在实际项目里的落地做法和踩过的坑。
AI棒棒牛15 小时前
人工智能·分类·数据挖掘
YOLO26最新创新改进系列:Dirichlet 分类证据 + DER 连续框不确定性,独家超强创新!截止目前,YOLO26最新创新改进系列已更新110+种,排列组合后可达到上万种创新模型!极大节省科研时间!!! 仍在持续更新中…
张人玉17 小时前
python·数据挖掘·数据分析·echarts·three.js
茶树 NeRF(Neural Radiance Fields,神经辐射场)三维重建与数据分析可视化系统——基于神经辐射场的茶树三维重建方法实现可视化大屏茶树 NeRF(Neural Radiance Fields,神经辐射场)三维重建与数据分析可视化系统。支持从茶树图片生成三维点云模型、交互式 Three.js 展示、ECharts 多维数据分析,以及日志与参数配置管理。
躺柒18 小时前
信息可视化·数据挖掘·数据分析·数据可视化·空间分析
读数据可视化14空间标量场(下)1.1. 与间接体绘制不同,直接体可视化无须从三维标量场中提取中间几何图元1.2. 体绘制积分的数学形式是一个连续积分公式,在实现时转化为离散采样模式,通过数值黎曼和来近似
hongyucai18 小时前
人工智能·分类·数据挖掘
通用分类算法的建模过程刚好就是刚才聊的σ\sigmaσ sigmoid函数。支持向量机 SVM 找最大间隔超平面;可以核函数(rbf、多项式),做非线性分类。
IT古董1 天前
大数据·人工智能·数据挖掘
FDE(Forward Deployed Engineer)详解:AI时代正在崛起的新型工程师Forward Deployed Engineer(FDE,前沿部署工程师),是一种介于软件工程师、解决方案架构师、技术顾问和产品工程师之间的新型工程岗位。
hh9501 天前
人工智能·数据挖掘·回归·单元测试·agent plan·adg成都社区·adg社区
gent Plan × DeepSeek Harness Agent 单元测试与行为回归框架在软件工程领域,随着大语言模型(LLM)在代码生成、自动化测试、智能运维等场景中的深度渗透,传统的软件质量保障体系正面临前所未有的挑战与变革。传统单元测试框架(如 JUnit、PyTest、Vitest)依赖人工编写测试用例,存在用例覆盖率低、维护成本高、难以适应快速迭代等固有缺陷;而传统的回归测试体系则侧重于接口返回值的断言,无法捕捉系统行为层面的微妙偏差。
ʜᴇɴʀʏ2 天前
数据挖掘·聚类·剪枝
AAAI 2026 | KTV:基于聚类与Token剪枝的关键帧选取论文题目:KTV: Keyframes and Key Tokens Selection for Efficient Training-Free Video LLMs
这个DBA有点耶2 天前
数据库·数据挖掘·dba
实时数据集成工具选型2026:从CDC到数据同步的完整指南大家好,我是小耶,写功课只是为了我踩过的坑,你们别再踩了!你有没有遇到过这种情况:业务方想看实时大屏,数据却要等T+1才能看到;老板要实时报表,你只能回答“明早9点出”;两个系统之间的数据需要同步,但每隔几小时才能同步一次——等你看到数据的时候,业务已经变了。
2601_950760792 天前
人工智能·分类·数据挖掘·蛋白
树突状细胞亚群的分类、标志物与功能特征简述 本文围绕树突状细胞的分类体系,系统阐述经典DC(cDC1与cDC2)、浆细胞样DC及单核细胞来源DC在人源和小鼠体系中的表面标志物、细胞因子谱及核心功能特征。
慧都小项2 天前
前端·测试工具·数据挖掘·回归·汽车·web
夜间Web回归跑到一半停了?TestComplete 15.83提升批量测试稳定性理想中的夜间回归,是下班前启动测试,第二天直接查看结果。Chrome跑一轮,Edge再跑一轮,登录、查询、下单、审批等业务流程依次完成,测试人员上班后便可以分析失败项、跟进缺陷。
逻辑君3 天前
人工智能·机器学习·数据挖掘
ANNA 意识驱动 RAG 系统版本:7.5.0 发布日期:2026年8月 状态:生产就绪在信息爆炸的时代,企业和研究机构面临的核心挑战不再是“缺乏信息”,而是“如何从海量信息中快速、准确地获取所需知识”。传统的检索系统往往依赖于关键词匹配,无法理解用户意图;而通用大语言模型虽然具备对话能力,却缺乏对特定领域知识的精准控制,容易产生“幻觉”。
民乐团扒谱机3 天前
人工智能·分类·数据挖掘
【读论文】2005 一种旋律转录的分类方法A classification approach to melody transcription[C]国标GB/T 7714-2015标准引用格式 POLINER G E, ELLIS D P W. A classification approach to melody transcription[C]
十三画者4 天前
人工智能·深度学习·数据挖掘·数据分析
【文献分享】KCFtools:基于k-mer的无比对基因组变异检测与基因型矩阵构建工具理解和利用遗传多样性对进化生物学和现代作物改良都至关重要。渐渗(introgression)——通过杂交和回交在不同物种或群体之间转移单倍型——在驯化和适应过程中扮演了关键角色,引入了如胁迫耐受性和病害抗性等有益性状。随着染色体级别参考基因组的发展,我们解析大型复杂基因组(如小麦、燕麦)的能力显著提升,大规模群体重测序和泛基因组框架的建立也揭示了与农艺性状相关的结构变异和存在/缺失变异(PAV)。然而,全面利用这些遗传资源来鉴定渐渗和可变区域,需要能够处理大规模、复杂和多样化基因组数据集的计算方法。
cspttty4 天前
大数据·数据库·人工智能·数据挖掘
会计专业大学期间考什么证会计专业考证不要只看证书名字,而要先想清楚:以后想进企业财务、会计师事务所、税务方向、银行金融,还是财务分析和业财融合岗位。
2601_966871407 天前
人工智能·数据挖掘·数据分析
菜菜AI数据分析实战课2期告别玩具数据集:菜菜AI数据分析实战课(2期)构建全链路工程壁垒在“模型即服务”的时代,算法的红利正逐渐向少数天才集中,而真正能够为企业创造巨大价值的,是那些能够打通从海量混沌数据到高质量智能输出全链路的实战派。然而,当前许多数据分析从业者仍深陷“只会调用分析库,遇到真实业务就卡壳”的困境。菜菜AI数据分析实战课(2期)正是为打破这一痛点而生,它摒弃了脱离实际的玩具数据集,用全量企业真实数据贯穿全流程,帮助学员完成从新手到企业级数据工程师的蜕变。
十三画者6 天前
人工智能·深度学习·数据挖掘·数据分析·transformer·数据可视化
【文献分享】ConfRetro:融合3D构象信息的逆合成预测Transformer框架逆合成(retrosynthesis)是有机合成和药物发现中的核心问题,其目标是从目标产物分子出发,找到能够合成该产物的反应物集合。这一任务面临着巨大的化学搜索空间和无数的分子组合,传统上高度依赖化学家的大量专业知识和经验,效率低下。近年来,数据驱动的深度学习方法在逆合成预测领域取得了显著进展,特别是无模板(template-free)方法——将逆合成视为序列到序列的机器翻译任务,直接从产物SMILES生成反应物SMILES,避免了预定义模板覆盖度有限和可扩展性差的问题。
罗政7 天前
数据挖掘·数据分析
零基础数据分析教程(5):数据从哪来获取数据不是「找个 Excel 打开」。它要回答:这个问题的数,现在落在哪套系统里、以什么形态存在、你能不能拿到、拿到的是明细还是已经加总过的结果。来源选错,后面所有计算都在替错误的表找理由。
ctlover7 天前
信息可视化·数据挖掘·数据分析
数据分析案例源码级教程:TMDB-TOP100电影数据统计分析导入依赖库、配置运行时参数、创建子图完成基本布局、加载数据.相关代码操作如下:输出结果如下:相关操作代码如下: