scikit-learn

TechEdu20260621 小时前
人工智能·机器学习·ai·scikit-learn
[人工智能]Scikit-learn:Python中的实用机器学习库Scikit-learn:Python中的实用机器学习库本文面向工程实践介绍Python机器学习库scikit-learn,包括其设计理念、核心API约定以及主要估计器家族。同时讨论数据预处理、模型选择和评估等典型工作流程,并通过示意图表说明常见用法。文中示例仅为示意,不代表具体产品或标准性能指标。
databook1 天前
python·机器学习·scikit-learn
基于模型的重要性评分进行“特征排序”前几篇介绍了使用方差阈值,相关性分析以及统计检验等方式来过滤特征,这些方法都有一个共同点,就是由人来决定如何打分。
心运软件3 天前
人工智能·python·算法·随机森林·机器学习·分类·scikit-learn
基于机器学习的智能邮件分类系统:从数据采集到模型部署全流程实战本文摘要:本文详细介绍了一个基于机器学习的智能邮件分类系统,涵盖数据采集、中文文本预处理、TF-IDF特征提取、五种机器学习模型对比训练、模型评估与可视化、GUI系统开发全流程。系统使用5,518封中英文混合邮件(中文占比74.6%)作为数据集,SVM模型在测试集上取得92.39%的准确率和92.33%的F1值。文中包含完整可运行代码,适合NLP入门和课程设计参考。 本文代码+数据:https://pan.quark.cn/s/c2e80eb58fa0
Patrick在香港4 天前
开发语言·python·数据分析·scikit-learn·ai编程·pip·uv
Python依赖管理从踩坑到选型:pip/poetry/uv四种方案全面实测这个报错你见过几次?我在香港的第一个Python项目——一个处理强积金数据的Flask应用——上线前就因为pip install的依赖冲突回滚了两次。那之后我把pip、pipenv、poetry、uv全部测了一遍。
databook5 天前
python·机器学习·scikit-learn
用统计检验来确定“重要特征”在做机器学习建模的时候,经常遇到一个让人头疼的问题:手上有几十甚至上百个特征,到底哪些该留、哪些该丢?
HZZD_HZZD7 天前
算法·scikit-learn·kmeans
用电负荷聚类分析实战:基于`scikit-learn`的`K-Means`与`DBSCAN`双算法对比、`PCA`降维可视化与智能电表负荷画像全流程核心内容:基于某产业园152条配电回路、90天、15分钟粒度的4G智能电表实测数据,完整走通一条负荷聚类分析流水线:
databook8 天前
python·机器学习·scikit-learn
用相关性分析消除“冗余特征”刚开始学机器学习时,我也像大部分人 一样,有个很朴素的想法:特征越多,模型能学到的信息就越多,效果自然越好。
databook11 天前
python·机器学习·scikit-learn
用方差阈值过滤掉“惰性特征”在机器学习实战中,我们常常把精力花在调参和选模型上,却忽略了一个更基础的问题:喂给模型的数据里,有多少特征是真正有用的?
happyprince1 个月前
python·架构·scikit-learn
01_scikit-learn-项目全景_架构与设计哲学维度一:项目定位与生态定位、代码结构、设计理念、原理、实现细节、整体流程。本篇采用「总—分—总」结构:先从宏观定位 scikit-learn 在科学 Python 生态中的角色,再分五个专题深挖其代码结构、设计理念、性能工程与工作流,最后收束于其设计哲学的统一性。全篇配 6 张图(含 mermaid 与概念图),并附使用指南与端到端案例。
大鱼>1 个月前
python·机器学习·scikit-learn
Scikit-learn Pipeline:构建可复用的 ML 流水线
ednO8nqdR1 个月前
python·plotly·django·virtualenv·scikit-learn·fastapi·pygame
Python小游戏制作:如何实现可配置的跨分辨率界面布局Python小游戏制作:如何实现可配置的跨分辨率界面布局要让 UI 在不同屏幕下保持一致风格,需要建立一个 “虚拟参考分辨率”。
大学生就业之家【央国企就业指导】1 个月前
scrapy·scikit-learn·pygame
央国企求职避免无效海投央国企求职避免无效海投 你有没有想过,每天守在电脑前疯狂海投几十份简历,这种看似努力的“勤奋”,可能正在浪费你应届生最宝贵的身份优势?数据显示,超过七成的应届生其实都在进行着无效求职,根本原因在于没有摸透央国企招人的“隐形规则”。
hboot2 个月前
python·scikit-learn·kaggle
AI工程师第三课 - 机器学习基础学习代码记录仓库使用Jupyter lab测试执行代码验证。Scikit-learn(sklearn)是一个开源机器学习库,支持监督学习和非监督学习。提供了用于模型拟合、数据预处理、模型选择、模型评估以及许多其他实用工具。
cvcode_study2 个月前
python·机器学习·scikit-learn
Scikit-learnScikit-learn是一个开源机器学习库,支持有监督和无监督学习。它还提供了各种工具 模型拟合、数据预处理、模型选择、模型评估, 以及许多其他公用事业。
2601_961875242 个月前
python·django·flask·virtualenv·scikit-learn·pygame·tornado
花生十三资源盘|电子版|全科
龙腾AI白云2 个月前
人工智能·virtualenv·scikit-learn
用知识图谱重构搜索引擎用知识图谱重构搜索引擎一、传统搜索:关键词的“机械匹配”时代 二、知识图谱登场:从“字面”到“语义” 三、搜索体验的重构:从十条链接到一个答案 四、典型应用:主流搜索引擎的变革 五、未来搜索:更深、更广、更个性化
龙腾AI白云2 个月前
scikit-learn·知识图谱
从GPT到开源大模型从GPT到开源大模型一、 GPT的崛起:闭源大模型的“奇点时刻” 二、开源的力量:大模型不再是少数人特权 三、核心差异:闭源 vs 开源,各有什么优劣 四、开源生态:从LLaMA到魔搭,百花齐放 五、未来展望:开源与闭源将长期共存
SilentSamsara2 个月前
开发语言·人工智能·python·机器学习·青少年编程·numpy·scikit-learn
scikit-learn 工作流工程化:Pipeline、ColumnTransformer 与自定义转换器没有 Pipeline 的机器学习代码通常在 Jupyter Notebook 中散落为以下碎片:StandardScaler().fit_transform(X_train) 在一行,model.fit() 在翻了好几页后的另一个 Cell 里,预处理和训练之间被分析和可视化的代码隔开。更致命的是,交叉验证时很容易把 fit_transform 应用于整个数据集而非仅训练集,导致测试集信息泄漏到训练过程中——这种 Bug 不会报错,只会让交叉验证分数虚高,而模型上线后的真实表现远低于预期。scikit-
weixin_468466852 个月前
人工智能·神经网络·机器学习·scikit-learn·sklearn·评价指标·网络模型
神经网络模型评价指标新手实战指南在机器学习模型的开发过程中,很多开发者容易陷入一个误区:认为只要模型的“准确率”高,就是一个好模型。但在实际业务中,尤其是面对数据分布不均的场景时,单纯依赖准确率往往会掩盖模型的真实表现。比如在一个欺诈检测系统中,如果欺诈样本只占总量的 1%,那么即使模型将所有样本都预测为“正常”,其准确率也能高达 99%,但这个模型实际上毫无用处,因为它漏掉了所有的欺诈行为。
恣艺3 个月前
python·机器学习·scikit-learn
Python 实用工具与机器学习入门:Rich + Tqdm + Faker + Schedule + Scikit-learn专栏:Python 常用工具库实战教程 | 第五篇 适合人群:Python 开发者、数据分析师、自动化运维工程师