|-----|------|--------|--------|--------|--------|--------|--------|----------|------|---------|----------|
| 赛区 | 参赛总队 | 推送国奖队数 | 省一获奖率 | 省二获奖率 | 省三获奖率 | 总获奖率 | 本科学校总数 | 高职高专学校总数 | 参赛校数 | 本科组参赛队数 | 高职高专参赛队数 |
| 北京 | 3454 | 211 | 10.75% | 16.50% | 0.00% | 27.25% | 69 | 23 | 66 | 3374 | 80 |
| 天津 | 1566 | 131 | 10.43% | 18.86% | 0.00% | 29.29% | 31 | 25 | 40 | 1390 | 176 |
| 河北 | 1851 | 164 | 9.60% | 19.87% | 0.00% | 29.46% | 63 | 68 | 69 | 1666 | 185 |
| 山西 | 2496 | 163 | 5.97% | 10.41% | 18.71% | 35.09% | 36 | 46 | 58 | 2106 | 390 |
| 内蒙古 | 582 | 67 | 9.06% | 12.64% | 16.18% | 36.30% | 21 | 33 | 29 | 476 | 106 |
| 辽宁 | 2786 | 177 | 10.09% | 11.04% | 15.13% | 36.26% | 64 | 50 | 60 | 2729 | 57 |
| 吉林 | 1697 | 123 | 18.57% | 36.96% | 11.18% | 66.71% | 40 | 28 | 41 | 1636 | 61 |
| 黑龙江 | 2108 | 143 | 14.33% | 24.00% | 13.16% | 51.49% | 40 | 40 | 39 | 2079 | 29 |
| 上海 | 2925 | 184 | 3.73% | 15.18% | 20.54% | 39.44% | 40 | 29 | 50 | 2840 | 85 |
| 江苏 | 4312 | 254 | 9.03% | 8.81% | 13.42% | 31.25% | 82 | 93 | 119 | 4017 | 295 |
| 浙江 | 1813 | 129 | 8.38% | 14.21% | 22.92% | 45.51% | 65 | 46 | 86 | 1477 | 336 |
| 安徽 | 1928 | 134 | 9.43% | 18.85% | 28.28% | 56.56% | 50 | 76 | 78 | 1769 | 159 |
| 福建 | 2807 | 142 | 10.07% | 14.14% | 18.87% | 34.59% | 41 | 49 | 56 | 1973 | 114 |
| 江西 | 1742 | 125 | 13.01% | 12.10% | 19.57% | 39.75% | 49 | 68 | 73 | 1318 | 424 |
| 山东 | 4328 | 254 | 14.39% | 19.96% | 19.38% | 51.94% | 72 | 95 | 122 | 3926 | 402 |
| 河南 | 3518 | 220 | 20.87% | 24.01% | 26.48% | 71.36% | 62 | 116 | 103 | 3005 | 513 |
| 湖北 | 2833 | 180 | 10.05% | 14.96% | 20.06% | 45.06% | 70 | 64 | 89 | 2667 | 166 |
| 湖南 | 1823 | 192 | 7.72% | 10.38% | 12.27% | 30.36% | 54 | 93 | 73 | 1620 | 203 |
| 广东 | 6886 | 382 | 8.08% | 14.89% | 22.49% | 44.95% | 77 | 89 | 115 | 6284 | 602 |
| 广西 | 1611 | 119 | 7.72% | 10.46% | 19.38% | 37.56% | 41 | 48 | 53 | 1297 | 314 |
| 海南 | 473 | 62 | 5.54% | 10.59% | 20.32% | 36.41% | 11 | 17 | 16 | 436 | 37 |
| 重庆 | 2039 | 140 | 13.03% | 14.97% | 0.00% | 28.00% | 29 | 46 | 60 | 1500 | 539 |
| 四川 | 2885 | 182 | 14.70% | 13.09% | 14.05% | 36.91% | 55 | 86 | 85 | 2621 | 264 |
| 贵州 | 1177 | 97 | 22.09% | 41.00% | 20.61% | 85.69% | 32 | 48 | 46 | 902 | 275 |
| 云南 | 733 | 125 | 12.42% | 13.03% | 21.68% | 47.11% | 35 | 57 | 37 | 1619 | 114 |
| 西藏 | 44 | 40 | 17.39% | 55.22% | 0.00% | 37.41% | 5 | 3 | 3 | 1938 | 6 |
| 陕西 | 5390 | 308 | 22.39% | 25.79% | 0.00% | 41.71% | 61 | 37 | 85 | 4740 | 650 |
| 甘肃 | 1198 | 98 | 7.92% | 11.44% | 16.17% | 35.53% | 28 | 21 | 31 | 1034 | 164 |
| 青海 | 110 | 44 | 15.00% | 35.00% | 0.00% | 50.00% | 6 | 7 | 5 | 88 | 22 |
| 宁夏 | 164 | 62 | 8.49% | 9.65% | 15.06% | 32.14% | 10 | 12 | 10 | 157 | 7 |
| 新疆 | 639 | 70 | 6.09% | 5.79% | 13.02% | 23.31% | 26 | 41 | 25 | 567 | 72 |
需要更多资料的宝子们可以+企鹅获取
|------------------------------------------|----------|----------|----------|-------------------------------------------------------|---------------------------------------------------------------------------------------------------------------|
| 模型名称 | 模型大类 | 具体分组 | 模型类别 | 适用场景 | 数据要求 |
| 反距离权重插值(IDW) | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 空间散点数据插值成面;污染物/气象要素空间分布估计;测量点网格化;空间字段缺失值填补 | 🔹 数据分布:空间连续且自相关(近邻相似)<br/>🔹 最少样本量:≥5个已知采样点<br/>🔹 标准化/预处理:统一坐标与单位,检查并处理异常值 |
| 分段线性插值 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 单调或分段折线数据加密;传感器数据点间补点;表格函数快速取中值;无需光滑的时间序列补缺 | 🔹 数据分布:自变量有序排列、无重复<br/>🔹 最少样本量:≥3个数据点<br/>🔹 标准化/预处理:数据按自变量排序,剔除明显错误点 |
| 径向基函数插值(RBF) | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 散乱多维点云插值与表面重构;不规则网格数据成规则网格;图像/地形重建;高维代理模型 | 🔹 数据分布:任意空间分布、允许散乱无序<br/>🔹 最少样本量:≥10个已知点(节点数越多越稳)<br/>🔹 标准化/预处理:各维坐标缩放到同一尺度,合并重复点 |
| 三次样条插值 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 光滑曲线还原;数据加密与绘图平滑;数值微分;CAD/轨迹插值 | 🔹 数据分布:自变量严格递增无重复<br/>🔹 最少样本量:≥4个节点<br/>🔹 标准化/预处理:节点排序去重,预先确定边界条件 |
| 有理函数插值 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 含极点或竖直渐近行为的数据拟合;宽范围变化数据;级数外推加速;物理量含分母奇异结构 | 🔹 数据分布:可含类似极点突变、无重复节点<br/>🔹 最少样本量:≥4个点(分子分母阶数至少各2)<br/>🔹 标准化/预处理:节点排序,检查极点是否落入插值区间 |
| 重心插值法 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 高次多项式插值的稳定实现(谱方法);配点法求解微分方程;插值多项式的快速求值;等距节点的数值逼近 | 🔹 数据分布:节点可任意,等距节点高次易振荡宜改用Chebyshev节点<br/>🔹 最少样本量:≥3个节点<br/>🔹 标准化/预处理:节点归一化到-1,1以改善条件数 |
| 自然邻域插值 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 稀疏且分布不规则的空间点插值;气象站/监测点面化;局部影响范围明确的表面重建;避免外推的插值需求 | 🔹 数据分布:空间连续、点分布不规则<br/>🔹 最少样本量:≥4个已知点(形成邻域)<br/>🔹 标准化/预处理:坐标统一,重复点合并 |
| B 样条插值 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | CAD曲线曲面设计;轨迹平滑与数据压缩;数据平滑近似;局部修改不影响全局的建模 | 🔹 数据分布:点列有序、允许含噪声<br/>🔹 最少样本量:≥4个点(三次B样条)<br/>🔹 标准化/预处理:点列参数化(均匀/弦长)、去重 |
| Hermite 插值法 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 同时给定函数值与导数的插值(轨迹/运动状态);保形插值(单调数据不产生过冲);数值微分验证;CAD端点约束 | 🔹 数据分布:函数值与导数值成对给出<br/>🔹 最少样本量:≥2个节点(每个含值与导数)<br/>🔹 标准化/预处理:导数与自变量量纲一致,检查导数方向合理性 |
| Kriging 克里金插值 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 地质/土壤/气象空间变量最优估计;矿藏储量估值;环境监测面化;需要估计方差的空间插值 | 🔹 数据分布:空间二阶平稳(或内蕴)假设<br/>🔹 最少样本量:≥15个点(变差函数可稳定估计)<br/>🔹 标准化/预处理:去除趋势(漂移)、必要时正态变换、检查各向异性 |
| LOESS 局部多项式平滑 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 时间序列趋势提取;散点趋势可视化;去除噪声揭示局部模式;无参数回归拟合 | 🔹 数据分布:任意分布、允许含噪声与离群点<br/>🔹 最少样本量:≥10个点(窗口内至少5-10点)<br/>🔹 标准化/预处理:统一x尺度,设定带宽span与多项式次数 |
| Newton 插值法 | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 逐步增加节点的插值计算;表格函数插值;差分与差商递推;多项式插值的增量式实现 | 🔹 数据分布:节点互异、自变量有序<br/>🔹 最少样本量:≥2个节点<br/>🔹 标准化/预处理:节点排序去重 |
| 多项式插值(Polynomial Interpolation) | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 少量节点间的数值逼近;理论函数复现;数值积分/微分基函数;谱方法基础 | 🔹 数据分布:节点互异、数据无噪声<br/>🔹 最少样本量:≥2个节点(n点确定n-1次多项式)<br/>🔹 标准化/预处理:等距节点次数不宜高,可改用Chebyshev节点 |
| 均值/中位数/众数填补(Mean/Median/Mode Imputation) | 数据预处理 | 插值与数值逼近 | 数据预处理 | 缺失率低的简单填补;连续变量(均值/中位数)与分类变量(众数)快速补全;作为复杂插补的对照基准 | 🔹 数据分布:缺失机制应为MCAR(或轻度MAR)<br/>🔹 最少样本量:无最低要求,需可估计中心值(≥几例观测)<br/>🔹 标准化/预处理:先分析缺失模式与比例,分类变量用众数、偏态连续变量用中位数 |
| 前向填充/后向填充(Forward/Backward Fill) | 数据预处理 | 插值与数值逼近 | 数据预处理 | 时间序列/面板数据缺段;传感器瞬时缺失;纵向随访数据LOCF;经济序列短缺口 | 🔹 数据分布:有序时间或纵向结构<br/>🔹 最少样本量:≥2个观测(有可继承的前值)<br/>🔹 标准化/预处理:按时间排序,确认缺口长度 |
| 线性插值(Linear Interpolation) | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 表格数据取中值;时间序列相邻点补缺;量纲换算与查表;温度/利率等连续量的快速估计 | 🔹 数据分布:自变量有序、区间内近似线性<br/>🔹 最少样本量:≥2个点<br/>🔹 标准化/预处理:排序去重 |
| 样条插值(Spline Interpolation) | 数据预处理 | 插值与数值逼近 | 插值与拟合 | 平滑曲线重建;数据加密;数值微分;曲线拟合与光滑化的通用选择 | 🔹 数据分布:有序点列、最好较光滑<br/>🔹 最少样本量:≥4个节点(三次样条)<br/>🔹 标准化/预处理:节点排序去重,选次数与边界条件 |
| 等距对数比变换(ILR) | 数据预处理 | 数据变换与标准化 | 数据预处理 | 成分数据(和为固定值)的多元分析;微生物组/地球化学数据;成分回归与判别;样本间距离计算 | 🔹 数据分布:各行成分为正且和为常数<br/>🔹 最少样本量:≥D个样本(D为成分数)<br/>🔹 标准化/预处理:零值须先处理(如乘法替换),成分和校准 |
| 概率积分变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 分布拟合优度检验(PIT残差);随机数生成(逆变换抽样);Copula建模;把任意连续分布映射到均匀分布 | 🔹 数据分布:连续型随机变量、CDF已知或可估计<br/>🔹 最少样本量:≥几十(检验PIT均匀性需样本量)<br/>🔹 标准化/预处理:若CDF含参数需先估计参数 |
| 加性对数比变换(ALR) | 数据预处理 | 数据变换与标准化 | 数据预处理 | 成分数据的统计建模;选定参考成分的相对比较;微生物组差异丰度分析;成分比例回归 | 🔹 数据分布:成分为正<br/>🔹 最少样本量:≥D个样本(D为成分数)<br/>🔹 标准化/预处理:零值替换、选定参考成分 |
| 逆正态变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 把非正态变量映射到近似正态;参数检验前提修复;回归/方差分析前正态化;多变量联合正态近似 | 🔹 数据分布:连续变量(允许偏态)<br/>🔹 最少样本量:≥30(估计分位/秩较稳定)<br/>🔹 标准化/预处理:需标准正态CDF Φ及变换策略(秩基或解析) |
| 秩正态化变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 稳健地正态化偏态数据;基因/生物数据批量归一化;非正态数据的关联分析;对离群点稳健的预处理 | 🔹 数据分布:任意连续(可含离群点)<br/>🔹 最少样本量:≥30(秩分位数较稳定)<br/>🔹 标准化/预处理:处理缺失与重复值(平局秩) |
| 中心化对数比变换(CLR) | 数据预处理 | 数据变换与标准化 | 数据预处理 | 成分数据的多元分析(如PCA);微生物组组成分析;成分可视化;作为ILR/ALR的中间表示 | 🔹 数据分布:成分为正<br/>🔹 最少样本量:≥D个样本(D为成分数)<br/>🔹 标准化/预处理:零值替换(如伪计数) |
| Anscombe 方差稳定变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 泊松计数数据的方差稳定;图像泊松去噪预处理;计数回归前的方差均匀化;小计数数据的正态近似 | 🔹 数据分布:泊松型计数(均值较小时更适用)<br/>🔹 最少样本量:取决于均值大小,均值≥几为宜<br/>🔹 标准化/预处理:确认数据为计数、零值占比不高 |
| Arcsine 平方根变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 比例/百分比数据的方差稳定;二项分布比例的正态近似;生态比例数据的统计分析;0-1区间响应变量 | 🔹 数据分布:比例/百分数(0-1或0-100)<br/>🔹 最少样本量:各比例基于≥一定试验次数<br/>🔹 标准化/预处理:百分比先除以100归一化,端点值需处理 |
| Box-Cox 对称变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 正数数据的正态化;回归/方差分析前分布改善;时间序列方差稳定;偏态数据的对称化 | 🔹 数据分布:全为正数(或平移后为正)<br/>🔹 最少样本量:≥30(λ估计较稳定)<br/>🔹 标准化/预处理:非正数据需加平移常数 |
| Chord 变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 生态丰度数据的距离计算;成分数据的弦距离;丰度向量的方向比较;群落分析预处理 | 🔹 数据分布:非负丰度/计数或成分数据<br/>🔹 最少样本量:≥几十个样本<br/>🔹 标准化/预处理:确认非负、关注零值处理 |
| Fisher Z 变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 相关系数的置信区间与检验;元分析中合并相关系数;相关差异的显著性检验;相关量的推断转换 | 🔹 数据分布:样本近似二元正态<br/>🔹 最少样本量:≥10(小样本时Z近似较弱)<br/>🔹 标准化/预处理:样本相关系数r须在(-1,1)内 |
| Freeman-Tukey 变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 泊松小计数数据的方差稳定;零值较多的计数数据处理;拟合优度检验统计量;百分比数据的变换 | 🔹 数据分布:泊松/二项计数(含较多小值与零)<br/>🔹 最少样本量:取决于均值,小均值时需更多样本<br/>🔹 标准化/预处理:确认计数类型(泊松或二项) |
| Hellinger 变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 生态丰度数据的多元分析(PCA/RDA前);群落组成差异;成分数据的低维嵌入准备;高零值丰度数据处理 | 🔹 数据分布:非负丰度/计数<br/>🔹 最少样本量:≥几十个样本<br/>🔹 标准化/预处理:非负确认,可与标准化配合 |
| Helmert 变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 方差分析中的正交对比;成分数据的正交基变换;类别变量的正交编码;分层线性模型的对比编码 | 🔹 数据分布:类别/水平数明确的因子或成分数据<br/>🔹 最少样本量:各水平样本量≥几<br/>🔹 标准化/预处理:确定水平顺序(逐层对比) |
| Pareto Scaling | 数据预处理 | 数据变换与标准化 | 数据预处理 | 代谢组学/NMR等组学数据预处理;突出低浓度变量贡献;多元统计(PCA/PLS)前缩放;减少高丰度变量主导 | 🔹 数据分布:连续测量值、可含高丰度低变异变量<br/>🔹 最少样本量:≥几十个样本<br/>🔹 标准化/预处理:去中心化、异常值检查 |
| Probit 变换 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 比例/概率数据的建模(probit回归);二分数据的GLM;剂量反应分析;把概率映射到线性空间做回归 | 🔹 数据分布:0-1比例或二分响应<br/>🔹 最少样本量:各类别样本≥几例<br/>🔹 标准化/预处理:概率勿取0/1端点(需处理) |
| VAST Scaling | 数据预处理 | 数据变换与标准化 | 数据预处理 | 代谢组学(NMR)数据预处理;突出稳定低噪声变量的贡献;多元建模前的变量加权;生物标志物筛选 | 🔹 数据分布:连续测量、含大量相对稳定变量<br/>🔹 最少样本量:≥几十个样本<br/>🔹 标准化/预处理:去中心化、剔除不稳定测量 |
| Wisconsin 双重标准化 | 数据预处理 | 数据变换与标准化 | 数据预处理 | 生态群落数据(样地×物种)标准化;丰度数据的多元分析准备;突出常见种与富样地;相似性/距离计算前处理 | 🔹 数据分布:样地×物种丰度矩阵<br/>🔹 最少样本量:≥几十个样地<br/>🔹 标准化/预处理:非负计数确认、零值策略 |
| 多维尺度分析(MDS) | 数据预处理 | 降维与流形学习 | 聚类与降维 | 距离/相似矩阵的可视化;偏好与感知图谱;多维数据低维再现;心理学/社会学结构分析 | 🔹 数据分布:任意(只需距离/相异矩阵)<br/>🔹 最少样本量:≥10个对象<br/>🔹 标准化/预处理:构造合适的距离度量,处理缺失距离 |