大数据

玖石书14 分钟前
大数据·git·elasticsearch
Git Submodule 完全指南:从添加到日常维护的常规操作全流程在大型项目中,我们经常需要在一个主仓库中引用其他独立的代码仓库。Git Submodule 正是解决这一问题的标准方案。它允许你将一个 Git 仓库作为另一个 Git 仓库的子目录进行管理,同时保持两个仓库的独立性——子仓库可以有自己的提交历史、分支和版本,而主仓库只需记录子仓库的特定提交引用即可。
用户36105886261224 分钟前
大数据·flink
Flink基础之有状态计算架构分析:状态存在哪、何时存、如何恢复上一篇讲了有界流与无界流,其中一个例子是「按类别统计每分钟订单金额」,用到了 sum 聚合。如果你真的把那段代码跑起来,会看到每来一条记录,输出金额就往上累加一点。问题来了:累加的中间值存在哪?作业重启之后,它是从零重算,还是接着上次的继续?
BYSJMG38 分钟前
大数据·python·信息可视化·数据分析·spark·课程设计·美食
计算机毕设选题做什么好?基于大数据的用户美食数据分析与可视化,PySpark预处理+ECharts大屏,含Isolation Forest异常检测算法精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
心易行者1 小时前
大数据·前端·数据库·人工智能·python
用html在线运行做数据可视化大屏,5个实战场景从入门到上线废话不多说,直接上干货。今天聊一个很多人想学但不知道从哪下手的话题——数据可视化大屏。你可能在公司年会、展厅、监控室见过那种炫酷的数据大屏,数字跳动、图表滚动,看起来特别高大上。但你知道吗?这种东西其实没你想的那么难,一个HTML文件加ECharts就能搞出来。
晴天161 小时前
大数据·elasticsearch·node.js
ES 标准、V8 引擎与 Node.js 版本联动关系全解与实战踩坑很多前端开发都会遇到非常诡异的问题:本地代码能跑,服务器打包报错 SyntaxError: Unexpected token ?.
天衍四九-2 小时前
大数据·数据库·人工智能·python·chatgpt·面试
Agent Skills从入门到工程化(十六):面试中如何讲清楚 Agent Skills?如果你准备 Agent 开发岗位,Agent Skills 是一个很适合展开的话题。它能体现你不只是会写 Prompt,而是理解 Agent 如何调用外部能力、如何工程化落地。
Capricorn19882 小时前
大数据·论文阅读·人工智能·笔记·架构·论文笔记
跨端同步与记忆锁定排障:OpenClaw 2.0 Active Memory 云端劫持危机,知芽 Notebook Skill 单元记忆架构解析OpenClaw 2.0 (v2026.8.1) 合并超 1.6 万个 PR,推出了 Active Memory、Grounded Dreaming 与 Shared Cloud Sessions 等核心功能。该机制默认将私有对话与长期记忆沉淀在官方 SQLite 与 Cloud Worker 中,一旦发生平台迁移或停更,将引发严重的数据锁定与资产流失故障。知芽 Notebook Skill 采用**单元记忆(Unit Memory)**与一套可验证的工程防护体系进行架构级排障,将用户的文献与笔记转化为本
fastjson_2 小时前
大数据·分布式·spark
Spark 安装和使用HDFS 是大数据常用分布式存储,Hive 提供 HiveQL,不存储业务数据,数据存放于 HDFS第一代计算引擎:MapReduce:用廉价机器实现分布式大数据处理
计算机源码社2 小时前
大数据·hadoop·python·机器学习·数据挖掘·spark·毕业设计
分享一个基于大数据的跨平台内容生态画像与互动等级分析系统,基于Hadoop+Spark的社交媒体互动数据可视化大屏分析💕💕作者:计算机源码社 💕💕个人简介:本人八年开发经验,擅长Java、Python、PHP、.NET、Node.js、Spark、hadoop、Android、微信小程序、爬虫、大数据、机器学习等,大家有这一块的问题可以一起交流! 💕💕学习资料、程序开发、技术解答、文档报告 💕💕如需要源码,可以扫取文章下方二维码联系咨询
Zenova EdgeOS2 小时前
大数据·人工智能
储能项目 BOT 模式演变:从单一建设到全周期运营的多元路径储能项目的交易结构正在从“建成交付”转向“长期运营”。过去很多项目把重点放在装机规模、并网时间和初始造价上;随着独立储能、共享储能、辅助服务和峰谷套利等机制逐步落地,项目价值越来越取决于可用容量、调度响应、安全运行、收益结算和期满转交的完整能力。
YangYang9YangYan3 小时前
大数据
2027 届秋招平台运营岗位备考|基于 2026 校招 JD、面经的求职准备手册1.每日拉取平台前一日流量、转化、留存核心指标,定位数据异常下跌的业务模块,输出简短异常说明2.巡检平台活动资源位,核对活动配置、规则、上线状态,及时处理配置错误、活动失效问题
TMT星球3 小时前
大数据·人工智能·生活
萤石亮相IFA 2026,多款AI创新产品集中展示,全球化智能生活体验引关注9月4日,2026年德国柏林国际消费电子展(IFA 2026)正式开幕。以“Accelerating Innovation”为主题,萤石EZVIZ携全新产品矩阵与AI技术成果亮相,集中展示覆盖家庭安全、户外守护、智能入户、家庭清洁及个人生活等多元场景的创新探索。从AI技术持续进化,到产品体验不断丰富,萤石正加速推动AI融入真实生活,为全球用户带来更加自然、便捷的智能生活体验。
大大大大晴天️3 小时前
大数据·uniffle
每天认识一个组件:统一 Shuffle 引擎Apache Uniffle在 Spark、MapReduce、Tez 等分布式计算任务中,Shuffle 往往是最容易放大性能瓶颈和稳定性问题的环节。在传统 Spark Shuffle 中,Map 端会把中间数据落在 Executor 所在节点的本地磁盘上,Reduce 端再跨节点拉取这些数据。这个模式在中小规模任务中足够直接,但在大规模集群、动态资源调度、云原生环境和超大 Shuffle 作业中,会暴露几个典型问题。
事界见闻3 小时前
大数据·自动化·汽车
汽车备件自动化立体仓库该如何规划?借鉴丰田 45000 个 SKU 项目实践2026年,中国汽车销量约占全球市场31%。庞大的汽车产销规模,不仅意味着整车生产和交付体系持续扩张,也带来了更加复杂的零部件存储、补货、拣选与配送需求。
BYSJMG6 小时前
大数据·人工智能·hadoop·数据分析·spark·课程设计
计算机毕设选题做什么好?基于大数据的用户健身行为数据分析与可视化系统,Hadoop+Spark处理精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
知见漫记10 小时前
大数据·人工智能
AI 桌面 Agent 本地执行能力技术对照:沙箱机制与权限模式拆解「AI 桌面 Agent 哪些支持本地执行」是选型阶段的高频问题,但从工程视角看,这个问题要拆成两层:一层是执行位置(本地还是云端),一层是执行时的权限模式(受控沙箱、全权限直操、云端建议)。本文以公开技术资料为依据,把支持本地执行的桌面 Agent 按权限与沙箱模式分为三档,逐档拆解执行架构与受控性设计,供选型参考。文中对比基于官网、官方文档与公开报道整理,不构成排名。
xcl092511 小时前
java·大数据·需求分析
幼儿托育系统开发实战:从需求分析到上线全流程指南幼儿托育系统开发实战:从需求分析到上线全流程指南幼儿托育系统是目前教育信息化领域中需求增长较快的垂直方向。与常规的培训教务系统不同,托育场景涉及幼儿接送安全、体温晨检、喂奶换尿布记录、餐食留样、监控视频对接、家长端实时互动等大量线下环节,因此系统开发绝不是简单的“签到 + 课表”组合。本文结合笔者的实际项目经验,梳理一套从需求调研到部署上线的完整路径,重点介绍核心功能设计、数据模型规划、技术选型与部署运维注意事项,供正在规划或正在开发此类系统的团队参考。
cspttty11 小时前
大数据
国际经济与贸易专业考什么证对就业有帮助国际经济与贸易专业不要先问哪个证书最有用,而要先判断自己想去哪里:外贸公司、跨境电商、货代物流、银行贸易金融、财务审计,还是咨询和数据分析岗位。不同方向需要证明的能力不同,证书只是能力的外部信号。
足球魅力12 小时前
大数据·业界资讯
哪款足球软件能分析凯利指数大数据?“凯利指数”这个词,经常看赔率的朋友应该不陌生。有人说它是判断赛果的“神器”,也有人觉得它飘忽不定、不好用。今天从技术分析角度,聊聊凯利指数到底是什么,以及智能数据软件怎么把它变成可参考的信号。
xwz小王子12 小时前
大数据·人工智能·机器人
机器人的“最后一毫米”: 新加坡南洋理工大学Facet-0如何教会基础模型“感受”自己的动作?导语:在制造业的真实场景中,机器人能否完成一次完美的精密装配,不取决于它“认不认识零件”,而取决于它在接触瞬间“有没有感受到那一点点偏差”。在0.1毫米的间隙里,视觉上几乎一样的两条轨迹,一条能让零件平滑入位,另一条则可能造成卡滞甚至损坏。新加坡南洋理工大学PINE Lab研发的Facet-0,用“预测接触后果”的思路,让精密装配的平均成功率从最强基线的15%冲到了82%。这不是简单的“加了力传感器”,而是一次从感知到决策的范式重构。