ai

java资料站19 分钟前
ai
八、SpringAl 会话记忆,历史对话,隔离记忆适用版本:Spring AI 1.0.x / 2.0LLM 是无状态的,不会保留先前交互的信息:那平时跟大模型聊天为什么能"记住"?——因为每次对话都把之前的对话消息一起发给大模型,这就是多轮对话。
七夜zippoe34 分钟前
ai·agent·长期记忆·短期记忆·记忆系统
短期记忆 vs 长期记忆:Agent 记忆系统的分层架构设计AI Agent 的记忆系统是决定其智能水平的核心基础设施。本文从人类认知科学的双系统理论出发,系统性地拆解 Agent 记忆的分层架构——工作记忆、会话记忆、长期记忆三层体系。深入探讨每层的设计原理、工程实现与取舍策略:工作记忆管理当前推理上下文,受限于 LLM 上下文窗口;会话记忆实现跨轮对话状态保持,需在完整性与 token 效率之间平衡;长期记忆基于向量数据库与知识图谱,解决知识持久化与精准检索问题。文章包含完整的 Python 实现代码、Mermaid 架构图、检索策略对比分析,以及"遗忘机制"
三声三视1 小时前
人工智能·ai·skillhub·tri-skill·tri-jobhunt
周日晚九点半,两份 JD 喂进 tri-jobhunt:全中的那份和缺一项的,都拿了 70 分周日晚九点半,书房台灯底下,老周在群里甩过来两份 JD,说明早十点截止,问我哪个值得投。一份是大厂的 AI 应用工程师,写得规规矩矩;另一份是家中小公司的,八条硬性要求,没写加分项。我简历改到第三版,实在不想再靠感觉拍板,就把 tri-jobhunt 翻出来当裁判用。
葡萄城技术团队1 小时前
ai
Jev 爆火之后,给企业应用配一个 AI 决策模型9 月 15 日,旧金山公司 TypeSafe AI 结束两年隐匿期,开放了一个叫 Jev 的模型。发布当天,它冲上 Hacker News 千分级热度;24 小时内,近 13% 的 Vercel 付费团队用上了它,Vercel 称这是其 AI Gateway 历史上被采纳最快的模型,超过了此前所有发布。一周内,Cloudflare、LangChain、Langfuse 相继集成,国内券商出了专题研报。
解决小子1 小时前
ai·职场和发展·创业创新·业界资讯·就业
2026年中国就业情况报告写任何分析之前,先把账本摊开。以下数据来自国家统计局、人社部、教育部及各研究机构,截至2026年公开发布口径。
运维开发王义杰2 小时前
ai
Gemini 3.8 语音大模型 GA:当 TTS 学会“演戏”,家庭英语学习与视频创作价值拆解2026 年 9 月 22 日,Google 官方宣布其新一代文本转语音(Text-to-Speech, TTS)大模型正式进入 GA(General Availability,通用可用)阶段。本次发布涵盖了旗舰级创作者模型 Gemini 3.8 Flash TTS (gemini-3.8-flash-tts)、主打高吞吐与实时级联的 Gemini 3.8 Flash-Lite TTS (gemini-3.8-flash-lite-tts),以及一个关键的基础设施端点 —— Gemini API Voic
XLYcmy3 小时前
ai·llm·agent·模型·mom·harness·工业系统
AI 时代,MOM(制造运营管理系统)该如何演进? 上AI 时代,MOM(制造运营管理系统)该如何演进?——从零设计一套适配多品类产线的通用 MOM 架构智能制造 / 工业软件 / MOM 架构
启雀AI3 小时前
人工智能·ai·软件需求·培训系统·培训平台
培训管理系统的 AI 智能陪练完整功能逻辑,以家电门店销售为例的剧本框架AI陪练功能的底层逻辑是一套**场景构建—智能交互—实时评估—反馈闭环**的模拟训练系统,本质是用大模型、语音/语义分析及多模态技术,在数字空间复现真实业务对话,让学员在低风险的虚拟环境里反复练习并拿到改进建议。可以拆成四个核心环节理解:
wflynn3 小时前
人工智能·ai
Claude 自主发现类 CRISPR 结构的新型逆转录酶系统:Anthropic 生命科学实验室的早期成果限制性内切酶、Taq 聚合酶、CRISPR——生物学史上这些里程碑式的发现,都源于研究者在海量序列数据中识别出"不寻常的东西"。2026 年春,Anthropic 组建生命科学研究团队,探索通用 AI 模型能否系统化并加速这类发现过程。团队不仅训练 Claude 理解生物学知识,还在湾区建立了真实的分子生物学实验室,开展 BSL-1 和 BSL-2 级别的湿实验室工作,全部实验操作由人类科学家完成,不涉及可感染人类的病原体。团队成员此前的研究方向涵盖 CRISPR 系统的进化与调控、细胞和基因疗法用新型酶
学代码的CJY4 小时前
人工智能·ai
AI大模型1-1-大模型认知与工程概览业界对“大模型(Large Models)”并没有绝对统一的严格定义。工程与教学语境里通常指四点:参数规模很大、训练数据很多、训练算力很强、能在多种任务上表现出较强通用能力。
七夜zippoe4 小时前
ai·agent·向量检索·rag 2.0·自主知识治理
RAG 2.0:从向量检索到 Agent 自主知识治理的进化路径RAG(检索增强生成)技术在大语言模型应用中已广泛落地,但传统 RAG 1.0 架构在 Agent 场景下暴露出检索僵化、知识不可更新、结果无法验证等根本性缺陷。本文提出 RAG 2.0 的核心范式转变——从被动向量检索进化为 Agent 自主知识治理,系统阐述检索决策机制、结果验证策略、知识自更新闭环三大核心能力,并提供基于 Python + LangGraph + FAISS 的完整工程实现。文章涵盖架构设计、关键代码、Mermaid 流程图及适用边界分析,适合已具备 RAG 基础经验的 AI 工程师
Steve__evetS5 小时前
ai·rag
RAG流程大模型的知识在训练后就固定了,所以大模型是无法直接拿到最新知识和私有数据的。此时,通常会采用RAG和微调这两种主流方案来使其拿到这些知识。
Yunovian6 小时前
开发语言·c++·人工智能·python·ai·rust·ai编程
AI时代,针对模型与应用,浅谈一下各编程语言每隔一段时间,开发圈都会重新争一次"什么语言最好"。到了 AI 时代,这个问题又多了一层:Python 是不是已经赢了?Rust 会不会吃掉 C++?Go 适不适合做 AI?Java、PHP 这种传统后端语言还有没有必要?
林伽一6 小时前
人工智能·科技·ai
每任务成本成为模型选型新标尺,AI基础设施走向“可验证“ | 林伽一 · AI科技日报 | 2026年09月24日今日 AI 产业的关键词是"成本"与"可验证"。Anthropic 与 OpenAI 同日发布 Opus 5.5 与 GPT-6 Sol/Luna,把竞争从能力参数直接拉到定价表上,每任务成本取代单模型能力成为企业采购的新标尺[① AI Business];Meta 在 Connect 2026 上把智能体 Muse 装进挂绳、镜框与口袋,硬件承载成为 AI 应用新主线;开源侧则迎来 Nemotron 3 Diarization、AnyJev、Voice of Reason 三连发,NVIDIA 同步开源
cpolar技术支持7 小时前
nginx·ai·cpolar·mcp·nginx-ui
服务器上的 Nginx 只想改配置却不敢动?把 Nginx-UI 跑起来,用 MCP 让 AI 助手帮你安全改配置,再用 cpolar 把面板短时开给自己先说个我自己踩过很多次的场景:临时要给一台服务器加个反向代理的 location,随手 SSH 上去 vi /etc/nginx/conf.d/xxx.conf,改完脑子一热 nginx -s reload——然后站点 502,自己还不知道哪儿错了。事后回头看,问题通常就两类:语法写错了一个分号,或者 reload 之前根本没跑 nginx -t。
VIP_CQCRE9 小时前
ai·大模型·api·glm·acedatacloud
用 Ace Data Cloud 快速接入 GLM Chat Completion API:OpenAI 兼容格式,一套接口调用主流大模型在大模型应用开发里,很多团队真正头疼的不是“有没有模型可用”,而是:如果你正在做 AI 客服、智能助手、知识库问答、代码生成、内容生产、Agent 工作流,Ace Data Cloud 的 GLM Chat Completion API 就是一个非常适合上手的选择。
知了一笑10 小时前
人工智能·ai·aigc
企业的AI转型,真能找到出路吗?真正的复杂,AI依旧无法理解。2026从年初开始,擅长顺应趋势的老板,开始高举AI转型的大旗,其中互联网企业最激进,势必要站在人工智能的前列腺上。
哥不是小萝莉16 小时前
ai·harness
AI Agent Harness:原理、架构与实现假设你希望 AI 帮忙排查一个线上问题:“最近五分钟,订单服务的错误率是否超过告警阈值?如果超过,请给出依据。”
小白跃升坊16 小时前
ai·1panel·laya·ai网关
Jev 发布三天就被开源了:33 毫秒做一次判断的 Laya,值不值得进生产?2026 年 9 月 15 日到 9 月 24 日,九天里发生了三件事:TypeSafe AI 发布闭源决策模型 Jev;Convai Innovations 开源了对标的 Laya;1Panel 把 Laya 封装成 Laya Server 上架应用商店。