llm

米小虾1 小时前
人工智能·llm
LLM评测的失效与依赖感知聚合现在做 Agent 评测的标准配方是:用一个 LLM 扮演用户去撩你的 Agent,再用另一个 LLM 当裁判给对话打分。 便宜、快、可扩展,不用人标注。
Crazy_MT5 小时前
flutter·llm·ai编程
Flutter 本地大模型实战:做一个自然语言记账工具大家好,我是 Crazy_MT。这篇文章想和你聊聊我最近在端侧大语言模型上的一次实践:把本地大模型聊天,接到一个真正能落库的自然语言记账功能里。
XLYcmy6 小时前
llm·sft·强化学习·多模态·苹果·rag·检索
DeepMMSearch-R1: Empowering Multimodal LLMs in Multimodal Web Search论文分享今天分享的论文是《DeepMMSearch-R1: Empowering Multimodal LLMs in Multimodal Web Search》
Sophnet云平台6 小时前
网络·人工智能·llm·openai·agent
2026:AI Agent应用元年,企业从试点到核心业务的跨越逻辑"AI Agent应用元年"不是营销话术,而是数据驱动的行业共识。Gartner预测到2028年底,具备智能体能力的软件将占企业应用软件总支出的50%以上(2024年这一比例只有2%)。McKinsey 2025 State of AI报告显示,88%的企业在至少一个业务职能中使用AI,但只有23%把Agent跑进了核心流程,另有39%仍在试验阶段(来源:McKinsey 2025 State of AI Report)。这意味着我们正处在从"能跑"到"能用好"的转折点。
凌奕6 小时前
llm·github·agent
OpenCodeReview 架构拆解:AI Code Review 为什么不能只是 Git Diff + LLM?随着 Claude Code、Codex 这类 Coding Agent 的能力越来越强,现在让 AI 帮我们做 Code Review 已经不是什么新鲜事了。
GreatVicent7 小时前
大数据·数据库·人工智能·llm·agent·企业信息化
腾讯AI产业大会解读:Agent进场,企业基础设施怎么搭"Agent进场,效能生长"(来自腾讯AI产业大会公开主题slogan),腾讯AI产业大会这八个字,是对当前企业AI阶段最精准的概括。腾讯发布WorkBuddy企业版和企业级Token生产调度平台,定位不是"做一个Agent",而是"搭建一个能让成百上千Agent各司其职、协同调度、安全合规的基础设施"。
掰头战士7 小时前
typescript·llm·agent
你说你折这玩意干什么-agent工作的核心,还真得好好考虑怎么折叠上下文终于进入大折叠时代,连iphone都开始捣鼓折叠屏了。这波热度不是巧了吗,agent中恰好有个概念,上下文工程,就是讲怎么折叠、编排上下文的。今天笔者基于claude架构,给大家讲讲agent的大脑供氧-上下文工程,以及claude的五层压缩手段。
千桐科技8 小时前
开源·llm·agent·ai智能体·qknow·智能体构建
qKnow 开源版 v2.4.3 更新解析:从知识数据接入到自定义解析与结果复用在企业知识库和智能体应用建设过程中,知识数据的处理通常并不是简单的“上传文件 → 生成知识”。实际业务中,企业已有的数据来源往往更加复杂。
流浪9259 小时前
llm
从 Vibe Coding 到 LangGraph:AI 时代编程范式的演进与重构当「写代码」这件事本身被 AI 重新定义,开发者真正需要的,是让自己从「逐行敲代码」升级为「定义目标、驾驭流程」。
掰头战士9 小时前
typescript·llm·agent
让散乱的工具调用成为正规军,今天咱们聊聊 Tool System管线的读写锁设想这样一个场景。你让 Agent 干:把 app.js 里的端口从 3000 改成 8080,顺手把超时也调到 8000 ms。
zLLM_Lab9 小时前
llm·deepseek
DeepSeek V4.1 Flash 工程实践(二):从权重装配到八卡文本链路上一篇讲了 Engram:把训练好的记忆放进主机内存,再用查表、AVX-512 BF16 和 CPU/GPU 重叠,让它参与推理。这一篇回到 GPU 主干。
桃西西呀12 小时前
人工智能·深度学习·llm
提前一天预报雾霾:手搓神经网络,讲清学习率、初始化、正则化九月中旬,天刚转凉,我早上出门前习惯性点开空气质量 App,看到一行小字:明天 PM2.5 轻度污染,建议减少户外活动。我盯着这行字看了一会儿,脑子里冒出两个问题。它怎么什么知道明天?它说的准吗?
武子康12 小时前
人工智能·llm·agent
同一套小智源码,换块 ESP32 开发板为何还要重新适配?你在一块 ESP32-S3 开发板上跑通了小智,换到另一块同芯片的板子,串口能启动,屏幕却不亮,麦克风也没有可用输入。这时,先改语音服务参数往往找错了位置。芯片能运行程序,只证明了一部分条件;程序究竟初始化哪组引脚、哪种音频设备和哪块屏幕,要看构建时选进来的板级实现。
小林ixn13 小时前
人工智能·llm·agent
别再用正则抠 JSON 了:LangChain 结构化输出的三种正确姿势做 AI 应用的时候,你会发现一个非常高频的需求:让大模型返回 JSON。不管是提取实体、解析表单、还是做下一步的业务分支判断,我们都希望 LLM 的输出是"机器可读"的,而不是一段自然语言。
桃西西呀12 小时前
人工智能·llm·ai编程
AI 客服为什么翻车:一个客服 Agent 的四类结构性问题上个月我帮朋友搭了个电商客服 Agent 的 PoC:接了知识库、挂了查订单和退款两个工具、套了个 prompt。demo 里一句"我要退款"答得有模有样,TTFT 也不算离谱。
我有满天星辰13 小时前
llm·知识库
一次性读取整个 Obsidian:自动把我的 Markdown 变成 AI 知识库系列:《从 0 打造我的本地 AI 知识库:Obsidian + Ollama + Milvus + RAG + MCP + Agent》
程序员柒叔13 小时前
人工智能·llm·github·agent·可观测性·langfuse
把可观测性数据送进 LLM 追踪平台本文基于实际部署经验整理,实验环境为 Windows + WSL2 + Docker。 核心目标:让 OpenTelemetry Demo 采集 Github Copilot 的 traces,在不改动任何业务代码的前提下,额外转发一份到自托管的 Langfuse,实现 LLM 调用的全链路追踪。
孙启超13 小时前
人工智能·后端·rust·llm·ai应用开发
【AI开发之Rust】第 5 课:引用与生命周期 —— 借用能活多久?预计时间:75-90 分钟 | 难度:⭐⭐⭐ | 前置:第 4 课(所有权与借用)第 4 课讲了"谁拥有数据、谁能借用",但留了一个悬案:借用检查器凭什么敢保证"引用不会指向已释放的内存"? 内存里最容易出的一种 bug 叫悬垂引用(dangling reference)——数据已经没了,手上还捏着它的指针。
掰头战士1 天前
typescript·llm·agent
MCP、Skill、Plugin,都是给agent拓展能力,到底有何区别?我在开发我的agent时,遇到这样的场景:我的 Agent 内置写死了十几个工具,可以读写文件了,现在我想让它给我提交代码,推送到远程仓库。
DigitalOcean1 天前
llm·agent
Kimi K3 + Claude:AI Agent 多模型路由实战在实际使用 AI 编程 Agent 时,经常会出现这样一种情况::修复配置文件里的一个拼写错误,花费竟然和开发一个耗费整个下午的新功能差不多。