llm

牛油果子哥q4 小时前
ai·llm
LLM安全与内容风控全栈落地: Prompt注入、越狱攻击、幻觉风控、敏感词过滤、C++风控网关、多级审核体系、线上攻防实战前面我们搞定了LLM服务架构、网关治理、性能压测、SLA稳定性。服务能跑、能抗并发、性能达标,但是距离「可以商用上线」还差最后一道、也是最致命的一关:AI安全与内容风控。
武子康7 小时前
人工智能·llm·agent
小智服务端怎样组织 ASR、LLM、TTS?先追本次连接实际使用的对象你给小智服务端改了模型配置,设备仍能连接,日志也有识别文本,但回答不像预期模型,或者文字已经出来,扬声器还没开始说话。此时"ASR→LLM→TTS"只能说明大方向:它没有告诉你,这个设备到底拿到了哪份配置、哪个实例,又在哪个交接点等待。
掰头战士7 小时前
前端·llm·agent
Prompt Cache,如果agent全靠LLM方做隐式缓存实在不够用。系统提示的内容一个字没改,只把其中一行挪了个位置,二十轮的账单差了 7 倍设想这样一个场景。你的 Agent 上线第一周,账单很稳定。第二周开始不对劲——同样的任务量,费用翻了一倍。
Code_Artist8 小时前
人工智能·llm·ai编程
☢︎自然语言 → 机器码:这到底是 AI 编程的终极形态,还是一个伪命题?如果 AI 已经能够理解自然语言、生成代码、编译代码,那么“编程语言”这层抽象是否最终会消失?自然语言 → 机器码,会不会成为 AI 编程的终极形态?
前端双越老师8 小时前
llm·agent·芯片
张三的 10 亿元 AI 梦:从“造神”到“活下去”大家好,我是双越。wangEditor 作者,前百度 滴滴 资深前端工程师,慕课网精英讲师,PMP,前端面试派 作者。
桃西西呀8 小时前
人工智能·深度学习·llm
机器眼里没有脸,怎么识别人脸?手写 CNN 拆开卷积层与 BatchNorm早上七点四十,地铁口,我掏出手机扫了一下脸,锁开了,半秒不到。同一件事的另一面是,过去一年 AI 生成的脸也多了起来。2025 年 9 月 1 日《人工智能生成合成内容标识办法》施行,要求 AI 生成合成的内容打上标识,到今年 9 月刚好跑满一年。
bestcxx9 小时前
ai·llm
DeepSeek 的“快”与“全”:一次关于搜索、爬虫与信息时效性的讨论最近和Deepseek 聊到 DeepSeek自己,** 聊着聊着,话题就滑向了更底层的好奇——它为什么能爬那么多信息而不被拦截?搜索为什么那么快?它是不是把整个互联网都缓存了?那还能搜到最新消息吗?
谢白羽10 小时前
笔记·llm·论文·大模型部署·sglang
MiniMax-H3 : 4卡 H20-3e一套权重部署实践/8卡H200部署优化实测H3-Base 将各模态编码后组织为统一序列,由同一个 Omni Transformer 联合预测视频与音频的潜在表示,再交给各自的 VAE 解码。文字和视觉条件会经过 H3-Encoder,视觉内容还通过 Visual VAE 表示,音频则由 Audio VAE 编码。这使参考素材的类型和长度都可能改变工作量;只验证文本生成,不能覆盖有声视频或混合参考的编码路径。
气象复杂12 小时前
llm
手写 ReAct 跑了 30 个任务:模型 0 格式失败,丢的 10 步全是我写的解析器接上一篇。第二个项目(LangGraph 多智能体岗位匹配)做到一半,我干了件框架时代的"逆行"事:不用 create_react_agent,不用任何框架,手写了一遍 ReAct 循环,然后在 30 个任务上跑了批量实验,同一输入连跑两轮。
桃西西呀12 小时前
人工智能·llm·agent
文件监控 Agent 为什么总在关键时刻掉链子你大概率写过或想写过这样一个东西:盯着一个文件夹,新文件进来自动分类、重复文件丢进回收站、某个目录一变更就告警。十几行 watchdog 就能跑起来,看起来是 AI Agent 里最简单的一类。
夫子39613 小时前
llm·agent
【第三部分:第一个 Agent 应用】13. 为 Agent 增加记忆能力:不是记住一切,而是在需要时想起正确的信息上一篇我们使用 State Machine 解决了一个重要问题:当前这一次任务执行到哪里。但状态机并不会让 Agent 真正“认识”用户。假设用户连续几周都在使用同一个需求分析 Agent,并多次说明:
PPPCODE13 小时前
llm·agent·mcp
从零手写一个MCP Agent服务:stdio与SSE两种连接模式的踩坑实录上周我在给公司的内部知识库做一个Agent入口,需要把几个自研工具(文档检索、SQL查询、发通知)暴露给Claude Desktop和自建的Agent框架同时使用。本来想直接抄官方示例了事,结果发现一旦涉及"同一个MCP服务要同时被本地客户端和远程Agent调用"这个需求,stdio和SSE的选型就没那么简单了。这篇记录一下我踩过的具体坑。
多云行者13 小时前
网关·llm·gateway·api·传统
什么是LLM Gateway?定义、技术栈与落地方式详解LLM Gateway 是位于应用与大模型服务之间的统一治理层,不是简单的反向代理。它把鉴权、路由、限流、计量、缓存这些非业务逻辑从业务代码里抽出来,让应用不再直连各家模型 API。没有网关时,团队通常会遇到 API Key 散落在每个服务配置里、重试逻辑反复实现、账单无法按团队归因、单模型故障直接传导线上应用等典型问题。本文回答三件事:LLM Gateway 的定义边界、内部技术栈分层,以及自研与开源两条落地路径。
星野云联AIoT技术洞察14 小时前
llm·私有化部署·saas·dify·物联网平台·iot平台·设备管理平台
物联网平台源码交付、私有化部署和 SaaS 怎么选:先算清责任与退出成本如果目标是用标准设备接入、告警和报表尽快上线,而且团队没有长期维护平台的专职人员,优先选成熟的物联网 SaaS。若数据必须进入企业自己的网络,但平台升级、监控和故障处理仍希望由供应商承担,选“托管私有化部署”通常比直接接源码更稳。只有当企业必须修改核心业务、掌握发布节奏、降低长期供应商锁定,并且愿意建立自己的平台工程与安全运维能力时,源码交付才真正有价值。
prog_610314 小时前
人工智能·llm·大语言模型·agent
【笔记】用agent手搓agent(一)今天我们从cursor手搓cursor进入下一个篇章,开始向泛化的agent去开发agent,进一步开始研究agent,向RSI进发。
闲研随记14 小时前
算法·llm·强化学习·rl
RL算法学习:ArgMaxRL链接:https://www.doubleai.com/research/argmaxrl-generalizing-maxrl-to-continuous-rewards
stereohomology16 小时前
人工智能·llm·薅羊毛
一个可能有用的经验:api key在Workbuddy或Trae IDE上使用摘要:现在通过 API Key 调用 LLM 算力的平台越来越多,但很多人会遇到一个奇怪现象:同一套 URL、API Key、模型 ID,在 WorkBuddy 里能用,在 Trae IDE 里却报错;或者反过来,怎么配都不行,换一个客户端突然就通了。问题不一定出在 API Key 本身,而可能出在“LLM 客户端”的兼容性上。本文结合个人踩坑经验,聊聊如何排查、如何换客户端,以及为什么 WorkBuddy、Trae IDE、Claude Code、Antigravity 这类工具值得同时保留。
米小虾1 天前
人工智能·llm
LLM评测的失效与依赖感知聚合现在做 Agent 评测的标准配方是:用一个 LLM 扮演用户去撩你的 Agent,再用另一个 LLM 当裁判给对话打分。 便宜、快、可扩展,不用人标注。
Crazy_MT1 天前
flutter·llm·ai编程
Flutter 本地大模型实战:做一个自然语言记账工具大家好,我是 Crazy_MT。这篇文章想和你聊聊我最近在端侧大语言模型上的一次实践:把本地大模型聊天,接到一个真正能落库的自然语言记账功能里。
XLYcmy1 天前
llm·sft·强化学习·多模态·苹果·rag·检索
DeepMMSearch-R1: Empowering Multimodal LLMs in Multimodal Web Search论文分享今天分享的论文是《DeepMMSearch-R1: Empowering Multimodal LLMs in Multimodal Web Search》