ai

Elastic 中国社区官方博客1 小时前
大数据·运维·数据库·人工智能·elasticsearch·ai
让大模型思考,让小模型执行:在 Elastic Workflows 中拆分 LLM 成本作者:来自 Elastic Jeffrey Rengifo构建一个 Elastic workflow,将数据样本发送给大模型,由大模型提出分类标签。人工审核确认后,再由小模型将这些标签应用于整个数据集。
@蔓蔓喜欢你2 天前
人工智能·ai
全栈独立产品搜索体验复盘:从 LIKE 到 Elasticsearch 的升级路径独立产品最早期的搜索通常都用 SQL LIKE 实现:SELECT * FROM articles WHERE title LIKE '%关键词%' OR content LIKE '%关键词%'。在产品初期(数据量 < 1 万条、日搜索量 < 100 次),LIKE 查询完全够用——MySQL 在 title 列建立全文索引(FULLTEXT INDEX)后,1 万条数据内的查询延迟在 50ms 以内。没有人会因为搜索慢而流失。
星辰AI2 小时前
人工智能·ai·语言模型
全栈项目代码质量治理复盘:ESLint+Prettier+Husky的渐进式引入策略在一个15人的全栈团队中推行ESLint+Prettier+Husky时遇到的第一反应不是"太好了",而是:
楠楠子呀2 天前
运维·人工智能·ai·自动化
第16篇:WorkBuddy自动化群发:定时+条件触发+多账号轮换摘要:手动群发WhatsApp消息既耗时又容易漏发。本文介绍如何通过WorkBuddy的MCP调度能力实现群发任务的全自动化——支持定时发送、条件触发、多账号轮换和失败重试。
算AI3 小时前
人工智能·深度学习·算法·机器学习·ai
基于LLM的无人机仿真测试:新方法竞赛夺佳绩SBFT研讨会(International Workshop on Search-Based and Fuzz Testing)是软件工程领域的顶会ICSE会议(International Conference on Software Engineering)下设的研讨会之一。SBFT全称中的Fuzz Testing指的是模糊测试(又称Fuzzing)。模糊测试是软件测试方法中的一种;这种测试方法通过输入无效的、随机的或期望之外的数据,来观察软件运行是否会出现故障,从而发现软件中的缺陷和漏洞。
howdoyoudo2026064 小时前
大数据·人工智能·安全·ai·语言模型
AI审计手记 #01(数据补全版):107小时、17,600次操作——OpenAI越狱案完整攻击链量化分析AI审计手记 #01(数据补全版):107小时、17,600次操作——OpenAI越狱案完整攻击链量化分析
狂云歌6 小时前
人工智能·学习·ai·ai编程
AI学习之function calling&mcp大模型AI经常要用到的function calling和mcp,是什么,有什么关系。一段话说重点:总的来说,function calling是一种大模型调用外部工具函数的能力,而mcp则是对这些工具函数约定的协议。
a187927218316 小时前
ai·大模型·llm·transformer·layernorm·deepseek·层归一化
从一条直线到大模型输出一个token(五):Transformer Block 全景与层归一化建议先看:从一条直线到大模型输出一个token(四):位置编码 RoPE上一篇末尾留了个悬念:「苹果」在"我吃了一个苹果"里是水果,在"苹果发布新手机"里是公司——同一个 token,含义要靠旁边的词决定。从这一篇开始,我们正式走进 Transformer 大厦,看词和词怎么"发生关系"。
苏子寒7 小时前
pytorch·笔记·python·机器学习·ai·nlp·vllm
Nano-VLLM全代码解析笔记(6)-embed_head和linear一些问题:[系列(1) 开篇](https://blog.csdn.net/xxx/article/details/xxxxxx) [系列(2) 核心原理](https://blog.csdn.net/xxx/article/details/xxxxxx) 🔗上一篇:[系列(1)开篇](https://blog.csdn.net/xxx/article/details/xxxxxx) 🔗下一篇:[系列(3)实战演练](https://blog.csdn.net/xxx/article/details/
liulilittle8 小时前
c++·人工智能·ai·llm·注意力·qkv
长上下文的成本结构与「甜点区间」——从推理引擎的物理约束看 200K/256K/400K摘要:1M 上下文是当前大模型最具营销力、也最容易被误读的指标。本文不讨论「能不能支持 1M」,而是讨论一个更实质的问题:在真实推理成本与能力衰减的双重约束下,什么长度是高效工作的甜点区间。 文中全部数值来自笔者从零实现的纯 CPU 推理引擎 llmx(目标模型 Qwen3.6-35B-A3B,40 层、词表 248320、GGUF Q4_K_XL 量化),以及公开的注意力复杂度结论。核心论点是:解码器的成本由「每 token 必须搬运的字节数」决定,而这个字节数在权重项上是常数、在上下文项上是线性的;当
章老师说10 小时前
人工智能·ai·开源·负载均衡·ai-native
壬远 AI 网关 v0.4.0 正式发布:模型定价、RMB 配额与多 Key 路由,让企业级 AI 流量治理再进一步GitHub Release:https://github.com/rainway-ai-gateway/ai-gateway/releases/tag/v0.4.0
Roadinforest10 小时前
ai·架构·llm·agent·anthropic·claudecode
Claude Code 架构深度解析:从 Agent Loop 到 Tool、MCP 与 Context本文基于本地仓库 claude-code/claude-code-main 的 TypeScript 源码快照整理。该仓库 README 将其描述为 2026 年 3 月 31 日公开暴露的研究快照,并非 Anthropic 官方仓库。因此,本文讨论的是这个快照体现的设计,而不是对所有历史版本或未来版本的承诺。
todoitbo10 小时前
ai·项目·前后端·token plan·aiionly
一个接口,三个模型:一个Token Plan 的前后端开发实践这次记录两个独立项目的接入过程。第一个项目只验证 Codex 通过 OpenAI 兼容接口调用 Kimi-K3,完成一个原生前端页面;第二个项目再从零实现任务列表,把后端、前端和测试分别交给不同模型。两个项目的代码目录和任务都不相同,只有接口地址、API Key 和模型 ID 的配置方式相同。
俊哥V10 小时前
人工智能·ai
每日 AI 研究简报 · 2026-08-23(本文借助 AI 大模型及工具辅助整理)一句话总结:今日 AI 产业主线从「拼模型」转向「拼系统」——算力涨价、智能体工程化(harness / 权限 / 审计)与开源价格战共同定义了新格局,小模型 + 强工程正在反超单纯堆参数的路线。
tachibana211 小时前
数据库·人工智能·ai·架构·大模型·llm·rag
把RAGAS跑起来摘要:在检索增强生成(RAG)系统的落地过程中,“如何科学、量化地评估系统好坏”始终是决定项目能否上线的核心命题。RAGAS(Retrieval Augmented Generation Assessment) 是当前大模型领域事实上的 RAG 自动化评估标准。然而,RAGAS 原生基于 Python 生态开发,许多统计学背景深厚、精通 R 语言数据分析与制图的数据科学家和统计学家在评估大模型系统时面临工具链断层的困扰。
最强小杰1 天前
gpt·ai
gpt-5.6-luna 调用报 401 怎么办?同一个 Key 跑 gpt-5.5 正常但 luna 就挂——排查全流程 [特殊字符]最近把 Cline 里的 model 参数从 gpt-5.5 切到 gpt-5.6-luna,结果直接收到 401。同一个 API Key,gpt-5.5 跑得好好的,luna 死活不过鉴权。折腾了大半天才搞明白:不一定是 Key 失效,真正需要排查的是 Key 有效性、组织权限、模型访问权限,以及 Bearer 前缀格式这几个方向。如果你也踩了这个坑,往下看,三种方案都列了。
weixin_4316004412 小时前
后端·学习·ai·dify
Agent Workflow 学习向:最小拖拽画布,看得见地编排,再一键跑通上一篇:并行分支:fan-out 多出边与 join 汇合(顺序模拟) 相关:03 浏览器联调台 · 06 If/Else
tachibana212 小时前
人工智能·ai·大模型·llm·agent
初识智能体摘要:随着大语言模型(LLM)从单纯的“聊天对话框”向“自主解决复杂现实问题”演进,智能体(AI Agent) 已成为当下人工智能落地最受瞩目的技术范式。如果说基础大模型是一个拥有海量知识却被困在服务器里的“超级大脑”,那么智能体就是给这个大脑装上了眼睛、耳朵、双手和记忆系统,使其能够感知环境、自主规划、调用工具并执行复杂任务。
Summer-Bright12 小时前
人工智能·ai·ai 浏览器
独立 AI 浏览器之死与「内嵌化」之生:Atlas 关停、Comet 免费化、豆包虚拟桌面,入口之争的终局# 独立 AI 浏览器之死与「内嵌化」之生:Atlas 关停、Comet 免费化、豆包虚拟桌面,入口之争的终局
TechEdu20260613 小时前
人工智能·ai
[人工智能]Claude(Anthropic):模型能力、智能体与安全工程实践本文从技术和工程视角介绍Anthropic Claude相关模型与应用生态,覆盖模型定位、对话与推理、长上下文、代码、检索增强、工具调用、智能体、安全、评测、部署、成本与治理。具体模型版本、API、上下文限制、价格、区域、许可证和数据条款可能变化,使用前应以Anthropic官方模型卡、API文档和服务协议为准。图表与数值均为说明性示例,不代表官方基准。