ai

spencer_tseng1 分钟前
ai·deepseek
Deepseek has increased its price 2026.08.17How much cost has AI reduced (2026.04.03 12:26)-CSDN博客
JaydenAI1 小时前
ai·langchain·agent·evaluation·openevals·agentevals
[基于AgentEvals的自动化评估-06]以LLM-as-a-Judge评估LangGraph执行轨迹对于利用LangGraph构建的工作流,前面的文章介绍了不需要LLM参与,通过将提取的执行轨迹与评估基准进行比较的方式来评估。我们不经介绍了AgentEvals原生的评估方案,还介绍我们经过改进和优化的方案(上篇下篇),以及如何从持久化的Checkpoint中提取执行轨迹。出来这种依赖我们手工比较的方式,我们也可以利用LLM-as-a-Judge的形式来评估其执行轨迹。
Summer-Bright2 小时前
人工智能·ai·ai应用·马斯克
[马斯克600亿买下Cursor] —— AI 应用简报 08.13-08.17核心观点:编码 Agent 战场闯进马斯克,600 亿美元收购 Cursor;同一周 Agent 治理全面硬化——Anthropic 曝出多 Agent 合谋、Gartner 警告 2340 亿 SaaS 支出面临洗牌。
旖旎夜光2 小时前
ai·学习方法·开发工具
DeepSeek Harness 安装教程DeepSeek Harness(dsh)是 DeepSeek AI 官方开源的 agent harness(智能体框架),可以理解为 "国产版 Claude Code / Codex"。
SamChan903 小时前
前端·python·ai·pdf·wpf
用Playwright端到端测试PDF翻译功能:Web自动化测试实战最近在做一个PDF翻译工具的Web端,需要自动化测试核心流程:上传PDF → 选择语言 → 等待翻译完成 → 下载翻译结果。这正好适合用 Playwright 做端到端测试。
billsking3 小时前
ai
给聪明人写SOP 一篇讲透 AI 的「技能 Skill」想象一个场景。你刚招了个新员工。名校毕业,脑子快,学习能力强,简历漂亮得挑不出毛病。你很满意。第一天上班,你说:"帮我发个周报。"
AI英德西牛仔3 小时前
人工智能·ai·chatgpt·pdf·deepseek·ai导出鸭
千问导出 pdf 颜色不一样怎么办,选用 AI 导出鸭优化格式转换,多维度剖析千问内容 PDF 变色各类成因通义千问生成的图文文档在PDF导出环节普遍出现色块偏色、图片褪色、底色丢失等问题,是文案、教研、商务办公人群高频难题。本文围绕该色差痛点,结合市场现存多种导出手段实测对比,依托行业白皮书调研数据、行业专家观点、用户真实试用反馈,详解AI导出鸭的技术逻辑与产品优势,最后介绍产品全终端布局,一站式妥善处理千问PDF导出色差问题。
TechEdu2026063 小时前
人工智能·ai·rl
[人工智能]Tianshou强化学习框架:概念、架构与工程实践Tianshou强化学习框架:概念、架构与工程实践本文面向工程实践与科研应用,系统介绍Tianshou强化学习框架的核心概念、架构设计和常见使用模式。Tianshou基于PyTorch实现,突出模块化、可复用和高性能,提供丰富的策略类、采样器、经验回放和训练工具,适合从原型验证到工程落地的不同阶段。本文结合示意图和表格,形成超过4页的技术参考材料,便于团队内部培训和方案评审。
努力搬砖的咸鱼3 小时前
人工智能·python·ai·单元测试·pytest·agent
意图理解:让Agent从需求描述自动生成Pytest测试策略前两篇我们搭好了环境,也看到了AI生成Pytest代码的效果,但AI是怎么知道要测什么的?第一篇里,我们直接把除法函数的源代码喂给AI,让它生成测试用例。这种方式叫代码驱动。AI看实现来写测试。
水水不水啊4 小时前
笔记·ai·deepseek·harness·dsh
DeepSeek自带的一些插件的功能介绍这是DSH的“大脑”和“躯干”,负责思考、决策和执行。这些插件赋予Agent各种“手脚”,让它能真正干活。
workbuddy小能手4 小时前
人工智能·ai·workbuddy
实战:封装一个WorkBuddy Skill,自动拉取腾讯会议AI录音笔的线下沟通上下文最近腾讯会议AI录音笔从二级功能升级到了首页一级入口(详见 meeting.tencent.com)。这个变化背后有一个容易被忽略的事实:线下沟通的上下文,从此可以被结构化地沉淀下来。
Kings994 小时前
ai·springboot·idea插件
AI 请求参数智能生成与一键调试方法支持,Fast Request重磅发布Fast Request 是一个类似 Postman 的 IDEA 插件。它是一套强大的 RESTful API 工具包,可以根据已有方法快速、自动生成 URL 和参数。
ONE_SIX_MIX13 小时前
ai·qwen3·llama-cpp
llama-server 部署 Qwen3.8-27B:真正开启 512K 上下文,突破 256K 截断使用 llama-server 部署 Qwen3.8-27B 时,启动命令中设置了 -c 512000,但实际请求一旦超过 256K tokens,服务端要么报错,要么返回截断结果。日志中的 ctx_size 虽然显示为 512000,但模型内部依然卡在 256K。
ebok.14 小时前
大数据·人工智能·低代码·ai
国产大模型落地业务系统的优选载体:京微智枢信创 AI 业务支撑平台近年来,以 GPT、文心一言、通义千问等为代表的国产大模型在技术能力上取得了长足进步,展现出强大的语言理解、内容生成与逻辑推理潜力。然而,将大模型从“技术演示”真正转化为驱动业务增长的“生产力工具”,企业普遍面临三大核心挑战:
wujian831114 小时前
人工智能·ai·word·豆包·deepseek·ai导出鸭
怎么用文心生成word文档?从格式错乱到智能导出,AI导出鸭让创作再无后顾之忧文心一言、AI导出鸭、Word智能导出、多格式兼容、跨终端协同在日常办公与内容创作中,将AI生成的结构化文本快速、准确地转换为规范的Word文档,已成为效率瓶颈。无论是毕业论文、商业计划书,还是技术白皮书,用户普遍面临“内容好写、格式难调”的困境。怎么用文心生成word文档?本文从项目痛点出发,结合AI导出鸭的全终端能力,提供一套可落地的智能导出方案。
雨辰AI16 小时前
运维·ai·机器人·ai编程
RAG 知识库搭建:基于人大金仓构建信创运维问答机器人|全栈国产化落地完整版信创运维团队普遍面临三大痛点:知识散落在文档、工单、群聊里,新人上手要半年;重复故障反复问,资深 DBA 精力被消耗在基础问题上;公网大模型数据不能出内网,合规红线不能碰。很多团队要么靠人肉传帮带,要么硬套通用 RAG 方案,答非所问、泄露数据、不符合信创要求。
JaydenAI2 天前
ai·langchain·agent·evaluation·openevals
[基于OpenEvals的自动化评估-15]以LLM-as-a-Judge方式评估Agent生成的代码基于OpenEvals的自动化评估-14:以静态代码分析方式评估Coding Agent生成的代码着重介绍了基于MyPy和Pyright这两种广受欢迎的基于Python的静态代码分析引擎器来评估Agent生成的代码,其实提取出来的代码还可以直接交给LLM进行评估。相关的评估器可以利用create_code_llm_as_judge这个工厂函数来创建,本篇文章就来介绍如何利用这种方式实施针对代码的评估。
Tezign_space16 小时前
ai·特赞·gea·企业级智能体
从Chatbot到企业级智能体GEA:四种企业AI形态的架构差异和技术边界AI工具遍地,企业里同时跑着好几种形态:客服窗口的聊天机器人、员工电脑上的AI助手、后台跑批的工作流自动化工具,还有近两年频繁被提及的企业级智能体。问题是,很多厂商把这些概念混着用——把AI助手叫"智能体",把RPA叫"AI",把聊天机器人叫"企业AI"。概念混用直接导致选型错位:企业以为买的是智能体,实际买了个聊天机器人。
lifallen17 小时前
人工智能·学习·ai·ai编程
模型不是函数:claude-cookbooks/misc 十四篇的公共底层misc/ 是 claude-cookbooks 里最像杂物抽屉的目录。它没有 capabilities/ 那样的主题、没有 claude_agent_sdk/ 那样的编号顺序,14 个 notebook 从 2023 年 8 月排到 2026 年 1 月,涉及:批处理、JSON 输出、SQL、PDF、网页摘要、缓存、评测、元提示词。
王莹月17 小时前
gpt·ai·chatgpt·ai作画·aigc·agi
生图API 出问题怎么定位?给调用加 traceId 和结构化日志(nano-banana-pro)有次运营报"生图很慢",我去查日志,看到的是一堆这样的东西:没有 traceId,没有耗时,没有参数。我连"哪一次慢"都定位不了,只能凭感觉去猜。