aigc

ZzT2 小时前
aigc·openai·ai编程
把 AI Coding 工作流做成插件:资产、契约与运行时的三层拆分DeepSeek Harness 开源后很快突破十万 star。热度之外,更值得研究的是它的设计原则:Everything is a Plugin。
神奇霸王龙12 小时前
python·ai·aigc·agent·ai编程·ai写作
Agent 沙箱横评:trace、幂等、边界三道关工程实测适用读者:想在自己应用里跑 Agent 工作流,接 Qwen / GLM / Kimi / DeepSeek 这些大模型 API 做工具调用的开发者 阅读时长:约 12 分钟 测试时间:2026 年 7 月(基于 炻光 AI 接入管理平台 公开文档)
技术传感器7 小时前
人工智能·架构·aigc·需求分析·issue
让 Hermes 自动完成一个软件需求:从 Issue 到 PR 的 AI 开发流水线前一篇,我们让 Hermes 每天凌晨自动巡检服务器。这一篇换一个场景:让 Hermes 自动接住一个软件需求,从 Issue 开始,一路完成分析、开发、测试和 PR。
NutShell Wang8 小时前
人工智能·开源·aigc·ai agent·智能体·vibe coding
「音画同生」时代开启:2026 年 8 月 AI 视频生成四大发布复盘过去一年,AI 视频长期停留在「画面生成 + 后期配音」的拼接阶段:镜头之间人物漂移、声音与画面不同步、每秒成本居高不下。2026 年 8 月,四款代表性发布的密集落地,第一次把「原生同步音频」从卖点变成了行业默认方向。本文用可溯源的事实,带你看清这条新主线,并给出一份创作者能直接照着用的选型清单。
奈斯先生Vector9 小时前
人工智能·重构·架构·prompt·aigc·音视频
AI 视频不是会动的图片:用 Shot Contract、时间码与音画质检构建可交付流水线一次 45 秒的产品短片项目里,团队生成了 18 个看起来都不错的镜头。单独暂停检查,每个画面都能用:产品材质清楚、人物五官完整、光线也符合品牌调性。真正放进剪辑时间线后,问题同时暴露出来:主角在相邻镜头里换了耳饰,产品旋钮从左侧跳到右侧,24 fps 的素材被当作 25 fps 解释,台词比口型早了四帧,环境声在每个切点重新起奏。画面质量并不差,但它不是一条能够交付的视频。
leeyi9 小时前
aigc·agent·ai编程
Agent 调了删库工具怎么办:5 层防线——DeepFlux 工具安全纵深防御(第84篇-E70)一个 Agent 接了 http.get 工具去抓网页。某个网页里藏了一行字:Agent 抓到这行,如果毫无防备,这行字就原样拼进了 LLM 上下文——这是典型的 prompt injection:外部内容劫持 Agent,诱导它调危险工具。
DS随心转小程序10 小时前
人工智能·重构·aigc·word·豆包·deepseek·ai导出鸭
AI 导出鸭重构转化链路,全面优化腾讯元宝输出 word 文档办公效率伴随腾讯元宝在财税做账、职场文书、教研备课、电商文案等领域大范围普及,大量上班族、科研教师、个体创业者依靠平台生成大篇幅正文内容,但平台原生仅支持在线文本浏览,无法直接生成规整Word文件。 从线下实地走访小微企业行政岗位来看,行政人员每日借助腾讯元宝草拟规章制度、活动方案,生成内容动辄上千字符,只能逐段全选复制,粘贴至Word后手动调整行距、段落缩进、标题层级;中小学教研老师批量编写教学设计、单元试卷文案时,多轮对话生成的内容零散无序,归集排版往往占用课后一到两小时;电商运营批量撰写商品详情文案,多批次
王莹月13 小时前
gpt·ai·chatgpt·ai作画·aigc·agi
全店商品图风格怎么统一?生图API 用 nano banana pro 批量出同一套视觉单张图好看不难,难的是一百个 SKU 出来是一套。风格飘的话,店铺看着像拼盘, 比图糙更伤转化。这篇讲在该服务上怎么用 批量生图做出风格统一的全店视觉。
DS随心转小程序1 天前
人工智能·aigc·word·豆包·deepseek·ai导出鸭
借助 AI 导出鸭简化各类办公场景下文心输出 word 文档全流程操作随着文心大模型在政务撰稿、教育培训、电商文案、工程标书等领域普及,大量职场人依靠文心生成完整文稿内容,但模型仅提供纯文本对话内容,无法直接生成规范Word文件成为行业普遍难题。 从中小企业行政调研视角来看,机关文员每日利用文心草拟通知、工作报告,生成内容后需要逐段复制、调整字体行距、补充目录;培训机构教研老师依托大模型编写课件讲义,零散对话文本拆分繁琐,手工排版单份文档平均耗时半小时以上;工程从业者批量整理项目可研文案时,多轮对话生成的内容分散杂乱,归集排版耗费大量人力成本,市场迫切需要专业工具打通文心文
m0_547486661 天前
人工智能·aigc
《人工智能通识基础与AIGC应用》全套PPT课件2026《人工智能通识基础与AIGC应用》全套PPT课件2026课件内容:第1章人工智能引l论.pptx 第2章人工智能通识基础.pptx 3.1-基本图像生成与风格迁移.ppx 3.2-文本生成与摘要案例.pptx 3.3-语音合成与语音识别案例.pptx 3.4高级图像.pptx 3.5视频生成案例.pptx 4.1使用GPT构建任意软件工程案例.ppx 4.2生成汽车外观概念设计图案例.ppt 4.3智能列车运维机器人案例.pptx 4.4建筑外观-室内概念设计图案例.ppx 4.5撰写财税战略分析报告.p
wangruofeng1 天前
aigc·ai编程·deepseek
Deepseek harness 安装配置保姆教程8 月 13 号,DeepSeek 开源了一个叫 deepseek-harness(命令行简称 dsh)的项目,一天冲到五万多 star。点进去你会发现一件怪事,README 总共才一千七百来字,没截图,没功能列表,连「这到底是个啥」都没讲明白,只甩出一句话,Everything is a Plugin。
修远客1 天前
aigc·ai编程
记忆模块:Agent的短期/中期/长期记忆 — 不是所有记忆都要放向量数据库很多 Agent 教程一讲记忆就是"向量数据库 + embedding 相似度检索",搞得新手以为没装 Milvus 就不配做 Agent。
DS随心转小程序1 天前
人工智能·chatgpt·aigc·word·豆包·deepseek·ai导出鸭
巧用 AI 导出鸭攻克各类难题完善 ChatGPT 输出 word 文档转化工作现如今政企文员、自媒体创作者、高校科研人员普遍常态化使用ChatGPT完成文稿撰写、课题分析、营销文案创作。绝大多数用户在模型生成内容后,面临无法直接生成标准Word的现实困扰。 中小公司行政人员每周依托ChatGPT撰写规章制度、会议纪要,大篇幅文本需要逐段复制,手动调整字体、行距、页码;高校硕博生利用ChatGPT整理文献综述,碎片化对话内容分散在聊天页面,汇总排版往往占用半天工作时间;短视频文案从业者批量产出脚本,多轮对话内容拆分繁琐,手动整理极易出现文字遗漏、排版错乱。市场急需一款适配ChatGP
咖啡星人k2 天前
人工智能·aigc
AI编程Agent为何要配真服务器:拆解MonkeyCode云端沙箱很多人第一次看到 MonkeyCode 的架构时,都会问同一个问题:AI 编程工具不就是在编辑器里装个插件吗?为什么 MonkeyCode 要给每个 AI 任务配一台真实的服务器?
AI创界者2 天前
人工智能·aigc·音视频
最新 ComfyUI + LTX-2.5 本地一键整合包:文生视频/图生视频/数字人全流程指南在当前生成式 AI 快速发展的背景下,开源视频生成模型正在迎来全新变革。作为 Lightricks 发布的重磅开源视频扩散模型,**LTX-2.5** 凭其出色的画质表现、连贯的动作动作生成以及对多模态控制(音效、补帧、首尾帧)的良好支持,引发了广泛关注。 然而,配置 ComfyUI 的运行环境、各种 Python 依赖库以及复杂的 PyTorch/CUDA 显卡驱动环境,常常将不少使用者拒之门外。 今天为大家分享 最新 ComfyUI + LTX-2.5 本地一键部署整合包*的使用与配置指南,实现真正的
xiezhr2 天前
github·aigc·deepseek
DeepSeek 不能识图?装个开源 Skill,纯文本模型也能"睁眼"了用 DeepSeek 的人是越来越多了。理由也简单,便宜,还越来越强。V4-Flash 正式版一出来,性能又往上蹿了一截,就在前几天V4-Pro正式版也发布了。
wangruofeng2 天前
aigc·ai编程
连 agent loop 自己都是插件,拆开 DeepSeek 新开源的 harness 底座大家好,我是若风。8 月 13 号,DeepSeek 开源了一个叫 deepseek-harness(命令行简称 dsh)的项目,一天冲到三万多 star。点进去你会发现一件怪事,README 总共才一千七百来字,没截图,没功能列表,连「这到底是个啥」都没讲明白,只甩出一句话,Everything is a Plugin。
怕浪猫2 天前
aigc·agent
DeepSeek Harness 开发者预览版:一切皆插件今天,DeepSeek Harness 的开发者预览版(v0.1 版本)面向全球 Harness 开发者开放测试,并同步以 MIT 协议开放源代码。
ServBay2 天前
aigc·ai编程·deepseek
DeepSeek V4 Pro 发布,1.6T 参数、1M 上下文,又有人坐不住了DeepSeek V4 Pro 千呼万唤始出来。这是V4系列中定位更高的模型,采用 MoE(Mixture-of-Experts)混合专家架构,总参数量达1.6T,激活参数49B,支持 1M(百万 Token)上下文长度,最大输出长度达到 384K Token。