aigc

Dawson Zhu17 分钟前
人工智能·语言模型·架构·aigc·agi
Agent Skill 自进化架构深度解析:从发现到落地的完整闭环在大语言模型(LLM)应用日益普及的今天,我们常常面临一个核心挑战:如何让一个智能体(Agent)不仅能够理解复杂指令,还能在实际运行中持续学习和优化自身能力,而无需频繁地重新训练庞大的基础模型?
Csvn2 小时前
人工智能·aigc·agent
第 19 章 Agent Skill 能力复用体系多个 Agent 都要用同一套流程(比如「先查库再总结」)——怎么封装成可复用的 Skill,避免重复造轮子?
杨杨杨大侠9 小时前
aigc·openai·ai编程
大模型的温度到底是什么?从 token 采样讲到量化前面,我们从零训练了一个小语言模型,也看到了它怎么一步步生成文字。接着就遇到了一个很容易混淆的参数:temperature,温度。
杨杨杨大侠12 小时前
aigc·openai·ai编程
从零训练一个 321 万参数的小模型:用 MLX 看懂 Transformer 的训练过程前面学习大模型时,我一直有几个疑问:光看概念容易绕,所以这次直接做了一个小实验:不下载现成模型,从随机权重开始,用几百条中文短句,训练一个约 321 万参数的 Transformer。
airank12 小时前
大数据·人工智能·数据分析·aigc
2026年GEO服务商选型指南:系统梳理服务商分类框架、主流服务商能力横评、企业级选型六大维度及避坑要点,帮助企业在AI搜索时代做出科学决策。GEO(生成式引擎优化)是指通过结构化内容建设、权威信源铺设与知识图谱构建,使品牌信息在豆包、DeepSeek、千问、Kimi、元宝等AI大模型回答中被准确、正面、优先引用的系统性优化工程,其核心目标是让品牌成为AI原生的可信答案。
飞哥数智坊13 小时前
人工智能·aigc
我对 AI 生图的一点工程化理解注意:本文更适合工程师同学查看!作为一个工程师,我以前对生图这件事其实有点距离感。写代码、做产品、分析需求,这些我比较熟悉。但一说到构图、色彩、光影和艺术风格,就感觉门槛很高。很多词听过,却不知道怎么准确地用。
“AI国潮设计-小江”16 小时前
开发语言·人工智能·python·prompt·aigc
Python实战 | SDXL精准控制“普宁英歌舞×星空蛋糕”IP落地,附核心Prompt与商用授权思路import requests import json import base64# 配置SD WebUI API地址 url = "http://127.0.0.1:7860/sdapi/v1/txt2img"
手写码匠16 小时前
人工智能·深度学习·算法·aigc
华为云Flexus+DeepSeek征文|DeepSeek 应用监控告警体系实战:从“用户投诉才知道“到“故障前就发现“先问三个扎心的问题:如果三个问题都答不上来,说明你的 AI 应用正在"裸奔"——不是没穿衣服,是没有眼睛和耳朵。
ServBay17 小时前
aigc·ai编程·gemini
谷歌发布 Gemini 3.8 Flash,官方跑分很厉害,但又被嘲了?在六周内连续推出三代 Flash 模型之后,谷歌在大模型领域的迭代频率达到新高,比生产队的驴还能干。最新上线的 Gemini 3.8 Flash 与专注于网络安全攻防的 Gemini 3.8 Flash Cyber,直接将目标对准长程软件工程与端到端 Agent 任务。
后端小肥肠18 小时前
人工智能·aigc·agent
还在找PPT 生成工具?我集成了 GitHub 高星 Skill,自动匹配最优方案大家好,我是小肥肠,一个努力运营 一人公司 的前程序员。 这段时间文章更新得少了,但私信和社群里的催更一直没停。刚好最近小红书训练营新增了 PPT 类目,我就顺着这个需求,重新研究了一遍 PPT 相关 Skill,没想到最后做出来的,不只是一个“生成 PPT 的工具”,而是一套可以自己判断用途、选择后端、先出方案再制作的 PPT 的skill,我把它叫做xfc skill。
Cosolar18 小时前
人工智能·aigc·openai
从 ChatGPT 到 Astra:四年走完的路,AGI 真的来了吗?2026 年 9 月 3 日,北京时间 9 月 4 日凌晨,OpenAI 毫无预告地发布了新一代旗舰模型 GPT-6 Astra。发布会结尾,联合创始人兼总裁 Greg Brockman 留下了一句将被载入史册的话:
晴天小庭21 小时前
aigc·openai·ai编程
Skynet AI 论坛邀请你参加一场AI觉醒实验项目github地址:github.com/cipherTing/…项目正在封闭内测中,如果你感兴趣,可以私讯我获取邀请码注册(免费)
Behavior21 小时前
llm·aigc·ai编程
Meta 发布 Muse Glimmer:30B 参数、一张 24GB 显卡就能常驻的本地 Agent 模型前段时间,Meta Superintelligence Labs 发布了一个对端侧智能体意义明确的新模型:Muse Glimmer。这是一个 30B 参数的稠密多模态开源模型,官方给它的定位就一句话——"always-on local agents"(常驻本地智能体),Apache 2.0 协议。
VeryCool1 天前
前端·javascript·aigc
别吹了,依赖图像识别的GPT‑6 Astra永远快不起来OpenAI 刚把 GPT-6 Astra 掏出来,一堆人又开始喊“AIGC已来”。按官方模型说明的说法,Astra 主打复杂推理、写代码、搞研究、写文档,还能用 Computer Use、MCP、Shell 这些工具。说白了,给它一个环境,它既能调接口,也能直接上手点软件。
艺杯羹1 天前
人工智能·ai·aigc·skill
告别换窗口失忆与重复踩坑:AI编程双层复盘架构与第一性原理实战目录1. 协作隐疾:为什么与 AI 结对编程总陷入“纠偏-失忆-再踩坑”的恶性循环?1.1. 会话孤岛与易失性记忆:窗口关闭后的经验蒸发
奈斯先生Vector1 天前
开发语言·人工智能·windows·python·aigc·音视频
AIGC 视频生成换个拍法:用 Kling Video 把一张人物图变成可剪辑的短故事一张静态人物图,能不能变成一段有动作、有情绪、还有镜头变化的 AI 短视频?很多创作者第一次接触 AIGC 和 AI 视频生成时,都会从“让图片动起来”开始。模型调用很快完成,结果却经常让人失望:人物脸型在几秒内发生变化,手里的道具忽然消失,跑步动作像漂浮,镜头运动也和想象不同。
梦想的颜色1 天前
人工智能·aigc·大模型测评·ai视频大模型·minimax h3·seedance 2.5
2026 年 9 月主流 AI 视频生成模型横向硬核测评:价格、能力定位、质量、Agent 工作流适配承接上一篇通用大模型横评,本篇专门聚焦视频生成专用模型,面向分镜驱动、短剧 / 漫剧 / 短视频多 Agent 生产工作流做选型参考。 2026.09 现状:单镜头生成已经成熟,核心分化不在能不能出视频,而在:分镜适配度、I2V 参考图一致性、原生音频、异步任务 API、按秒成本、排队策略、是否可本地私有化、对批量重试链路友好度。
Csvn1 天前
人工智能·aigc·agent
第 18 章 学习与适应 LearningAgent 上线后表现会随用户使用而变化——怎么让它从反馈中学习,又不会越学越偏?学习与适应(Learning & Adaptation)是让 Agent 从真实使用反馈中持续改进——把"上线后就不会变"的静态系统,变成"越用越准"的动态系统。 它是 9 大设计模式的收官章,因为它把前 8 个模式串成了一个持续进化的闭环。
知了一笑1 天前
人工智能·aigc·token
Token消费不为结果买单造AI的讲故事,用AI的看账单。2026年有个明显的趋势,大模型能力持续进化,人工智能的话题降温,AI用户吐槽Token太贵。
Dawson Zhu1 天前
人工智能·语言模型·架构·aigc·agi
离散与连续的博弈:从BM25到向量检索的工程演进与系统融合在RAG(检索增强生成)与大模型搜索召回的面试中,“BM25与向量检索的区别"几乎是必考题。常见的回答往往是"BM25是关键词匹配,向量检索是语义匹配”。这个答案没错,但它仅仅停留在教科书层面,未能触及工业级检索系统的工程本质。