aigc

杨杨杨大侠24 分钟前
aigc·openai·ai编程
全量微调、LoRA、QLoRA 怎么选?用简单例子讲清六种微调方法刚了解大模型训练时,我以为“微调”就是拿一些资料,让模型继续学。这个理解没错。但再往下看,又出现了一串名字:全量微调、冻结层、LoRA、QLoRA、Adapter、Prompt Tuning……
橙序员小站2 小时前
后端·aigc·ai编程
从 Demo 到生产:Agent Harness 如何把 AI 真正“接”进项目模型负责生成下一步,框架负责组织链路,而 Agent Harness 负责让这次运行在真实项目里可控、可追踪、可恢复。
粥里有勺糖3 小时前
前端·github·aigc
视野修炼-技术周刊第132期 | 一些有趣的组件欢迎来到第 132 期的【视野修炼 - 技术周刊】,下面是本期的精选内容简介🔥强烈推荐🔧开源工具&技术资讯
xierui1231234 小时前
数据库·人工智能·aigc·软件工程
Agent记忆不是聊天记录:用三层存储构建可追溯的 AI 工作流最近 Hugging Face 发布了 Funes,一个给 Claude Code、Codex、pi、Hermes 等编码 Agent 使用的持久记忆层。它解决的不是“让模型记住更多聊天”,而是把本机已有执行轨迹变成可检索、可追溯的工作记忆。
杨杨杨大侠4 小时前
aigc·openai·ai编程
推理模型和 MoE 到底有什么区别?从一道打折题讲到专家分工学习大模型时,我一开始把两个概念混在了一起:推理模型会多想几步,MoE 会找几个专家,是不是都在让多个模型讨论,然后选一个答案?
feasibility.4 小时前
人工智能·aigc·视频·地图·具身智能·英伟达·世界模型
ABot-World-0:当一块 RTX 5090 能编织无限世界——交互式世界模型的高德解法一句话总结:高德 AMAP CV Lab 用一张 RTX 5090,把“无限交互世界”从数据中心的幻想拉进了你的桌面机箱。5B 参数的因果学生模型,基于 Wan2.2 骨干,经三阶段渐进蒸馏(Teacher Forcing → ODE Distillation → LongForcing),在 720P/16FPS/1.2s 延迟/~19GB 显存的约束下,实现了小时级甚至日级不崩溃的闭环交互世界 rollout。
奈斯先生Vector8 小时前
开发语言·人工智能·windows·python·aigc·音视频
AIGC 视频生成实战:用 Kling Video 拆解文生视频、图生视频与完整工作流一张商品海报,真的能直接变成一条可发布的短视频吗?这是许多内容团队第一次接触 AI 视频生成时最容易产生的期待。提示词写好了,模型调用也成功了,得到的结果却可能出现人物手指变形、商品结构改变、镜头突然加速、字幕乱码,甚至前后画面完全不像同一个产品。问题往往不在于“不会写一句提示词”,而在于没有把文字、画面、时长、声音、任务状态和后期流程组织起来。
SmartBrain8 小时前
人工智能·aigc
智能体是“数模治理”方向的重要技术引擎核心判断:智能体部署呈“三步走”演进——2021—2023年以“两库”制度打底规则治理、2025年智能体进入医保真实场景并扩为“三库”试点、2026年上升为国民级智能体与国家顶层设计。治理范式从“规则判定”走向“数据+模型驱动”,“AI进域、数据不出域”是贯穿始终的治理原则,最终落点是覆盖全民参保人的“个人医保云”国民级健康智能体。
漂着的圆木9 小时前
人工智能·计算机视觉·aigc·ai agent
GLM-5.3-Flash 接入 Agent Loop:图片验收别只查 OCR一张图尺寸正确、没有乱码、文件哈希也对,为什么仍然可能完全不能发?因为这些检查只证明“文件存在且结构正常”,没有证明画面真的符合题目。手握钢笔的图库照片可以没有任何文字,也可以通过尺寸、OCR 和感知哈希检查,但它仍然可能和“模型输出的隐形签名”毫无关系。
怕浪猫9 小时前
gpt·chatgpt·aigc
一次面试让我重新认识了 Codex,顺便搞懂了 GPT-6 Astra上周技术面试,面试官看了我简历上写的「熟练使用 AI 编程工具」,笑了笑问:"那你用过 Codex 吧?你觉得它和 Cursor 最大的区别在哪?"
灵感__idea10 小时前
aigc·openai·ai编程
《AI工程》:模型选择,微调与数据集(深度篇)确定可实现的最佳性能,在成本与性能之间进行权衡。前两篇文章,我们讨论了产品决策,浅聊了开发技术,如果不来点更深入的硬菜,对开发人员不太过瘾,上菜~
Csvn10 小时前
人工智能·aigc·agent
第 17 章 评估与自检 EvaluationAgent 的输出没人把关就会出错——内嵌自检、Guardrail、结构化验证,怎么平衡误杀与漏检?评估与自检(Evaluation & Self-check)是在 Agent 输出交付前,用规则、结构校验和模型审核对它进行把关,拦截不合格输出、触发重试或降级。 它是"质量保障"在单次调用层面的落地(第 20 章讲的是体系化的评测,本章讲的是内嵌在流程里的实时自检)。
Dawson Zhu11 小时前
人工智能·语言模型·架构·aigc·agi
Kafka 在 AI Agent 系统中的应用:任务队列与事件总线的角色辨析及工程实践AI Agent(智能体)通常被描述为“感知—规划—行动”的循环:接收用户输入或环境事件,调用大模型推理,再借助工具(检索、数据库、HTTP 接口、代码执行等)完成任务。一个看似简单的对话请求,背后可能串联多次 LLM 调用、知识库查询、工具调用和结果汇总,端到端耗时从几百毫秒到几十分钟不等。
手写码匠11 小时前
人工智能·深度学习·算法·aigc
华为云Flexus+DeepSeek征文|DeepSeek R1 推理优化实战:让复杂任务的回答又快又稳用 DeepSeek-R1 做复杂任务(代码审查、数学推理、逻辑分析)的开发者,大概率都遇到过这样的抱怨:
wangruofeng19 小时前
chatgpt·aigc
用 GPT-6 Astra 打磨 Vecsy:我的浏览器 SVG 编辑器进化记GPT-6 Astra 今天正式发布,刚好我用 Astra 来打磨了一下我的 Vecsy 项目,实现了几个以前一直想做而没有实现的功能。
Csvn1 天前
人工智能·aigc·agent
第 16 章 多智能体 Multi-Agent一个 Agent 搞不定复杂任务——多个 Agent 分工协作,怎么避免它们互相抢上下文、任务冲突?多智能体(Multi-Agent)是让多个各司其职的 Agent 协作完成一个任务——每个 Agent 有自己的角色、目标、工具和上下文,通过编排器或互相通信协同工作。
yuezhilangniao1 天前
aigc·comfyui
MiniMax-H3视频生成模型使用坑点与记录(持续更新)《MiniMax-H3视频生成模型使用坑点与记录(持续更新)》刚开始玩大模型那会儿,最让我着迷的恰恰是它那种捉摸不透的"感性"——同样的参数,这次跑出来干干净净,下次就莫名其妙给你整点"花活",像极“前女友”有没有感觉大家? 呵呵,但这种"随机"背后其实藏着严密的规律,类似女性常说的我就觉得你骗我,我的直接告诉我! 没错就是她:“第六感”——表面感性,底层是极其精密的信息处理。
DisonTangor1 天前
人工智能·算法·开源·aigc·腾讯云·腾讯云ai代码助手
【腾讯混元雪耻归来】 Hy4 preview:770B 参数 MoE 旗舰模型,1M 上下文全面开源🖥️ 官方网站 | 💬 GitHubHy4 preview 是腾讯混元团队(Tencent Hy Team)研发的新一代混合专家(MoE)旗舰模型。模型总参数量为 770B,其中每个 token 激活 49B 参数。主干网络包含 78 层,其中第一层使用标准稠密 FFN,其余 77 层替换为 MoE,每层包含 256 个路由专家和 1 个共享专家;每个 token 激活 top-8 路由专家以及共享专家。除主干网络外,模型还内置了 1 层原生 MTP(Multi-Token Prediction,多
VIP_CQCRE1 天前
aigc·api·ai绘画·ace data cloud
Nano Banana Image API:用 Ace Data Cloud 快速接入高一致性的 AI 图像生成与编辑能力如果你最近关注 AI 图像生成,一定会发现一个明显趋势:大家不再只满足于“生成一张好看的图”,而是更关心 同一个主体能否在不同场景、风格、角度和动作下保持一致。
全栈弄潮儿1 天前
aigc·openai·ai编程
初学者关于 AI 编程最常问的 10 个问题写完一段代码、遇到一个报错、看到一个新的 AI 工具,初学者往往都会有同样的疑问。这一篇不讲复杂概念,直接回答 10 个高频问题。每个回答都尽量给出一个能马上执行的动作。