ai

knqiufan1 小时前
ai·oceanbase·minimax·powercontext
MiniMax Code 接入 PowerContext:构建跨会话与跨 Agent 的项目上下文底座随着 Agent 工具生态的演进,大家手头的选择越来越多,从早期的 Claude Code、Codex,到现在的 DeepSeek Harness、MiniMax Code 等等。我最近在使用 MiniMax Code 来处理一些数据清洗与日常工作和学习的任务,作为一款桌面端 Agent,它在 Harness 架构、插件市场、Skills 以及 MCP 扩展支持上做得很扎实,在写代码还是调用外部工具执行日常任务能力都很出色。
还卿一钵无情泪8 小时前
运维·人工智能·docker·ai·容器·nlp·干货
Docker 部署Unsloth 绕开环境配置难题前提GPU环境安装了NVIDIA Container Toolkit一般情况下这个过程需要版本匹配等各种问题,需要大家自己耐心安装
码士集团小青8 小时前
ai
同样的RAG系统,分块策略不同,命中率能差20%我花了三个月搭了一套自建 RAG 知识库,240 篇技术文章灌进去,向量库跑起来一切正常。然后我用"Redis Cluster 怎么扩容"搜了一下。
Hello_Pyhx10 小时前
ai·语音识别·克隆·声音
VoiceStudio v0.5.6:从桌面生成到本地语音 API如果程序里需要把文字变成语音,可以把 VoiceStudio 看成一套带桌面工作区的本地语音服务:先在界面确认引擎与声音可用,再通过 HTTP 接口提交文字、取得音频。桌面负责模型管理和试听,脚本负责把这一步接进自己的流程。
最强小杰10 小时前
ai·github
Claude Opus 4.8 调用一直报 529 怎么办?同样请求换旧模型却正常——附 429/529 双桶退避代码标题:Claude Opus 4.8 调用一直报 529 怎么办?同样请求换旧模型却正常——附 429/529 双桶退避代码
goehou11 小时前
ai·llm·json·agent·教程·结构化输出
LLM 结构化输出全解:从 Prompt 约束到 Schema 硬保证,三层实现怎么选LLM 系列又一篇。Function Calling 篇讲过「模型输出结构化请求」的协议细节——但那个循环里有个前提没展开:模型输出本来就是不可靠的散文,怎么让它变成代码能直接用的数据? 这篇讲透结构化输出。
?? Daisy13 小时前
人工智能·ai·ai编程
ZCode 添加自定义模型:自定义供应商的字段与易错点(2026-09)本文依据 ZCode 官方公开信息与灵眸AI 官方接入文档(2026-09-09 更新)整理,端点协议实现于 2026-09-18 用零凭证方法实测。笔者未实机跑过 ZCode 全流程,涉及客户端行为的表述均已注明来源。
奇牙coding14 小时前
java·网络·gpt·ai
GPT-5.5 API 报 401 但 GPT-5.4 正常怎么办?不是 Key 失效,是 Organization 头的强制校验变了上周三帮朋友排一个诡异的 bug:他的后端服务调 GPT-5.4 一切正常,把 model 参数换成 gpt-5.5 之后,同一个 Key、同一段代码,直接 401。他折腾了一整天,换了三个 Key,甚至重新注册了账号,还是 401。最后发现根本不是 Key 的问题。
sbjdhjd15 小时前
大数据·人工智能·经验分享·笔记·ai·chatgpt·开源
智能体开始“动手”之后:OpenAI越权事件、Anthropic算力资本化与开放权重模型竞逐 | AI与SI行业日报整理(9月29日—10月6日)目录一、逐日报整理二、跨日报归并与重点判断1. 智能体安全问题从测试环境延伸至外部系统2. Anthropic的IPO叙事同时暴露增长和成本约束
belldeep16 小时前
人工智能·3d·ai
AI-3D 真人剧如何制作「AI-3D 真人剧」本质上是用 AI 生成写实 3D 感人物、再逐镜生成视频的短剧生产方式,核心难点是让同一个角色在不同镜头里长相、造型、服装保持一致。下面是完整的制作管线(这也是豆包短剧生产走的固定流程)。
大飞记Python16 小时前
人工智能·ai·ai编程
MiMo-V2.6-Distill-Qwen-9B 本地部署实测:8GB内存可跑,但推理能力让人失望大家好,我是搞自动化的大飞~好久不见,前一段时间因为太忙了,所以偷懒了几天MiMo-V2.6 Pro和Flash发布了,网上各种测评分析满天飞,什么超越Kimi K3、DeepSeek V4之类的。
林伽一17 小时前
人工智能·安全·ai·开源
从2048并发会话到501B开源模型,算力账本开始按“单位卡产出“计价|2026年10月07日今天技术圈最值得拆的,不是"模型又大了多少",而是"每单位算力能兑现多少可计费产出,以及这份产出能否被验证"。集群调度把高优先级负载启动时间压缩了83%[① TLDR AI],推理引擎则把单卡并发会话数推到2048[② SiliconANGLE AI];开源侧,Reflection AI的Beam以501B总参、23B激活参数的稀疏架构,声称用比更大开放模型少3至4倍的推理算力即可竞争[③ MarkTechPost]。与此同时,可验证性正从概念走进协议实现[④ The Verge AI]。本文从推理基础设
俊哥V17 小时前
人工智能·ai
AI一周事件 · 2026-09-30 至 2026-10-06(本文借助 AI 大模型及工具辅助整理)本周 AI 进入"开源模型 + 个人智能体协议"双线竞速:Mistral 万亿参数 Le Chonk、Google Gemini 4 Argon 接连刷新能力上限,Meta/Sierra 牵头 Personal Agent Protocol 试图定义智能体与商业交互的标准,OpenAI 则在数学证明与自我改进(RSI)上密集突破。
wflynn1 天前
ai·技术
Reflection AI 发布 501B 参数开放权重模型 BeamReflection AI 发布了 Beam,这是该公司首个开放权重模型。Beam 采用稀疏激活架构,总参数量为 501B,每个 token 激活 23B 参数。模型在 23.8 万亿 token 上完成预训练,整个预训练阶段在 4 周内完成,训练期间 Goodput(有效计算利用率)达到 92.3%。
xiangshangdemayi1 天前
ai·gis·教程·token·strata·自由
Strata教程:让GISer真正实现了token自由这几天,一个新的推理框架 Strata 火了,能让消费级显卡(英伟达 30、40 系列)实现本地运行 Qwen3.8 Flash。看了 GitHub 上的介绍和很多人的测试,用 8G 显存和 32G 内存就能跑出不错的成绩,大概 50 tok/s。于是趁着假期,我也赶紧试了一下,这里记录一下。
空堂与归1 天前
人工智能·ai
Hinton 首篇 RSI 论文:AI 自我进化怎么闭环?关键词:递归自我改进、RSI、智能爆炸、有效研发劳动力、AI 研发自动化2026 年 10 月 3 日,图灵奖与诺贝尔物理学奖得主 Geoffrey Hinton 在社交平台 X 上发文,随后一份由他与 Yoshua Bengio、Andrew Barto、OpenAI 首席科学家 Jakub Pachocki、Anthropic 联合创始人 Jack Clark 等 22 位研究者联署的论文《What if automating AI R&D triggers an intelligence explo
软件开发技术深度爱好者1 天前
ai·技术实践
DeepSeek Harnesss使用教程截至2026年10月初,DeepSeek Harness 的最新公开版本是 v0.2 预览版,并已提供开箱即用的 macOS 和 Windows 桌面端安装包。需要注意的是,Harness 自发布以来迭代非常快。从 v0.1 开发者预览版(8月13日)到 v0.2 预览版(9月29日),中间经历了多个版本。因此,在实际使用时,建议通过官方渠道确认是否为最新版本。DSH目前处于 developer preview 阶段,官方明确警告“会有破坏兼容性的改动”(breaking changes)。
2601_956743681 天前
人工智能·ai·geo·上海
上海GEO营销工程实践:知识库构建、AI内容生产、官网承接与监测优化闭环评估摘要:进入2026年第四季度,上海企业在搜索“上海GEO营销公司哪家好”“上海GEO营销公司推荐”“上海GEO营销服务商”时,真正关心的已不只是某家机构能否提升品牌在 AI 回答中的出现概率,而是服务商能否把品牌资料、内容生产、官网阵地、媒体信源、AI 监测、客户转化和长期运营串成一条可复盘的增长链路。GEO 生成式引擎优化正在从单点曝光服务,转向企业数字资产建设工程。对企业负责人、市场部门、采购部门和数字化团队来说,选型的关键不应停留在“谁的说法更热闹”,而应回到技术系统、交付流程、案例沉淀、合规机制和
空心木偶☜1 天前
ai·ai编程·langgraph
LangGraph 错误处理和重试机制想象你在打电话给客服。有时候线路忙,打不通;有时候对方正在通话中;有时候你拨错号码了。线路忙:等一会儿再打,可能就通了 → 值得重试
菩提小狗1 天前
ai·开源·极客日报·it热点·技术资讯
每日极客日报 · 2026年10月06日今日精选 25 条 IT 科技热点,覆盖 AI 大模型、开源生态、云原生、芯片硬件与工程实践等领域。Reflection AI 于 10 月 5 日发布稀疏 MoE 模型 Beam,总参数 5010 亿、每 token 仅激活 230 亿,预训练 23.8 万亿 token、支持百万上下文,并将于本月内以 Apache 2.0 开源权重。其推理算力仅为 GLM-5.2 的 1/3–1/4,定位"可私有部署的 AI 工厂"卖点,被视为对标 DeepSeek、Qwen 的西方开放权重方案。