ai

ai小陈5 小时前
运维·服务器·人工智能·ai·ssh·gpu算力
GPU服务器租用存储验收:检查点写入与磁盘吞吐实战选择GPU服务器租用实例时,显卡性能达标并不代表训练过程一定顺畅。大模型训练保存检查点时,若磁盘空间不足、写入抖动或目录落在慢速系统盘,GPU可能长时间等待,甚至因写盘失败丢失恢复点。本文用可复现方法检查容量、吞吐和检查点落盘完整性。
bigdata-余建新5 小时前
ai
week10基于手头文件写了一个问答系统,不需要网页,能用代码做出回答就行,方法任选即可读取本地文件 → 文本切分 → 向量化 → 检索相关内容 → 调用大模型生成答案。使用RAG方法。
JackSparrow4146 小时前
人工智能·程序人生·ai·github·cloudflare·astro·静态博客
和AI一起将全部CSDN博文迁移到个人博客站回想起最初为什么选择CSDN?是因为我希望自己有个可以简单记录技术的地方,如果还有可能的话,我希望我的博文能帮到更多和我遇到类似问题的人。在最初,选择一个平台直接发布技术博文对我来说既简单省心,又可以依赖该平台良好的SEO曝光让更多的人看到我的博文。虽然中间也曾折腾过个人站点,但当时我觉得还是把精力放在博文质量方向较好
搬砖的小码农_Sky6 小时前
人工智能·windows·ai·ai编程
AI Agent:如何处理Claude Code 最近版本(2026年更新)引入的模型上下文限制在Claude Code里使用非Anthropic的AI大模型(本文为qwen3.7-flash-2026-07-15),可能会报以下错误。
kaixin_啊啊7 小时前
人工智能·ai
【零基础学AI】第 1 章课后练习与答案先独立完成,再向下核对答案。归类时可以写多个层级,例如“人工智能、机器学习、深度学习”。题目没有提供实现细节时,只写能够确定的类别。
李航19839 小时前
人工智能·python·计算机视觉·ai·ai编程
AI定制柜建模,需要详细的建模规范和标准流程高级篇 【教程】下载DeepDraw AI建模引擎并安装在Codex中使用 给AI做了一套视觉工具,找出场景里全部植物,还能整理导出模型库 Astra感觉成精了,居然在通过模型的顶点推算门框轮廓线,然后居然还对准了 看我手把手教出来的AI学生不赖呀,给张橱柜参考图一会就设计出来了 Codex 直接驱动 DeepDraw 建模:一句话创建模型,再用一句话修改它 太神奇了,用Codex识别手绘的量房草稿,然后直接出房型图 AI建模太牛了,自己动手搭建AI建模软件,Codex直接操作DeepDraw窗口建模 自
kaixin_啊啊12 小时前
人工智能·ai
【零基础学AI】第 1 章——AI 究竟包含哪些技术?打开短视频,首页很快排出一批你可能愿意看的内容。拿起手机,镜头认出人脸以后解锁。再打开一个对话工具,输入几句话,它能接着写邮件、提纲或代码。
VIP_CQCRE12 小时前
ai·大模型·agent·coze·acedatacloud
Coze 接入大模型太麻烦?用 Ace Data Cloud 统一 OpenAI Responses API如果你正在用 Coze 搭建智能体,最常遇到的问题之一是:模型越来越多,协议越来越多,平台接入方式却不统一。
CoderJia程序员甲14 小时前
ai·大模型·llm·github·ai教程
GitHub 热榜项目 - 周榜(2026-10-03)生成于:2026-10-03共发现热门项目: 18 个Token赞助:siliconflow前些天发现了一个巨牛的人工智能学习网站,通俗易懂,风趣幽默,忍不住分享一下给大家。点击跳转到网站。
IvorySQL14 小时前
数据库·人工智能·ai·postgresql·区块链
PostgreSQL 日报| relchecks 溢出导致表无法删除(9 月 28 日)该消息是一条简短的归档说明,发布于关于为 TABLES IN SCHEMA 发布功能支持 EXCEPT 子句的讨论线程中。此前,Shveta Malik 报告已能在 HEAD 上复现一个崩溃问题,并建议在单独线程中跟进。Mihail Nikalayeu 随后补充了归档链接,指向专门处理该崩溃问题的新线程及其对应的 commitfest 条目。此消息本身不包…
c萱15 小时前
ai·语言模型·aigc·产品经理·ai-native
AI产品经理——02AI产品的发展目录一、大模型的演变及概念二、AI产品经理的关键定义三、大模型带来的变化四、AI pm从入门到精通的职业路线
海带紫菜菠萝汤17 小时前
人工智能·深度学习·ai·开源·大模型
欧洲也开源了「78B 只激活 3.46B」:主权叙事变了,技术选型没变德国 AI 公司 Aleph Alpha 于 10 月 3 日发布并开源大模型 Kolibri:总参数 78.1B、每 token 仅激活 3.46B(激活比约 4.4%),德英双语,原生上下文 262,144 token、官方称测试可用到 100 万;权重以 Apache 2.0 协议放上 Hugging Face,随附一份 189 页的技术报告(来源:Aleph Alpha 官方发布文,经 HuggingNews、Web Pulse、AGI Hunt 多源转述)。公司把它定位为「主权模型」:德国团队建
空堂与归18 小时前
人工智能·gpt·ai
GPT-6 Astra填充Token 10%→50%监控盲区关键词:GPT-6 Astra、填充 Token、隐式推理、思维链监控、Redwood Research、大模型安全
全栈练习生18 小时前
python·ai
大模型原理之 MoE 混合专家模型混合专家模型在 Transformer 中以“多个并行前馈专家 + 可学习门控路由”替代单一稠密 FFN 层,实现知识容量与单次计算量的解耦:每个 token 仅激活少量专家,模型得以在近恒定算力预算下承载远超同规模稠密模型的参数总量。本文从架构机理、稀疏激活、训练稳定性与系统工程四个维度梳理 MoE 技术体系:形式化门控路由与 Top-K 稀疏激活的数学表达,剖析“赢家通吃”正反馈导致的路由坍缩及主流均衡方案,总结 DeepSeekMoE 细粒度切分与共享专家隔离创新,归纳显存墙、All-to-All
空堂与归18 小时前
开发语言·人工智能·gpt·ai
GPT-6.1 Sol 来了:1/5 价逼近 Astra 级2026年9月29日,OpenAI 在 DevDay 2026 上正式发布 GPT-6.1 Sol(模型 ID gpt-6.1-sol),把接近旗舰 Astra 的智能体编码能力,压到了 Astra 标准输入/输出价的五分之一:1.05M token 上下文窗口、128K 最大输出,厂商自测 DeepSWE v1.1 拿到 75.22%,与旗舰 Astra 的 74.8% 基本持平。对做 Agent 工具链、自动化运维和代码生成产品的开发者来说,这件事的意义不在「又多了一个新模型」,而在于中端价位段的绝对
bigdata-余建新19 小时前
ai
week9目标: 部署一个VLLM大模型服务,验证速度提升。内容:使用同一个开源大模型,分别采用 Hugging Face Transformers 原生推理和 vLLM 服务化推理,在相同硬件、相同输入长度、相同输出长度下,对比单请求延迟、并发吞吐、TTFT、TPOT 和 Tokens/s,验证 vLLM 在在线推理场景中的性能提升。
数商思语行20 小时前
人工智能·ai·供应链·商业分析·ontology·本体·fde
Palantir Study 27|Global Branching:安全修改生产 Ontology恒川工业的缺料应用已经上线。采购员从外部门户读取 SD-260808-01,门户通过 OSDK 依赖 risk_level 和催交 Action。Buyer 此时提出:“给采购订单行增加供应商承诺可信度。”
七夜zippoe20 小时前
ai·自动化·agent·测试·openclaw
Agent 自动化测试:怎么给“会自己决策“的程序写测试本文是《AI Agent 生产化实战(OpenClaw 主线)》系列第 5 篇。前面四篇把 Agent 搭起来了、看得见了、也把成本压下来了——但还剩一个最要命的问题没解决:你怎么确认这次改动没有把之前修好的东西弄坏? 传统后端的答案是单元测试,可这套答案在 Agent 上几乎全部失效:输入不再是确定的,输出不再是可断言的,同一段代码跑两次结果可能不同。本篇面向已经用上 CI、却对 Agent 改动"只敢人工点几下"的团队:基于 OpenClaw(2026-08 版)+ Vitest + 评测集方案,讲清
kali-Myon20 小时前
人工智能·安全·ai·自动化·web
ARTEX:AI 驱动的自动化漏洞挖掘平台目录项目概述核心架构与工作方式环境准备与项目部署基本使用介绍小结ARTEX 是一套开源 AI 自主渗透测试系统,采用 Go 后端、Next.js 前端和 PostgreSQL。系统以 LLM Agent 为核心,面向授权安全测试中的资产梳理、目标探索、漏洞发现与复测,提供任务管理、执行记录、资产视图、流量留痕及报告等能力。