ai

xcLeigh5 小时前
前端·人工智能·python·ai·html·ai开发·豆包
Doubao-Seed-Evolving大模型接入教程|搭建全品类提示词+AI工具导航网页过往大模型版本多为固定大版本发版制(如2.0、2.1-Pro固定版本号,版本生命周期内能力基本锁定);
俊哥V6 小时前
人工智能·ai
每日 AI 研究简报 · 2026-07-20(本文借助 AI 大模型及工具辅助整理)一句话总结:中国 AI 模型厂商在开源领域强势突围,Moonshot 与阿里巴巴接连发布与 OpenAI、Anthropic 竞争的前沿模型;苹果 AI 正式在中国备案落地;企业级 AI Agent 安全问题浮出水面,超半数企业已发生安全事件。
元闰子6 小时前
ai
怎样才算是好的 Agent 记忆系统?记忆系统(Memory System)是 Agent 保持多轮任务连贯性的核心组件,解决了模型上下文窗口有限的问题。它把 Agent 历史交互上下文保存起来,并在必要时召回,让 Agent 具备了人类的记忆能力。
GPUStack7 小时前
ai·大模型·llm·gpu·vllm·gpu集群·sglang·gpustack
Day 0 实测|在 GPUStack 上部署 Inkling-BF16:8 卡 H20-141G 推理性能测试Inkling 是由 Thinking Machines Lab 发布的新一代开源多模态大语言模型,采用 Mixture-of-Experts(MoE)Transformer 架构,支持文本、图像和音频等多模态输入,并生成文本输出。模型拥有约 975B 总参数、41B 激活参数,并支持最长 1M token 上下文窗口。
云卷云舒___________7 小时前
ai·阿里·deepseek·ai日报·harness·qwen38·tokenplan
阿里开源Qwen3.8 2.4T模型预览版、并推出Token Plan订阅、DeepSeek Harness与V4正式版同发 | 7月20日 AI日报💡 今日趋势速览:阿里开源2.4万亿参数Qwen3.8模型并推Token Plan订阅,DeepSeek Harness代码智能体将随V4发布,模型与工具生态竞争加剧。
俊哥V9 小时前
人工智能·ai
每日 AI 研究简报 · 2026-07-18(本文借助 AI 大模型及工具辅助整理)一句话总结:2026 世界人工智能大会(WAIC)在上海开幕,中国 AI 开源力量与全球治理议题成为焦点;阿里云发布 AI Agent 安全最佳实践,企业级智能体安全正式进入"必选项"阶段。
不爱记笔记7 小时前
人工智能·ai·机器人·具身智能·deepseek
2026 WAIC大会亮点解析!超节点、机器人与AI应用全面开花摘要: 2026世界人工智能大会在上海举办,超过1100家企业参展,3000多件产品亮相,其中300多件为全球首发或首秀。本文基于B站UP主科技狐的大会长视频内容进行整理,通过Ai好记完成视频转录和要点提炼,从AI算力基础设施、机器人、AI终端硬件、应用层四个维度梳理大会核心亮点。
todoitbo9 小时前
人工智能·ai·aigc·claude
Claude Code 接蓝耘实测:选第三方 API 的三条铁律网上给 Claude Code 接第三方 API 的教程一抓一大把,但清一色都在教你怎么填 base_url、api_key,填完能对话就算完事。可真正把它挂上去跑一阵子你就会发现:填 URL 是五分钟的体力活,选对平台才是真功夫。
猫先生Mr.Mao7 小时前
ai·机器人·具身智能·vla·π0.7
一文梳理 RT-2 到 π0.7:通用机器人策略的技术演进【从零走向AGI】旨在深入了解通用人工智能(AGI)的发展路径,从最基础的概念起,逐步构建完整的知识体系。 项目地址🔗:https://github.com/AI-mzq/From-Zero-to-AGI.git
土星云SaturnCloud7 小时前
服务器·人工智能·ai·边缘计算·语音识别
MP_SENet轻量语音降噪模型在土星云边缘设备的部署实战边缘语音交互、工业音频监测等场景对端侧降噪的需求持续增长,云端方案存在延迟高、隐私风险等问题。MP_SENet以仅2M参数量实现了顶尖降噪效果,天然适配边缘部署。本文基于土星云BM1684X架构设备,完整讲解模型原理、环境搭建、Python推理部署与性能实测。
电子工匠8 小时前
ai·开源软件
Understand Anything 在 Qoder 中的完整使用指南一句话总结: Understand Anything 是一个多平台兼容的 AI 编程助手技能,它通过 Tree-sitter 静态分析 + LLM 语义理解的双引擎架构,将任何代码库转化为可交互的知识图谱,让你从"盲读代码"进化到"全景理解"。
猫先生Mr.Mao8 小时前
ai·论文解读·具身智能·vla·onetwovla
具身智能之OneTwoVLA详解:如何统一推理与行动【从零走向AGI】旨在深入了解通用人工智能(AGI)的发展路径,从最基础的概念起,逐步构建完整的知识体系。 项目地址🔗:https://github.com/AI-mzq/From-Zero-to-AGI.git
带刺的坐椅8 小时前
java·ai·llm·agent·solon
Solon TeamAgent 协作协议:从 SEQUENTIAL 流水线到 HIERARCHICAL 主管团队如果单个智能体是专家,那团队就是组织架构。难点不在“多加几个 Agent”,而在于:下一步谁说话、谁审核、何时停机。
doiito8 小时前
ai·rust·架构设计
【RUST AI】把 TTS 搬进浏览器:kokoroi-rs 的 WASM 实践摘要:本文深入解析 kokoroi-rs 项目的 WASM 模块,展示如何将 Kokoro TTS 模型编译为 WebAssembly,在浏览器中实现纯前端、零服务器的高质量中文语音合成。文章涵盖整体架构(G2P 引擎 + ONNX 推理)、两种推理后端(ONNX Runtime Web 与纯 Rust oxionnx)的深度对比、JavaScript API 设计、构建与 Demo 演示,以及隐私安全、性能表现与未来方向。适合关注 Rust + WASM + AI 的前端开发者、隐私敏感应用及边缘计算场
亮亮在江湖8 小时前
ai
YOLO训练 vs LlamaFactory训练 完整区分一、底层本质完全不同任务领域:计算机视觉 CV,图像 / 视频感知 模型输入:图片、视频帧 模型输出:框坐标 (x,y,w,h) + 类别置信度 + 类别标签 训练目标:让模型看懂画面,定位物体、区分物体种类 训练数据:标注图片(每张图画框标注目标) 网络结构:CNN 卷积神经网络,轻量化视觉骨干网络
wabs6668 小时前
ai·文献
关于文献【RL/SFT】1、【我的问题】RL教调度,SFT改机制是什么意思?【deepseek】【我的总结】经过RL的AI只是学会了什么时候调度,SFT让AI的内部推理逻辑变了
ofoxcoding9 小时前
网络·人工智能·ai·音视频
Seedance 2.0 与 Wan 2026 视频生成 API 成本效率深度对比分析******`[](https://ofox.io/zh/models)[](https://app.ofox.io/) **TL;DR:** 两个中国视频模型,一个端点,一道清晰的价差。 字节跳动的 Seedance 2.0 三档定价 $0.04–$0.07/s,旗舰档能到 4K。阿里巴巴的 Wan 统一 $0.10/s,上限 1080p。同样的片子,Seedance 在 1080p 便宜约 30%,Mini 档便宜约 60%。Wan 的价格靠更短的最短时长(2s 对 4s)和阿里的运动一致性来撑。两家
码农杂谈00079 小时前
ai·gea·context资产
组织管理视角深度解读:时尚集团GEA智能体案例——AI重构创意行业的组织资产与人力博弈传统时尚、文创企业的组织模式,完全建立在核心天才的隐性知识之上,这是案例所有痛点的根源:组织知识高度私有化
wuyuanshun9 小时前
人工智能·ai
LangGraph原理逻辑-LangGraph接入MCP(三)而随着几千个MCP服务突然冒出,百度、阿里等厂商也开始大规模接入MCP,这个协议也迅速在互联网上引起轩然大波。按照那些流量派见风就是雨的性子, MCP也着实被大吹特吹了一波。随着MCP服务越来越火爆,LangGraph的AgeNnt中也提供了MCP的集成。这次我们就分几个部分,逐步深度拆解MCP服务。
hhzz9 小时前
图像处理·计算机视觉·ai·cnn·大模型
CNN图像分类入门:基于TensorFlow+Keras的CIFAR-10数据集全流程实战CIFAR-10是深度学习图像分类领域最经典的数据集之一,由Alex Krizhevsky、Vinod Nair和Geoffrey Hinton于2009年收集整理。它包含60000张32×32彩色图像,分为10个类别,每个类别6000张,是计算机视觉入门和模型验证的"金标准"。