技术栈
ai
xcLeigh
5 小时前
前端
·
人工智能
·
python
·
ai
·
html
·
ai开发
·
豆包
Doubao-Seed-Evolving大模型接入教程|搭建全品类提示词+AI工具导航网页
过往大模型版本多为固定大版本发版制(如2.0、2.1-Pro固定版本号,版本生命周期内能力基本锁定);
俊哥V
6 小时前
人工智能
·
ai
每日 AI 研究简报 · 2026-07-20
(本文借助 AI 大模型及工具辅助整理)一句话总结:中国 AI 模型厂商在开源领域强势突围,Moonshot 与阿里巴巴接连发布与 OpenAI、Anthropic 竞争的前沿模型;苹果 AI 正式在中国备案落地;企业级 AI Agent 安全问题浮出水面,超半数企业已发生安全事件。
元闰子
6 小时前
ai
怎样才算是好的 Agent 记忆系统?
记忆系统(Memory System)是 Agent 保持多轮任务连贯性的核心组件,解决了模型上下文窗口有限的问题。它把 Agent 历史交互上下文保存起来,并在必要时召回,让 Agent 具备了人类的记忆能力。
GPUStack
7 小时前
ai
·
大模型
·
llm
·
gpu
·
vllm
·
gpu集群
·
sglang
·
gpustack
Day 0 实测|在 GPUStack 上部署 Inkling-BF16:8 卡 H20-141G 推理性能测试
Inkling 是由 Thinking Machines Lab 发布的新一代开源多模态大语言模型,采用 Mixture-of-Experts(MoE)Transformer 架构,支持文本、图像和音频等多模态输入,并生成文本输出。模型拥有约 975B 总参数、41B 激活参数,并支持最长 1M token 上下文窗口。
云卷云舒___________
7 小时前
ai
·
阿里
·
deepseek
·
ai日报
·
harness
·
qwen38
·
tokenplan
阿里开源Qwen3.8 2.4T模型预览版、并推出Token Plan订阅、DeepSeek Harness与V4正式版同发 | 7月20日 AI日报
💡 今日趋势速览:阿里开源2.4万亿参数Qwen3.8模型并推Token Plan订阅,DeepSeek Harness代码智能体将随V4发布,模型与工具生态竞争加剧。
俊哥V
9 小时前
人工智能
·
ai
每日 AI 研究简报 · 2026-07-18
(本文借助 AI 大模型及工具辅助整理)一句话总结:2026 世界人工智能大会(WAIC)在上海开幕,中国 AI 开源力量与全球治理议题成为焦点;阿里云发布 AI Agent 安全最佳实践,企业级智能体安全正式进入"必选项"阶段。
不爱记笔记
7 小时前
人工智能
·
ai
·
机器人
·
具身智能
·
deepseek
2026 WAIC大会亮点解析!超节点、机器人与AI应用全面开花
摘要: 2026世界人工智能大会在上海举办,超过1100家企业参展,3000多件产品亮相,其中300多件为全球首发或首秀。本文基于B站UP主科技狐的大会长视频内容进行整理,通过Ai好记完成视频转录和要点提炼,从AI算力基础设施、机器人、AI终端硬件、应用层四个维度梳理大会核心亮点。
todoitbo
9 小时前
人工智能
·
ai
·
aigc
·
claude
Claude Code 接蓝耘实测:选第三方 API 的三条铁律
网上给 Claude Code 接第三方 API 的教程一抓一大把,但清一色都在教你怎么填 base_url、api_key,填完能对话就算完事。可真正把它挂上去跑一阵子你就会发现:填 URL 是五分钟的体力活,选对平台才是真功夫。
猫先生Mr.Mao
7 小时前
ai
·
机器人
·
具身智能
·
vla
·
π0.7
一文梳理 RT-2 到 π0.7:通用机器人策略的技术演进
【从零走向AGI】旨在深入了解通用人工智能(AGI)的发展路径,从最基础的概念起,逐步构建完整的知识体系。 项目地址🔗:https://github.com/AI-mzq/From-Zero-to-AGI.git
土星云SaturnCloud
7 小时前
服务器
·
人工智能
·
ai
·
边缘计算
·
语音识别
MP_SENet轻量语音降噪模型在土星云边缘设备的部署实战
边缘语音交互、工业音频监测等场景对端侧降噪的需求持续增长,云端方案存在延迟高、隐私风险等问题。MP_SENet以仅2M参数量实现了顶尖降噪效果,天然适配边缘部署。本文基于土星云BM1684X架构设备,完整讲解模型原理、环境搭建、Python推理部署与性能实测。
电子工匠
8 小时前
ai
·
开源软件
Understand Anything 在 Qoder 中的完整使用指南
一句话总结: Understand Anything 是一个多平台兼容的 AI 编程助手技能,它通过 Tree-sitter 静态分析 + LLM 语义理解的双引擎架构,将任何代码库转化为可交互的知识图谱,让你从"盲读代码"进化到"全景理解"。
猫先生Mr.Mao
8 小时前
ai
·
论文解读
·
具身智能
·
vla
·
onetwovla
具身智能之OneTwoVLA详解:如何统一推理与行动
【从零走向AGI】旨在深入了解通用人工智能(AGI)的发展路径,从最基础的概念起,逐步构建完整的知识体系。 项目地址🔗:https://github.com/AI-mzq/From-Zero-to-AGI.git
带刺的坐椅
8 小时前
java
·
ai
·
llm
·
agent
·
solon
Solon TeamAgent 协作协议:从 SEQUENTIAL 流水线到 HIERARCHICAL 主管团队
如果单个智能体是专家,那团队就是组织架构。难点不在“多加几个 Agent”,而在于:下一步谁说话、谁审核、何时停机。
doiito
8 小时前
ai
·
rust
·
架构设计
【RUST AI】把 TTS 搬进浏览器:kokoroi-rs 的 WASM 实践
摘要:本文深入解析 kokoroi-rs 项目的 WASM 模块,展示如何将 Kokoro TTS 模型编译为 WebAssembly,在浏览器中实现纯前端、零服务器的高质量中文语音合成。文章涵盖整体架构(G2P 引擎 + ONNX 推理)、两种推理后端(ONNX Runtime Web 与纯 Rust oxionnx)的深度对比、JavaScript API 设计、构建与 Demo 演示,以及隐私安全、性能表现与未来方向。适合关注 Rust + WASM + AI 的前端开发者、隐私敏感应用及边缘计算场
亮亮在江湖
8 小时前
ai
YOLO训练 vs LlamaFactory训练 完整区分
一、底层本质完全不同任务领域:计算机视觉 CV,图像 / 视频感知 模型输入:图片、视频帧 模型输出:框坐标 (x,y,w,h) + 类别置信度 + 类别标签 训练目标:让模型看懂画面,定位物体、区分物体种类 训练数据:标注图片(每张图画框标注目标) 网络结构:CNN 卷积神经网络,轻量化视觉骨干网络
wabs666
8 小时前
ai
·
文献
关于文献【RL/SFT】
1、【我的问题】RL教调度,SFT改机制是什么意思?【deepseek】【我的总结】经过RL的AI只是学会了什么时候调度,SFT让AI的内部推理逻辑变了
ofoxcoding
9 小时前
网络
·
人工智能
·
ai
·
音视频
Seedance 2.0 与 Wan 2026 视频生成 API 成本效率深度对比分析
******`[](https://ofox.io/zh/models)[](https://app.ofox.io/) **TL;DR:** 两个中国视频模型,一个端点,一道清晰的价差。 字节跳动的 Seedance 2.0 三档定价 $0.04–$0.07/s,旗舰档能到 4K。阿里巴巴的 Wan 统一 $0.10/s,上限 1080p。同样的片子,Seedance 在 1080p 便宜约 30%,Mini 档便宜约 60%。Wan 的价格靠更短的最短时长(2s 对 4s)和阿里的运动一致性来撑。两家
码农杂谈0007
9 小时前
ai
·
gea
·
context资产
组织管理视角深度解读:时尚集团GEA智能体案例——AI重构创意行业的组织资产与人力博弈
传统时尚、文创企业的组织模式,完全建立在核心天才的隐性知识之上,这是案例所有痛点的根源:组织知识高度私有化
wuyuanshun
9 小时前
人工智能
·
ai
LangGraph原理逻辑-LangGraph接入MCP(三)
而随着几千个MCP服务突然冒出,百度、阿里等厂商也开始大规模接入MCP,这个协议也迅速在互联网上引起轩然大波。按照那些流量派见风就是雨的性子, MCP也着实被大吹特吹了一波。随着MCP服务越来越火爆,LangGraph的AgeNnt中也提供了MCP的集成。这次我们就分几个部分,逐步深度拆解MCP服务。
hhzz
9 小时前
图像处理
·
计算机视觉
·
ai
·
cnn
·
大模型
CNN图像分类入门:基于TensorFlow+Keras的CIFAR-10数据集全流程实战
CIFAR-10是深度学习图像分类领域最经典的数据集之一,由Alex Krizhevsky、Vinod Nair和Geoffrey Hinton于2009年收集整理。它包含60000张32×32彩色图像,分为10个类别,每个类别6000张,是计算机视觉入门和模型验证的"金标准"。