ai

楚国的小隐士7 小时前
ai·大模型·编程·软件工程·ai编程·软件架构
在生产环境中和AI协作编程在vibe coding概念火了之后,这个理念很快暴露了它的问题:它只关注最终的效果,不关心代码层面是如何实现的,但是AI的特点又是“输入决定输出”,这就意味着,如果不对AI进行任何约束,那么AI就会像脱缰的🐎一样横冲直撞。因此才会有“spec工程”和后来的“harness工程”这两个概念。“harness”,本意就是指马术运动中的马具,是马镫、马鞍、辔头、马嚼子、缰绳、马鞭……的统称,是用来约束和指示🐎的行为和方向的,在AI编程领域则引申为“约束工程”的意思。
筝筝ba9 小时前
科技·ai
1988 NDX收盘价格复盘全年最大回撤:从7月5日高点191.90到11月21日低点163.82,回撤 -14.6%全年涨幅:从年初161.81到年末177.41,涨幅 +9.6%
_HAIHUI_10 小时前
ai
WorkBuddy体验今天在更新cc switch版本的时候,遇到了安装源丢失,导致卸载失败的问题。尝试了许多办法,都没有效果。耗费了近半个小时。弄着弄着,也到了饭点。索性死马当活马医,把这坨烂摊子丢给Workbuddy。
一航jason11 小时前
android·人工智能·ai·架构·ai编程·llama
Android平台推理框架及试用场景模型对比核心结论:文本 LLM 用 llama.cpp 一站通吃,视觉/语音/图像生成各归专项工具(whisper.cpp、sherpa-onnx、stable-diffusion.cpp),NPU 能效交给 AI Edge SDK,PyTorch 模型下放给 ExecuTorch。 llama.cpp 虽然模型覆盖最广,但 ASR/TTS/图像生成不在它的范畴内,别硬塞。
一航jason12 小时前
android·人工智能·ai·ai编程·llama·ai-native
Android 端侧大模型推理框架对比CPU 上限选 llama.cpp,GPU 上限选 MLC-LLM,NPU 能效上限选 MediaPipe / AI Edge SDK(Qualcomm AI Engine Direct),PyTorch 生态选 ExecuTorch,"能跑就行"选 PocketPal / Ollama 移动端。 没有"全能王",瓶颈决定了上限——想跑得更稳更快,关键是选对硬件路径(CPU / GPU / NPU)再选框架。
科技每日热闻12 小时前
ai
创业公司需要弹性可伸缩的 GPU 算力,如何规避大额前期硬件投入?创业企业使用 GPU 算力,普遍面临两大风险:一是为开展模型训练提前批量采购显卡与服务器,产品尚未完成市场验证,现金流已被硬件资产大量占用;二是仅满足当下少量 GPU 业务需求,业务规模上涨后算力无法实现扩容。
武汉大学-王浩宇12 小时前
ai
Autodl配置claude code教程Claude Code 需要 Node.js 环境才能运行。不建议挂T,使用官方仓库下载nodejs显示版本号,说明安装成功。
VIP_CQCRE14 小时前
ai·mcp·claude code·ace data cloud
Claude Code 接入 NanoBanana MCP:让 AI 编程助手直接完成图片生成与编辑如果你已经在使用 Claude Code 写代码、改项目、查问题,那么下一步很自然:能不能让它不只停留在“代码助手”,而是直接调用外部工具,帮你完成产品配图、页面插画、素材合成、营销视觉图等工作?
小白跃升坊14 小时前
ai·大模型·llm·推理优化
大模型推理入门:从原理到实践写给谁看的? 听说过 ChatGPT、DeepSeek、通义千问,想搞明白"大模型到底是怎么回答问题的"、想了解本地部署和推理框架区别的同学。不要求你有 AI 背景,我尽量用人话讲清楚。
腾视科技-AIoT15 小时前
人工智能·科技·ai·算力模组·ai算力模组·ai模组·腾视科技
超低功耗 性能卓越|腾视科技重磅推出TS-SG-SM9系列AI算力模组,引领边缘智能计算新篇章在人工智能技术蓬勃发展的当下,对高性能算力模组的需求愈发迫切。近日,腾视科技正式推出新一代AI算力模组TS-SG-SM9系列,该系列产品搭载算能高集成度处理器CV186AH/BM1688芯片,以超强算力、超低功耗和丰富接口为核心优势,为人工智能场景提供高效、灵活的算力支持,助力AI微服务器、AI边缘计算终端、工业控制、无人机及AIoT等终端领域实现智能化突破。
张忠琳15 小时前
ai·agent·deepseek·harness·dsh
【deepseek-harness】DeepSeek Harness Agent Loop 模块深度架构分析之一代码仓库:github.com/deepseek-harness 分析范围:packages/core/agent-loop/ + packages/core/agent/(Agent 接口与驱动器) 分析维度:设计实现 · 循环机制 · Turn/Step/Round 三层嵌套 · 事件分发 · 工具调度 · 数据流 文档版本:v1.0 分析日期:2025-09-03
一技安身15 小时前
docker·ai·语言模型
【大模型】Win11 部署 DeepSeek+ RAGFlow0.27.2 (Ollama方案,断网可用)最终版脚本下载: https://download.csdn.net/download/cnxzzcn/93430748
韩曙亮16 小时前
人工智能·ai·大模型·腾讯云·ai大模型·千问·智谱
【AI 大模型】国内各平台 AI 大模型 价格、性能 对比分析 ② ( 智谱 BigModel | 腾讯云 TokenHub | 千问 AI 平台 )AI 大模型平台 :智谱 BigModel 大模型平台 : https://bigmodel.cn/智谱 GLM-5.3 大模型定价 : https://docs.bigmodel.cn/cn/guide/start/pricing
张忠琳18 小时前
ai·agent·deepseek·harness·dsh
【deepseek-harness】DeepSeek Harness Agent Loop 模块深度架构分析之二工具调用调度模型模型顺序保证结果和上下文按模型顺序提交 committed 只跨连续的 model-order slot 推进 dispatch 可重叠 policy 和 results 保持有序
科技每日热闻18 小时前
ai
AI创业公司需要GPU算力进行模型训练和推理,推荐选择哪些云平台?AI创业公司选择GPU云平台,不能只比较“单张卡每小时多少钱”。真正影响模型训练和推理成本的,还有GPU型号与规模、集群利用率、故障恢复、弹性扩缩、推理效率,以及创业公司能否获得云积分和技术支持。
科技每日热闻19 小时前
ai
AI 创业公司开展模型训练与推理需要 GPU 算力,该怎么挑选云平台?AI 创业公司开展模型训练与推理需要 GPU 算力,该怎么挑选云平台?从 GPU 实例选型到搭建训练集群的实操指南
事圆则缓20 小时前
android·ai·代码规范
遗留项目改造实战指南:从可读性、代码质量到性能和 AI 约束一个阅读性很差的项目,真正难改的往往不是“代码丑”,而是没人敢判断一次修改会影响哪些页面、哪些状态和哪些隐含流程。 一句话结论:遗留项目改造不要从大重写开始,而要从“可观测、可验证、可回退”的小步治理开始,把混乱代码逐渐收敛成有边界、有测试、有性能预算的系统。 本文以 Android 和 Kotlin 项目为主要语境,很多方法也适用于 Flutter、微信小程序、Web 前端和服务端。文中的类名如 ViewModel、Repository、UseCase、WorkManager、CoroutineScop
喵喵爱自由20 小时前
docker·ai·语言模型
Deepseek Harness镜像离线部署本文记录通过容器镜像方式,本地部署 Deepseek Harness(DSH)的完整流程。作者已将 DSH 运行所需的全部环境打包成镜像,省去了部署时构建环境的繁琐准备,只需下载、导入并运行容器,即可快速完成本地部署。