qwen

zhangfeng11332 天前
人工智能·docker·ai编程·qwen·算子开发·vllm·mi50
AMD Instinct MI50(gfx906)上为 Qwen 系列模型优化并可用的 vLLM 相关仓库、Docker 镜像与实践指南。直接结论关键资源(推荐先看)ROCm / PyTorch / 兼容性要点性能与注意事项快速示例命令(用于验证与启动)
云卷云舒___________3 天前
qwen·阿里·字节跳动·ai日报·豆包工作·paloma·wan30
Qwen新模型paloma现身Arena、阿里Wan3.0视频模型上线、字节豆包工作开放下载 | 8月25日 AI日报💡 今日趋势速览:Qwen新模型以paloma代号现身Arena,前端编程表现被测出可比肩Opus 5,引发社区对其定位猜测。阿里Wan3.0视频生成大模型正式上线,单次可生成30秒视频并直接读取多种文档。字节豆包工作火速上线开放下载,主打办公场景。大厂正加速将前沿模型推向实际产品落地。
老大白菜9 天前
python·qwen·deepseek·harness
Qwen3.8-27B 本地推理 + DeepSeek Harness 配置本文档记录本机硬件环境、Qwen3.8-27B 模型的安装与推理服务部署,以及在 DeepSeek Harness(dsh)中的接入配置。支持文本 + 图片(多模态)。
虎鲸不是鱼11 天前
大模型·多模态·qwen·lm studio·千问
【RTX Pro 4500】Qwen3.8 27B NVFP4在LM Studio挂载多模态模型【RTX Pro 4500】Qwen3.8 27B NVFP4在LM Studio挂载多模态模型之前已经部署了模型: https://lizhiyong.blog.csdn.net/article/details/163834176
小白跃升坊12 天前
开源·大模型·通义千问·qwen·qwen3.8-27b
阿里云通义千问正式开源 Qwen3.8-27B:性能与成本的黄金平衡点2026年8月14日,阿里云通义千问(Qwen)正式开源 Qwen3.8 系列模型。作为系列中最受关注的成员,Qwen3.8-27B 以"性能与成本的黄金平衡点"定位,向全球开发者开放下载与商用授权。
咕噜咕噜啦啦17 天前
人工智能·qwen·vllm
vLLM框架前言:真是学无止境啊,最近也是接触到了一些新东西,更觉前路漫漫。最值得加深印象的应该是环境隔离。开始时,我竟然直接pip安装了,可能也是因为不知道安装的是个什么概念。然后就引发了一系列环境冲突问题。跑不同工具、做不同实验,都应该创建独立虚拟环境。
liferecords24 天前
开源·llm·qwen
Qwen3.8-Max 开源了:该不该从 Claude 切过去?💡 一句话带走:阿里把旗舰 Qwen3.8-Max(2.4 万亿参数、95B 激活、1M 上下文、原生看图看视频)发了,还宣布下周开源权重——这是 Max 系列头一回开源。多模态和"自主跑十天"的编码能力是真亮点,但标准编码基准它还排在 Claude Fable 5 后头;社区有人退订 Anthropic,也有人测了预览版直骂。把它说清楚:亮点和短板都在,能不能替 Claude,看你用在哪儿。
神奇霸王龙1 个月前
人工智能·ai·aigc·dubbo·claude·qwen·ai金融
跨厂商大模型接入实战:5大基座性能对比适用读者:想在企业 IM / 自动化工作流里跨厂商调 Qwen / Claude / SparkDesk / ERNIE 这些大模型 API 做生产部署的开发者 阅读时长:约 12 分钟 测试时间:2026 年 7 月(基于 炻光 AI 接入管理平台 公开文档)
minhuan1 个月前
qwen·大模型应用·llama3·gpt-4o·deepseek·主流大模型能力边界·claude3.5
主流大模型能力边界:GPT-4o、Claude3.5、Llama3、Qwen、DeepSeek横向对比22.6很多刚接触大模型的朋友都会陷入同一个困境:网上评测五花八门,各类模型更新速度飞快,看着GPT-4o、Claude 3.5、Llama 3、通义千问Qwen、DeepSeek一堆名字,分不清谁擅长什么、调用要花多少钱、到底能不能部署在自己业务里。
带娃的IT创业者1 个月前
人工智能·开源·qwen·开源大模型·deepseek·ai竞赛·开源策略
中国开源大模型策略:正在赢得全球AI竞赛过去一年,全球AI领域的格局发生了微妙但深刻的转变。曾经被普遍认为“美国领先,中国追赶”的叙事,如今正在被改写。一个关键变量浮出水面:开源权重(Open-Weights)模型策略。以DeepSeek、Qwen等为代表的中国AI团队,通过大规模开放模型权重,正在全球开发者社区中赢得前所未有的关注和影响力。Hacker News上近千票的热议并非偶然,它折射出一个事实:中国AI的“开放”策略,正在对抗美国AI的“封闭”和“专有”模式,并且在这场竞赛中占据了主动。
云卷云舒___________1 个月前
ai·qwen·opus·grok·deepseek·ai日报·interns2
DeepSeek V4灰度测试、马斯克Grok 4.6下周开测、上海AI实验室Intern-S2击败Opus4.8 | 7月18日 AI日报💡 今日趋势速览:DeepSeek V4灰度测试提升推理能力,马斯克Grok 4.6下周全面测试,上海AI实验室Intern-S2开源模型击败Qwen3.6和Opus4.8。
俊俊谢2 个月前
机器学习·大模型·llama·qwen·llama-factory·deepseek·hugging-face
LLaMA-Factory 部署与 DeepSeek-R1-Distill-Qwen 模型乱码问题解决全记录摘要:本文记录了在远程 A100 服务器上部署 LLaMA-Factory,并加载 DeepSeek-R1-Distill-Qwen 系列模型时遇到的输出乱码问题。通过强制指定 Qwen2Tokenizer,最终完美解决。全过程包括环境配置、CUDA 版本协调、模型下载、问题排查与修复。
放下华子我只抽RuiKe53 个月前
ai·中间件·fastapi·ai编程·qwen·ai大模型·openclaw
FastAPI 全栈后端(六):中间件与依赖注入创作者: Yardon | GitHub: github.com/YardonYan | 版本: v1.0 |
雲明3 个月前
语音识别·大语言模型·qwen·chainlit
Qwen2.5-7B-Instruct实战教程:Chainlit集成语音输入(Whisper API)你可能已经见过太多标着“7B”的大模型,但Qwen2.5-7B-Instruct不是简单参数堆砌的产物。它是在Qwen2系列基础上真正“长高长大”的一代——知识更广、逻辑更稳、表达更准,而且特别懂“人话”。
Python私教3 个月前
人工智能·语言模型·qwen·ollama·本地大模型·大模型部署·deepseek
Cursor + Claude Code 全流程实战:搭一套生产级 AI 编程工作流(2026 最新版)这是专栏「AI编程实战:Cursor与Claude Code」的第 1 篇。读完你会得到一套可以照抄进真实项目的 AI 编程工作流:Cursor 与 Claude Code 各自的定位与协作分工、项目级提示词(rules)的写法、一个真实小项目从 0 到跑通的多文件改造、以及 8 个我在生产中真实踩过的报错的「原文 + 根因 + 解法」。不是"怎么装个插件试试看",而是"明天上班就能用上、还能少踩坑"。
周公3 个月前
claude·qwen·claude code·open claw
Claude code使用第三方算力安装配置过程在 Windows 10 上使用绿色安装包(便携版)安装 Node.js 和 npm,可以避免安装程序,直接解压即可使用。以下是详细步骤:
bryant_meng3 个月前
人工智能·github·qwen·hugging face·clip
【Hugging Face】The GitHub of Open-Source AI Models本文系统梳理 HuggingFace 平台的核心功能与生态,并选取若干典型模型做简要说明,适合初次接触的读者建立全局认知。
兆。3 个月前
架构·qwen·多模态模型·ollama
多模态模型详解:从拼接式到原生统一架构2026年,多模态AI已经从"新鲜事物"变成"基础设施"。GPT-4o 原生多模态架构的全面铺开、Gemini 2.5 的"统一表征空间"、Claude 4 的视觉理解能力跃升、以及 GPT-6(代号"Spud")于2026年4月14日正式发布——这些事件背后,是一个核心技术范式的转变:
兆。3 个月前
langchain·openai·qwen·ollama·本地大模型
如何在本地搭建天气智能体项目本文将介绍如何在本地搭建一个完整的天气智能体项目。项目主要分为两部分:根据 2026 年 Ollama 最新公告(v0.18.0),我们使用以下技术: