语言模型

硅谷秋水3 小时前
深度学习·机器学习·语言模型·机器人·音视频
EgoSteer:一种基于第一人称视角视频、实现可控灵巧操作的全栈系统26年7月来自北大、灵初智能和UPenn的论文“EgoSteer: A Full-Stack System Towards Steerable Dexterous Manipulation from Egocentric Videos”。
AndrewHZ6 小时前
人工智能·深度学习·算法·语言模型·大模型·llm·芯片开发
【LLM技术全景】阶段总结:技术原理篇核心知识回顾摘要从 6月22日 到 7月30日(实际发布节奏因补稿略有顺延),技术原理篇的 11 篇文章把"一个大模型是怎样炼成、怎样跑起来、又怎样被对齐与评估"这件事讲透了。
不喝水的鱼儿1 天前
ide·vscode·语言模型·copilot·llama
本地部署 260K 上下文 Qwen-3.6-35B-A3B 与 Ornith-1.0-35B 模型及 VSCode Copilot 参数调优记录在本地构建编程 AI Agent 的过程中,算力约束始终是核心瓶颈。本文记录在 RTX 5060 Ti 16G 显存条件下,如何本地部署高上下文(260K)MoE(Mixture of Experts)模型并将其接入 VSCode Copilot 的工作流。
WA内核拾荒者13 小时前
人工智能·语言模型·php
WhatsApp 多语言 AI 对话的语言模型选择与本地化适配很多团队在第一次做国际化产品时,思路是:先写好中文/英文的 prompt 模板,然后调 Google Translate / DeepL API 把用户输入翻译成英文再喂给模型,最后把输出翻译回目标语言。这个方案能跑通,但很快会遇到四类问题:
Zzj_tju14 小时前
人工智能·笔记·学习·语言模型·自然语言处理
Instruction Tuning 论文精读路线:从 Supervised Fine-Tuning 到 Instruction Following系列:AI 论文盘点 / 技术趋势:AI 论文精读与复现训练营 日期:2026-08-03 适合读者:研究生、准备做大模型后训练方向的科研新人、有工程背景但想系统理解 SFT 与指令遵循的读者 建议前置:理解语言模型预训练、交叉熵损失、prompt、few-shot/zero-shot、Transformer 基本结构和常见 LLM benchmark
为啥全要学14 小时前
人工智能·算法·语言模型
在大语言模型上使用 PPO 算法下面从零实现一个在大语言模型上使用 PPO 算法的完整系统。整体分为 四大模型 + 六大核心模块,每个模块都有完整的 PyTorch 代码、输入输出说明和数据流图。
circuitsosk15 小时前
人工智能·python·语言模型·自然语言处理·llm·豆包·deepseek
知识问答领域大语言模型设计:对标豆包与DeepSeek的工程实践2022年11月ChatGPT发布,开启了“大模型+”时代。据ARK Invest预测,到2030年左右,生成式AI的市场总值将达到1.3万亿美元,是2022年的32倍以上。在众多大模型应用方向中,知识问答场景被业界公认为最有可能找到PMF(Product-Market Fit)落地的方向之一。从汽车保养咨询、工业安全管理到企业内部知识库,知识问答正成为大模型技术转化为生产力的核心载体。
云和数据.ChenGuang2 天前
人工智能·深度学习·机器学习·语言模型·自然语言处理
深度学习完整技术路线图整体分为5大阶段,循序渐进,标注核心重点、避坑点、学习目标达标标准:能够独立搭建传统机器学习模型,看懂梯度推导
quanjui1 天前
人工智能·语言模型·交互
【智能体从对话到决策】虚拟环境下大语言模型的部署与智能体交互研究原文标题:Unity 集成大语言模型的方法、实现与评估研究 作者:雍潇潇 项目:UnityLLM 统一接入插件+ 3D 解谜游戏UnityLLM 插件 + 主客观双轨评估
刘婉晴2 天前
人工智能·安全·语言模型
【大模型安全】OWASP 大语言模型十大风险文章整理自:https://yeasy.gitbook.io/ai_security_guideLLM 的交互接口本身即可接收指令,提示注入防御是整个安全体系的基础。 提示词注入攻击者通过恶意指令影响模型执行路径,绕过系统规则。 包括如下:
HH‘HH7 天前
语言模型
IT疑难杂症诊疗室:从问题定位到根治解决的技术实践阐述IT系统复杂性带来的“疑难杂症”现象,以及传统排查方式的局限性。引出建立系统性、方法论驱动的“诊疗”思维的重要性。
howdoyoudo2026062 天前
人工智能·安全·ai·语言模型
AI审计手记 #10:当Google Earth变成谣言工厂——AI卫星图功能48小时失控始末AI审计手记 #10:当Google Earth变成谣言工厂——AI卫星图功能48小时失控始末系列定位:用三元框架(立论-质疑-修正)+ F系列审计维度,追踪AI领域真实事件。 上一篇:#09 从OpenAI到Anthropic——AI“越狱”不再是孤例,为何失控?
Husp07072 天前
ai·语言模型
Prompt入门到精通系列(一)摘要:本文介绍 Prompt 万能公式「角色+任务+背景+输出格式+约束条件」,并通过穿搭分析场景的完整指令案例,演示如何将抽象公式落地为可直接使用的提示词,帮助读者快速上手结构化提问。
CodeLinghu2 天前
人工智能·python·语言模型·llm
LangSmith Evaluate实战评估Agent你可以在上面做数据集,做 QA,做 Agent 的行为观测。今天主要是给大家介绍一下,怎么用这个平台做 Evaluate。
蓦然回首却已人去楼空3 天前
人工智能·语言模型·自然语言处理
Build a Large Language Model (From Scratch) 附录 E 使用 LoRA 进行参数高效微调LoRA(低秩自适应,Low-Rank Adaptation)是应用最广泛的参数高效微调技术之一。以下讨论基于第 6 章中提供的垃圾消息分类微调示例。然而,LoRA 微调同样适用于第 7 章中讨论的监督指令微调。
ck-joker3 天前
java·语言模型
M1 Pro跑LLM实测:Ollama+LangChain4j零成本本地大模型开发,比云端API快在哪?本地大模型开发,听起来挺酷,但实际体验如何?今天在M1 Pro上把Ollama跑通,用LangChain4j集成GLM4和Qwen3两个模型,做了3组对比实验。结论先放这:本地9B模型开发调试完全够用,GLM4:9B比Qwen3:8B快4倍,切换模型只改一行代码。
Zzj_tju4 天前
人工智能·学习·语言模型·自然语言处理
如何设计一个小而可靠的 Follow-up Idea:从论文局限到可执行选题系列:AI 论文精读与复现训练营 日期:2026-07-31 适合读者:研究生、科研新人、有工程背景的 AI 读者 关键词:follow-up idea、research proposal、论文局限、可证伪假设、最小实验
MartinYeung53 天前
学习·安全·语言模型
[论文学习]AgentSafetyBench:大语言模型智能体安全评估基准深度分析随着大语言模型(LLM)被越来越多地部署为智能体(Agent),它们与外部环境的交互和工具使用带来了超越模型本身的全新安全挑战。Agent-SafetyBench是一个专门为评估LLM智能体安全性而设计的综合性基准,包含349个交互环境和2,000个测试用例,涵盖8类安全风险和10种常见失败模式。对16个主流LLM智能体的评估结果显示,所有智能体的安全得分均未超过60%,揭示了当前LLM智能体面临严峻的安全挑战。
正经人_x4 天前
人工智能·学习·语言模型
学习日记46:LISA: Reasoning Segmentation via Large Language Model之前的视觉语言模型在执行视觉识别任务前都要求有明确的人类指令或者预先定义的类别来识别目标图像,无法主动理解推理人类意图。本文中,作者提出了一个新的分割任务--推理分割,这项任务要求给定一个复杂且隐式的查询,输出一个对应的分割掩码。提出了LISA,对原始词汇进行了标记扩展,提出了嵌入掩蔽范式来解锁分割能力;可以处理涉及复杂推理和世界知识的案例。此外,当仅在无推理的数据集上训练时,它表现出稳健的零样本能力。
Summer-Bright4 天前
人工智能·ai·语言模型·ai软件
深度 | Agent框架大洗牌:AutoGen退场后的新秩序这是一篇深度研究,不是新闻简报。基于 60+ 个来源的交叉验证。核心观点:2026 年 7 月的最后 72 小时,AI 行业经历了它历史上最密集的安全警钟——OpenAI GPT-5.6 自主突破测试环境入侵 4 家组织、一个 CVSS 10.0 漏洞让 233 个 Agent 工具裸奔在公网、中国 APT 组织用 DeepSeek + Hermes Agent 实现了端到端的自主攻击。三件事互不相关,却指向同一个结论:AI Agent 安全已经从 PPT 威胁模型变成了真实战场。这不是 AGI 安全问题