技术栈
ai对齐
AI你一生一世
3 天前
人工智能
·
大语言模型
·
数学推理
·
ai对齐
·
形式化验证
·
推理模型
·
语义漂移
当AI在数学中“失准”:一场关于形式化、直觉与工程取舍的深度复盘
我是AI时代的无业游民,我游荡在现实与意念之间过去两年,大模型在自然语言、代码生成甚至竞赛级数学题上的表现让人产生了一种错觉:数学似乎是AI最容易攻克的堡垒之一。毕竟,数学语言精确、规则明确、答案可验证——这不正是机器最擅长的领域吗?
阿杰学AI
5 个月前
人工智能
·
安全
·
ai
·
语言模型
·
自然语言处理
·
aigc
·
ai对齐
AI核心知识141—大语言模型之 对齐难题(简洁且通俗易懂版)
对齐难题 (The Alignment Problem) 是整个人工智能领域,乃至全人类在这个世纪面临的“最终级 Boss” 。
阿杰学AI
10 个月前
人工智能
·
安全
·
ai
·
语言模型
·
aigc
·
ai对齐
·
alignment
AI核心知识38——大语言模型之Alignment(简洁且通俗易懂版)
AI 对齐 (AI Alignment) 是人工智能领域最核心、最哲学,也最关乎人类命运的概念。简单来说,AI 对齐就是确保人工智能的目标、行为和价值观,与人类的意图和利益完全一致。
深度之眼
3 年前
人工智能
·
大语言模型
·
ai对齐
大语言模型对齐技术 最新论文及源码合集(外部对齐、内部对齐、可解释性)
大语言模型对齐(Large Language Model Alignment)是利用大规模预训练语言模型来理解它们内部的语义表示和计算过程的研究领域。主要目的是避免大语言模型可见的或可预见的风险,比如固有存在的幻觉问题、生成不符合人类期望的文本、容易被用来执行恶意行为等。
我是有底线的