苹果刚刚揭示了一项AI技术,以更好地与ChatGPT竞争|TodayAI

解决模型升级带来的困扰

AI实验室在更新其底层大型语言模型时,常常会引发意外行为,包括彻底改变其响应查询的方式。苹果(Apple)研究人员开发了新方法,以改善用户在面对熟悉的AI模型升级时的体验。

在一篇研究论文中,苹果的研究人员指出,用户在与LLM互动时会发展出自己的系统,包括特定的提示风格和技术。切换到新模型可能会是一个耗时且令人疲惫的过程,从而降低用户的使用体验。尤其是对于使用iOS的主流用户来说,这种改变可能是不可接受的。

创建一致性指标

为了解决这个问题,苹果团队研究了创建指标以比较不同模型版本之间的回归和不一致性的方法,并开发了一种训练策略,以最大限度地减少这些不一致性的发生。尽管尚不清楚这项技术是否会成为未来iOS Apple Intelligence的一部分,但苹果显然在为更新底层模型后的情况做准备,以确保Siri在未来对相同查询做出一致的响应。

实现AI向后兼容

研究人员表示,通过使用他们的新方法,他们成功将负面翻转(即旧模型给出正确答案而新模型给出错误答案的情况)减少了最多40%。论文的作者还强调了在新旧模型都出现错误时保持一致性的价值。"我们认为,当两个模型都错误时,保持一致性是有价值的,"他们说,并补充道,"用户可能已经发展出应对模型错误时的互动策略。"因此,不一致会导致用户不满意。

展示MUSCLE方法

苹果研究团队称他们的解决方案为MUSCLE(兼容LLM进化的模型更新策略)。这一方法无需改变基础模型的训练,而是依赖于训练适配器,即LLM的插件,被称为兼容性适配器。为了测试这一系统的有效性,研究团队对如Llama和Phi等LLM进行了更新,发现某些任务中的负面翻转率高达60%。测试包括让更新后的模型回答数学问题,以查看它们是否仍然能正确回答特定问题。

通过使用MUSCLE系统,研究人员表示他们成功减少了相当数量的负面翻转,有时减少了多达40%。

应对快速发展的AI市场

鉴于ChatGPT和谷歌的Gemini等聊天机器人的快速更新,苹果的研究有望使这些工具的更新版本更加可靠。如果用户在切换到新模型时不得不在用户体验恶化之间做出权衡,那将是一个巨大的遗憾。苹果的新技术可能会使用户在享受新模型带来的改进时,不再需要面对适应新模型的困扰,从而提供更为稳定和满意的使用体验。

相关推荐
Raink老师5 小时前
【AI面试临阵磨枪-70】Agent 系统如何做分布式调度、跨服务协作、故障恢复?
人工智能·面试·职场和发展
tedcloud1235 小时前
RTK部署教程:构建稳定的AI Workflow环境
服务器·javascript·人工智能·typescript·ocr
Raink老师5 小时前
【AI面试临阵磨枪-71】如何用 AI 优化推荐系统、内容审核、广告创意、搜索体验?
人工智能·面试·职场和发展
AI医影跨模态组学5 小时前
Biomarker Res(IF=11.5)安徽医科大学第一医院:基于机器学习的放射组学模型:子宫内膜癌患者的预后预测及机制探索
人工智能·深度学习·论文·医学·医学影像·影像组学
ftpeak6 小时前
Mooncake:以 KVCache 为中心的分离式 LLM 服务架构
人工智能·ai·架构·ai编程·ai开发
Terrence Shen6 小时前
Hermes agent的tools是怎么落地应用的系列
人工智能·llm·agent·hermes
Raink老师6 小时前
【AI面试临阵磨枪-72】电商全场景 AI Agent 设计(商品咨询 / 订单 / 物流 / 售后 / 退款)
人工智能·面试·职场和发展
仙女修炼史6 小时前
CNN更看重Texture还是shape:imagenet-trained cnns are biased
论文阅读·人工智能·cnn
视***间6 小时前
视程空间 AIR SC6N0-C-MB NX 16GB 规格详解与机器人/机器狗适配说明
人工智能·机器人·边缘计算·机器狗·ai算力·具身机器人·视程空间
视***间6 小时前
小身板・强算力・全适配 —— 视程空间 AI 算力开发板如何完美适配机器人 / 机器狗
人工智能·机器人·边缘计算·ai算力·视程空间·算力开发板