苹果刚刚揭示了一项AI技术,以更好地与ChatGPT竞争|TodayAI

解决模型升级带来的困扰

AI实验室在更新其底层大型语言模型时,常常会引发意外行为,包括彻底改变其响应查询的方式。苹果(Apple)研究人员开发了新方法,以改善用户在面对熟悉的AI模型升级时的体验。

在一篇研究论文中,苹果的研究人员指出,用户在与LLM互动时会发展出自己的系统,包括特定的提示风格和技术。切换到新模型可能会是一个耗时且令人疲惫的过程,从而降低用户的使用体验。尤其是对于使用iOS的主流用户来说,这种改变可能是不可接受的。

创建一致性指标

为了解决这个问题,苹果团队研究了创建指标以比较不同模型版本之间的回归和不一致性的方法,并开发了一种训练策略,以最大限度地减少这些不一致性的发生。尽管尚不清楚这项技术是否会成为未来iOS Apple Intelligence的一部分,但苹果显然在为更新底层模型后的情况做准备,以确保Siri在未来对相同查询做出一致的响应。

实现AI向后兼容

研究人员表示,通过使用他们的新方法,他们成功将负面翻转(即旧模型给出正确答案而新模型给出错误答案的情况)减少了最多40%。论文的作者还强调了在新旧模型都出现错误时保持一致性的价值。"我们认为,当两个模型都错误时,保持一致性是有价值的,"他们说,并补充道,"用户可能已经发展出应对模型错误时的互动策略。"因此,不一致会导致用户不满意。

展示MUSCLE方法

苹果研究团队称他们的解决方案为MUSCLE(兼容LLM进化的模型更新策略)。这一方法无需改变基础模型的训练,而是依赖于训练适配器,即LLM的插件,被称为兼容性适配器。为了测试这一系统的有效性,研究团队对如Llama和Phi等LLM进行了更新,发现某些任务中的负面翻转率高达60%。测试包括让更新后的模型回答数学问题,以查看它们是否仍然能正确回答特定问题。

通过使用MUSCLE系统,研究人员表示他们成功减少了相当数量的负面翻转,有时减少了多达40%。

应对快速发展的AI市场

鉴于ChatGPT和谷歌的Gemini等聊天机器人的快速更新,苹果的研究有望使这些工具的更新版本更加可靠。如果用户在切换到新模型时不得不在用户体验恶化之间做出权衡,那将是一个巨大的遗憾。苹果的新技术可能会使用户在享受新模型带来的改进时,不再需要面对适应新模型的困扰,从而提供更为稳定和满意的使用体验。

相关推荐
数智化管理手记1 小时前
手工统计指标误差大、效率低?指标管理系统如何告别人工算数痛点?
大数据·运维·数据库·人工智能·云计算
fthux4 小时前
RenoPit 能为普通业主做什么?看懂图纸、审查合同,提前发现装修坑
javascript·人工智能·ai·开源·github·chrome扩展·open source·edge扩展·firefox扩展
火山引擎开发者社区7 小时前
火山引擎混合云 veStack 智算平台 Day0 适配 Kimi K3
人工智能
RSABLOCKCHAIN7 小时前
AI Agents in LangGraph-2
人工智能·python
cd_949217218 小时前
哪些AI工具适合生成游戏开发用的3D道具模型?从道具草稿到引擎测试的选择方法
人工智能·3d
FII工业富联科技服务8 小时前
工业设备运维如何Agentic化?拆解Factory Brain的设备运维架构
大数据·运维·人工智能·架构·制造
糖果店的幽灵8 小时前
人已经用 WorkBuddy 找工作拿了面试,你还在一份份手工改简历
人工智能·面试·职场和发展·langgraph
qq29539 小时前
2026 财搭子决策模拟器:多智能体投研架构能力拆解
大数据·人工智能·架构
满怀冰雪10 小时前
12-PaddlePaddle, 飞桨, 分类模型, 训练循环, 损失函数, 优化器, cross_entropy, Adam
人工智能·深度学习·分类·paddlepaddle
冬奇Lab10 小时前
AI 评测系列(08):评测 CI/CD——持续质量门控
人工智能