AI大模型日报#0822:OpenAI推GPT-4o微调服务、混元大模型负责人专访

导读:AI大模型日报,爬虫+LLM自动生成,一文览尽每日AI大模型要点资讯!

目前采用"文心一言"(ERNIE-4.0-8K-latest)、"智谱AI"(glm-4-0520)生成了今日要点以及每条资讯的摘要。欢迎阅读!

今日AI大模型领域迎来多项重要更新。OpenAI正式推出了GPT-4o微调服务,允许开发者使用自定义数据集进行模型微调,以提升性能并降低成本。此外,该公司还限时免费开放微调功能,每日附赠百万训练token,引发了业界广泛关注。同时,可灵AI作为国内唯一被马斯克点赞的文生视频模型,以其强大的视频生成能力获得了国内外广泛认可,快手也因此取得了里程碑式的突破。 在模型应用方面,腾讯混元大模型负责人王迪在访谈中强调了跨领域系统工程的重要性,并探讨了AI大模型的发展与应用。此外,英伟达推出的LongVILA全栈解决方案,通过新型多模态序列并行训练,在长视频处理方面展现出了卓越性能。 在模型评估方面,南洋理工大学研究团队开源的LMMs-Eval评估框架,为多模态大模型提供了一站式评估服务,以低成本、零数据泄露为目标,助力模型训练者专注于模型改进。

标题: 可灵AI还是火到了马斯克那!
摘要: 马斯克点赞可灵AI,快手AIGC取得里程碑式突破。可灵AI是国内唯一被马斯克点赞的文生视频模型,其强大的视频生成能力和想象力获得国内外广泛关注。快手发布的2024年第二季度及中期业绩显示,总营收同比增长11.6%,经调整净利润达46.8亿元。截至目前,已有超过百万人使用过可灵AI,累计生成超千万视频。快手将加大AI战略投入,探索新的业务变现模式。
网址: 可灵AI还是火到了马斯克那!|可灵ai|埃隆_马斯克|奥运|王悦_手机网易网

标题: 不花一分钱!GPT-4o微调限时免费开放,每日附赠百万训练token

摘要: OpenAI推出GPT-4o微调功能限时免费,每天赠送100万训练token,至9月23日。开发者可低成本构建自定义应用程序。同时,OpenAI强调数据隐私安全,不会共享业务数据。此举引发网友热议,有人认为微调不如提示词缓存,但也有支持者。此外,GPT-4o mini也免费微调,每日赠送200万训练token。
网址: 不花一分钱!GPT-4o微调限时免费开放,每日附赠百万训练token | 量子位

标题: 腾讯混元大模型负责人王迪:揭秘万亿 MoE 系统工程之道|智者访谈

摘要: 《智者访谈》邀请腾讯机器学习平台部总经理王迪,探讨AI大模型的发展与应用。王迪指出,大模型是跨领域系统工程,需高效整合技术与业务。腾讯自研万亿级MoE大模型,强调大模型研发需从基础设施到业务场景的全链路理解。访谈中,王迪还讨论了小模型趋势、OpenAI的技术路径、MoE Scaling Law等,强调在资源有限下,高效探索模型规模与性能的关系是关键。
网址: 腾讯混元大模型负责人王迪:揭秘万亿 MoE 系统工程之道|智者访谈 | 机器之心

标题: 支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频

摘要: 科技记者提炼要点:研究者推出LongVILA,首个全栈解决方案,用于训练和部署长上下文视觉语言模型。LongVILA结合系统设计、模型训练策略和数据集构建,显著提高长视频处理性能。通过新型多模态序列并行训练,LongVILA在视频字幕和指令遵循任务上展现优异表现,支持更长上下文长度,优于现有模型。
网址: 支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频 | 机器之心

标题: 多模态模型评测框架lmms-eval发布!全面覆盖,低成本,零污染
摘要: 南洋理工大学研究团队开源LMMs-Eval评估框架,专为多模态大模型设计,提供一站式评估。自2024年3月发布,已获1100+Stars,30+贡献者。LMMs-Eval旨在简化评测,包括Lite版和LiveBench动态测试,以低成本、零数据泄露为目标,助力模型训练者专注于模型改进。
网址: 多模态模型评测框架lmms-eval发布!全面覆盖,低成本,零污染 | 机器之心

相关推荐
计算机科研狗@OUC6 分钟前
【TMM2024】Frequency-Guided Spatial Adaptation for Camouflaged Object Detection
人工智能·深度学习·目标检测·计算机视觉
悟兰因w13 分钟前
论文阅读(三十五):Boundary-guided network for camouflaged object detection
论文阅读·人工智能·目标检测
大山同学15 分钟前
多机器人图优化:2024ICARA开源
人工智能·语言模型·机器人·去中心化·slam·感知定位
Topstip22 分钟前
Gemini 对话机器人加入开源盲水印技术来检测 AI 生成的内容
人工智能·ai·机器人
小嗷犬38 分钟前
【论文笔记】VCoder: Versatile Vision Encoders for Multimodal Large Language Models
论文阅读·人工智能·语言模型·大模型·多模态
Struart_R43 分钟前
LVSM: A LARGE VIEW SYNTHESIS MODEL WITH MINIMAL 3D INDUCTIVE BIAS 论文解读
人工智能·3d·transformer·三维重建
lucy1530275107944 分钟前
【青牛科技】GC5931:工业风扇驱动芯片的卓越替代者
人工智能·科技·单片机·嵌入式硬件·算法·机器学习
幻风_huanfeng1 小时前
线性代数中的核心数学知识
人工智能·机器学习
volcanical1 小时前
LangGPT结构化提示词编写实践
人工智能
weyson2 小时前
CSharp OpenAI
人工智能·语言模型·chatgpt·openai