好家伙,OpenAI 第一的位置屁股还没坐热呢,谷歌 Gemini 就重夺竞技场榜首了

谷歌 Gemini 模型重夺竞技场榜首

谷歌 AiStudio7 上新了实验性的 gemini-exp-1121 模型,该模型在 lmarena8 上超越了昨天 OpenAI 发布的新 4O 模型,重新夺得了榜首。好家伙,回合制,OpenAI 第一的位置屁股还没坐热呢。

阿里 In-Context LoRA:高效多场景精准出图

In-Context LoRA1 是阿里最近非常火的一个项目。上次介绍时,模型还未开放,现在官方已经放出了 10 个预训练模型。社区围绕它开发了多种工作流,如虚拟试穿、品牌设计、对象迁移和角色扮演等。

IC LoRA 基于 Flux 这玩意生成的效果非常好,电商领域一定能打出一片天。

配图使用 Logo in Context2 制作,这也是利用了 IC LoRA。配合图生图技术,可以将任何 Logo 融入到任何事物中。

京东健康开源音频驱动的数字人头项目 JoyVASA

JoyVASA3 是京东健康开源的一个音频驱动的数字人头项目,它不仅支持唇形一致和表情控制,还能为动物生成数字头。这类技术在市场上非常多,有需求的读者可以在三花上搜索'数字人',不过真正落地的不多,JoyVASA 看起来是个不错的选择。

Black Forest Labs 发布 FLUX Tools:官方支持的控制模型

黑森林实验室(Black Forest Labs)发布了 FLUX Tools4 系列模型,包括:

  • Fill 支持局部重绘和扩图
  • Depth & Canny 官方 Controlnet 模型
  • Redux 图像参考图生图 这些模型均已开放下载,并基于 Flux dev 的开源协议。ComfyUI 发文5 表示第一时间支持了这些模型,官方下场做生态,好日子来了。

Tülu 3:完全开放的大模型

Tülu 36 70B & 8B 是一个完全开放数据、评估代码和训练算法的大模型。在 12 项基准测试中,其平均得分超越了许多同参数量开源模型,特别是 70B 模型,其表现甚至超越了 GPT4o-mini,直逼 claude 3.5 haiku。官方宣称,他们的目标是让任何人都能后训练模型,因此不仅开放了权重,还一并开放了整套基础设施。非常的酷

相关推荐
冬奇Lab2 天前
每日一个开源项目(第120篇):SkillLens - 微软出品,照亮 AI Agent 技能生命周期的“显微镜”
人工智能·开源·资讯
冬奇Lab6 天前
每日一个开源项目(第117篇):Recordly - 零剪辑基础也能制作电影级产品演示视频
开源·资讯
烟花情报局13 天前
主产区安全整改深化 行业加速洗牌(5 月 21 日)
资讯
烟花情报局14 天前
江苏沭阳启动烟花爆竹全链条打非治违专项行动
资讯
冬奇Lab14 天前
一天一个开源项目(第108篇):Andrej Karpathy Skills - 用一个 CLAUDE.md 文件修复 LLM 编码的四个顽疾
人工智能·开源·资讯
冬奇Lab16 天前
一天一个开源项目(第106篇):Claude Plugins Official - Anthropic 官方 Claude Code 插件生态全解析
人工智能·开源·资讯
冬奇Lab17 天前
一天一个开源项目(第105篇):Academic Research Skills - 学术研究全流程 AI 代理套件,及其工作流设计的启示
人工智能·开源·资讯
烟花情报局18 天前
湘西州:部署全链条打非治违工作
资讯
冬奇Lab18 天前
一天一个开源项目(第104篇):CLI-Anything - 让所有软件变成 AI 代理可调用的命令行接口
人工智能·开源·资讯
烟花情报局21 天前
多省市联动部署安全监管工作
资讯