免费AI生成图片和视频,免费、不限量、全模态的AI API

完整阅读体验:https://mp.weixin.qq.com/s/3FMjW9iNonhy6qoPaYY_6A

简介

Agnes AI是什么

最近大家应该都听说Agnes AI了,我此前却从未听闻。

它爆火的原因是:提供免费、不限量(限速)、全模态的AI API服务

还有这种好事?本文就来分析、实测一下,看看究竟如何。

Agnes AI 简介

Sapiens AI 是一家总部位于新加坡的人工智能技术公司,其核心重心在于构建智能体基础设施(Agentic Intelligence infrastructure)。

  • 技术定位:致力于开发专有的多模态 AI 模型和系统级架构,使智能体(AI Agents)能够在真实世界环境中进行推理、协作和解决复杂任务。

Agnes AI 是 Sapiens AI 旗下的一款"全能型" AI 创作与执行平台,由新加坡国立大学(NUS)AI 博士生 Bruce Yang 于 2025 年创立。

Agnes AI API 为开发者提供统一、稳定、易于集成的多模态 AI 模型服务,支持文本、图像、视频和多模态生成与理解能力。

通过 Agnes AI API,开发者可以快速构建 AI 原生应用,包括但不限于:

  • AI 聊天和文本生成
  • 逻辑推理和内容理解
  • 文生图和图像编辑
  • 图生视频和视频生成
  • 音视频同步生成
  • Agent 工具和自动化工作流
  • 创意内容生成和多模态交互应用

Agnes AI API 兼容 OpenAI 风格的接口,开发者可以轻松迁移和集成现有项目,只需极少的代码修改,降低开发成本,提高集成效率。

🔗Agnes 官网:https://agnes-ai.com/

免费 API

Agnes有网页聊天网页:https://app.agnes-ai.com/

现在每天送1200积分,任何类型的对话都会消耗积分。

这一点,大多数AI都是类似的,都有免费的网页版或者App,要么是限额、要么是限速(每分钟/小时/天 的请求数量)。

Agnes也有手机App,国区没有。实测美区 Apple ID可以下载。

但是Agnes AI 却提供免费的API,还是多模态的,文本、图片、视频,都能生成!

在官网申请API key,就可以在Claudecode、OpenClaw、Hermes等应用中使用了。

同时也有付费Plan(支持银联):

免费和付费对比:

用户计划 文本模型 RPM 图像模型配额 视频模型配额
免费 实际 20 RPM 与分辨率有关 实际 20 RPM
企业版 实际 40 RPM 与分辨率有关 实际 40 RPM
Token Plan 实际 1,000 RPM 与分辨率有关 实际 100 RPM

不同付费 Plan对比:

计划 agnes-2.0-flash agnes-image-2.0/2.1-flash agnes-video-v2.0
Starter 1,500 次/5h;15,000 次/周 4,000 张/天 500 秒/天
Plus 7,500 次/5h;75,000 次/周 4,000 张/天 500 秒/天
Pro 30,000 次/5h;300,000 次/周 4,000 张/天 500 秒/天
  • RPM 即每分钟请求次数:requests per minute
  • 目前免费用户和付费用户最大的区别就是每分钟请求数量限制不同,但是模型的推理/输出 速度是一样的,都很慢(免费人太多了),这周末他们会分卡池,付费的输出速度可能会快一些。

具体模型细节

模型分类简述

(1)文本模型

  • 模型ID:agnes-2.0-flash

  • 目前是支持1M上下文的,但是高峰期会变成512K,由于全球范围内免费,所以大部分时间是高峰期

(2)图像模型

模型 功能 建议用例
agnes-image-2.0-flash 文生图、图生图、URL 输出、Base64 输出 创意图像、产品视觉、海报、图像转换
agnes-image-2.1-flash 高密度图像生成、图像编辑、URL 或 Data URI 输入、灵活的图像尺寸 详细构图、营销素材、角色视觉、社交媒体内容

(3)视频模型

模型 功能 建议用例
agnes-video-v2.0 文生视频、图生视频、多图视频、关键帧动画、异步生成 故事讲述、营销视频、产品演示、社交视频、应用动态素材
模型速率限制

(1)文本模型

用户类型 公开请求 RPM 实际可执行 RPM
免费 30 20
企业版 60 40
TToken Plan 1,000 1,000

(2)图像模型

速率限制和图片分辨率相关。

用户类型 分辨率 公开请求 RPM 实际可执行 RPM
免费 / 默认 1K 30 20
免费 / 默认 2K 20 10
免费 / 默认 3K 2 1
免费 / 默认 4K 1 1
企业版 1K 60 40
企业版 2K 40 20
企业版 3K 2 1
企业版 4K 2 1
Token 计划 1K 120 100
Token 计划 2K 120 80
Token 计划 3K 2 1
Token 计划 4K 2 1

(3)视频模型

用户类型 公开请求 RPM 实际可执行 RPM
免费 / 默认 30 20
企业版 60 40
Token 计划 100 100
  • 公开请求 RPM:允许用户每分钟发起的请求数。
  • 实际可执行 RPM:在服务端调度和容量限制后,每分钟实际可执行的请求数。
  • 如上所示:图片和视频模型除了每分钟请求数量限制,还有每天的生成数量限制。但是我没看见免费用户的图片和视频数量限制,可能也是一样的吧。

隐私与数据安全

既然是免费的,我一下就想到了Google AI Studio(今年还没用过),它是把用户聊天用户模型训练的。

Agnes当然也是一样的了,在官网隐私政策里面明确写了:https://agnes-ai.com/zh-Hans/docs/privacy-policy

你提交的任何输入(例如提示、文件、文本)以及服务生成的输出(如 AI 响应)都可能被处理、存储,并用于训练和改进他们的 AI 模型。

所以你就别在重要项目里面使用这个模型,另外,ClaudeCode等应用里面最好不要给它最高权限(读写电脑所有文件而无需你的确认)。

性能

在 LiveBenc 和 LMArena 上没找到这个模型。

就用它们官网展示的吧:

(1)文本模型

  • 排名网站:https://claw-eval.github.io/

  • 整体排名19(浮动),通用排名第9,这个榜单的最新日期是5月9号,一些更厉害的新模型不在表中。

(2)图片模型

从前面的网站排名来看,基本属于第三梯队了。不过它是免费 的啊。好用、便宜、量大,这些不可能同时满足。至少算力成本都不允许这样的情况出现。

模型实测

文本模型

  • 模型名称:agnes-2.0-flash

支持 Opencode、OpenClaw、Hermes、Claude、Codex++、WorkBuddy、CherryStudio等,官网文档都有写,我就不重复了。

Claude里面配置文本模型

这里就在claude code里面做个示例吧,通过CC Switch 。

不了解 CC Switch的可以看我以前的文章:https://mp.weixin.qq.com/s/zcwrS7zs6zLX6TflOPMxPA

简述步骤(默认你安装了claude、ccswitch):

  • 完全退出claude

  • Agnes官网登录,创建密钥:https://platform.agnes-ai.com/settings/apiKeys

  • cc switch右上角,添加供应商,选择第一个,自定义配置

  • API key填写刚才创建的即可

  • 请求地址:https://apihub.agnes-ai.com/v1,(不必勾选完整url)

  • 高级选项:

    • API格式:OpenAI Chat Completions(需开启路由)
    • 认证字段:默认,ANTHROPIC_AUTH_TOKEN
    • 模型映射,点击获取模型列表,然后全部选择:agnes-2.0-flash即可,可以勾选1M上下文
    • 兜底模型:agnes-2.0-flash
    • 配置JSON:见下面的代码块

    你可以自己对比一下,env和includeCoAuthoredBy是自动生成的,需要手动添加:litellm_settingsallowed_openai_params

    注意严格对照格式,不要出现语法错误。

bash 复制代码
{
  "env": {
    "ANTHROPIC_AUTH_TOKEN": "xxx",
    "ANTHROPIC_BASE_URL": "https://apihub.agnes-ai.com/v1",
    "ANTHROPIC_DEFAULT_SONNET_MODEL": "agnes-2.0-flash[1M]",
    "ANTHROPIC_DEFAULT_SONNET_MODEL_NAME": "agnes-2.0-flash",
    "ANTHROPIC_DEFAULT_OPUS_MODEL": "agnes-image-2.1-flash[1M]",
    "ANTHROPIC_DEFAULT_OPUS_MODEL_NAME": "agnes-image-2.1-flash",
    "ANTHROPIC_DEFAULT_FABLE_MODEL": "agnes-2.0-flash[1M]",
    "ANTHROPIC_DEFAULT_FABLE_MODEL_NAME": "agnes-2.0-flash",
    "ANTHROPIC_MODEL": "agnes-2.0-flash",
    "ANTHROPIC_DEFAULT_HAIKU_MODEL": "agnes-2.0-flash"
  },
  "litellm_settings": {
    "drop_params": true
  },
  "allowed_openai_params": [
    "thinking",
    "context_management"
  ],
  "includeCoAuthoredBy": false
}

然后点击保存。

最后启用这个供应商,开启路由。

没有路由按钮,点击设置--路由--本地路由--路由总开关

文本模型测试

很慢,我现在是不会使用它的。

这个 11 秒回复算是快的。

目前是支持1M上下文的,但是高峰期会变成512K。

目前的免费版和token plan的输出速度也是一样的,只是每分钟的请求数量不同,这周末,会把它们分开,token plan的速度或许会快一些。

图片模型

图片模型需要安装skills才能用,看这个:https://github.com/lj1270998580-crypto/Agnes-help-skill

但是体验不好,所以我用Rust写了一个GUI界面,来调用它的图片和视频模型,后文均是在本软件内生成的。

项目地址:https://github.com/LingyunStudio/AgnesStudio

文生图

用时2-3分钟左右吧。

prompts:

bash 复制代码
清明上河图
  • 中文渲染效果:

prompts:

bash 复制代码
书法作品,楷书,内容是李白的将进酒原文(不是这8个字),简体中文

这,这不对吧(这个我生成了2遍,都这样)。不过中文还是可以正常显示,有时候也会乱码。

对比Gemini和GPT画的(完全相同的提示词):

Nano Banna Pro GPT Image 2

好吧,我释怀了,Gemini怎么越来越拉了,不会只剩下Vertex AI 勉强能用吧。

图生图

还可以,速度较慢。

用时大概2-3分钟。

  • 将图片换成素描风格:
原图 生成的图片

视频模型

也还行,就是比较慢。

文生视频

用时大概5-6分钟。

prompts:

bash 复制代码
无人机拍摄的海浪冲击着大苏尔加雷角海滩上崎岖的悬崖。蓝色的海水拍打着白色的波浪,夕阳的金色光芒照亮了岩石海岸。远处有一座小岛,岛上有一座灯塔,悬崖边上长满了绿色的灌木丛。从公路到海滩的陡峭落差是一个戏剧性的壮举,悬崖的边缘突出在海面上。这是一幅捕捉到海岸原始美景和太平洋海岸公路崎岖景观的景色。

图生视频

用时大概8-9分钟。

  • 图生视频模型,传入的图片必须是公网可以访问的URL才行,直接传图片不可用。

  • 图床我用的是upgit+github+jsdelivr实现,里面的图片是文生图做的。

  • 图生图模型的图片可以上传本地的。

多图视频

关键帧视频

哎哟,实在有点慢,我就不测试这两个了,等不了一点。

对了,视频是有声音的,还挺好听:

总结

Agnes特点:

  • 多模态、全免费、限速不限量
  • 用户聊天数据被用于训练模型
  • 输出速度较慢,周末可能或提升付费用户输出速度
  • 模型水平第三梯队
  • 不建议使用文本模型,图片模型可以玩玩,视频模型等待太久,不太建议

为何免费?

  • "不缺算力",但是缺少用于训练模型的:真实、高质量、多样化的用户多模态交互数据
  • 用户即做了数据提供者,又做了模型测试员
  • 靠"免费"迅速爆火(全球),快速获得知名度

附:DeepSeek API 价格

计费项 v4-flash v4-pro
百万 tokens 输入(缓存命中) 0.02元 0.025元
百万 tokens 输入(缓存未命中) 1元 3元
百万 tokens 输出 2元 6元