硬核横评
硬核横评

Agnes AI 横评:一个免费 OpenAI 兼容 API 搞定文本图片视频

横评 Agnes AI 免费 OpenAI 兼容多模态网关(含中国站直连),5 个模型覆盖文本/图片/视频,一个 key 走通。含 5 模型规格对比表、Agnes vs 付费方案对比表、OpenAI SDK drop-in 代码示例与选型建议。免费额度限制客观写清,代表性对比非亲自压测。

发布于 2026年8月10日8 分钟阅读
<!-- agnes-free-multimodal-api-review | review | Agnes AI 横评:一个免费 OpenAI 兼容 API 搞定文本图片视频 -->

一个 API key,文本、图片、视频全包,还免费、还 OpenAI 兼容、还有中国站国内直连——Agnes AI 听起来像"太好以至于不真实"。但把它的 5 个模型摊开看:对话编码有 agnes-2.5-flash,文生图有 image-2.1-flash,文生视频有 video-v2.0,全走同一个 base_url,openai SDK 改两行就能跑。这篇就把它当横评来拆:5 个模型各自的最佳射程、和付费方案的差距、以及免费额度到底卡在哪。

先说清边界:下面基于 AgnesAI-Labs/AgnesAI-Models 官方 README、agnes-ai.com 文档和 HN 公开讨论整理,截至 2026-08-10。三个相关仓库的星数经 GitHub 核实(AgnesAI-Models 2,728★、agnes-video-generator 222★、agnes-ai-skill 58★)。免费额度以官方平台 platform.agnes-ai.com 实时为准、随时可能调整;这是代表性对比,非亲自全量压测。

一、Agnes AI 是什么:免费 OpenAI 兼容多模态网关

Agnes AI 是官方的多模态 API 网关,卖点就一句话:一个 key、一套 OpenAI 兼容接口,文本图片视频全接。对开发者来说意味着迁移成本几乎为零——你原来用 openai SDK 写的代码,把 base_url 换成 https://apihub.agnes-ai.com/v1api_key 换成 Agnes 的,其余不动。

两个关键细节。第一,双站点:国际站 agnes-ai.com + 中国站 agnes-ai.cn。国内开发者不用挂梯子,agnes-ai.cn 直连可用,这是它和多数海外免费网关最大的不同。第二,模型覆盖广:5 个模型覆盖文本对话、编码 agent、图片生成编辑、视频生成四类任务,不是只有聊天。文档在 agnes-ai.com/doc/overview,控制台在 platform.agnes-ai.com。

生态也已经在长:jomeswang/agnes-ai-skill(58★,MIT)把 Agnes 接进 Codex、Claude Code、WorkBuddy、Claude Desktop、Cherry 等 agent;lcy362/agnes-video-generator(222★,MIT)基于 Agnes 免费模型做了开源自托管视频生成器。本站的 Agnes 免费多模态工作流 SOP 讲怎么串,这篇先讲它到底有什么、值不值得用。

二、5 个模型横评:规格对比表

把 5 个模型按类型、端点、能力、最佳场景对一遍。

模型类型端点核心能力最佳场景
agnes-2.5-flash文本+视觉语言/v1/chat/completions编码/agent/工具调用/多轮/推理/图像理解对话+编码+看图主力
agnes-2.0-flash文本+视觉语言/v1/chat/completions推理/编码/工具调用/流式/图像理解/agent轻量对话+agent 编排
agnes-image-2.0-flash图片生成+编辑/v1/images/generations文生图/图生图,URL 或 Base64基础出图+图生图
agnes-image-2.1-flash图片生成+编辑/v1/images/generations高密度视觉生成/图片编辑/灵活尺寸高质量出图+图片编辑
agnes-video-v2.0视频生成/v1/videos文生视频/图生视频/多图视频/关键帧动画视频生成(异步任务)

几个要点。第一,两个文本模型(2.5-flash 和 2.0-flash)都带视觉语言能力,能"看图"——不是只能聊天。第二,图片模型走的是 /v1/images/generations,和 OpenAI DALL-E 同一个端点命名,drop-in 友好。第三,视频模型走 /v1/videos,是异步任务 API——提交任务拿 task_id,轮询拿结果,不是同步返回(这点后面避坑会讲)。第四,2.5-flash 是最新旗舰,能力覆盖最全;2.0-flash 更轻量,适合不需要最新能力的场景省额度。

三、逐个拆:5 个模型各自的最佳射程

agnes-2.5-flash:对话编码看图主力,能力最全。 5 个里最新的旗舰文本模型,编码、agent、工具调用、多轮推理、图像理解全有。日常用它一个就能顶"聊天 + 写代码 + 看截图改 bug + 串工具调用"四件事,是 Agnes 的核心卖点。最佳射程:个人开发者的日常 AI 助手、agent 工作流的主脑、要带视觉理解的任务。

agnes-2.0-flash:轻量文本模型,省额度。 上一代 flash,推理/编码/工具调用/流式/图像理解/agent 都支持,只是不如 2.5 新。当你不需要最强能力、想把额度留给图片视频时,用它跑对话最划算。最佳射程:轻量对话、agent 编排的中间步骤、批量调用省额度。

agnes-image-2.0-flash:基础文生图。 支持文生图和图生图,输入输出走 URL 或 Base64。够做配图、封面、快速概念图。短板:分辨率和细节不如 2.1。最佳射程:快速出图、对画质要求不高的批量配图。

agnes-image-2.1-flash:高质量出图+图片编辑。 2.0 的升级版,主打"高密度视觉生成"(细节更密、画质更高)、图片编辑、灵活尺寸。要出能用的成品图、要改图、要非标准尺寸,选它。最佳射程:成品级出图、图片编辑、需要灵活尺寸的场景。

agnes-video-v2.0:视频生成,异步任务。 5 个里唯一做视频的,支持文生视频、图生视频、多图视频、关键帧动画四种模式。注意它是异步的:提交任务返回 task_id,轮询直到完成。免费额度下视频配额最紧(后面避坑讲)。最佳射程:短视频生成、概念视频、内容创作的视频素材。

四、Agnes vs 付费/其他方案

单平台也能横评——把 Agnes 放到"免费多模态 API"这个赛道里,和 OpenAI 官方付费、其他免费网关比,看它强在哪、弱在哪。

维度Agnes AIOpenAI 官方付费其他免费网关
价格免费(有额度限制)按 token 付费多数免费
中国站/国内可用有 agnes-ai.cn 直连无,需梯子多数无
OpenAI 兼容是,drop-in原生部分是
模态覆盖文本+图片+视频文本+图片+视频多数只有文本
免费额度文本 20 RPM、图片按分辨率、视频按配额无免费档文本为主,额度小
开源自托管生态agnes-video-generator 可零成本出视频

结论很直接:Agnes 的差异化在**"免费 + 中国站 + OpenAI 兼容 + 真多模态"四合一**。OpenAI 官方模态最全但要钱、国内不可用;其他免费网关多数只覆盖文本、没中国站。Agnes 把这四个叠加起来,对国内开发者尤其香——不用梯子、不用改代码、文本图片视频一个 key。和本站 大模型性价比横评 里的付费模型比,Agnes 胜在"零成本起步";和 另一个免费窗口 WorkBuddy 比,Agnes 胜在多模态覆盖。

五、怎么用:OpenAI SDK drop-in

迁移成本是"好用"的关键指标。Agnes 全走 OpenAI 兼容,用 openai SDK 改两行:

python
from openai import OpenAI

client = OpenAI(
    api_key="agnes-xxx",           # 换成你的 Agnes key
    base_url="https://apihub.agnes-ai.com/v1",  # 换成 Agnes base
)

# 文本对话(流式)
stream = client.chat.completions.create(
    model="agnes-2.5-flash",
    messages=[{"role": "user", "content": "用一句话解释什么是 MCP"}],
    stream=True,
)
for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="")

# 图片生成
img = client.images.generate(
    model="agnes-image-2.1-flash",
    prompt="极简风格封面,AI 工具主题",
    n=1,
)
print(img.data[0].url)

图片编辑、视频生成同理,端点命名和 OpenAI 一致。视频走 /v1/videos 异步提交,需要轮询 task 状态。完整示例见官方文档 agnes-ai.com/doc/overview。

六、选型建议:按需求选谁

你的需求首选理由
日常对话+编码+看图agnes-2.5-flash能力最全,一个顶四个
轻量对话省额度agnes-2.0-flash上一代够用,省额度给图片视频
成品级出图/图片编辑agnes-image-2.1-flash高密度生成+灵活尺寸
快速配图不挑画质agnes-image-2.0-flash基础出图够用
视频生成agnes-video-v2.0唯一视频模型,四种模式
要全本地零成本出视频agnes-video-generator 自托管开源 MIT,基于 Agnes 免费模型
要让 Codex/Claude Code 直接调agnes-ai-skillAgent Skill,一键接多个 agent

最后一行是生态补充:想在自己的 agent 里用 Agnes,agnes-ai-skill 已经做好了适配。想完全离线零成本出视频,lcy362/agnes-video-generator 开源自托管,OpenMontage 也能接 Agnes 当免费模型源。

七、三个避坑

一、免费额度有限,视频配额紧,别当生产。 Free/default 档文本 20 RPM,图片按分辨率限 RPM,视频按 RPM+配额——视频是配额最紧的。拿它做原型验证、个人项目、内容创作没问题;要上生产环境扛流量,先在 platform.agnes-ai.com 看清楚档位和限额,免费档扛不住生产负载。

二、视频是异步任务,要轮询。 agnes-video-v2.0 走 /v1/videos,提交后返回 task_id,你得轮询任务状态直到完成,不是同步拿结果。第一次用容易写成同步等待然后卡死。照官方文档的异步轮询模式写,设好超时和重试。

三、中国站与国际站模型/额度可能差异,以官方为准。 agnes-ai.cn 和 agnes-ai.com 是两个站点,模型清单、免费额度、可用功能可能不完全一致。国内开发优先用中国站,但具体能力以 platform.agnes-ai.com 实时显示为准,别想当然认为两边完全对等。

八、常见问题

Q:Agnes AI 真的免费吗?有隐藏费用吗? A:有免费档(Free/default),文本 20 RPM、图片按分辨率限速、视频按配额,不收钱。但免费额度有限,超出或商用高频要升档——具体价格以 platform.agnes-ai.com 为准。"免费"指有可用免费额度起步,不是无限免费。

Q:国内能用吗?要梯子吗? A:不用。Agnes 有中国站 agnes-ai.cn,国内直连可用,这是它和多数海外免费网关最大的区别。API base 用 https://apihub.agnes-ai.com/v1

Q:和 OpenAI 官方 API 完全一样吗? A:接口兼容(端点命名、参数结构一致),openai SDK 改 base_url 和 api_key 就能用。但模型本身是 Agnes 自家的(agnes-2.5-flash 等),不是 GPT,能力和表现不同。视频端点 /v1/videos 是 Agnes 扩展,OpenAI 官方没有完全对应的同步视频 API。

Q:能让 Claude Code / Codex 直接用吗? A:能。jomeswang/agnes-ai-skill(58★,MIT)是 Agent Skill,支持 Codex、Claude Code、OpenClaw、Claude Desktop、Hermes、WorkBuddy、Cherry,把 Agnes 接成这些 agent 的模型后端。

Q:免费额度用完了怎么办? A:升档到付费档(以官方为准),或者用 lcy362/agnes-video-generator 开源自托管零成本出视频、把高频任务搬到本地。本站 Agnes 免费多模态工作流 SOP 专门讲怎么搭零成本工作流。


参考来源

本文由 AI 辅助生成,经人工审核编辑。最后更新:2026-08-10

常见问题

Agnes AI 真的免费吗?有隐藏费用吗?
有免费档(Free/default),文本 20 RPM、图片按分辨率限速、视频按配额,不收钱。但免费额度有限,超出或商用高频要升档,具体价格以 platform.agnes-ai.com 为准。“免费”指有可用免费额度起步,不是无限免费。
国内能用吗?要梯子吗?
不用。Agnes 有中国站 agnes-ai.cn,国内直连可用,这是它和多数海外免费网关最大的区别。API base 用 https://apihub.agnes-ai.com/v1。
和 OpenAI 官方 API 完全一样吗?
接口兼容(端点命名、参数结构一致),openai SDK 改 base_url 和 api_key 就能用。但模型本身是 Agnes 自家的(agnes-2.5-flash 等),不是 GPT,能力和表现不同。视频端点 /v1/videos 是 Agnes 扩展,OpenAI 官方没有完全对应的同步视频 API。
能让 Claude Code / Codex 直接用吗?
能。jomeswang/agnes-ai-skill(58★,MIT)是 Agent Skill,支持 Codex、Claude Code、OpenClaw、Claude Desktop、Hermes、WorkBuddy、Cherry,把 Agnes 接成这些 agent 的模型后端。
免费额度用完了怎么办?
升档到付费档(以官方为准),或者用 lcy362/agnes-video-generator 开源自托管零成本出视频、把高频任务搬到本地。本站 Agnes 免费多模态工作流 SOP 专门讲怎么搭零成本工作流。

相关文章

硬核横评

一个 agent 被攻破就全盘失守:四套凭证与权限治理方案横评

凭据从配置项变成了攻击面,但绝大多数团队防线还停在"给 agent 套个沙箱"。本文与站内沙箱隔离横评明确分工:沙箱管"代码在哪跑",凭据治理管"密钥怎么用、动作谁批、凭据能不能外带"。对比 OpenClaw 2.0、OpenWorker、OpenHuman 与传统密钥托管四套方案,按凭据生命周期六环节(存/用/批/外带/审计/多 agent)拆:OpenClaw 掩码请求 + opt-in proxy 目标白名单;OpenWorker hard floors + 自主权阶梯 + reviewer model + 熔断器,且无人值守绝不自批;OpenHuman Privacy Mode 在 Rust core 强制 + agent 间 E2E 加密。二手数据(SaaS Sentinel 转述,未找到一手报告)显示 1 个 agent 妥协概率 0.24、7 个升到 0.86,风险随数量超线性增长——前提是"任一 agent 提议即执行"。

2026年9月1日11 分钟阅读
硬核横评

涨价之后怎么选:11 个模型的真实 token 成本横评,把峰谷、缓存与 tokenizer 三重口径算进去

模型标价至少套着三层衣服,只看标价等于只看最外面那层:时段(DeepSeek 8 月 17 日起峰谷计价,工作日 9:00–12:00 与 14:00–18:00 为高峰、闲时减半、周末全天闲时,同一模型单价差一倍)、缓存(命中前缀缓存的输入 token 单价远低于标准输入,变量不在厂商手里而在你的提示词结构里)、分词(Sonnet 5 换分词器后相同输入映射 1.0 到 1.35 倍 token 数,且倍数随内容类型浮动)。本文统一口径为「综合单价 =(输入单价 + 输出单价)÷ 2」,即假设输入输出 token 数量相等,作为中立起点,再给三种典型负载比重的重算结果,并覆盖 11 个模型的标价、缓存命中价、峰谷价与分词放大后的实际位置。结论不是「哪个模型最便宜」,而是「不存在最便宜的模型,只存在对你这个负载最便宜的模型」——脱离输入输出比重、缓存命中率与内容类型给出的比价,只是在比标价而非比成本。国内模型价格来自 2026-08-24 逐页复核、8-28 再复核的官方定价页速查表,海外价格来自 2026-08-31 汇总,存在口径冲突的项目文中逐条标注。未做实际调用压测。

2026年8月31日9 分钟阅读
硬核横评

腾讯 770B 只激活 49B:五款万亿级开源旗舰横评,决定部署成本的不是总参数

Hy4 preview(770B/49B)发布把开源旗舰的参数军备推到新高,但决定部署成本的不是总参数:激活参数省的是算力,权重驻留吃的是显存。本篇横评五款开放权重旗舰--Hy4 preview、GLM-5.3、Kimi K3(2.8T)、DeepSeek V4(1.6T 口径)、Qwen3.8-Max(2.4T)--按总参/激活比、上下文、许可证、显存门槛(工程估算口径)与 API 价格快照逐项对表。与 8-27 价格横评分工:那篇算 320B 级 API 账,本篇算 700B-2.8T 级参数与部署门槛账。五条按场景结论:追最新选 Hy4(Apache 2.0+MTP 投机解码+FP8 友好)、要参数规模选 K3、要成熟生态选 GLM/DeepSeek、阿里系合规选 Qwen,以及共同一条--先看每 token 成本与稀疏注意力,再看总参。

2026年8月29日9 分钟阅读