Agnes-2.5-Flash vs Agnes-2.0-Flash:模型对比与接入指南
依据 Agnes AI 官方文档整理 | https://agnes-ai.com/zh-Hans/docs/
真伪✅ 真——基于 Agnes AI 官网公开文档核验(agnes-ai.com/zh-Hans/docs/) 时间截至2026-07-27访问时核验 对象开发者用户需注册获取 API Key |
一、模型规格对照表
参数项 | Agnes-2.0-Flash | Agnes-2.5-Flash |
发布状态 | 已公开发布 | 灰度测试中(需加入灰度名单) |
上下文窗口 | 512K tokens | 最高支持 512K tokens |
单次输出限制 | 65.5K tokens | 65.5K tokens |
多模态输入 | 支持文本 + 图片 URL | 支持文本 + 图片 URL |
优化方向 | agent工作流、tool invocation、coding、reasoning | 代码、agent 工作流、tool calls、多模态理解(基于 2.0 升级) |
Thinking 模式 | 支持(OpenAI/Anthropic 兼容格式) | 支持,可选分配预算 token(如 2048) |
API 端点 | https://apihub.agnes-ai.com/v1/chat/completions | https://apihub.agnes-ai.com/v1/chat/completions |
协议兼容性 | OpenAI 兼容 | OpenAI 兼容 |
二、性能基准(官方披露数据)
模型 | Claw-Eval Pass³ | 备注 |
Agnes-2.0-Flash | 60.9% | Claw-Eval 总榜第 9 名(据官方文档披露) |
Agnes-2.5-Flash | 未公开 | 当前为灰度阶段,官方未发布独立评测数据 |
ⓘ 关于 Benchmarks 的说明 以上 Benchmark 数据仅来自 Agnes-2.0-Flash 的官方文档。Agnes-2.5-Flash 作为基于 2.0 的升级版本,在代码生成、调试和推理能力方面有"增强",但具体数值未在公开材料中披露。 |
三、定价政策(依据官方文档)
定价阶段 | 输入 ($/1M) | 输出 ($/1M) | 适用范围 |
灰度测试期(2.5-Flash) | $0 | $0 | 仅限灰度名单用户 |
标准费率(两版通用) | $0.03 | $0.15 | 灰度过后或超出免费额度 |
注:文档中未明确免费层级的 RPM / TPM 限制,建议直接咨询 Agnes AI 客服或查看控制台配额详情。
四、接入方式(手把手教程)
方案 A:通过 Agnes AI 官方 API(唯一直接渠道)
第 1 步:注册账号 & 获取 API Key
① 访问:agnes-ai.com
② 登录 / 注册账号
③ 进入控制台 → API Keys → 创建新 Key(以 sk- 开头)
⚠️ 注意:Agnes-2.5-Flash 目前仅在灰度名单内可用。如果你不在名单中,API 调用会自动回退到 Agnes-2.0-Flash(官方建议 fallback 策略)。
第 2 步:配置 API 请求
Base URL:https://apihub.agnes-ai.com/v1
认证头:Authorization: Bearer YOUR_API_KEY
Model 字段取值:
• 使用 2.0-Flash:agnes-2.0-flash
• 使用 2.5-Flash(灰度内):agnes-2.5-flash
第 3 步:Python 示例(OpenAI 兼容库)
| # 安装:pip install openai
|
方案 B:通过 IDE 插件间接使用
主流支持 OpenAI 兼容协议的 IDE 插件均可接入 Agnes,如:
•Cursor:设置 → Model Provider → Custom → Base URL 填入 apihub.agnes-ai.com/v1,填入 API Key,model 选择 agnes-2.0-flash 或 agnes-2.5-flash
•Cody / Codeium:同样可通过自定义 OpenAI 端点接入
•VS Code + OpenAI 兼容插件:配置相同
五、FAQ 常见问题(基于官方文档)
Q:Agnes-2.5-Flash 是无限期免费吗? A:官方文档中写的是"灰度测试期 $0/1M tokens",意味着此免费政策仅限于当前灰度阶段,未来可能按标准费率($0.03/$0.15 per M tokens)计费。Agnes-2.0-Flash 的价格信息类似,文档中亦标注了标准费率。具体免费是否持续到另行通知,请以 Agnes AI 控制台显示为准。 |
Q:两个模型的上下文的区别? A:根据 Agnes AI 官方文档,两个模型都支持最高512K tokens的上下文窗口,单次生成分输出最多65.5K tokens。此前部分非官方资料误将上下文写为 256K,请以官网为准。 |
Q:如何判断自己是否在 Agnes-2.5-Flash 灰度名单中? A:尝试调用 agnes-2.5-flash 模型,如果返回错误或非预期的 agnes-2.0-flash 结果,则可能不在灰度名单内。官方文档建议在不可用时 fallback 到 agnes-2.0-flash。具体入灰度条件未公开说明,需要通过 Agnes AI 控制台或联系官方确认。 |
Q:免费版有速率限制吗? A:Agnes AI 官方文档中未明确列出免费用户的 RPM / TPM 限制。具体配额请登录 Agnes AI 控制台查看,或参考你 API Key 所属账户的用量详情。 |
六、总结与建议
💡 核心要点: 1.Agnes-2.0-Flash已稳定公开,支持 512K 上下文,Benchmark 数据(Pass³ 60.9%,Claw-Eval 第 9 名)可在官方文档验证,适合需要稳定使用的开发者。 2.Agnes-2.5-Flash是基于 2.0 的升级版,重点强化代码、agent 工作流和多模态理解,当前处于灰度阶段(仅对部分用户开放),免费测试期内 Token 价格为 $0,之后可能回归标准定价。 3. 两者均通过同一个 OpenAI 兼容 API 端点访问,切换只需修改 model 字段,支持同一账户并行实验。 4.接入建议:先注册 Agnes AI 账号获取 API Key,用 agnes-2.0-flash 确保稳定性;如需要尝鲜 2.5-Flash 的编码增强能力,可申请加入灰度名单并在代码中实现 fallback 逻辑。 |