免费的大模型Agnes-2.0-Flash升级到Agnes-2.5-Flash
Agnes-2.5-Flash vs Agnes-2.0-Flash:模型对比与接入指南
依据 Agnes AI 官方文档整理 | https://agnes-ai.com/zh-Hans/docs/

|
真伪✅ 真——基于 Agnes AI 官网公开文档核验(agnes-ai.com/zh-Hans/docs/) 时间截至 2026-07-27 访问时核验 对象开发者用户需注册获取 API Key |
一、模型规格对照表
|
参数项 |
Agnes-2.0-Flash |
Agnes-2.5-Flash |
|
发布状态 |
已公开发布 |
灰度测试中(需加入灰度名单) |
|
上下文窗口 |
512K tokens |
最高支持 512K tokens |
|
单次输出限制 |
65.5K tokens |
65.5K tokens |
|
多模态输入 |
支持文本 + 图片 URL |
支持文本 + 图片 URL |
|
优化方向 |
agent工作流、tool invocation、coding、reasoning |
代码、agent 工作流、tool calls、多模态理解(基于 2.0 升级) |
|
Thinking 模式 |
支持(OpenAI/Anthropic 兼容格式) |
支持,可选分配预算 token(如 2048) |
|
API 端点 |
https://apihub.agnes-ai.com/v1/chat/completions |
https://apihub.agnes-ai.com/v1/chat/completions |
|
协议兼容性 |
OpenAI 兼容 |
OpenAI 兼容 |
二、性能基准(官方披露数据)
|
模型 |
Claw-Eval Pass³ |
备注 |
|
Agnes-2.0-Flash |
60.9% |
Claw-Eval 总榜第 9 名(据官方文档披露) |
|
Agnes-2.5-Flash |
未公开 |
当前为灰度阶段,官方未发布独立评测数据 |
|
ⓘ 关于 Benchmarks 的说明 以上 Benchmark 数据仅来自 Agnes-2.0-Flash 的官方文档。Agnes-2.5-Flash 作为基于 2.0 的升级版本,在代码生成、调试和推理能力方面有"增强",但具体数值未在公开材料中披露。 |
三、定价政策(依据官方文档)
|
定价阶段 |
输入 ($/1M) |
输出 ($/1M) |
适用范围 |
|
灰度测试期(2.5-Flash) |
$0 |
$0 |
仅限灰度名单用户 |
|
标准费率(两版通用) |
$0.03 |
$0.15 |
灰度过后或超出免费额度 |
注:文档中未明确免费层级的 RPM / TPM 限制,建议直接咨询 Agnes AI 客服或查看控制台配额详情。
四、接入方式(手把手教程)
方案 A:通过 Agnes AI 官方 API(唯一直接渠道)
第 1 步:注册账号 & 获取 API Key
① 访问:agnes-ai.com
② 登录 / 注册账号
③ 进入控制台 → API Keys → 创建新 Key(以 sk- 开头)
⚠️ 注意:Agnes-2.5-Flash 目前仅在灰度名单内可用。如果你不在名单中,API 调用会自动回退到 Agnes-2.0-Flash(官方建议 fallback 策略)。
第 2 步:配置 API 请求
Base URL:https://apihub.agnes-ai.com/v1
认证头:Authorization: Bearer YOUR_API_KEY
Model 字段取值:
• 使用 2.0-Flash:agnes-2.0-flash
• 使用 2.5-Flash(灰度内):agnes-2.5-flash
第 3 步:Python 示例(OpenAI 兼容库)
| # 安装:pip install openai
|
方案 B:通过 IDE 插件间接使用
主流支持 OpenAI 兼容协议的 IDE 插件均可接入 Agnes,如:
• Cursor:设置 → Model Provider → Custom → Base URL 填入 apihub.agnes-ai.com/v1,填入 API Key,model 选择 agnes-2.0-flash 或 agnes-2.5-flash
• Cody / Codeium:同样可通过自定义 OpenAI 端点接入
• VS Code + OpenAI 兼容插件:配置相同
五、FAQ 常见问题(基于官方文档)
|
Q:Agnes-2.5-Flash 是无限期免费吗? A:官方文档中写的是"灰度测试期 $0/1M tokens",意味着此免费政策仅限于当前灰度阶段,未来可能按标准费率($0.03/$0.15 per M tokens)计费。Agnes-2.0-Flash 的价格信息类似,文档中亦标注了标准费率。具体免费是否持续到另行通知,请以 Agnes AI 控制台显示为准。 |
|
Q:两个模型的上下文的区别? A:根据 Agnes AI 官方文档,两个模型都支持最高 512K tokens 的上下文窗口,单次生成分输出最多 65.5K tokens。此前部分非官方资料误将上下文写为 256K,请以官网为准。 |
|
Q:如何判断自己是否在 Agnes-2.5-Flash 灰度名单中? A:尝试调用 agnes-2.5-flash 模型,如果返回错误或非预期的 agnes-2.0-flash 结果,则可能不在灰度名单内。官方文档建议在不可用时 fallback 到 agnes-2.0-flash。具体入灰度条件未公开说明,需要通过 Agnes AI 控制台或联系官方确认。 |
|
Q:免费版有速率限制吗? A:Agnes AI 官方文档中未明确列出免费用户的 RPM / TPM 限制。具体配额请登录 Agnes AI 控制台查看,或参考你 API Key 所属账户的用量详情。 |
六、总结与建议
|
💡 核心要点: 1. Agnes-2.0-Flash 已稳定公开,支持 512K 上下文,Benchmark 数据(Pass³ 60.9%,Claw-Eval 第 9 名)可在官方文档验证,适合需要稳定使用的开发者。 2. Agnes-2.5-Flash 是基于 2.0 的升级版,重点强化代码、agent 工作流和多模态理解,当前处于灰度阶段(仅对部分用户开放),免费测试期内 Token 价格为 $0,之后可能回归标准定价。 3. 两者均通过同一个 OpenAI 兼容 API 端点访问,切换只需修改 model 字段,支持同一账户并行实验。 4. 接入建议:先注册 Agnes AI 账号获取 API Key,用 agnes-2.0-flash 确保稳定性;如需要尝鲜 2.5-Flash 的编码增强能力,可申请加入灰度名单并在代码中实现 fallback 逻辑。 |
更多推荐


所有评论(0)