免费大模型 API 去哪找?模型接入技能升级实战:实时验价、失效墓碑与 MiniMax M3 双端点对照
本文首发于 note.sichenai.cc,原文链接:https://note.sichenai.cc/articles/free-model-discovery-skill.html,作者:斯晨
免费大模型 API 的攻略有一个通病:写作当天是真的,一个月后变成坑。我 8 月 21 日发布的 OpenRouter 免费模型接入教程就是活例,主角模型 6 天后整个下架(列表除名 + 端点 404)。
这个问题促成了我对开源模型接入技能 model-connector 的一次升级,本文拆解三个部分:
- 发现层设计:如何用「实时验价」替代「历史记录」,让工具只报告此刻真的免费的模型
- 墓碑机制:下架模型不删记录、移入退役名单并保留查证路径的设计
- 双端点对照实测:同一款 MiniMax M3,付费中转与官方免费路由在能力上的四处分叉
全部结论来自 2026-08-27 一次完整实战的工具实证。
问题定义:时效性信息在工具链里的位置
接入免费模型的工作流里有三类信息:配置参数(端点、鉴权格式)、能力结论(是否支持图片、推理默认值)、状态结论(是否免费、是否在架)。前两类相对稳定,第三类是纯运营状态,随时翻转。
传统攻略把三类信息混在一起写死,这是失效的根源。正确的做法是把状态类信息从「存储」改为「查询」:每次使用时现场获取,用完即弃。发现层的全部设计都围绕这个原则展开。
发现层架构
触发条件四选一:用户点名要免费;用户未指定具体模型;指名模型命中失效名单;已接入渠道报 404。四个条件都不满足则走原快路径,零额外开销。
核心动作只有一个接口调用:拉取平台公开的模型列表,筛选定价字段输入价与输出价同时为零的条目,禁止引用任何缓存或记忆值。8 月 27 日上午实测:全平台 417 个模型,完全免费者 20 个。
| 模型 id | 上下文 | 备注 |
|---|---|---|
| thinkingmachines/inkling:free | 1M | 公共免费路由 |
| minimax/minimax-m3:free | 1M | 公共免费路由 |
| nvidia/nemotron-3-ultra-550b-a55b:free | 1M | 公共免费路由 |
| google/gemma-4-31b-it:free | 262K | 公共免费路由 |
| z-ai/glm-5.2:free | 256K | 公共免费路由 |
两点工程注意:
- 列表中 Google Lyria 系列为音乐生成模型,定价筛零无法区分用途,人工剔除步骤不可省
- 全部
:free路由共用一把 OpenRouter Key,各自受每日请求次数限制
墓碑机制的规则变更在于处理「失效」的方式:从直接删除条目改为移入退役名单(保留别名、下架原因、时间、查证方式)。收益是命中旧名称时可以立即短路告知,并转推荐可用替代,避免拿过期参数白试一轮。
接入实战:MiniMax M3 免费路由的四轮探针
选定 minimax/minimax-m3:free 作为实战对象(手中存有同款模型付费中转链路的 8 月实测记录,构成天然对照组)。
| 探针项 | 结果 | 说明 |
|---|---|---|
| 文本对话 | 通过 | cost=0,模型串原样透传有效 |
| 工具调用 | 通过 | get_weather 测试函数正确解析城市参数 |
| 图片输入 | 通过 | 8×8 红色 PNG 实测答「红色」 |
| 输出上限 | 524288 通过 / 786432 拒绝 | 触达边界时披露合并计算规则 |
上限探测的关键发现在报错原文:「本端点最大上下文长度 1048576 tokens,然而你请求了约 1048577(文本输入 1 + 输出 1048576)」。即输入输出共享 1M 总池。据此配置文件两字段均保守填 524288。
宿主侧验证采用运行日志反查:配置写入数分钟后宿主可用模型列表由 23 变 24,custom-local:minimax/minimax-m3:free 在列,热加载生效无需重启。命令行直连成功与宿主加载成功是两个独立事件,后者才是交付标准。
对照表:同名模型,不同入口,能力分叉
| 维度 | 付费中转(tokenhub,8 月实测) | 免费路由(OpenRouter,8/27 实测) |
|---|---|---|
| 模型名写法 | 平铺 minimax-m3 | minimax/minimax-m3:free |
| 图片输入 | 不支持(404) | 支持 |
| 推理模式 | 强制开启 | 默认关闭,需显式传参 |
| 输出口径 | 单独计 52 万封顶 | 与输入共享 100 万总池 |
| 计费 | 按 token | 0 元,每日限次 |
图片支持的反转最值得警惕:收费侧不支持、免费侧反而支持。结论只有一个,换入口必须重新验收,同名模型的旧结论不具备继承效力。
非免费模型的快路径
发现层只是新增前哨,「快速接入」仍是技能本职。常见模型(DeepSeek / GLM / Kimi 等)有带实测数据的登记条目,报名字和 Key 即跳过文档研读预填配置;生僻模型退回读文档流程提取端点、鉴权格式、确切 model 字符串。两路汇合于同一组探针,文档虚标(如某模型标称 1M 输出、实际 52 万被拒)和历史漂移都会在此现形。
上手方式
npx skills add sichenai/sichen-skills
WorkBuddy 用户复制到 ~/.workbuddy/skills/ 后,智能体对话里唤起 model-connector:要免费就说「帮我接个免费的大模型」;指定模型就给名字和 Key,其余全自动。
边界说明
- 发现层仅直连 OpenRouter 列表接口;国内厂商(智谱 flash 免费、硅基流动赠额等)为逐家人工核对口径,本次未逐一复核
- 免费路由每日限次的具体数值未实测,仅确认限制存在
- 输入侧独立上限无探针,524288 为保守推导值
- 所有「免费」表述截至 2026-08-27
数据来源与实测标注(文末)
- 实测环境:WorkBuddy + macOS,2026-08-27 工具实证(OpenRouter 列表接口实时拉取、四轮 API 探针、宿主日志反查)
- 付费对照组:2026-08 上旬 tokenhub 链路同口径实测
- 工具:model-connector v1.8.0(自研开源,sichenai/sichen-skills)
更多推荐

所有评论(0)