你的 API Key 还在吃灰吗?
OpenRouter 上 17 款免费模型,上下文最长的 100 万 token,参数最大的 550B——听起来像自助餐厅敞开吃。但 Reddit 上有人抱怨"50 次用完就断",有人发现"免费版的对话被拿去训练",还有人以为自己在用图片生成模型,结果输出的是音频。
免费模型不是不能用,是大多数人用错了。今天把 OpenRouter 免费池翻了个底朝天,帮你避开那些隐藏的坑。
新面孔:Google Lyria 3,但不是你以为的那种
这次新增的两款模型都来自 Google Lyria 3 系列:
| 模型 | 上下文 | 输入 | 输出 | 定价 |
|---|---|---|---|---|
| Lyria 3 Pro Preview | 1M | 文本+图片 | 文本+音频 | 免费 |
| Lyria 3 Clip Preview | 1M | 文本+图片 | 文本+音频 | 免费 |
注意看 modality——text+image→text+audio。这意味着它不是单纯的"图片生成模型",而是多模态理解+音频生成的混合体。你可以给它一张图片加一段文字描述,它返回文本和音频。把它当 Stable Diffusion 用的人,大概率会一脸懵。
100 万 token 的上下文窗口是亮点,但对于音频生成场景,实际能用的有效长度还有待验证。毕竟 Preview 版本的定位就是"先尝鲜,别上生产"。
17 款全清单:按场景选,别按参数选
完整免费模型列表如下,我按实际用途重新分组:
编程 & Agent
| 模型 | 上下文 | 亮点 |
|---|---|---|
| poolside/laguna-xs-2.1:free | 262K | 编码专精,Apache 2.0 开源 |
| poolside/laguna-m.1:free | 262K | 旗舰编码 Agent,32K 输出 |
| cohere/north-mini-code:free | 256K | MoE 稀疏架构,高效编码 |
| openai/gpt-oss-20b:free | 131K | OpenAI 开源 20B,工具调用 |
推理 & 长文本
| 模型 | 上下文 | 亮点 |
|---|---|---|
| nvidia/nemotron-3-ultra-550b-a55b:free | 1M | 550B 参数,免费池最大 |
| nvidia/nemotron-3-super-120b-a12b:free | 1M | 120B,结构化输出 |
| nvidia/nemotron-3-nano-30b-a3b:free | 256K | 轻量推理,性价比高 |
| nvidia/nemotron-3-nano-omni-30b-a3b:free | 256K | 多模态推理(图片+音频+视频) |
多模态
| 模型 | 上下文 | 亮点 |
|---|---|---|
| google/gemma-4-31b-it:free | 262K | Vision+Video+Tools |
| google/gemma-4-26b-a4b-it:free | 262K | 同上,更轻量 |
| nvidia/nemotron-nano-12b-v2-vl:free | 128K | 视觉+视频理解 |
| nvidia/nemotron-3.5-content-safety:free | 128K | 内容安全检测 |
路由 & 特殊
| 模型 | 上下文 | 亮点 |
|---|---|---|
| openrouter/free | 200K | 自动路由,随机选免费模型 |
| nvidia/nemotron-nano-9b-v2:free | 128K | 结构化输出 |
代价清醒:免费的三张账单
源文章不会告诉你这些。免费模型有三种隐性成本,用之前必须知道:
账单一:每天 50 次的天花板
免费用户每日上限 50 次请求,充值 10 美元后提升到 1000 次。但注意——20 RPM(每分钟请求数)是固定的,充钱也不会变快。Reddit 用户反馈,50 次在对话场景下"大概 4.5 美分的价值",做 Agent 开发时一轮调试就能用完。
账单二:你的对话可能变成训练数据
Poolside 的免费模型明确声明:"If you are using Laguna XS 2.1 for free, we may use your inputs and outputs to train and improve our models。"把商业代码逻辑喂给免费 API,等于免费给别人送训练数据。NVIDIA 的免费模型虽未明确声明训练条款,但免费服务的隐私政策通常留有后门。
账单三:模型随时消失
腾讯 Hy3 今天(7 月 21 日)下架。Poolside Laguna M.1 将在 7 月 28 日下架。免费模型的生命周期不确定——今天能用的,明天可能就 404 了。把业务逻辑绑定在免费模型上,是最脆弱的架构选择。
选型指南:三步选对免费模型
第一步:确定场景
- 写代码 → Laguna XS 2.1 或 North Mini Code
- 长文档理解 → Nemotron 3 Super(1M 上下文)
- 图片/视频理解 → Gemma 4 31B
- 快速测试/原型 → openrouter/free 自动路由
第二步:检查限制
- 需要工具调用?不是所有免费模型都支持。OpenClaw 用户报告,设置
free过滤后常遇 "No endpoints found that support tool use" 错误 - 需要多轮对话?50 次/天可能不够,考虑充值或 BYOK
第三步:设置降级策略
- 永远不要只依赖一个免费模型 ID
- 用
openrouter/free做兜底路由 - 重要场景配置付费模型的 fallback
隐藏福利:BYOK 模式
如果你有自己的 API Key(比如直接从 Google、NVIDIA 申请),OpenRouter 的 BYOK(Bring Your Own Key)模式提供每月 100 万次免费路由——只负责中转,不收推理费。这比免费模型池的 50 次/天实用得多,适合已有 provider key 的开发者。
趋势判断:免费池正在变成获客漏斗
OpenRouter 免费模型的数量从早期的 5-6 款增长到 17 款,但仔细看结构:NVIDIA 占了 6 款,Google 4 款,Poolside 2 款。大厂把免费模型放上去,本质是获客漏斗的顶层——让你免费用,用顺了切付费版。
这不是坏事,但你要清醒:
- 免费模型是试用装,不是正装。质量波动大,Reddit 用户反馈"大模型经常吐出毫无意义的回复"
- Preview 标签意味着随时变。Lyria 3 现在免费,正式版大概率收费
- 模型上下架是常态。Hy3 和 Laguna M.1 的下架说明,免费池是流动的
正确的姿势:用免费模型做原型验证和轻量测试,生产环境老老实实用付费版或自部署。4.5 美分/天的免费额度,正好够你判断一个模型值不值得花钱。
相关链接:
- OpenRouter 免费模型集合:https://openrouter.ai/collections/free-models
- OpenRouter API 限速文档:https://openrouter.ai/docs/api_reference/limits
- BYOK 模式说明:https://openrouter.ai/docs/guides/routing/provider-selection
- costgoat 实时免费模型清单:https://costgoat.com/pricing/openrouter-free-models
- Agnes AI(1M 上下文+4K 生图+视频全免费):https://platform.agnes-ai.com/
暂无评论。