17 款免费模型摆在面前,你大概率用错了 3 个

你的 API Key 还在吃灰吗?

OpenRouter 上 17 款免费模型,上下文最长的 100 万 token,参数最大的 550B——听起来像自助餐厅敞开吃。但 Reddit 上有人抱怨"50 次用完就断",有人发现"免费版的对话被拿去训练",还有人以为自己在用图片生成模型,结果输出的是音频。

免费模型不是不能用,是大多数人用错了。今天把 OpenRouter 免费池翻了个底朝天,帮你避开那些隐藏的坑。

新面孔:Google Lyria 3,但不是你以为的那种

这次新增的两款模型都来自 Google Lyria 3 系列:

模型 上下文 输入 输出 定价
Lyria 3 Pro Preview 1M 文本+图片 文本+音频 免费
Lyria 3 Clip Preview 1M 文本+图片 文本+音频 免费

注意看 modality——text+image→text+audio。这意味着它不是单纯的"图片生成模型",而是多模态理解+音频生成的混合体。你可以给它一张图片加一段文字描述,它返回文本和音频。把它当 Stable Diffusion 用的人,大概率会一脸懵。

100 万 token 的上下文窗口是亮点,但对于音频生成场景,实际能用的有效长度还有待验证。毕竟 Preview 版本的定位就是"先尝鲜,别上生产"。

17 款全清单:按场景选,别按参数选

完整免费模型列表如下,我按实际用途重新分组:

编程 & Agent

模型 上下文 亮点
poolside/laguna-xs-2.1:free 262K 编码专精,Apache 2.0 开源
poolside/laguna-m.1:free 262K 旗舰编码 Agent,32K 输出
cohere/north-mini-code:free 256K MoE 稀疏架构,高效编码
openai/gpt-oss-20b:free 131K OpenAI 开源 20B,工具调用

推理 & 长文本

模型 上下文 亮点
nvidia/nemotron-3-ultra-550b-a55b:free 1M 550B 参数,免费池最大
nvidia/nemotron-3-super-120b-a12b:free 1M 120B,结构化输出
nvidia/nemotron-3-nano-30b-a3b:free 256K 轻量推理,性价比高
nvidia/nemotron-3-nano-omni-30b-a3b:free 256K 多模态推理(图片+音频+视频)

多模态

模型 上下文 亮点
google/gemma-4-31b-it:free 262K Vision+Video+Tools
google/gemma-4-26b-a4b-it:free 262K 同上,更轻量
nvidia/nemotron-nano-12b-v2-vl:free 128K 视觉+视频理解
nvidia/nemotron-3.5-content-safety:free 128K 内容安全检测

路由 & 特殊

模型 上下文 亮点
openrouter/free 200K 自动路由,随机选免费模型
nvidia/nemotron-nano-9b-v2:free 128K 结构化输出

代价清醒:免费的三张账单

源文章不会告诉你这些。免费模型有三种隐性成本,用之前必须知道:

账单一:每天 50 次的天花板

免费用户每日上限 50 次请求,充值 10 美元后提升到 1000 次。但注意——20 RPM(每分钟请求数)是固定的,充钱也不会变快。Reddit 用户反馈,50 次在对话场景下"大概 4.5 美分的价值",做 Agent 开发时一轮调试就能用完。

账单二:你的对话可能变成训练数据

Poolside 的免费模型明确声明:"If you are using Laguna XS 2.1 for free, we may use your inputs and outputs to train and improve our models。"把商业代码逻辑喂给免费 API,等于免费给别人送训练数据。NVIDIA 的免费模型虽未明确声明训练条款,但免费服务的隐私政策通常留有后门。

账单三:模型随时消失

腾讯 Hy3 今天(7 月 21 日)下架。Poolside Laguna M.1 将在 7 月 28 日下架。免费模型的生命周期不确定——今天能用的,明天可能就 404 了。把业务逻辑绑定在免费模型上,是最脆弱的架构选择。

选型指南:三步选对免费模型

第一步:确定场景

  • 写代码 → Laguna XS 2.1 或 North Mini Code
  • 长文档理解 → Nemotron 3 Super(1M 上下文)
  • 图片/视频理解 → Gemma 4 31B
  • 快速测试/原型 → openrouter/free 自动路由

第二步:检查限制

  • 需要工具调用?不是所有免费模型都支持。OpenClaw 用户报告,设置 free 过滤后常遇 "No endpoints found that support tool use" 错误
  • 需要多轮对话?50 次/天可能不够,考虑充值或 BYOK

第三步:设置降级策略

  • 永远不要只依赖一个免费模型 ID
  • openrouter/free 做兜底路由
  • 重要场景配置付费模型的 fallback

隐藏福利:BYOK 模式

如果你有自己的 API Key(比如直接从 Google、NVIDIA 申请),OpenRouter 的 BYOK(Bring Your Own Key)模式提供每月 100 万次免费路由——只负责中转,不收推理费。这比免费模型池的 50 次/天实用得多,适合已有 provider key 的开发者。

趋势判断:免费池正在变成获客漏斗

OpenRouter 免费模型的数量从早期的 5-6 款增长到 17 款,但仔细看结构:NVIDIA 占了 6 款,Google 4 款,Poolside 2 款。大厂把免费模型放上去,本质是获客漏斗的顶层——让你免费用,用顺了切付费版。

这不是坏事,但你要清醒:

  • 免费模型是试用装,不是正装。质量波动大,Reddit 用户反馈"大模型经常吐出毫无意义的回复"
  • Preview 标签意味着随时变。Lyria 3 现在免费,正式版大概率收费
  • 模型上下架是常态。Hy3 和 Laguna M.1 的下架说明,免费池是流动的

正确的姿势:用免费模型做原型验证和轻量测试,生产环境老老实实用付费版或自部署。4.5 美分/天的免费额度,正好够你判断一个模型值不值得花钱。


相关链接:

评论

暂无评论。

登录后可发表评论。