想免费用 AI 模型?可以试试这个,文本/图片/视频全免费了,直接冲
日常写代码,我用得比较多的是 ZCode、Codex 和 Qoder。
ZCode 开的是 Coding Plan Pro,Codex 开的是 Plus,Qoder 是公司给的,默认 3000 credits,不够可以申请。Qoder 其实挺好用的,就是额度不太够用。虽然能申请,但用多了就得解释——公司这是怕你不用,又怕你用多了。我懒得去解释,索性自己掏钱开了 GLM Coding Plan Pro 和 Codex Plus。以前我是用Claude Code+GLM,但是在升到Coding Plan Pro V2,量就不够用了,所以选用了ZCode,在 ZCode 中通过 Coding Plan 调用模型时,额度消耗全周期按 0.67 系数折算。同样的模型调用量,在额度扣减侧仅按 67% 计算;等效来看,用户在活动周期内的可用额度约为原来的 1.5 倍。
不过说实话,大部分人还是不喜欢花钱,更喜欢薅羊毛。我们同事几乎没人自费买 AI 服务,要么是工作量真不大,要么是用得特别节约。这年头行情不好,能省则省。
那么,有没有免费的模型可以用呢?当然有,不少平台都放出了少量免费模型:
- OpenRouter:提供 25+ 个免费模型,免费账户每天 50 次请求,每分钟最多 20 次;
- NVIDIA:提供免费 API,速率限制通常为 40 RPM,覆盖 DeepSeek、Moonshot 等 100 多个模型。
这些额度,低频用户尝尝鲜还行,真要拿来干活,那是远远不够的。
也有人自己买硬件,用 Ollama、LM Studio等部署开源模型。这条路成本不低——比如 GLM5.3,那部署成本,一般用户根本玩不起。
最近,一位老朋友辞职在家里搞AI视频生成,这也提起了我的兴趣,也想探索一下,但是一般的视频按秒收费啊,这又有点舍不得了,像千问、海螺、可灵这个Agent有免费额度,不过用起来不怎么得劲啊,后来发现了一个模型:Agnes。它的 Flash 版本目前全部免费,而且覆盖文本生成(Agnes)、图片生成(Agnes Image)、视频生成(Agnes Video)三条产品线,堪称白嫖全家桶。
一、文本模型
| 模型 | 计费项 | 刊例价 | 现价 |
|---|---|---|---|
| agnes-2.5-flash | 输入缓存命中 | $0.005 / M | $0 / M |
| 输入 Token | $0.05 / M | $0 / M | |
| 输出 Token | $0.15 / M | $0 / M | |
| agnes-2.5-pro | 输入缓存命中 | $0.045 / M | $0.045 / M |
| 输入 Token | $0.45 / M | $0.45 / M | |
| 输出 Token | $0.90 / M | $0.90 / M | |
| agnes-2.5-pro-beta | 输入缓存命中 | $0.01 / M | $0.01 / M |
| 输入 Token | $0.10 / M | $0.10 / M | |
| 输出 Token | $0.30 / M | $0.30 / M | |
| agnes-3.0-flash | 输入缓存命中 | $0.005 / M | $0 / M |
| 输入 Token | $0.05 / M | $0 / M | |
| 输出 Token | $0.15 / M | $0 / M |
划重点:agnes-2.5-flash 和 agnes-3.0-flash 目前完全免费,输入、输出、缓存命中统统 $0。Pro 系列正常计费,其中 pro-beta 的价格约为 pro 的三分之一,想省钱可以先用 beta 过渡。
计费规则就两条:
- 输入缓存命中的单价是普通输入 Token 的 10%;
- 缓存命中价只对服务端确认命中的部分生效,没命中的按普通输入价算。
Artificial Analysis 给 agnes-3.0-flash 打了 36 分的智能指数(目前是估算值,独立评测还没出来),在同类 61 个模型里排第 1,全部 652 个模型里排第 26。这个模型 2026 年 9 月 11 日才发布,是个推理模型,还支持图片输入,上下文窗口给到了 1M token——大约 1500 页 A4。榜单统计的价格是输入 $0.05、输出 $0.15 每百万 token。也就是说,免费期内等于白嫖一个榜单前排的新模型,这羊毛含金量还可以。
二、图片模型
三个图片模型(agnes-image-2.0-flash / 2.1-flash / 2.5-flash)的价格和计费方式完全相同,就放一张表了:
| 计费项 | 刊例价 | 现价 |
|---|---|---|
| 1K 输出图片 | $10 / 千张($0.010 / 张) | $0 |
| 2K 输出图片 | $18 / 千张($0.018 / 张) | $0 |
| 3K 输出图片 | $21 / 千张($0.021 / 张) | $0 |
| 4K 输出图片 | $24 / 千张($0.024 / 张) | $0 |
| 第 4 张起的输入参考图片 | $0.003 / 张 | $0 / 张 |
当前所有分辨率档位和输入参考图片均免费。
按刊例价计算时,费用公式为:
刊例价费用 = 输出图片张数 × 对应分辨率单价 + max(0, 输入图片张数 - 3) × $0.003
也就是说,图生图或多图参考任务,前 3 张输入图片不收费,从第 4 张开始按张计费。不过现在是免费期,这些规则都触发不了。
规格方面,官方文档写得很细:输出支持 1K/2K/3K/4K 四档,也接受 1024x768 这类精确尺寸,不直接支持的会自动归一化(比如 1920x1080 会被归到 16:9 的 1K 档,输出 1312x736);比例支持 1:1、3:4、4:3、2:3、3:2、16:9、9:16、21:9 八种,横竖屏都齐了。图生图直接传参考图的 URL 或 Base64 就行。日常出个配图,规格上完全够用。
在 Artificial Analysis 的文生图像榜上没有 Agnes,倒是图像编辑榜上有 agnes-image-2.0-flash——Elo 1010,排第 35 名;作为参照,榜首的 GPT Image 2.5 是 Elo 1175。说白了,免费的图片模型离头部付费模型还有肉眼可见的差距,拿来玩玩、出个配图没问题,指望它扛商业级的活就勉为其难了。至于 2.5-flash,还太新,没进榜。
三、视频模型
| 模型 | 计费项 | 刊例价 | 现价 |
|---|---|---|---|
| agnes-video-v2.0 | 视频时长 | $0.005 / 秒 | $0 / 秒 |
| agnes-video-2.5 | 720P 输出视频 | $0.025 / 秒 | $0.025 / 秒 |
| 1080P 输出视频 | $0.040 / 秒 | $0.040 / 秒 | |
| 1K 输出视频 | $0.040 / 秒 | $0.040 / 秒 | |
| 2K 输出视频 | $0.055 / 秒 | $0.055 / 秒 | |
| 第 6 张起的输入图片 | $0.005 / 张 | $0.005 / 张 | |
| agnes-video-2.5-flash | 720P 视频时长 | $0.025 / 秒 | $0 / 秒 |
划重点:agnes-video-v2.0 免费,agnes-video-2.5-flash 限时免费(目前只有 720P),video-2.5 正常计费。
Video 2.5 系列的计费公式:
视频总金额 = 输出秒数 × 分辨率单价 + 输入视频秒数 × 分辨率单价 + max(0, 图片数 - 免费张数) × 图片超额单价
两个细节:输入视频时长没有独立单价,但会并入总时长一起计费;输入图片前 5 张免费,第 6 张起 $0.005 / 张。
再看看 2.5-flash 实际能生成的规格(官方文档):分辨率只有 720P,比例支持 16:9、9:16、1:1、4:3、3:4、21:9;时长 4~12 秒,默认 5 秒。参考素材最多传 5 张图加 3 段音频,不支持直接喂视频;另有关键帧模式,用首帧/尾帧图片来控制起止画面。参数校验在任务创建前完成,无效请求不会入队也不会计费——这点对免费用户挺友好。
Artificial Analysis 的文生视频榜上,Agnes Video 2.5 拿了 Elo 1076、排第 20 名(图生视频榜 Elo 1031、第 24 名);免费的老一代 v2.0 是 Elo 897、排第 36 名(图生视频 925、第 32 名)。参照一下,榜首 Gemini Omni Flash 的 Elo 是 1233。也就是说,收费的 2.5 标准版在榜单中游偏上,免费能玩的 v2.0 靠后一些,离头部都还有距离——但考虑到一个免费一个按秒收费,这个成绩对白嫖党来说完全能接受。2.5-flash 同样因为太新还没进榜,不过它限时免费,等榜单收留它的时候,说不定免费期都过了。
模型好不好用不能看排行,排行也只是作为参考,到底好不好用,还是需要自己结合实际的场景去使用,才知道好不好用。
四、免费虽好,限制不少
Flash 免费归免费,RPM 限制是跑不掉的:
| 模型类型 | 规格 | 允许发起 | 实际执行 |
|---|---|---|---|
| 文本 | — | 30 RPM | 20 RPM |
| 图片 | 1K | 30 RPM | 20 RPM |
| 图片 | 2K | 20 RPM | 10 RPM |
| 图片 | 3K | 2 RPM | 1 RPM |
| 图片 | 4K | 1 RPM | 1 RPM |
| 视频 | — | 2 RPM | 1 RPM |
规律很明显:越贵的东西管得越严。文本最宽松,图片按分辨率分级管,视频卡得最死——毕竟生成成本摆在那里。
所以对免费用户来说,Agnes 的定位就是基础测试和轻量个人使用,想拿来当生产力主力,还是得考虑付费。
五、不够用?还有 Token Plan
除了按量计费,Agnes 也提供订阅制的 Token Plan。订阅最实在的变化是 RPM 大幅放宽:文本从 30/20 直接拉到 1000,视频从 2/1 提到 6/5,图片 1K/2K 放宽到 120/100、120/80——3K/4K 基本不动,高分辨率该卡还是卡,看来算力成本是真省不下来。当然,RPM 之外还有订阅配额,两者同时生效:
| Plan | agnes-3.0-flash | agnes-image-2.1-flash | agnes-video-2.5-flash |
|---|---|---|---|
| Starter | 每 5 小时 1,500 次;每周 15,000 次 | 每天 4,000 张 | 每天 500 秒 |
| Plus | 每 5 小时 7,500 次;每周 75,000 次 | 每天 4,000 张 | 每天 500 秒 |
| Pro | 每 5 小时 30,000 次;每周 300,000 次 | 每天 4,000 张 | 每天 500 秒 |
这个性价比还是比较高的。
Agnes 支持 OpenClaw、Hermes、Claude Code、WorkBuddy、OpenCode 等客户端接入。它提供 OpenAI 兼容的 API,凡是支持 OpenAI Chat Completions 的都能直接配置;Claude Code 这类走 Claude 协议的,用 CC-Switch 转发一层就行。
代码生成我还没有试过,毕竟我开了那么多会员,主要是最近在探索视频生成。试用了一下,生图和生视频还行,当然和收费的模型比肯定有差距——但毕竟免费,咱们也不能要求太高,对吧?


视频还在尝试中,初步看效果也还可以。就是我写的那个程序,在语音和字幕处理上还有点问题。
写在最后
说白了,平台敢把 Flash 免费开放,就不怕你白嫖——它怕的是你白嫖完就走。等你用顺手了、离不开了,自然会掏钱。随着白嫖的用户越来越多,Agnes服务器的压力也会越来越大,像下午这种高峰期,可能也会出现接口异常的情况。怎么说呢,人家都免费给你用了。还想咋地?
目前可以免费体验的Agent还是比较多,比如Deepseek、MiniMax、智谱清言、千问、豆包等,具体如何选择,主要取决于使用场景,如果是摸索学习,我觉得可以体验一下Agnes,毕竟它可以接入那么多Agent里面,能做的事情就比较多了。但是高要求、且量比较大的。还是花钱买好用的模型吧。
想免费用 AI 模型?可以试试这个,文本/图片/视频全免费了,直接冲




