全球排名前十的 AI Lab,Agnes 最新宣布旗下核心全模态模型 API 无限期免费开放,包括文本、图片、视频,全部免费用。

这是在月初免费的基础上,又加了两个大件:百万 Token 上下文和 4K 图片生成。
我也顺手用它做了个图片版的番茄钟,可以避免 vibe 过多,有效缓解 AI 精神病
01
用量暴涨
免费三周之后,Agnes 官方最新公布了过去一周的用量数据:全模态 Token 总消耗 4.29 万亿。

其中文本模型 Agnes-2.0-Flash 贡献了 2.68T,图片和视频模型合计 1.61T。单周生成了 567 万张图片,237 万秒视频。
如果你对 4.29T 没有非常清晰的概念的话,可以这么来看:
在 OpenRouter 的模型周调用排行里,4.29T 的调用量已经超过了小米 MiMo-V2.5,仅次于 DeepSeek V4 Flash。

在这里面,图片和视频的调用占比约为 35%。
免费 + 优秀的多模态能力对许多人而言,还是非常有吸引力的。我自己其实很少用到多模态模型,一是我工作内容上更偏文本,二是多模态确实是有点贵……
而免费之后,我预感会释放出大量有意思的 idea 玩法出来,毕竟以前会被成本劝退的操作,现在变得随手可做,不需要考虑多少钱这事了。
02
百万上下文
Agnes-2.0-Flash 终于正式支持了 1M Token 上下文窗口。
不过在高峰时段请求量较大时,可能会限制在 512K,以保持服务稳定更多人可用。
百万 Token 大家应该都点概念了,大约就是一整本篇小说、好几份法律合同、一套大型技术手册和文档、一个不那么夸张的中型项目的完整代码,基本上能一次性全给塞进去。

当然,百万上下文,也同样是免费的。
而在几个月前,如果想用百万上下文的模型,真得是花上百美金买会员还要等灰度到了才能用上……现在它成了 Agnes 免费 API 的标配,人人可用。
03
4K 出图
同时 Agnes-Image-2.1-Flash 的图片模型也升了级,新增了 4K 输出。
生成的图片最高支持 4096×4096 的分辨率,1:1、16:9、9:16、4:3、3:4 等主流比例都能用。

使用上,就改一个参数的事,把 "size": "1K" 换成 "size": "4K",即可:
●●●
{
"model": "agnes-image-2.1-flash",
"prompt": "一只在冰面上滑行的小熊,科普海报风格",
"size": "4K",
"ratio": "1:1"
}
└
如果你经常需要制作电商主图、广告素材、设计海报等这一类对清晰度有硬性要求的图,之前 1K 输出确实有点不大够用,且细节多少会差点意思。4K 会在纹理的还原和细节表现力等方面有大幅提升。
不过,考虑到 4K 生成时间比较长,官方对免费 RPM 做了些合理的限制:4K 图片每分钟只能请求一次。
如果你请求量大,日常想免费批量出图,那还是建议用 1K、2K,4K 请留给那些真正需要精细输出的场景。
需要注意的是,4K 的价格和 1K 是一样的:免费。
04
图片版番茄钟
Agnes 的 API 兼容 OpenAI 协议,Cursor、Claude Code、Hermes……等等各种 Agent 框架,只要工具支持自定义 endpoint,就都能直接接上,免费开薅。
而对不一小心就会沉浸于 vibe 中长达三五小时的我来说,我第一时间闪现的灵感就是:我应该用来搞一个图片版本的番茄钟。
我之前有过一个开源的桌面小精灵项目 Peeky,它会住在屏幕上,观察并记录你在干什么,偶尔主动跟你搭句话。

我后来还给它加了些小功能,比如截图后可以直接翻译、内容问答、进行文字识别等。这些功能虽然简单,但还真挺好用的,我之前就接入了 Agnes 在薅它的免费额度。
所以我这次就直接给 Peeky 加了个新功能:番茄工作法休息提醒。
当然了,这个提醒可不只是弹个通知框,或者闹钟响一下。
而是你当你 vibe 过度之际,会突然被温柔提醒:

具体的逻辑上,是每隔一段时间(默认 25 分钟,也可自行设置),Peeky 会调用 Agnes 的模型,现场生成一张风格随机的图片,然后以动画的形式从屏幕底部飘过去,提醒你该让眼睛和脑子休息一下。

生成的图片的风格上,你是可以自己选择的:可爱小动物、二次元动漫少女、宁静风景、治愈美食、萌宠……还有个自定义选项,你可以自己写提示词弄些更大胆、更有想象力的画面出来,不时就提醒你一下。

实现上是两步:
先用文本模型 Agnes-2.0-Flash,根据你的 context(当前时间、你的用户名风信息,后面还会加你的心情、截屏、甚至用摄像头给电脑前的你拍个照(◐‿◑)) + 你选的风格现场生成一段图片描述 prompt。
然后,用图片模型 Agnes-Image-2.1-Flash,根据这段 prompt 出图。
日志里也能看到文本模型自动生成的 prompt,比如我选了「二次元动漫少女」风格:

代码大概长这样(你不用看,主要是你可以拷贝后扔给你的 AI 看):
●●●
// 文本模型生成图片 prompt
constpromptResp=awaitclient.chat.completions.create({
model:"agnes-2.0-flash",
messages: [{
role:"user",
content:`生成一段英文图片描述,主题:${style},用于提醒休息`
}]
});
constimagePrompt=promptResp.choices[0].message.content;
// 图片模型生成图片
constimageResp=awaitclient.images.generate({
model:“agnes-image-2.1-flash”,
prompt:imagePrompt,
size:“1K”,
response_format:“b64_json”
});
└
模型配置上,Peeky 兼容了 OpenAI 协议,填上 Agnes 的 Base URL 和 API Key 就可以了。

跑起来是这个效果:

当然,你也可以把 size 改成 "4K",并可以让基于你的特殊癖好指令出来的高清无码大图全屏填满你的电脑屏幕。
每次都不带重样,因为 prompt 是现场基于 context 生成的,风格会统一但内容则不同。
最让人放心的是:你永远不需要关心钱,因为免费;也不需要关心稳定性,因为官方有一帮人在保障护航。
你如果想到了什么有意思的用法,可以集成到 Peeky 中提 pr 给我(我刚想到的提醒时间需要改进一下,比如避开我正在打字、或者正在语音输入)。
05
透明化开发
说了我的薅羊毛蕃茄钟,来说说官方的透明。
Agnes 还做了一件事:把开发进度全部都公开了出来。
在官方 GitHub Issues 看板上,用户反馈的从 TTFT 有时偏慢、图片模型偶发 503、Codex 接入报 400 等各种大小问题,全都在上面公开跟踪和闭环处理。

还能直接看到功能排期和 Bug 修复进度:

对一个主打免费策略的 API 平台来说,如此透明化开发会让人更多几分放心。毕竟,免费最让人担心的就是「出了问题没人管」。
百万上下文、4K 出图、文本、图片、视频、语音合成(TTS 正在灰度中)、全模态……透明化开发、持续迭代升级,还全都免费!
这么好的羊毛,不用我多说了吧?
◇ ◆ ◇

