一个AI平台把文本/图片/视频全免费了,我接入了Hermes Agent
一个AI平台把文本/图片/视频全免费了,我接入了Hermes Agent 全球排名前十的AI实验室Sapiens AI,最近干了一件让开发者直呼良心的事:他们把自家Agnes平台的三类多模态模型——文本、图像、视频——全部免费开放了。不是限时免费,不是试用额度,就是正儿八经的$0。 有人在Cla
💡 你将学到
一个AI平台把文本/图片/视频全免费了,我接入了Hermes Agent 全球排名前十的AI实验室Sapiens AI,最近干了一件让开发者直呼良心的事:他们把自家Agnes平台的三类多模态模型——文本、图像、视频——全部免费开放了。不是限时免费,不是试用额度,就是正儿八经的$0。 有人在Cla
一个AI平台把文本/图片/视频全免费了,我接入了Hermes Agent
全球排名前十的AI实验室Sapiens AI,最近干了一件让开发者直呼良心的事:他们把自家Agnes平台的三类多模态模型——文本、图像、视频——全部免费开放了。不是限时免费,不是试用额度,就是正儿八经的$0。
有人在Claw-Eval的PASS³跑分上跟Claude Opus 4.6和GLM 5.1掰手腕,有人在AA图像编辑排行榜上刷到Elo 1178,还有人拿着AA图生视频的Elo 934在跑图转视频——这些能力现在一分钱不花就能用。我花了一个下午把它们全部接入了Hermes Agent,从文本对话到文生图、图生图,再到文生视频、图生视频,完整跑了一遍。下面直接上干货。
Agnes 全家桶有多全
先说模型阵容。文本主力是Agnes 2.0 Flash,512K上下文窗口,支持工具调用、多轮对话和Thinking Mode,Claw-Eval PASS³跑分60.9%,超过DeepSeek V4 Pro的58.4%。图像方面,Agnes Image 2.1 Flash主打高信息密度和构图保留——你给一张图让它改风格,原始布局不会跑偏;视频方面,Agnes Video V2.0支持文生视频、图生视频、关键帧动画三种模式,异步API异步取,最长18秒,720p。
标准定价是文本$0.03/1M输入tokens、图片$0.003/张、视频$0.005/秒,在行业里已经是地板价。但现在是$0。你没看错,就是$0。至于什么时候会恢复定价,没人知道,但趁着免费先上车总是对的。
注册和拿到API Key
去platform.agnes-ai.com注册账号,邮箱验证通过后登录,进入API Platform页面,点"Create API Key"一键生成。把Key复制下来,后面配置要用。
接入Hermes Agent就三步
Hermes Agent支持自定义OpenAI兼容provider,Agnes的API完全兼容OpenAI格式,零成本迁移。
第一步:在config.yaml里加provider。Windows用户注意路径——文件在C:\Users\<用户名>\AppData\Local\hermes\config.yaml,很多人写成了~/.hermes,结果401读半天不知道哪错了。
providers:
agnes:
name: Agnes AI
api: https://apihub.agnes-ai.com/v1
api_key: ${AGNES_CRED}
api_mode: chat_completions
default_model: agnes-2.0-flash
discover_models: true
第二步:在同目录的.env文件里写入AGNES_CRED=你的API_KEY。API Key去platform.agnes-ai.com注册拿到。
第三步:命令行切模型,重启TUI。
hermes config set model.provider custom:agnes
hermes config set model.default agnes-2.0-flash
搞定。Hermes就切换到了Agnes 2.0 Flash作为默认文本模型。
文生图和图生图:一句话出图,一张图改风格
Agnes Image 2.1 Flash的API地址是POST /v1/images/generations。文生图一句话就出:
curl -X POST "https://apihub.agnes-ai.com/v1/images/generations" \
-H "Authorization: Bearer ***" \
-H "Content-Type: application/json" \
-d '{
"model": "agnes-image-2.1-flash",
"prompt": "A luminous floating city above a misty canyon at sunrise",
"size": "2K",
"ratio": "16:9"
}'
返回的data[0].url就是图片链接。我实测生成一张2K 16:9的莫兰湖日出风景照,画面细节丰富、色彩准确,7MB的文件质量相当能打。
图生图更有意思。你传一张图上去,改风格、改颜色、改场景,构图不变。比如把一张湖边风景变成雨夜赛博朋克风:
curl -X POST "https://apihub.agnes-ai.com/v1/images/generations" \
-H "Authorization: Bearer ***" \
-H "Content-Type: application/json" \
-d '{
"model": "agnes-image-2.1-flash",
"prompt": "Transform into a rain-soaked cyberpunk night with neon reflections, preserve original composition",
"size": "2K",
"ratio": "16:9",
"extra_body": {
"image": ["https://example.com/input.png"],
"response_format": "url"
}
}'
有个坑:response_format不能放顶层JSON,必须放在extra_body里面。另外API会把你的精确像素值标准化到最近的预设档位,所以我建议直接用size+ratio的组合,别手写宽高。
文生视频和图生视频:文字变电影,图片变短片
视频API是异步的,三步搞定:创建任务、轮询状态、下载视频。
创建任务:
curl -X POST "https://apihub.agnes-ai.com/v1/videos" \
-H "Authorization: Bearer ***" \
-H "Content-Type: application/json" \
-d '{
"model": "agnes-video-v2.0",
"prompt": "A cinematic drone shot over a misty mountain range at sunrise, golden light breaking through clouds, smooth motion, photorealistic",
"width": 1152,
"height": 768,
"num_frames": 121,
"frame_rate": 24
}'
返回video_id后,用这个接口轮询:
curl "https://apihub.agnes-ai.com/agnesapi?video_id=<VIDEO_ID>" \
-H "Authorization: Bearer ***"
状态从queued到in_progress到completed,完成后url字段就是视频链接。我也测了一段5秒的航拍山景视频,推理花了大约103秒,最终输出流畅度还行。
图生视频同理,在请求里加一个image参数传入图片URL就行。关键帧动画则需要用extra_body.mode: "keyframes"传入多张图片URL。
视频有两个容易踩的坑:一是num_frames必须是8n+1(81、121、241、441),写错直接报错;二是推理时间不短,轮询间隔设10秒以上比较合理。
总结
Agnes AI是我目前见过最良心的免费API平台——文本、图像、视频全模态覆盖,全部免费。接入Hermes Agent改几行配置就行,不需要额外SDK。但还有一个更简单的方法,把官方接入说明文档丢给hermes,然后说一句:“根据文档规范,把图片生成和视频生成的接口调用做成一个skill”。 如果你在用Hermes Agent或者任何OpenAI兼容的AI框架,现在上车正好。免费的时候不用,难道等收费了再用?
