.cn 专属!Agnes-2.5-flash 中文对话模型开放,速收藏

Agnes API 全面测评:哪些接口真正能用?实测告诉你答案

AI 探索笔记 · 实测日期:2026 年 7 月

最近 Agnes AI 的 API 服务经历了一次重大调整——域名切换、模型更迭、部分接口停服。到底现在哪些 API 能正常使用?文生图质量如何?视频接口为何被禁?本文基于真实调用测试,逐一拆解每个接口的状态,并附上可落地的应用方案。


一、域名迁移:从 .com 到 .cn

Agnes API 的请求地址已从https://apihub.agnes-ai.com/v1切换至https://apihub.agnes-ai.cn/v1

经实测,两个域名目前都能正常访问,但 .cn 域名有一个显著优势:新增了agnes-2.5-flash模型,而 .com 域名的模型列表中暂未出现该模型。这意味着 .cn 是目前更推荐使用的节点。

两个域名均通过 Cloudflare CDN 加速,实测延迟差异不大。建议开发者在代码中统一切换到 .cn 域名,以获取最新的模型支持。


二、模型全家福:6 款模型一览

当前 .cn 节点共注册了 6 款模型,涵盖文本对话、图像生成和视频生成三大类:

模型名称类型实测状态
agnes-2.0-flash文本对话✅ 可用
agnes-2.5-flash🆕文本对话✅ 可用(仅.cn)
agnes-2.5-pro-alpha文本对话✅ 可用
agnes-image-2.0-flash文生图✅ 可用
agnes-image-2.1-flash文生图✅ 可用(推荐)
agnes-video-v2.0文生视频❌ 403 禁用

三、接口实测:逐一拆解

1. 文本对话接口/v1/chat/completions

POST /v1/chat/completions Model: agnes-2.5-flash Input: "hello" Response: "Hello! I'm Agnes-2.5-Flash, developed by Sapiens AI." Status: 200 ✅

文本对话接口运行稳定,响应速度快,实测 30 秒内返回结果。支持三个模型版本:2.0-flash(基础版)、2.5-flash(新版,推荐)和 2.5-pro-alpha(高级版)。适用场景包括智能客服、内容创作辅助、代码生成、知识问答、多轮对话应用等。接口完全兼容 OpenAI 格式,迁移成本极低。

2. 文生图接口/v1/images/generations

POST /v1/images/generations Model: agnes-image-2.1-flash Size: 768×1152(竖屏9:16) Response: 返回图片URL Status: 200 ✅ 生成耗时: 15-30秒/张

文生图是目前最稳定、最实用的接口,也是本文测试中最推荐的模型。agnes-image-2.1-flash生成的图片质量优秀,支持多种尺寸(1024×1024、768×1152、1152×768 等),画面细节丰富、色彩还原准确。

我们用它制作了一系列竖屏短视频,包括《贝加尔湖的深渊密码》《武夷山悬棺》等未解之谜系列,8 张场景图并行生成,单张耗时 15-30 秒,成功率接近 100%。


3. 图生图接口/v1/images/edits

⚠️ 状态:503 Service Unavailable
错误信息:no available server —— 后端推理节点未部署

图生图接口虽然已注册路由,但后端推理服务当前处于不可用状态。实测使用小文件(292 字节)和大文件(1.6MB 图片)均返回 503 错误,排除了 Cloudflare 上传限制的可能,确认是服务端本身的问题。该接口的缺失意味着目前无法实现图片风格迁移、细节修改、局部重绘等高级图像编辑功能,期待后续版本能够恢复。

4. 文生视频接口/v1/video/generations

❌ 状态:403 Forbidden
错误信息:Model is blocked —— 模型已被封禁

视频生成接口agnes-video-v2.0已被后端封禁,调用时返回 403 错误。该接口之前支持 keyframes 模式生成短视频,但目前完全不可用。封禁原因未公开,可能是出于成本控制或服务稳定性考虑。

替代方案:文生图 + TTS 语音合成 + FFmpeg 视频拼接。虽然画面是静态的,但配合高质量 AI 图片和语音旁白,最终效果在短视频平台上依然有不错的表现。


四、实战应用:用现有 API 打造短视频生产线

虽然视频接口不可用,但我们用文生图 + edge-tts + Pillow + FFmpeg 搭建了一套完整的短视频生产流水线:

🔧 技术栈

  • 场景图生成:agnes-image-2.1-flash,支持 768×1152 竖屏 9:16
  • 语音旁白:edge-tts(微软免费 TTS 引擎),中文发音自然
  • 标题叠加:Pillow 库,半透明黑色底条 + 白色大字
  • 视频合成:FFmpeg,静态图 + 音频 → H.264 视频片段 → concat 合并

📊 生产效率

  • 8 张场景图并行生成:约 60-90 秒
  • TTS 语音合成:约 20 秒
  • 标题叠加:约 5 秒
  • 视频片段编码 + 合并:约 3-5 分钟
  • 总计:一支 8 场景竖屏短视频,从零到成品约 5 分钟

💡 关键经验

  1. 并行生成:图片接口支持并发,4 线程并行可将 8 张图的总耗时缩短至 60 秒内
  2. 错误重试:API 偶发 429(限流)和 503 错误,建议加入指数退避重试机制
  3. edge-tts 参数:语速调节必须用--rate=-5%格式(等号连接),用空格会报错
  4. FFmpeg 编码:concat 合并时避免 stream copy,建议统一 re-encode(-c:v libx264 -preset fast -crf 23
  5. 竖屏输出:请求 768×1152,实际返回 832×1248,注意尺寸差异对字幕布局的影响

五、API 调用代码示例

importrequests API_KEY="your-api-key"API="https://apihub.agnes-ai.cn/v1"headers={"Authorization":f"Bearer{API_KEY}","Content-Type":"application/json"}# 1. 文本对话r=requests.post(f"{API}/chat/completions",headers=headers,json={"model":"agnes-2.5-flash","messages":[{"role":"user","content":"你好"}],"max_tokens":100})print(r.json()["choices"][0]["message"]["content"])# 2. 文生图r=requests.post(f"{API}/images/generations",headers=headers,json={"model":"agnes-image-2.1-flash","prompt":"cinematic sunset","n":1,"size":"768x1152"})url=r.json()["data"][0]["url"]img=requests.get(url).content

六、总结与建议

✅ 当前推荐使用

  • agnes-2.5-flash(文本对话):速度快、质量好、仅 .cn 可用
  • agnes-image-2.1-flash(文生图):最稳定的图像生成模型,强烈推荐
  • agnes-2.5-pro-alpha(文本对话):高级版,适合对质量要求更高的场景

⏳ 暂时不可用

  • agnes-video-v2.0(文生视频):403 封禁,可用图片 + TTS 方案替代
  • /v1/images/edits(图生图):503 无服务,期待后续恢复

📝 开发建议

  • 统一使用 .cn 域名,获取最新模型支持
  • 所有接口兼容 OpenAI 格式,可直接用 openai SDK 或 requests 调用
  • 加入 429/503 自动重试机制,建议间隔 10-30 秒
  • 文生图支持并发,善用多线程可大幅提升生产效率

关注“GC随笔” 获取更多AI前沿知识