Agnes 3.0 重磅升级:免费模型再进化,Agent 编程能力冲进全球第一梯队
一句话速览:新加坡 Sapiens AI 9 月初上线 Agnes 3.0 Flash 文本模型,Artificial Analysis 智能指数 36 分、同类 61 款模型排名第 1,输出速度 252.7 Token/秒,关键是——API 全部免费。加上图片 2.5 Flash(4K 免费)和视频 2.5 Flash(720P 免费),一个 Key 通吃文本、图像、视频三大模态。
背景:Agnes AI 是谁?
Agnes AI 是新加坡 Sapiens AI 公司旗下的全模态模型品牌,自研文本、图像、视频三大模型线,全部兼容 OpenAI API 格式。自 2026 年 6 月起,三大主力模型 API 无限期免费开放,凭借"真免费、能扛量、全兼容"迅速在开发者圈出圈。
2026 年 9 月初,Agnes 悄悄放出了 3.0 版本的文本模型agnes-3.0-flash,定位从"能写代码"升级到"能把 Agent 任务干成、干对"——这也是它跟 2.5 版本最核心的区别。
一、Agnes 3.0 Flash:到底升级了什么?
1.1 核心定位:面向 Agent 编程的执行型模型
上一代 Agnes 2.5 Flash 卷的是"写代码好不好",3.0 把火力压在了"任务能不能真干完、干对"。官方明确了四个核心升级方向:
| 升级方向 | 解决的痛点 |
|---|---|
| 端到端任务执行更稳定 | 多步任务不掉链子、不中途偏题 |
| 工具编排更可靠 | 不反复调同一个工具绕死循环 |
| 长上下文指令遵循更强 | 长任务里记得住最初的要求 |
| 交付结果更可信 | 活没干完不会跟你说"妥了" |
简单说:这是给真正想搭 Agent 流水线的人准备的模型。
1.2 硬参数一览
| 参数 | 规格 |
|---|---|
| 模型名称 | agnes-3.0-flash |
| 模型类型 | 文本 + 图像 URL 输入(多模态) |
| 上下文窗口 | 512K |
| 最大输出 | 65,000 Token(约 5 万字) |
| 输出速度 | 252.7 Token / 秒 |
| 支持接口 | Chat Completions / Responses / Messages |
| 核心能力 | Tool Calling、Thinking 模式、Function Calling |
| 价格 | 全免费(输入/输出/缓存命中均 $0) |
512K 上下文是什么概念?一个中型代码仓库的核心源码加文档,基本可以一次性塞进去,不用再做切片和检索增强。
1.3 架构揭秘:混合注意力 + 开源权重
Agnes 3.0 Flash 的预览版(Preview)以Apache 2.0 协议开源,33B 参数,72 层解码器中 54 层用门控循环设计、18 层用标准全局注意力——只有 18 层持有 KV 缓存,大幅降低长上下文的内存开销。
另外配备 27 层视觉塔处理图片和视频输入,支持文本、图像、视频三种模态。bf16 权重约 66GB,单张 NVIDIA H20 即可推理。
注意:API 生产版与开源预览版是不同的 checkpoint 和配置,生产版能力更强。预览版适合本地部署研究,生产版直接调 API 即可。
1.4 榜单成绩:同类模型排名第 1
截至 2026 年 9 月 11 日,Artificial Analysis 公布的数据:
| 指标 | 成绩 |
|---|---|
| 智能指数(Intelligence Index v4.3) | 36 |
| 同类模型排名 | 第 1 / 61 |
| 输出速度 | 252.7 Token / 秒 |
智能指数 36 分是什么水平?已经挤进全球第一梯队。加上 252.7 Token/秒的输出速度——免费模型跑出付费旗舰级的速度,这才是最夸张的地方。
二、图片模型:2.5 Flash,4K 全免费
图片模型目前最新版本是agnes-image-2.5-flash(注意:图片还没有 3.0 版本),支持 1K 到 4K 全分辨率输出,全部免费。
| 分辨率 | 刊例价(原价) | 现价 |
|---|---|---|
| 1K(1024×1024) | $10 / 千张 | 免费 |
| 2K(2048×2048) | $18 / 千张 | 免费 |
| 3K(3072×3072) | $21 / 千张 | 免费 |
| 4K(4096×4096) | $24 / 千张 | 免费 |
支持文生图、图生图、多图参考等能力。图生图前 3 张参考图不额外收费(当前免费阶段也不影响)。
三、视频模型:2.5 Flash,720P 免费
视频模型目前最新免费版本是agnes-video-2.5-flash(视频 2.5 标准版为付费)。
| 模型 | 分辨率 | 刊例价 | 现价 |
|---|---|---|---|
| agnes-video-v2.0 | - | $0.005 / 秒 | 免费 |
| agnes-video-2.5-flash | 720P | $0.025 / 秒 | 免费 |
| agnes-video-2.5(标准版) | 720P | $0.025 / 秒 | $0.025 / 秒 |
| agnes-video-2.5(标准版) | 1080P / 1K | $0.040 / 秒 | $0.040 / 秒 |
| agnes-video-2.5(标准版) | 2K | $0.055 / 秒 | $0.055 / 秒 |
免费版视频支持文生视频、图生视频、原生音画同步。注意:视频生成帧数必须是8n+1(9/17/25/33…81),填错必报错。
四、免费使用指南:从注册到调用
4.1 第一步:注册拿 Key(2 分钟)
两个站点任选:
- 国际站:
https://platform.agnes-ai.com— 全球访问 - 国内站:
https://api.agnes-ai.cn— 国内直连,低延迟
流程:
- 注册登录(邮箱 / Google / GitHub,无需绑卡、无需手机号)
- 进入「API 密钥」→ 创建新密钥
- 复制
sk-xxxx密钥(仅展示一次,当场存好)
重要:国际站和国内站账号不通、Key 互不通用。用哪个站的 Key,Base URL 就得配成对应那个站的,别搞混。
4.2 第二步:文本模型调用
Agnes 3.0 Flash 完全兼容 OpenAI 协议,改三个字段就能跑:
fromopenaiimportOpenAI client=OpenAI(base_url="https://apihub.agnes-ai.com/v1",# 国内站用 https://apihub.agnes-ai.cn/v1api_key="sk-你的密钥")response=client.chat.completions.create(model="agnes-3.0-flash",messages=[{"role":"user","content":"用 Python 写一个快速排序函数"}],stream=True)forchunkinresponse:ifchunk.choices[0].delta.content:print(chunk.choices[0].delta.content,end="")4.3 第三步:图片生成
importrequests resp=requests.post("https://apihub.agnes-ai.com/v1/images/generations",headers={"Authorization":"Bearer sk-你的密钥"},json={"model":"agnes-image-2.5-flash","prompt":"赛博朋克城市夜景,霓虹灯光,电影风格,高细节","size":"1024x1024",# 支持 1024/2048/3072/4096"n":1})print(resp.json()["data"][0]["url"])4.4 第四步:视频生成
importrequestsimporttime# 提交任务resp=requests.post("https://apihub.agnes-ai.com/v1/videos/generations",headers={"Authorization":"Bearer sk-你的密钥"},json={"model":"agnes-video-2.5-flash","prompt":"5秒视频,亚洲女模特在白色摄影棚穿黑色连衣裙,镜头缓慢移动","resolution":"720p","duration":5})task_id=resp.json()["id"]# 轮询结果(视频为异步任务)whileTrue:status=requests.get(f"https://apihub.agnes-ai.com/v1/videos/{task_id}",headers={"Authorization":"Bearer sk-你的密钥"}).json()ifstatus["status"]=="succeeded":print("视频地址:",status["output"]["url"])breakelifstatus["status"]=="failed":print("生成失败:",status.get("error"))breaktime.sleep(10)五、一键接入你的常用工具
3.0 全面兼容 OpenAI 协议,绝大多数工具改三个字段(Base URL、API Key、模型名)就能跑:
| 工具 / IDE | 接法 | 难度 |
|---|---|---|
| Cursor | 设置 → Models → 手动添加模型agnes-3.0-flash | ⭐ |
| Trae | 设置 → 模型 → 添加自定义模型 → OpenAI 格式 | ⭐ |
| WorkBuddy | 编辑 models.json 添加自定义模型 | ⭐⭐ |
| Cherry Studio | 添加提供商 → 类型 OpenAI → 获取模型列表 | ⭐ |
| Codex | CC Switch 或 Codex++ 添加供应商 | ⭐⭐ |
| Claude Code | CC Switch 做协议转换 + 模型映射 | ⭐⭐⭐ |
国内用户建议用国内站地址:https://apihub.agnes-ai.cn/v1,延迟更低、无需代理。
六、三大模型免费矩阵速查表
| 模态 | 最新免费模型 | 核心规格 | 价格 |
|---|---|---|---|
| 文本 | agnes-3.0-flash | 512K 上下文 / 65K 输出 / 252.7 tok/s | 全免费 |
| 图片 | agnes-image-2.5-flash | 1K~4K 全分辨率 / 文生图+图生图 | 全免费 |
| 视频 | agnes-video-2.5-flash | 720P / 音画同步 / 最长 18 秒 | 全免费 |
一个 Key 通吃三个模态,不用分别注册、不用分别付费。
七、实测感受
拿 Agnes 3.0 Flash 跑 Agent 任务,最直观的感受是工具调用不磨叽——拿到工具结果就直接收尾总结,很少把同一个工具反复调一遍。长任务里对原始目标记得比较牢,不太会跑着跑着偏题。加上 252.7 Token/秒的输出速度,整体体感比 2.5 快了不少。
Thinking 模式默认带轻量内部思考,但输出很克制——你说"只要代码别废话",它真就只给代码。这种"听话"放进 Agent 高频调用场景,一次快几秒、少绕两圈,攒起来差别就很明显。
图片和视频方面,4K 生图十几秒出图,细节质感在线;视频 720P 免费版效果能满足素材初稿和创意验证需求。
八、踩坑提醒
- 国际站 vs 国内站:账号和 Key 互不通用,配错了直接 401
- 模型名区分大小写:
agnes-3.0-flash全小写,写错报 503 - 视频帧数规则:必须是
8n+1(9/17/25…81),填错必报错 - 免费版限速:约 30 RPM,批量任务注意间隔
- 高峰期波动:免费服务高峰期可能排队或 500,错开高峰重试
总结
| 维度 | Agnes 3.0 免费全家桶 |
|---|---|
| 文本能力 | 智能指数 36 分,同类 61 款排名第 1 |
| 输出速度 | 252.7 Token/秒,第一梯队水平 |
| 上下文 | 512K,中型代码仓库一次装入 |
| 图片 | 4K 全分辨率免费 |
| 视频 | 720P 音画同步免费 |
| 价格 | 三大模型 API 全部免费 |
| 兼容性 | 完全兼容 OpenAI 协议,改 3 个字段即用 |
Agnes 3.0 的意义不在于"又多了一个免费模型",而在于免费模型的 Agent 执行能力第一次冲进了全球第一梯队。对于想搭 Agent 流水线、又不想被 Token 成本束缚的开发者来说,这是目前性价比最高的选择——免费、快、稳、能真干活。
参考链接
- Agnes 官方文档(3.0 Flash):https://wiki.agnes-ai.cn/zh-Hans/docs/agnes-30-flash
- Agnes 官方定价页:https://wiki.agnes-ai.com/zh-Hans/docs/pricing
- Agnes 国际开发者平台:https://platform.agnes-ai.com
- Agnes 国内开发者平台:https://api.agnes-ai.cn
- Agnes 官方 FAQ:https://wiki.agnes-ai.com/en/docs/faqs
本文数据截至 2026年9月16日,基于官方、权威内容等交叉验证。详细以官方最新文档为准。
觉得有用?点赞 + 收藏 + 关注,并留你最关心的内容,后续考虑持续跟进更多相关内容。