
新智元报道
最近一周,我们被一件事惊到了。
OpenAI在上周四宣布:彻底关停ChatGPT Pro $200套餐。原因就是,Astra导致的算力需求太高,OpenAI承受不了了。
的确,很多开发者都有这样的体验,看着后台疯狂燃烧的Token,感觉钱包在滴血——试错成本太高了!
如今,模型的执行能力和使用成本共同影响着最终体验,我们需要的,是AI能交付一个完整任务。
好消息是,今天,一个刚刚重磅升级,且完美踩中上述所有痛点的「王炸」组合——Agnes 3.0 Flash 大模型 + AgnesCode工作台来了!
在最新的国际权威榜单中,它的综合智能水平直接挤进了第一梯队;但最不可思议的是,它的API调用,全!部!免!费!
而且,它不仅仅是一个网页对话框,它通过内置在桌面级工作台AgnesCode中,真正实现了「让AI帮你把活儿完整干完」。
到了今天,所有人最关心的问题就是:当AI开始真正参与工作,免费模型是否也能帮助用户把任务完整做好?
那我们就来看看,零成本的AI究竟能帮我们把工作效率带飞到什么程度。
一个人,一台电脑,一个免费的工程师
目前,免费的Agnes 3.0 Flash模型已经内置在了AgnesCode里。

什么是AgnesCode?
它不仅仅是个编辑器,它是Agnes AI推出的一款桌面AI工作台。
它能把你的本地项目、模型能力、Skills扩展以及MCP整合在一个工作空间里。更棒的是,它支持通过CLI用自然语言直接参与实际开发。
下面我们就实测一把。
首先,让它把一张照片,做成一间能走进去的老屋。
注意,下面这张照片,是我们让Agnes模型用自己的图像生成能力画的一副「1997年前后,中国北方城市普通人家的客厅」。

然后,我们把这张照片输入,让它根据照片中的空间关系和家具布局,复刻建模一个3D房间。
结果,AgnesCode输出的简直惊艳。
操作起来,完全就是个第一人称游戏:用WASD可以在屋里溜达,滑动鼠标后还能四处打量。


我们试着对准半空中的灯绳按了下「E」,灯竟然真的亮了,仔细看,灯泡甚至还会像老旧电灯那样微微闪烁。
接着走到大彩电前按E,屏幕瞬间爆出满屏雪花;走到冰箱前,门也真能朝外拉开。
屋里的桌椅板凳,还可以搬起来满屋子乱放,想放哪放哪,玩乱了按个R键,就能一键全部归位。
最绝的是,它居然悄悄给这个房间配齐了全套音效:拉灯绳清脆的「啪」一声、老电视刺耳的雪花噪音、拉开冰箱门时那种厚重的闷响,一应俱全。

然后我们把难度往上提一提,让它做一个真正能玩的游戏。
上学的时候,谁没在数学书的草稿纸上画过火柴人打架。
这次,我们就让它把这件事做成一款第一人称射击游戏:
用Vite + Three.js做一个可玩的第一人称射击游戏。整个世界像画在横格笔记本上:米白纸张、蓝色圆珠笔轮廓和排线阴影,敌人是红色火柴人。WASD移动,鼠标瞄准,左键射击,R换弹;提供步枪、霰弹枪和武士刀,手感要有明显区别。敌人会追击,命中有墨迹效果。显示血量、弹药和击杀数,死亡可重开。
进去第一眼,是一张横格纸。
远处的集装箱是圆珠笔勾出来的方块,画法跟当年上课走神时在笔记本上涂的一模一样。

最后,我们让它用HTML和SVG,做一只鹈鹕骑自行车的循环动画。
这个梗,圈内人都知道。起因是知名开发者Simon Willison有个执念:每出一个新的大模型,他都会测试用代码画一只骑自行车的鹈鹕。
因为鹈鹕那大嘴短腿的身材,配上自行车复杂的机械结构,简直就是测试AI空间理解能力的「照妖镜」。
这次,我们跟Agnes的新模型上点难度:让它动起来。而且要求很刁钻——
用单文件写个循环动画,鹈鹕得稳稳坐在车座上,翅膀死死扶着车把,双脚必须踩在踏板上;最关键的是,腿得跟着踏板转动自然地弯曲伸展,不能脱节。
点开它交回来的网页,我们真有点被惊到了。

画面里,车轮呼呼转,脚蹬子踩得飞起,鹈鹕的腿完美契合着机械运动的节奏。
而且,最让人觉得这个模型懂得常识的,是它自己砍掉的一个小功能。
开始它打算让鹈鹕一边骑车一边扇翅膀,过程中它意识到不对:这个跟题目里「翅膀扶住车把」的要求矛盾了。
全程没有人工干预,完全是它脑补出了物理画面,自己把逻辑漏洞堵上了。
总之,实测后的体验是,通过AgnesCode + Agnes 3.0 Flash,免费模型也开始从「陪聊机器人」走向「能真正干活的全栈工程师」。
能力够顶,而且免费
Agnes 3.0 Flash打破算力焦虑
实测完工作台,回过头来看看今天的主角Agnes 3.0 Flash。它在在AgnesCode和API中全面上线了。
在AI全面渗透电商、办公、开发的今天,一个任务往往包含多个步骤,而Agnes 3.0 Flash本次升级,就是冲着AI Coding、Agent和复杂任务工作流来的。
官方给出的价格依然十分惊喜,当前API的缓存命中输入、输入及输出Token三项现价均为$0,完全零成本。

免费的模型,智商够用吗?答案是,绝对给你惊喜!
让我们看看刚刚出炉的 Artificial Analysis 权威评测榜单。在这个强调真实工作任务、工具执行、编程和复杂推理的综合评测中,Agnes 3.0 Flash成绩亮眼。
在Artificial Analysis Index v4.3 中,Agnes 3.0 Flash获得36 分,综合智能表现已进入当前主流模型梯队。跟DeepSeek V4 Pro 0813(max)分数完全持平。

在Artificial Analysis的智能表现 × Token价格对比中,Agnes 3.0 Flash以约 0.03 美元/百万 Token 的价格进入最具吸引力区间,并位于帕累托前沿。

在开发和执行复杂Agent任务时,我们再也不用为反复修改、疯狂Debug的Token消耗而心疼了。
你可以尽情地让它试错、迭代,直到跑出完美的交付成果。
从电脑桌面到物理世界,AGH正在路上
如果你觉得免费模型加AgnesCode已经够用了,那么Agnes AI正在布的大局,可能会让你更兴奋。
目前,AgnesCode主要解决了开发者在电脑桌面的「超级工作台」问题。
但是,企业级的复杂业务呢?如何让Agent真正融入公司的审批流、知识库,甚至去控制物理世界的设备?
剧透一下:Agnes AI正在探索一款全新的Agent基础设施产品——Agnes Harness(简称AGH),并计划于9月底开源发布!
AGH的野心极大,它希望提供一套开放的Agent运行环境。
最牛的地方在于它的「从通用到专属」架构:底层Runtime是统一的,但企业可以通过引入Agnes Package(FDE),把自己的私有知识库、数据库、工作规范、验证规则封装成插件。
这意味着,未来不仅是在代码编辑器里,你的业务系统、Ai-for-Science科研场景,甚至可编程硬件,都能通过统一的方式与Agnes 3.0 Flash发生交互。
AI能力将在越来越多的真实场景中,持续、稳定地执行复杂任务。
免费AI时代,真的来了
回顾这两年的AI发展,我们见证了无数次「参数的狂欢」。
但对于真正需要用AI提效的你我来说,最让人心动的还是这句:「活儿干完了,而且不要钱!」
Agnes 3.0 Flash用AA榜单上的36分证明了自己的「智商」,又用零Token成本展现出最大的诚意。而AgnesCode把云端算力,变成了你触手可及的生产力。
当试错不再需要成本,限制你创造力的,就只剩下你的想象力了。
行动起来吧!立刻开始你的免费AI之旅。
下载AgnesCode工作台(即刻体验内置3.0 Flash):
https://agnes-ai.com/agnescode
开发者平台API接入:
https://platform.agnes-ai.com/login
编辑:Aeneas 好困