亚马逊免费送出决策模型:智能体最廉价的调用不再打表
AWS本周免费推出Strands Decider 2B;同一周,OpenAI预览了自家的决策模型,TypeSafe的融资谈判也浮出水面。智能体循环中最廉价的调用,标价刚刚归零。
Vincent Jiang · 3 min read
自制复刻版成了亚马逊的免费产品
AWS杰出工程师马克·布鲁克看到TypeSafe的Jev后,照自己的思路复刻了一版12。这个自制决策器一度登顶Jevbench同规模模型的排行榜1,亚马逊随后将其打磨完善,于10月1日发布,定名Strands Decider 2B:基座为Qwen3.5-2B,参数约20亿,按Apache 2.0协议开源,既无托管API,也不按次收费2。它读取智能体的状态,返回打分后的选项和置信度数值12。
智能体的高频步骤正走下计费表
它瞄准的正是高频环节:路由这条请求、挑选那件工具、审查那个动作2。AWS曾用本地一块RTX 3090测试该模型早前的第18个检查点,结果为每次决策中位耗时106毫秒;正式发布版本自身的延迟并未公布2。
Jev于9月15日上线,定价为每百万token输入0.042美元,输出token免费;相比之下,TypeSafe列出的大语言模型(LLM)输入价格区间为0.20美元至10美元3。一次黑客松测试中,审查智能体一次运行中的全部动作,在Jev上花费2.94美元,在前沿模型上花费372美元4。没有人专门为此另立一张按token计价的价目表。
一百万输入token:前沿模型最高10美元,Jev 4美分,AWS免费
Data
| Value | |
|---|---|
| 前沿LLM输入 | $10/M |
| 最便宜LLM输入 | $0.2/M |
| TypeSafe Jev | $0.04/M |
| Strands Decider 2B | free |
免费的权重,照样在烧某人的GPU
亚马逊自己公布的图表显示,该模型在同等规模的公开模型中位列第二,排在Mapika的决策模型之后;只有在公开完整训练配方的模型中,它才排名第一。Jev本身并未出现在图表中,因此双方并无正面对比数据2。AWS没有给出单次请求的运行成本估算;而对Jev模型权重闭源的TypeSafe,每10亿输入token收费42美元23。免费的是标价,不是成本。
花一千美元就能造出克隆版,排行榜仍偏向Jev
9月29日,OpenAI在DevDay开发者大会上预发布了Decisions API,萨姆·奥尔特曼承诺,将把该实验室的Luna模型收窄到预设选项,以此换来极致速度4。Jev上线后的两周内,数十个克隆版相继问世12;布鲁克估计,造一个的成本是“几百或几千美元”1。但战绩榜不这么看:Jev 1.13在25场《星际争霸》对战中赢下21场,开源的OpenJev战绩为0胜9负,Jev最便宜的一场经过验证的胜局只花了0.016美元6。
又快又便宜很容易,护城河是数据
“如果你想要真正又快又便宜,那就用骰子,”TypeSafe CEO迪奥戈·阿尔梅达说。“难的是智能”,而他的护城河,是模型背后的合成数据4。他说,眼下这些克隆版“更像是一帮搞机器学习的人想实现一个酷炫的架构”1。
资本仍在为这条护城河争论。9月15日,TypeSafe完成4000万美元种子轮融资,估值2亿美元5;而据The Information报道,正在洽谈的新一轮融资规模在10亿美元以上,估值越过100亿美元大关,若按此成交,将是种子轮估值的50倍7。就连功劳的归属也有争议:融资消息曝光后,Latent Space的swyx抱怨,一段YouTube视频裁掉了自家标志、且未注明出处,还附上一句“请支持小创作者”89。
免费的决策,带来的是需求而非颠覆
Jev以经济学家威廉·斯坦利·杰文斯(William Stanley Jevons)命名,依据是TypeSafe的论断:“智能成本每下降一个数量级,就能解锁数量级更多的用例”3。若这一论断成立,亚马逊的免费决策模型带来的算力销量只增不减:更多智能体将在仍有人付费租用的硬件上,做出更多决策。
谜底要看两个日子。一是OpenAI为Decisions API公布的定价——该API仍处于小范围预览阶段,费率尚未公布4;二是TypeSafe本轮融资能否以100亿美元以上的估值收官7。决策若按token计价,计价器就仍在走字;决策定价若趋近于零,这笔押注便得到印证。
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



