Anthropic刚刚发布了Claude Opus 5.5,该模型于9月22日推出,被介绍为运行成本低于Opus 5的模型。这家实验室宣称,在默认设置下,其典型工作负载可节省约40%。这一使用估算并不意味着每个token的价格出现了统一下调,而这一细微差别会改变人们的解读。
有两种节省叠加在一起。公布的价格为每百万输入token 4美元、每百万输出token 20美元,而Opus 5为5美元和25美元,即单价低20%。缓存读取可以复用已经处理过的上下文,其价格从每百万0.50美元降至0.20美元。Anthropic还补充说,该模型每项任务消耗的token更少,整体收益主要靠的是这种节制,而不是价格。
当一家品牌方比较各种工具,用来分析其档案或准备系列文件时,弄清节省来自何处很重要。账单变轻,可能源于价格、完成的工作量,或是对上下文更好的复用。这几种原因对组织的牵涉各不相同。
此外,这家开发方提出了一项在这类页面上并不多见的保留意见:在这样的能力水平上,模型之间的分数差距对真实差异的说明力下降。如果榜单已无法分出高下,比较就必须在别处进行,也就是在品牌方自己的工作场域。
一次有用的评估,应当从几份有代表性的文件出发,每份都附有预期结果,以及会使其无法采用的错误清单。随后,除供应商开出的金额外,还要统计返工次数、复核时间和缺失的来源。问题于是变得具体:哪种工具生成的文件能让团队真正使用,其完整成本又是多少?一个便宜但耗时验证的结果并不会消除这笔开支,只是把它转移到经验最丰富的人身上,也就是时间最昂贵的那些人。
因此,这一发布带来了降低技术支出的可能。它对品牌方的价值,仍有待在其自身的工作中加以确立,并须符合其对证据、保密和传承的要求。
Cette publication est également disponible en :
