亚马逊AWS调整Anthropic模型计费为按Token支付

6月30日 11:07
AWS宣布自明年起将Anthropic模型收费方式由算力转向Token,同时启动千人规模前置团队项目以加速客户AI落地应用。

亚马逊云科技(AWS)近期宣布两项重大战略调整,旨在优化大模型成本结构并深化企业级服务支持。其一是在计费模式上,针对在 AWS 平台上运行的 Anthropic 系列模型,将原有的按计算实例运行时长付费方式,变更为按 Token(词元)数量进行结算。该政策调整预计于明年正式生效,意在更精准地反映大模型实际运行时的资源消耗与业务负载情况。其二是在服务交付层面,AWS 决定组建全新的前置驻场工程师部门,初期规划投入10亿美元资金,派遣多支专业团队直接进入客户企业内部办公。

关于计费模式的具体细节,新方案将依据模型处理的文本单元数量进行收费,而非传统的算力时间租赁。这一变革源于当前云计算服务对 AI 成本核算精细化管理的需求,特别是对于高频调用或长文本处理场景,按 Token 计费能更准确地匹配业务产出与资源投入。由于亚马逊在自有 Nova 系列模型的竞争力上尚未完全满足内部需求,目前其 Alexa 购物助手、Kiro 编程工具及 Quick 职场助手等核心业务仍大量依赖 Anthropic 的模型支持。因此,收入分享机制的改变将直接构成 AWS 支出端的新变量。与此同时,亚马逊高管明确表示,公司正致力于提升自研模型能力,目标是在明年推出达到行业前沿水平的自有产品,以降低对外部厂商的依赖程度。

在人员部署方面,AWS 前沿人工智能工程与服务副总裁弗朗西斯卡·巴斯克斯指出,新部门将分批派遣5至6组工程师进驻客户现场,每组驻场周期设定为45天。这些工程师具备综合业务能力,负责协调客户内部协作、编写可投入生产的代码,确保 AI 模型在实际业务流程中产生价值。该计划预计新部门员工规模将达到数千人,人员来源包括外部招聘与内部调岗。尽管亚马逊自去年10月以来已累计裁撤超过3万名企业岗位员工,但前置驻场工程师业务被视为行业少数增长领域之一。此前,Palantir 已在此类服务模式上深耕十余年,Salesforce、谷歌云及 Anthropic 等竞争对手也相继推出了类似服务。根据领英报告数据,2023至2025年间市场对同类岗位的需求呈现爆发式增长,预计增幅达42倍,显示出企业对于 AI 落地实施支持的强烈渴求。