Amazon Raises Prices on Key AI Cloud Service(2026-07-07)
如果你正在用Amazon Web Services(AWS)跑AI模型,或者计划在云端部署大语言模型,那么有个不太好的消息:AWS最近悄然上调了其核心AI服务——Amazon Bedrock的部分定价。
涨价幅度有多大?
据AWS官方更新,自2026年第二季度起,Amazon Bedrock上最受欢迎的模型系列之一(Anthropic Claude 3.5 Sonnet)的按需推理价格上调了约12%。具体来说:
- 输入Token价格:从每百万Token $3.00 涨至 $3.36
- 输出Token价格:从每百万Token $15.00 涨至 $16.80
虽然看似“只涨了十几美分”,但对于每天调用数百万次的企业级用户来说,成本增幅可能相当可观。例如,一家中型电商客服公司,每天处理约500万Token的推理请求,按30天计算,月度额外支出将增加约$2,700。
为什么涨价?
AWS官方给出的理由包括:
- 底层GPU计算资源(如NVIDIA H100、B200)的持续短缺
- 模型训练与推理能耗成本上升
- 增值服务(如模型微调、知识库集成)的维护投入增加
但行业观察人士指出,这更像是云计算巨头在全球AI竞争加剧背景下的集体调价行为——Google Cloud和Azure此前也已对部分AI服务进行类似调整。
企业如何应对?
面对涨价,不要急于转投其他平台,先尝试以下策略:
1. 优化调用方式
- 批量推理:将非实时请求合并为批处理任务,AWS对批量API有额外折扣(约30-40%)。
- 模型蒸馏:如果精度要求不高,尝试将大模型(如Claude 3.5)的知识蒸馏到更小的模型,可大幅降低Token消耗。
2. 探索替代模型
AWS Bedrock也支持多个开模型(如Llama 3、Mistral)和自研模型(Amazon Nova)。关键对比数据:
- Llama 3.2 90B价格仅为Claude 3.5 Sonnet的60%,在聊天和代码生成任务上表现接近。
- 对于简单的文本分类或摘要,使用Amazon Nova Micro成本可再降低40%。
3. 对冲成本
与AWS签订预留容量合同(1年或3年),可锁定当前价格并享受15-25%折扣。尤其适合长期、稳定的AI工作负载。
行动号召
别让涨价吃掉你的AI预算。 立即做三件事:
- ✅ 登录AWS Cost Explorer,查看上月Bedrock的实际消耗与支出。
- ✅ 测试至少一个替代模型(如Llama 3或Amazon Nova),评估性能损失是否在可接受范围内。
- ✅ 联系你的AWS客户经理,询问是否有针对老客户的折扣或信用额度。
记住:在云端,成本控制能力就是竞争力。今天花1小时优化,明天可能省下数万。
免责声明: 本文内容基于公开信息整理,仅供参考,不构成任何投资或商业决策建议。AWS定价可能随时调整,请以AWS官网最新公告为准。建议企业在作出任何服务变更前,进行充分的成本与性能测试。