Kimi K3正式登陆AWS Bedrock
2026年9月18日,AWS宣布月之暗面(Moonshot AI)的旗舰开源模型Kimi K3在Amazon Bedrock上正式可用。Bedrock是AWS的托管模型平台,Kimi K3的加入为该平台增添了一个面向编程和知识工作负载的大型开源模型选项。
AWS表示,Kimi K3通过跨区域推理(cross-Region inference)在每一个Amazon Bedrock区域均可使用,开发者无需在特定区域单独申请即可调用。
一个拥有100万Token上下文窗口的视觉模型
Kimi K3是月之暗面迄今能力最强的旗舰模型。根据AWS和月之暗面官方的模型描述,该模型拥有2.8万亿总参数,采用混合专家(MoE)架构,在896个路由专家中每个Token仅激活16个,激活参数约1040亿。
Kimi K3原生支持视觉理解,并拥有100万Token的上下文窗口,月之暗面称其为全球首个开源的3万亿参数级别模型。
在编程能力方面,Kimi K3在Frontend Code Arena编程榜单上以1679分超越Anthropic的Claude Fable 5登顶,成为开源模型首次超越头部闭源模型的里程碑。
AWS将这款模型定位为适合长程编程会话、跨文档与图像分析以及扩展智能体工作流等场景。

首个支持显式提示缓存的开源模型
Kimi K3是Amazon Bedrock上首个支持显式提示缓存(explicit prompt caching)的开源模型。Bedrock文档规定,缓存检查点最小为1024个Token,缓存保留时间至少30分钟。AWS建议新应用使用bedrock-runtime端点,并推荐通过Chat Completions API调用Kimi K3。
对于需要处理长上下文负载的团队而言,显式缓存可以显著影响重复系统提示、代码仓库上下文和多轮智能体执行的调用成本。在同类托管推理部署中,缓存的操作价值取决于请求的复用模式,而不仅仅是上下文窗口的大小。
数据边界与安全控制
AWS明确表示,Bedrock上开源模型的推理数据保留在AWS数据边界内,不与模型提供商共享,也不用于训练底层模型。公司同时声明,推理请求启用了零数据保留和零运营人员访问。
定价结构
AWS文档列出了Kimi K3的标准档定价。全球跨区域推理的输入价格为每百万Token 3.00美元,输出价格为15.00美元,缓存读取为0.30美元,缓存写入为3.75美元。美国跨区域推理的对应价格分别为3.30美元、16.50美元、0.33美元和4.125美元。这一全球档定价与月之暗面官方API价格保持一致。
根据第三方分析机构Artificial Analysis的数据,Kimi K3单次推理的平均任务成本约为0.94美元,不到竞争对手Anthropic Claude Opus的一半。

Bedrock开源模型矩阵持续扩大
Kimi K3的加入是Bedrock持续扩充开源模型矩阵的一部分。AWS表示,自2025年以来,Bedrock已新增数十款开源模型,提供商包括DeepSeek、Google、MiniMax、Mistral AI、Moonshot AI、NVIDIA、OpenAI和Qwen。在平台能力层面,Bedrock在2026年新增了对工具调用、结构化输出、推理、流式响应以及Responses和Chat Completions API的支持。
对于正在评估长上下文负载的团队而言,Kimi K3提供了一种新的托管选项。实际使用中,任务质量、跨区域路由的延迟、缓存命中率以及总Token成本,仍需结合团队自身的代码仓库和文档工作负载进行验证。
(素材来自:月之暗面/亚马逊云服务 智算芯能前沿网综合)
本文由智算芯能前沿网编辑整理,转载请注明出处。
