发生了什么
亚马逊云科技 9 月 18 日通过官方博客宣布,月之暗面(Moonshot AI)的旗舰模型 Kimi K3 已在 Amazon Bedrock 正式可用。按官方说明,Kimi K3 是首个参数规模达到 2.8 万亿的开放权重模型,原生具备视觉能力,上下文窗口为 100 万 token,官方口径下相对上一代 Kimi K2 的扩展效率提升约 2.5 倍。模型结构上采用混合专家设计,每个 token 激活 896 个专家中的 16 个,属于典型的稀疏激活路线。
- 总参数 2.8 万亿,每 token 激活 16 / 896 个专家,权重使用 MXFP4、激活使用 MXFP8,从监督微调阶段起引入量化感知训练。
- 100 万 token 上下文窗口 + 原生视觉,面向跨大型代码仓库的长程编码会话、含扫描件与截图的多文档分析,以及需要持续上下文的智能体工作流。
- 是 Amazon Bedrock 上首个支持显式提示缓存的开放权重模型,复用同一前缀上下文时可降低延迟与输入成本。
- 通过跨区域推理调用,全球配置文件 global.moonshotai.kimi-k3 比地理配置文件便宜约 10%,美国区配置文件 us.moonshotai.kimi-k3 可满足数据驻留要求。
需要澄清的一点:这不是模型首发
Kimi K3 本身并非本周新发布的模型。月之暗面已于今年 7 月 16 日通过自家 Kimi 应用、桌面端、命令行工具与 API 首发,完整开权重随后在 7 月 27 日放出。本次的真正变化是接入方式:此前企业如需使用,只能走月之暗面自有端点或自行托管;现在可以在既有的 Bedrock 托管环境中调用,并沿用平台统一的访问、加密与审计控制。这种区分对判断该新闻的时效价值很重要,也避免了把平台集成误读为模型发布。
企业采购视角
对已把工作负载放在 Bedrock 上的团队来说,接入新模型不需要额外调整安全姿态,这在选型决策中的权重通常高于模型本身的跑分。AWS 说明,与其他开放权重模型一致,客户数据在 AWS 数据边界内处理,不共享给模型提供方,也不用于训练底层模型;推理请求默认启用零数据保留,零操作员访问则避免 AWS 运维人员接触提示词与补全内容。调用侧支持 OpenAI 兼容的 Responses 与 Chat Completions API,以及 Bedrock 原生的 Invoke 与 Converse API。
这一动作也延续了 Bedrock 对开放权重模型的持续投入。自 2025 年以来,该平台陆续接入来自 DeepSeek、Google、MiniMax、Mistral AI、Moonshot AI、NVIDIA、OpenAI 与 Qwen 的数十个开放权重模型;2026 年新增的工具调用、结构化输出、推理、响应流式输出以及 Responses / Chat Completions 接口,均以平台能力而非单模型集成的方式提供,新模型上架即可直接复用。
厂商口径与已知限制
- 2.5 倍扩展效率提升、参数规模等关键指标均出自模型方与平台方自身说明,尚无平台方给出的独立基准。
- 月之暗面在技术说明中提到,模型在保留思考历史的模式下训练,若智能体框架未把历史思考内容回传,生成质量可能不稳定。
- 模型侧重长程任务,在指令含糊时可能做出用户预期之外的决策,需要在系统提示中给出更明确的行为约束。
- 第三方榜单口径不一:Artificial Analysis 智能指数将其列为 189 个受跟踪模型的第四名,而厂商自身评估中其整体表现仍落后于 Claude Fable 5 与 GPT-5.6 Sol。
综合来看,这条新闻对国内企业的实际意义是渠道而非能力:国产旗舰开源模型借助全球云渠道出海,与云厂商的收入分成可能成为开源模型变现的一条新路径,而采购方获得了在不改变数据边界前提下调用前沿开源权重的选项。

