月之暗面(Moonshot AI)的Kimi K3,正式在Amazon Bedrock上线。

这不是一个普通的模型上架公告。2.8万亿参数——这是目前已知最大的开放权重(open-weight)模型,没有之一。而它现在可以通过AWS的企业基础设施直接调用,受到AWS数据边界的保护,推理数据不会回流给Moonshot AI。

什么是「开放权重」,为什么重要

开放权重与开源模型的区别在于:开源允许你看到训练代码和数据,开放权重只是允许你下载和使用模型权重,但通常不公开完整训练细节。

Kimi K3属于开放权重模型。这意味着任何人、任何机构都可以部署它,无需向月之暗面支付API费用,也无需依赖其服务稳定性。

在Bedrock上,这个优势被放大:你可以在AWS数据边界内运行K3,推理请求留在你自己的云环境,不离开AWS,满足数据主权和合规要求。这对医疗、金融、政府等受监管行业尤为关键。

K3的技术规格

月之暗面称K3是其迄今最强模型,以下是关键指标:

  • 参数规模:2.8万亿参数(全球首个开放权重模型达到此规模)
  • 上下文窗口:100万token(约750,000词,可以装下一本完整小说+大量代码库)
  • 原生视觉能力:支持图片输入,无需单独视觉模块
  • 扩展效率:相比K2提升约2.5倍——同等计算预算下性能更高

尤其值得一提的是显式Prompt Caching支持——这是K3在Bedrock上的独家特性(其他Bedrock开放权重模型尚未支持)。Prompt Caching允许将重复使用的上下文(如系统提示、文档背景、代码库)缓存起来,后续调用不需要重新处理,可以显著降低延迟和成本。

为什么AWS如此重视开放权重

AWS对开放权重模型的投资节奏正在加速。2025年以来,Bedrock陆续接入了来自DeepSeek、Google、MiniMax、Mistral AI、月之暗面、NVIDIA、OpenAI、Qwen的数十个模型。

这背后有一个清晰的策略逻辑:AWS不押注单一模型赢家,而是把自己打造成「模型中立」的企业AI基础设施。用户选择在Bedrock上运行什么模型,不影响AWS收取算力、存储、安全和工具链的费用。

更重要的是,平台能力(tool calling、structured output、reasoning、streaming等)作为基础设施而非模型特性提供。K3上线即可使用这些功能,无需额外集成。

月之暗面的全球化野心

Kimi K3登陆Bedrock,是月之暗面第一次将其旗舰模型以「企业级合规」的方式送达全球用户。

此前,国际用户使用Kimi的主要渠道是其官方API或直接下载权重自行部署。通过Bedrock,企业可以在不改变现有安全架构的前提下接入K3——这对那些因数据主权顾虑而对中国AI模型持谨慎态度的机构来说,是一个重要的门槛降低。

月之暗面计划于2026年9月发布首个开放权重模型(K3),这个时间节点与Bedrock上线几乎同步,绝非巧合。

从技术看竞争格局

2.8万亿参数的规模,意味着什么?

做个对比:Meta Llama 4最大版本约为4000亿参数;Qwen 3最大开放版本约为2350亿参数。K3的参数量是它们的10倍以上

当然,参数量不等于能力。MOE(混合专家)架构可以让2.8万亿参数中的大部分在单次推理时保持「休眠」,实际激活的参数可能只有其中一小部分。但在代码生成、长文档理解、多步推理等需要深度上下文的任务上,这个规模优势往往能直接转化为性能优势。

开放权重模型的竞争格局,正在因为K3的出现而被重新校准。


来源:AWS Machine Learning Blog,2026年9月18日