AWS Bedrock GovCloud 上线 OpenAI GPT OSS 与 NVIDIA Nemotron 模型
AWS 宣布在 GovCloud(美国)区域上线一批前沿开源模型:OpenAI 的开放权重模型 gpt-oss-120b 和 gpt-oss-20b,以及 NVIDIA Nemotron 家族的 Nano 9B v2、Nano 12B v2、Nano 30B 和 Super 120B。这批模型主要面向美国国防、情报及政府承包商,处理情报分析、任务规划、合规审查等高敏感场景。 推理全部在 GovCloud 隔离区域内完成,基础设施由美国公民在本土运营。支撑这套服务的是 AWS 新一代推理引擎 Mantle,设计上遵循「零操作员访问」原则——AWS、客户、模型供应商都无法访问客户的推理提示词或生成结果。GovCloud 的合规框架覆盖 FedRAMP High、DoD SRG Impact Level 2/4/5,以及 ITAR 和 CJIS。 用户可通过两个端点调用模型:OpenAI 兼容的 bedrock-mantle 端点(支持 Chat Completions 和 Responses API),以及原生 bedrock-runtime 端点(支持 Converse 和 InvokeModel API,带 Guardrails 等 Bedrock 内置能力)。推理支持单 Region(us-gov-west-1)和跨 Region 路由,覆盖 GovCloud 东西两个区域。除 Reserved 套餐外,Standard、Priority、Flex 三个服务等级均已开放。 将 OpenAI 和 NVIDIA 的开放权重模型引入严格合规的政府隔离云,是开源模型进入国家安全场景的一个标志性节点——零信任架构加上可独立审计的开放权重,让政府机构在性能与合规之间有了新的平衡点。