探所 Curio 再探再报 了解探所 →
#AI

SageMaker 支持 Nemotron 3 无服务器微调

AWS 将 SageMaker 无服务器模型定制扩展到 NVIDIA Nemotron 3 系列,首批支持 Nano(30B 总参,3B 激活)和 Super(120B 总参,12B 激活)。该系列采用 Mamba-Transformer 混合专家架构,原生支持 1M token 上下文,企业可借助 SageMaker 无需配置 GPU 集群、按使用量付费完成微调。

微调路径覆盖三种技术:监督微调(SFT)、可验证奖励强化学习(RLVR)和 AI 反馈强化学习(RLAIF)。用户可在 SageMaker Studio 图形界面或 Python SDK 中上传 JSONL 数据、设置超参数并启动任务,训练指标自动接入 MLflow 追踪。

💡 为什么值得看AWS 上可监督微调与强化学习 Nemotron 3,无需管理 GPU 集群,降低专属模型开发门槛。

查证

来源档案

AWS Machine Learning Blog

AWS 官方技术博客,分步讲解新功能使用方法。

一手官方源,功能已上线,细节可直接采信。

延伸阅读

完整教程 · aws.amazon.com 约 15 分钟
从数据准备到微调、评估的端到端实操指南,含 RLVR 奖励函数定制说明
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store