探所 Curio 再探再报 了解探所 →
#AI

Anthropic 招 Safeguards 工程师,年薪最高 48.5 万美元

Anthropic 的招聘页上多了一个 Staff+ Software Engineer, Account Creation 岗位,工作地点在旧金山、纽约或西雅图,年薪区间 **$320,000–$485,000**。岗位挂在 Safeguards 团队下,做的是模型监控、滥用阻断和用户保护这类工作。

具体职责写得很实:搭建监测 API 合作方异常行为的系统,必要时**自动执行处罚**,并把结果汇总到内部看板给分析师人工复核;同时把滥用模式回流给研究团队,在训练阶段加固模型。候选人需要熟练 Python 与 TypeScript,有 integrity、spam、欺诈或滥用检测经验者优先。

💡 为什么值得看安全岗 $32 万–48.5 万,还能看 Anthropic 如何用工程管模型。

查证

来源档案

Anthropic Greenhouse 招聘页

Anthropic 官方招聘系统的一手岗位页,含职责、薪资区间与任职要求。

官方一手源,岗位信息与薪资区间可直接采信;页面无发布时间,无法判断该岗是添加还是长期开放。

延伸阅读

Safeguards 团队的执法闭环 · job-boards.greenhouse.io 3 分钟
职责把检测、自动处罚、人工复核和训练回流串成一条链,能看出 Anthropic 的滥用治理实际靠工程系统而非纯政策。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中