#AI
DeepSeek 首次公开 Agent 训练沙盒 DSec
DeepSeek 在知乎独家发布长文,首次系统阐释支撑 DeepSeek-V4 全部训练、评测与数据预处理的沙盒基础设施 DSec。
从 DeepSeek-V4.1 起,Agent 轨迹执行逻辑迁出 GPU 训练 Pod,部署在可被抢占的 GPU 资源池之外,任务被抢占后执行状态保留并可从中断处继续。生产数字:单分片约 160 台服务器、3 万个 CPU 内核、250 TB 内存,日服务约 300 万个沙盒,峰值并发超 38 万;8192 容器集中创建从 60 多分钟压到约 35 分钟。DeepSeek 承认安全边界仅缓解部分问题。
💡 为什么值得看DSec 承载 V4.1 全部 Agent 沙盒,单分片日服务 300 万沙盒。
查证
来源档案
量子位(转载 DeepSeek 知乎长文)
科技媒体转载,正文为 DeepSeek 知乎独家技术长文全文
属官方一手内容的转载,事实以 DeepSeek 自述为准;文中 arXiv 编号未给出,未能独立核对论文页,性能数字均为厂商自报。
延伸阅读
抢占恢复如何保住 Agent 状态,是 Agent RL 训练工程的通用难题,这段设计对做训练基础设施的人最有用。
90% 沙盒平均 CPU 用量不足申请量 5%、超卖超 50 倍,virtio-pmem 与 DAMON 的实测收益可迁移到自建沙盒。