#AI
Simon Willison 实测 smolvm 作不可信代码沙箱
Simon Willison 让 **Claude Fable 5**(运行于 Claude Code for web)独立完成了一次沙箱调研:把 smolvm 当作执行用户提交的不可信 Python/JavaScript 代码的安全边界,考察 CPU/RAM 限制、禁网、指定文档访问等能力。
Claude Code for web 容器是 Firecracker 客户机、缺 /dev/kvm,无法嵌套虚拟化,于是代理改用 GitHub Actions runner 跑真实测试。结果:离线镜像、禁网执行、资源与超时限制、存储配额、只读输入/可写输出挂载、--unprivileged 均按预期工作,冷启动约 0.6–1.5 秒、热执行约 50ms。完整测试数据见原文仓库。
💡 为什么值得看Claude Code 沙箱实测数据,是 Agent 工具链实用参考。
查证
来源档案
Simon Willison 博客
独立研究员一手实测博客,基于自己 GitHub research 仓库的测试记录
一手实验笔记,可信度高;测试由 agent 执行,结论未做第三方交叉验证
延伸阅读
仓库里的 run-tests.sh 与 workflow 展示了沙箱各项限制的具体验证方法,能直接复用