#AI
Claude 两款新模型代号泄露,未经官宣
Anthropic 两款未公开的 Claude 早期访问模型代号在第三方应用和 Discord 社区曝光:claude-marshmallow-eap 与 claude-melon-eap。目前没有任何官方发布——无 model card、无发布日期、无官方回应,全部信息来自开发者截获与早期测试者的零散反馈。
社区反馈集中在两点:一是**性能**,测试者认为 Marshmallow 综合表现优于 Melon,且 Marshmallow 的对话体验比当前 Opus 5 更自然;二是**算力消耗**,有测试者称两款模型在作答前消耗海量思考 token,多次触发最大 token 上限。两款模型据称均未达到 Fable 级别能力标准。
💡 为什么值得看两个 EAP 代号在 API 流量与 Discord 被截获,社区实测称 Marshmallow 对话体验优于 Opus 5,但一切尚未获 Anthropic 确认。
这次泄露出了什幺
- 两个标识均在第三方应用与 Discord 中出现,其中一处拼作 claude-mashmallow-eap,被社区视为「真实转录而非伪造」的迹象
- 「-eap」是 Anthropic 的早期访问预览后缀,上次同类标识出现后数周内就有正式模型落地
- Marshmallow 对话体验优于 Opus 5、综合优于 Melon 的说法来自早期测试者的 X 反馈,属单方评测,无基准数据
- 两款均未达 Fable 级,社区对 Opus 5.1 / Sonnet 5.1 / Haiku 的归因纯属推测,Anthropic 从未确认过 Honeycomb 与 Opus 5 的对位关系
- 思考 token 消耗与 57 次 API 调用的说法仅见于单一中文转述,未见第二独立源交叉验证
查证
来源与可信度
延伸阅读
e2 的补料源补充了 Honeycomb EAP 在 7 月初的完整时间线,用它对照可判断这两款新模型「数周内落地」的猜想到底成色几何
e1 是唯一提到「高频触发 max-tokens 上限」的源,若想核实这套慢思考机制是否真能拔高推理质量,需回到 X 原始测试推文看一手数据