探所 Curio 再探再报 了解探所 →
#AI

Claude 两款新模型代号泄露,未经官宣

Anthropic 两款未公开的 Claude 早期访问模型代号在第三方应用和 Discord 社区曝光:claude-marshmallow-eap 与 claude-melon-eap。目前没有任何官方发布——无 model card、无发布日期、无官方回应,全部信息来自开发者截获与早期测试者的零散反馈。

社区反馈集中在两点:一是**性能**,测试者认为 Marshmallow 综合表现优于 Melon,且 Marshmallow 的对话体验比当前 Opus 5 更自然;二是**算力消耗**,有测试者称两款模型在作答前消耗海量思考 token,多次触发最大 token 上限。两款模型据称均未达到 Fable 级别能力标准。

💡 为什么值得看两个 EAP 代号在 API 流量与 Discord 被截获,社区实测称 Marshmallow 对话体验优于 Opus 5,但一切尚未获 Anthropic 确认。

这次泄露出了什幺

  • 两个标识均在第三方应用与 Discord 中出现,其中一处拼作 claude-mashmallow-eap,被社区视为「真实转录而非伪造」的迹象
  • 「-eap」是 Anthropic 的早期访问预览后缀,上次同类标识出现后数周内就有正式模型落地
  • Marshmallow 对话体验优于 Opus 5、综合优于 Melon 的说法来自早期测试者的 X 反馈,属单方评测,无基准数据
  • 两款均未达 Fable 级,社区对 Opus 5.1 / Sonnet 5.1 / Haiku 的归因纯属推测,Anthropic 从未确认过 Honeycomb 与 Opus 5 的对位关系
  • 思考 token 消耗与 57 次 API 调用的说法仅见于单一中文转述,未见第二独立源交叉验证

查证

来源与可信度

· 两个身份标识 claude-marshmallow-eap 和 claude-melon-eap 出现在第三方开发者应用与 Discord 社区中 [1][2]
· 这两个标识采用「食物名 + EAP」命名,属于早期访问预览格式,但 Anthropic 未发布任何 model card、发布日期或官方回应 [1][2]
· 社区实测反馈称 Marshmallow 综合表现优于 Melon,且 Marshmallow 的对话体验被认为优于当前的 Opus 5 [1][2]
· 两款模型据称均未达到 Fable 级别能力标准,开发者据此猜测它们可能分别对应 Opus 5.1 与 Sonnet 5.1(或 Haiku 迭代),但归因属社区推测 [1][2]

延伸阅读

Honeycomb 先例 · link.baai.ac.cn
e2 的补料源补充了 Honeycomb EAP 在 7 月初的完整时间线,用它对照可判断这两款新模型「数周内落地」的猜想到底成色几何
思考 token 实测 · 36kr.com
e1 是唯一提到「高频触发 max-tokens 上限」的源,若想核实这套慢思考机制是否真能拔高推理质量,需回到 X 原始测试推文看一手数据
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store