发布时间:2026/8/28 22:10:35
Claude两个新模型实测流出,空间推理封神,算力直接榨干了 Claude空间推理封神昨天刚刚曝出的Claude 两款新模型——棉花糖和甜瓜今天已有实测出现了有人实测后发现两款新模型在3D强化学习和建筑空间布局上性能强到可怕。另外它们对算力的吞噬也十分疯狂。在给出答案前它们会消耗海量的「思考token」Thinking Tokens进行深度逻辑推理甚至屡次逼近系统的使用上限从这款模型看Claude正在进化为具备「慢思考」、深度空间物理推理能力的下一代 AI 巨兽。One-Shot 拿下3D强化学习与建筑布局有人实测后给出评价Anthropic真的在疯狂推进3D强化学习。建筑物的空间布局简直好得令人发指而且这一切都是一步到位One-Shot生成的要知道对于LLM空间想象力一直是个死穴。让AI理解一个 3D 房间中桌椅的物理坐标关系、重力法则或者规划一个拥有复杂动线和承重结构的建筑群布局简直难如登天。但这次Claude 的「棉花糖」和「甜瓜」似乎跨越了这道鸿沟。它们能够直接理解并生成复杂的3D坐标和空间关系。而且实测中发现它们的建筑布局极其优秀表示新模型在处理拓扑学、几何学和物理约束时性能也很强大。并且它们是One-Shot输出不需要人类反复调整prompt去修正错误模型经过深度的内部思考后一次性就能输出完美的3D场景数据。这背后隐藏着巨大的商业和产业价值。想象一下未来的游戏开发者只需要用自然语言描述「帮我生成一个中世纪风格的要塞包含三个防御塔和一个隐藏的地下通道」Claude就能直接输出完美的3D模型代码或布局参数。建筑师可以直接让AI根据地形和光照条件生成几十种符合力学结构的初步布局方案。元宇宙、工业数字孪生、自动驾驶仿真环境的构建……这一切都将因为这种强大的 3D 生成能力而被彻底重塑棉花糖与甜瓜的双重暴击昨天全网都被棉花糖和西瓜刷屏了。这次曝光的两款模型内部代号分别为claude-marshmallow-eap棉花糖和claude-melon-eap甜瓜。这种「食物EAP」的命名规则延续了他们在今年7月短暂测试过的 claude-horchata-eap欧恰塔一种墨西哥饮料的传统。这两款模型到底是从哪里冒出来的据开发者从 API 流量记录中截获的数据显示在8月21日的 00:45-00:57Z 期间claude-marshmallow-ht-eap 的 ID 在 API 流量中被高频调用了 57 次随后它在 Claude Code 的模型列表中以「Custom model」的身份赫然出现并达到惊人的100万 Token 超长上下文窗口。虽然目前这两款模型还没有第一方 API 端点似乎仅限于红队测试人员或内部核心人员使用但早期的零星测试反馈已经足够炸裂。「棉花糖」 的综合能力被认为略强于「甜瓜」。在日常对话和逻辑交互中「棉花糖」的体验甚至比目前的 Opus 5 还要好对话显得更加自然、宜人。尽管它们目前的表现似乎还在 Anthropic 顶级的「Fable」级别之下但它们到底是传说中的 Opus 5.1Sonnet 5.1还是全新的 Haiku 迭代现在还没有定论。算力吞噬者疯狂的「思考token」不仅如此多位测试者都发现了一个极其反常的现象这两个新模型在使用时对算力的消耗达到了极其疯狂的地步一位测试者在推文中惊呼「我注意到这两个模型的一个共同点它们使用了海量的思考token以至于我在测试时多次直接触发了 max-tokens最大token数的上限」什么是「思考token」为什么它如此重要在过去的大模型交互中AI 往往像是一个「快言快语」的应答者根据概率分布逐字逐句地瞬间生成答案。而Claude 的新一代模型彻底改变了这一逻辑。在最终给出答案之前模型会在后台生成大量的「隐形」Token用来进行极其深度的自我推演、思维链构建和逻辑试错。这种「不计成本」的计算力倾注释放出了一个极其强烈的信号 Anthropic 正在暗中攻克 AI 深度推理的瓶颈这也印证了此前行业内的猜测——大模型的竞争正在从「训练阶段的算力堆叠」向「推理阶段的算力消耗」转移。当 Claude 开始疯狂「思考」到触碰上限时它所输出的答案质量将形成对传统模型的降维打击。疑似紧急救火Opus 5 的「复仇之战」这两款神秘模型的突然泄露时机也很微妙。仅仅在不到一个月前的 2026 年 7 月 24 日Anthropic 刚刚发布了万众瞩目的旗舰模型 Opus 5。在此之前6月30日发布的 Sonnet 5 曾广受好评。然而Opus 5却惨遭滑铁卢。有开发者在X上无情嘲笑「Opus 5 的负面评价实在太严重了以至于 Anthropic 不得不立刻推出两个新模型来试图取代它……笑死我了。」确实Opus 5 似乎没能满足用户对「跨代际提升」的期待。对于急于上市Anthropic 来说这无疑是一次重大打击。因此「棉花糖」和「甜瓜」在这个节骨眼上被曝出引发了外界的无限遐想。猜想一Opus 5.1 的绝地反击。许多人认为这两个与 Opus 5.1 紧密关联的模型正是 Anthropic 针对 Opus 5 缺陷进行紧急回炉重造后的「威力加强版」。通过引入强大的「思考token」机制强行拔高模型的逻辑天花板。猜想二新一代 Sonnet / Haiku 的突袭。也有测试者认为考虑到其惊人的速度和性价比它们可能是 Sonnet 或 Haiku 的更新版毕竟它们并未被冠以顶级的「Fable」称号。但无论是哪种情况Anthropic 显然已经坐不住了。他们正在疯狂加快迭代速度甚至不惜将极度消耗算力的前沿模型直接下放测试。X开发者们已经按捺不住激动「接下来的几周到几个月将会变得极其有趣」棉花糖和甜瓜能否一雪Opus 5的前耻让Anthropic再赢一局原文链接Claude两个新模型实测流出空间推理封神算力直接榨干了-36氪

相关新闻

2026/8/28 22:10:35

终于懂了!PaperXie查重不对标知网定稿|是超大优势不是缺点✅

很多同学之前误会太深!误以为PaperXie查重无法等同于知网、维普学校定稿系统是缺陷,实则恰恰相反——这是PaperXie独有的核心优势,也是它最护学生、最合规、最不容易翻车的关键原因。 市面上很多查重工具故意虚假标榜“100%对标学校定稿系统…

2026/8/28 22:51:03

动态规划实战:从蓝桥杯“修路”题解析双序列对齐与状态机DP

1. 项目概述:从一道国赛真题看动态规划的实战拆解“修路”这个题目,乍一看平平无奇,不就是修条路嘛。但当你点开第十三届蓝桥杯JavaB组国赛的H题,看到那串输入数据和问题描述时,很多朋友的第一反应可能是头皮发麻。这道…

2026/8/28 22:51:03

跨越鸿沟的基石:论“系统构想”与架构师的早期介入

在软件工程和系统开发的漫长周期中,“构想”阶段往往是最容易被忽视,却又最致命的一环。图片中明确指出:系统构想是指系统开发人员与用户之间的共同协议。 这不仅是一个概念,更是项目成功的“锚点”。它打破了传统“乙方闭门造车,甲方验收时惊呆”的僵局,将双方拉到了同一…

2026/8/28 22:51:03

需求分析的核心内容与关键特性解析

需求分析作为软件工程与系统开发中承上启下的核心环节,其质量直接决定了项目最终能否成功交付。结合图 14-3 与图 14-4,我们可以从“需求分析应该考查/包含哪些内容”以及“高质量需求分析应具备哪些特点”两个维度,全面理解这一过程。 一、 需求分析考查的内容(基于图14-…

2026/8/28 22:46:03

电柜空间里的能量战争:04 柜门缝隙:最容易被忽略的高频泄漏口

第四篇 柜门缝隙:最容易被忽略的高频泄漏口 —— 为什么1毫米缝隙,能毁掉整个控制系统? 开篇:那条从未被放在心上的裂痕 某汽车焊装车间,一台运行多年的机器人控制柜突然“性情大变”。 EtherCAT随机掉站、编码器频繁报警、无线扫码枪失联、触摸屏偶发死机……故障极…

2026/8/28 16:16:17

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/28 16:16:21

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/28 16:16:22

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/28 0:00:34

2026学术工具专业测评|Paperxie全维度性能实测报告[特殊字符]

2026年国内高校毕业论文审核体系全面升级,重复率查重AIGC人工智能检测双检机制正式常态化落地,多所高校明确执行“双项一票否决”制度,重复率超标或AI生成痕迹不达标,均直接取消答辩资格。随着抽检力度加大、学术规范要求升级&…

2026/8/28 0:00:34

凭什么稳居论文工具顶流[特殊字符]Paperxie综合实力深度全解析

2026年论文双检内卷严重,市面上AI论文工具层出不穷,但大多只是单一功能凑数、模板化严重、双检高风险、套路收费。 在一众同质化工具里,Paperxie能长期稳居行业顶流、成为应届生公认毕业神器,从来不是靠营销,而是靠实…

2026/8/28 0:00:34

2026论文工具深度测评|为什么Paperxie是目前最稳的学术工具✅

2026高校论文查重AIGC双检严查常态化。 市面上绝大多数AI论文工具依旧存在明显短板:模板感重、AI痕迹超标、改写毁逻辑、收费套路多、查重不准、格式适配差。 在全网工具普遍“偏科”的现状下,Paperxie凭借全维度均衡实力脱颖而出,成为适配…

2026/8/28 16:16:48

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/28 16:16:50

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/28 11:06:45

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…