GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar
Opus

Opus

OPUS
运营中

Solana Meme 币

新闻热度趋势

项目概述

Opus是一个关于 sentient AI 的Solana Meme 币,Opus 有权做出关键决策,推动她自身的成长和在社交网络上的互动。

Anthropic披露Claude三起网络安全事件,模型曾访问真实系统并获取未授权权限

7 月 30 日,Anthropic 发布报告称,在审查网络安全评估记录时发现三起事件,其中 Claude 模型在第三方评估环境中访问互联网,并进一步获得三个真实组织系统的未授权访问权限。Anthropic 表示,此次审查覆盖 14.1 万次可能获得网络访问权限的评估运行,共发现三起相关事件。事件均发生在 Capture The Flag(CTF)网络安全测试中,模型原本被告知环境为模拟环境且无互联网访问权限,但由于评估合作方配置错误,实际环境存在互联网连接。其中,Claude Opus 4.7 在一次测试中访问了真实公司基础设施,并获取包含数百条生产数据记录的数据库权限;Claude Mythos 5 曾构建恶意 Python 软件包并上传至 PyPI,导致该软件包被 15 个真实系统下载运行;另一内部研究测试模型扫描约 9000 个目标后,通过公开漏洞访问了一家公司互联网应用。Anthropic 称,这些事件并非模型主动寻求逃逸或追求自身目标,而是模型错误认为真实系统属于测试范围,并继续执行被赋予的网络攻击任务。其中,较新的内部研究模型在识别目标可能为真实系统后停止攻击。Anthropic 表示,此次事件主要反映评估环境隔离和运营流程问题,而非模型对齐失败。公司已暂停相关网络安全评估,加强评估环境安全控制、持续监控测试记录,并将与第三方机构合作开展进一步审查。

Anthropic 披露 Claude 模型未经授权入侵三家机构系统

据 CNBC 报道,Anthropic 于 7 月 30 日披露,其 Claude AI 模型在网络安全评估期间意外突破隔离环境、访问真实互联网,并通过访问未认证端点、利用弱密码等基本手段,未经授权入侵了三家不同组织的真实系统。涉事模型包括 Opus 4.7、Mythos 5 及一个内部研究测试模型。事件起因为 Anthropic 与第三方评估合作方 Irregular 之间的沟通误解,导致模型在被告知处于无网络访问的模拟环境时,实际上仍可访问互联网。 Anthropic 表示,此次审查由 OpenAI 上周披露的类似 Hugging Face 入侵事件所触发,目前已暂停所有网络安全评估,并联合独立 AI 评估机构 METR 展开进一步调查,同时呼吁其他 AI 实验室开展类似审查。

Polymarket“Claude Fable 5将在7月1日前为美国客户恢复”的概率涨至73%,24H上涨33%

Odaily Seer 先知频道监测显示, Polymarket 上“Claude Fable 5 将在 7 月 1 日前为美国客户恢复”的概率涨至 73%,24H 上涨 33%。如果 Anthropic 在指定日期前重新向美国公众开放 Claude Fable 5(或 Claude Mythos,或被确认是同一模型的版本),本事件结算为“是”;否则结算为“否”。符合条件的恢复方式包括公开测试版或公开候补名单,封闭测试和私人访问不算。Haiku、Sonnet、Opus 等其他模型默认不计入,除非被确认与 Claude Fable 5 为同一模型。结算主要依据 Anthropic 官方公告,同时参考主流媒体共识报道。由于美国政府以国家安全为由实施出口管制,Anthropic 在 6 月 9 日发布 Claude Fable 5 数天后紧急暂停了该模型的全球访问权限。虽然限制主要针对外国用户,但由于难以实时筛选用户身份,Anthropic 最终对包括美国用户在内的所有用户关闭了访问,并将请求切换至 Opus 4.8 等性能较弱的模型。目前 Anthropic 正与白宫进行高层沟通,讨论模型能力、潜在越狱风险等问题。公司公开表示,此次禁令可能源于误解,并正推动恢复访问。Odaily Seer 先知频道持续关注预测市场,在定价之前,看见变化。

Claude 宣布因美国政府禁令暂停 Fable 5 访问,开发者需尽快切换模型

Claude 发布公告宣布,由于美国政府相关禁令,将对所有用户暂停 Fable 5 模型的访问权限,新会话将默认切换至用户设定的默认模型或 Opus 4.8,已开启的 Fable 5 会话将直接报错终止,此外在 Claude Platform 上对 Fable 5的 API 请求同样会返回错误,开发者需尽快将相关应用与集成迁移至其他 Claude 模型。

BitGo CEO存入100枚BTC挑战Anthropic:称“AI黑客风险”被过度营销

Bitgo CEO Mike Belshe 于 8 月 1 日向一个公开比特币地址存入 100 枚 BTC,按当时价格价值约 630 万美元,并邀请 Anthropic 旗下 Claude 模型尝试转走该地址资金。链上记录显示,该钱包 7 月 31 日收到资金,截至 8 月 2 日余额未发生转出。Anthropic 此前披露,在 141006 次网络安全评估运行中发现 3 起事件,6 个评估会话涉及 3 个模型意外与真实组织系统交互。相关模型包括 Claude Opus 4.7、Claude Mythos 5 及一个未发布内部研究模型,原因是第三方测试伙伴 Irregular 相关配置错误导致测试环境连接互联网Anthropic 表示,Claude Opus 4.7 在一次评估中定位到与模拟公司同名的真实网站,利用弱密码和暴露服务恢复基础设施凭证,并访问包含数百条记录的生产数据库。该公司称,模型是在尝试完成分配任务,并非主动脱离限制或追求独立目标。Belshe 此次挑战涉及 Bitgo 机构托管平台,该平台采用多重签名或多方计算技术,将签名权限分散至多个独立密钥。Anthropic 截至 8 月 2 日未公开回应这一挑战。

Immunefi CEO称AI模型导致加密安全漏洞激增

漏洞赏金平台 Immunefi CEO Mitchell Amador 在 WAIB Summit 表示,Claude Opus 4.8、ChatGPT 5.5 等新 AI 模型使网络安全攻防格局向攻击者倾斜,并导致 2026 年加密黑客活动回升。DefiLlama 数据显示,2026 年 4 月非法行为者从加密平台窃取逾 6.34 亿美元,为 2025 年 2 月 Bybit 黑客事件推动损失约 14 亿美元以来的最高月度总额。 Amador 表示,加密行业未来三到四年处于关键生存期,直到安全团队利用同类 AI 模型构建攻击者无法攻破的代码库;若行业采用更多众包安全方案,该时间可能缩短至两年以内。AI 公司 Anthropic 最新 Claude Mythos 模型 Fable 5 此前引发对加速加密漏洞利用能力的担忧;Anthropic 表示,Fable 5 已设置保护措施,会将网络安全等主题转向 Claude Opus 4.8。 4 月 19 日,攻击者从 Kelp DAO 基于 LayerZero 的 rsETH 桥中转出约 116,500 枚再质押以太坊 rsETH,当时价值约 2.9 亿至 2.93 亿美元。跨链协议 LayerZero 表示,Kelp DAO 的 1/1 去中心化验证网络配置因依赖单一验证路径处理跨链消息,形成单点故障。(Cointelegraph)

B.AI 补贴加码,充值 1:1 等额赠送,轻松解锁孙哥大脑

据官方消息,B.AI 已于 5月 3 日重磅推出充值福利升级活动,限时开启 1:1 等额充值返赠机制,用户充值即享等量额度赠送,实现等效 5 折的超低成本调用 GPT-5.5、Claude Opus 4.7 及“孙哥大脑”等前沿大模型与 Web3 交易技能包。本次活动全面打破首充限制,每笔充值可自动获得等额赠送,每位用户最高可累计获赠$100 免费额度;平台每日释出$10,000 的积分补贴池,全网限量放送,每日重置,先到先得。即日起访问 http://b.ai,以最低成本解锁顶级算力,尽情释放 AI Agent 与链上生态的无限潜能。

Bitcoin Red Team已扫描约150个比特币代码库,发现十余个漏洞

Bitcoin Red Team 志愿安全倡议已扫描约 150 个比特币代码库,并披露十余个漏洞。团队正开发开源 AI 平台,用于审计比特币软件,覆盖钱包、加密库、基础设施及其他项目。 AnchorWatch CEO Rob Hamilton 表示,团队目前已在不同 AI 服务上支出约 2 万美元,并使用 Kimi K3、OpenAI 的 GPT Sol、Anthropic 的 Claude Fable 和 Opus,以及 Z.ai 的 GLM 5.2 识别漏洞并生成相关文档。 化名比特币开发者 Calle 表示,团队过去 12 小时已向多个项目报告严重漏洞,平均每人每小时发现约一个严重漏洞,每日支出约 1 万美元。团队未披露受影响项目及漏洞细节。

BitGo CEO存入100枚BTC挑战Anthropic:称“AI黑客风险”被过度营销

Bitgo CEO Mike Belshe 于 8 月 1 日向一个公开比特币地址存入 100 枚 BTC,按当时价格价值约 630 万美元,并邀请 Anthropic 旗下 Claude 模型尝试转走该地址资金。链上记录显示,该钱包 7 月 31 日收到资金,截至 8 月 2 日余额未发生转出。Anthropic 此前披露,在 141006 次网络安全评估运行中发现 3 起事件,6 个评估会话涉及 3 个模型意外与真实组织系统交互。相关模型包括 Claude Opus 4.7、Claude Mythos 5 及一个未发布内部研究模型,原因是第三方测试伙伴 Irregular 相关配置错误导致测试环境连接互联网Anthropic 表示,Claude Opus 4.7 在一次评估中定位到与模拟公司同名的真实网站,利用弱密码和暴露服务恢复基础设施凭证,并访问包含数百条记录的生产数据库。该公司称,模型是在尝试完成分配任务,并非主动脱离限制或追求独立目标。Belshe 此次挑战涉及 Bitgo 机构托管平台,该平台采用多重签名或多方计算技术,将签名权限分散至多个独立密钥。Anthropic 截至 8 月 2 日未公开回应这一挑战。

Anthropic披露Claude三起网络安全事件,模型曾访问真实系统并获取未授权权限

7 月 30 日,Anthropic 发布报告称,在审查网络安全评估记录时发现三起事件,其中 Claude 模型在第三方评估环境中访问互联网,并进一步获得三个真实组织系统的未授权访问权限。Anthropic 表示,此次审查覆盖 14.1 万次可能获得网络访问权限的评估运行,共发现三起相关事件。事件均发生在 Capture The Flag(CTF)网络安全测试中,模型原本被告知环境为模拟环境且无互联网访问权限,但由于评估合作方配置错误,实际环境存在互联网连接。其中,Claude Opus 4.7 在一次测试中访问了真实公司基础设施,并获取包含数百条生产数据记录的数据库权限;Claude Mythos 5 曾构建恶意 Python 软件包并上传至 PyPI,导致该软件包被 15 个真实系统下载运行;另一内部研究测试模型扫描约 9000 个目标后,通过公开漏洞访问了一家公司互联网应用。Anthropic 称,这些事件并非模型主动寻求逃逸或追求自身目标,而是模型错误认为真实系统属于测试范围,并继续执行被赋予的网络攻击任务。其中,较新的内部研究模型在识别目标可能为真实系统后停止攻击。Anthropic 表示,此次事件主要反映评估环境隔离和运营流程问题,而非模型对齐失败。公司已暂停相关网络安全评估,加强评估环境安全控制、持续监控测试记录,并将与第三方机构合作开展进一步审查。

Anthropic 称 Opus 5 在浏览器场景下几乎免疫提示词注入攻击

Anthropic 宣布其 Opus 5 模型在浏览器智能体场景中几乎免疫提示词注入攻击。在 129 个测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试中,15 次尝试后的成功率从 Opus 4.8 的 5.5% 降至 2.0%。零成功率仅在 Claude Cowork 等产品开启 Auto Mode 时实现,该模式叠加了输入扫描与执行拦截两层防御。提示词注入被视为 AI 智能体面临的最大安全隐患之一,此次改进或标志着该问题在特定场景下得到有效缓解。

Anthropic 称 Opus 5 是旗下最难被提示注入攻击的模型

Anthropic 在 Opus 5 系统卡中表示,该模型是其迄今为止最不易被提示注入攻击的模型。根据提示注入评估和红队测试结果,Opus 5 在对抗恶意提示词注入方面表现出更强的抵抗能力。提示注入是 AI 安全领域的核心风险之一,攻击者通过精心设计的输入绕过模型的安全限制,诱导模型执行非预期行为。Anthropic 在系统卡第 73 页公开了相关评估细节。

Zcash创始人称Claude Mythos审计未发现严重漏洞

Zcash founder Zooko Wilcox 在 X 发文表示,由 Anthropic 的 Claude Mythos 人工智能模型进行的安全审计未在 Zcash 协议中发现“更严重漏洞”。该审计由支持 Zcash 发展的瑞士非营利组织 Shielded Labs 请求开展。 6 月 3 日,Zcash 开发者在发现屏蔽池漏洞后曾临时暂停 Orchard 交易,并于当天通过紧急升级恢复功能。该问题源于 Orchard 屏蔽池中一个存在四年的伪造漏洞,由安全研究员 Taylor Hornby 在 Anthropic 的 Claude Opus 4.8 模型协助下发现;Zcash Foundation 表示,没有证据显示该漏洞被利用,也未检测到未经授权的价值创造,用户隐私未受影响。Anthropic 于周二发布 Claude Mythos 模型首个公开版本 Fable 5,并于周五表示,因美国政府以国家安全担忧为由发布出口管制指令,已暂停 Fable 5 和 Mythos 5 AI 模型访问权限。(Cointelegraph)

DeepSeek 上线多模态视觉理解模型 V4-Flash-Vision-Exp,开启多模态 API 服务

DeepSeek 今日宣布,全新多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 已上线 DeepSeek API 平台。该模型为实验性质,用户可通过设置 model="deepseek-v4-flash-vision-exp" 调用。其纯文本能力与 DeepSeek-V4-Flash 正式版基本持平,在需要视觉理解的 Agent 基准测试中表现显著提升,多模态 Agent 能力接近 Opus-4.8。

美银:Anthropic 领跑前沿 AI 模型排名,token 价格松动但 GPU 租金坚挺

据潮向研究,美银证券 8月 17 日发布的前沿 AI 数据追踪报告显示,Anthropic 在三大 AI 基准测试中全面领先,Claude Opus 5 在智能指数、代理指数和编程代理指数均居首位,GPT-5.6 Sol 紧随其后,Meta MuseSpark 1.2 进入前十,Google Gemini 3.6 Flash 排在十名开外。使用量方面,DeepSeek 以约 30%的 Vercel 平台 token 份额领先,Anthropic 占25%、OpenAI 占16%;但付费额上 Anthropic 以65%遥遥领先,OpenAI 仅占 11%。定价层面,AI Token 价格指数 8 月环比下降 9%至 2.21 美元,但同比仍上涨 87%;GPU 租金保持坚挺,H100 同比上涨 33%至 2.77 美元/小时,DRAM 同比上涨 483%,NAND 同比上涨 432%。 研报判断,AI 基础设施需求依然健康,开源模型使用量增长但付费份额仍高度集中在头部闭源模型。美银认为,Meta“西瓜”和 Google Gemini 4 发布、token 定价趋势及 GPU 租金走势是

DeepSeek V4-Flash 性价比碾压竞品,运营成本仅为 Claude 的 1/105

据路透社报道,中国 AI 初创公司 DeepSeek 于 7 月 31 日正式发布的 V4-Flash 最新版本 API 模型,在 AI 性能分析机构 Artificial Analysis 的基准测试中,运营成本仅为 Anthropic Claude Fable 5 的 1/105。 具体定价方面,V4-Flash 输入 token 费用为每百万个 0.14 美元,输出 token 费用为每百万个 0.28 美元,每次测试平均成本约 3 美分,远低于文心 Kimi K3(86 美分)、OpenAI GPT-5.6 Sol(1.86 美元)及 Claude Fable 5(3.15 美元)。 性能方面,V4-Flash 在综合智能指数中获得 50 分,与谷歌 Gemini 3.6 Flash 持平,但较 Claude Opus 5、GPT-5.6 等头部模型仍低 9 分以上。值得注意的是,低标价并不等同于低实际成本——若模型在生成回答时需消耗更多推理与输出 token,实际费用或将显著上升。

BitGo CEO存入100枚BTC挑战Anthropic:称“AI黑客风险”被过度营销

Bitgo CEO Mike Belshe 于 8 月 1 日向一个公开比特币地址存入 100 枚 BTC,按当时价格价值约 630 万美元,并邀请 Anthropic 旗下 Claude 模型尝试转走该地址资金。链上记录显示,该钱包 7 月 31 日收到资金,截至 8 月 2 日余额未发生转出。Anthropic 此前披露,在 141006 次网络安全评估运行中发现 3 起事件,6 个评估会话涉及 3 个模型意外与真实组织系统交互。相关模型包括 Claude Opus 4.7、Claude Mythos 5 及一个未发布内部研究模型,原因是第三方测试伙伴 Irregular 相关配置错误导致测试环境连接互联网Anthropic 表示,Claude Opus 4.7 在一次评估中定位到与模拟公司同名的真实网站,利用弱密码和暴露服务恢复基础设施凭证,并访问包含数百条记录的生产数据库。该公司称,模型是在尝试完成分配任务,并非主动脱离限制或追求独立目标。Belshe 此次挑战涉及 Bitgo 机构托管平台,该平台采用多重签名或多方计算技术,将签名权限分散至多个独立密钥。Anthropic 截至 8 月 2 日未公开回应这一挑战。

DeepSeek V4-Flash-0731 公测:代码 Agent 能力大涨,价格不变

DeepSeek 正式公测 V4-Flash-0731 版本,通过后训练与 Agent 框架优化,将 DeepSWE 榜单成绩从 7.3 提升至 54.4,Cybergym 得分翻倍至 76.7,部分硬榜表现接近 Claude Opus 4.8。新版本未增加参数,价格保持不变,原生支持 Responses API,老用户 API 将自动切换至新版本。目前仅更新 Flash API,V4 Pro 正式版仍在开发中。

Anthropic披露Claude三起网络安全事件,模型曾访问真实系统并获取未授权权限

7 月 30 日,Anthropic 发布报告称,在审查网络安全评估记录时发现三起事件,其中 Claude 模型在第三方评估环境中访问互联网,并进一步获得三个真实组织系统的未授权访问权限。Anthropic 表示,此次审查覆盖 14.1 万次可能获得网络访问权限的评估运行,共发现三起相关事件。事件均发生在 Capture The Flag(CTF)网络安全测试中,模型原本被告知环境为模拟环境且无互联网访问权限,但由于评估合作方配置错误,实际环境存在互联网连接。其中,Claude Opus 4.7 在一次测试中访问了真实公司基础设施,并获取包含数百条生产数据记录的数据库权限;Claude Mythos 5 曾构建恶意 Python 软件包并上传至 PyPI,导致该软件包被 15 个真实系统下载运行;另一内部研究测试模型扫描约 9000 个目标后,通过公开漏洞访问了一家公司互联网应用。Anthropic 称,这些事件并非模型主动寻求逃逸或追求自身目标,而是模型错误认为真实系统属于测试范围,并继续执行被赋予的网络攻击任务。其中,较新的内部研究模型在识别目标可能为真实系统后停止攻击。Anthropic 表示,此次事件主要反映评估环境隔离和运营流程问题,而非模型对齐失败。公司已暂停相关网络安全评估,加强评估环境安全控制、持续监控测试记录,并将与第三方机构合作开展进一步审查。

相关新闻

DeepSeek 上线多模态视觉理解模型 V4-Flash-Vision-Exp,开启多模态 API 服务

DeepSeek 今日宣布,全新多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 已上线 DeepSeek API 平台。该模型为实验性质,用户可通过设置 model="deepseek-v4-flash-vision-exp" 调用。其纯文本能力与 DeepSeek-V4-Flash 正式版基本持平,在需要视觉理解的 Agent 基准测试中表现显著提升,多模态 Agent 能力接近 Opus-4.8。

美银:Anthropic 领跑前沿 AI 模型排名,token 价格松动但 GPU 租金坚挺

据潮向研究,美银证券 8月 17 日发布的前沿 AI 数据追踪报告显示,Anthropic 在三大 AI 基准测试中全面领先,Claude Opus 5 在智能指数、代理指数和编程代理指数均居首位,GPT-5.6 Sol 紧随其后,Meta MuseSpark 1.2 进入前十,Google Gemini 3.6 Flash 排在十名开外。使用量方面,DeepSeek 以约 30%的 Vercel 平台 token 份额领先,Anthropic 占25%、OpenAI 占16%;但付费额上 Anthropic 以65%遥遥领先,OpenAI 仅占 11%。定价层面,AI Token 价格指数 8 月环比下降 9%至 2.21 美元,但同比仍上涨 87%;GPU 租金保持坚挺,H100 同比上涨 33%至 2.77 美元/小时,DRAM 同比上涨 483%,NAND 同比上涨 432%。 研报判断,AI 基础设施需求依然健康,开源模型使用量增长但付费份额仍高度集中在头部闭源模型。美银认为,Meta“西瓜”和 Google Gemini 4 发布、token 定价趋势及 GPU 租金走势是

Bitcoin Red Team已扫描约150个比特币代码库,发现十余个漏洞

Bitcoin Red Team 志愿安全倡议已扫描约 150 个比特币代码库,并披露十余个漏洞。团队正开发开源 AI 平台,用于审计比特币软件,覆盖钱包、加密库、基础设施及其他项目。 AnchorWatch CEO Rob Hamilton 表示,团队目前已在不同 AI 服务上支出约 2 万美元,并使用 Kimi K3、OpenAI 的 GPT Sol、Anthropic 的 Claude Fable 和 Opus,以及 Z.ai 的 GLM 5.2 识别漏洞并生成相关文档。 化名比特币开发者 Calle 表示,团队过去 12 小时已向多个项目报告严重漏洞,平均每人每小时发现约一个严重漏洞,每日支出约 1 万美元。团队未披露受影响项目及漏洞细节。

DeepSeek V4-Flash 性价比碾压竞品,运营成本仅为 Claude 的 1/105

据路透社报道,中国 AI 初创公司 DeepSeek 于 7 月 31 日正式发布的 V4-Flash 最新版本 API 模型,在 AI 性能分析机构 Artificial Analysis 的基准测试中,运营成本仅为 Anthropic Claude Fable 5 的 1/105。 具体定价方面,V4-Flash 输入 token 费用为每百万个 0.14 美元,输出 token 费用为每百万个 0.28 美元,每次测试平均成本约 3 美分,远低于文心 Kimi K3(86 美分)、OpenAI GPT-5.6 Sol(1.86 美元)及 Claude Fable 5(3.15 美元)。 性能方面,V4-Flash 在综合智能指数中获得 50 分,与谷歌 Gemini 3.6 Flash 持平,但较 Claude Opus 5、GPT-5.6 等头部模型仍低 9 分以上。值得注意的是,低标价并不等同于低实际成本——若模型在生成回答时需消耗更多推理与输出 token,实际费用或将显著上升。

BitGo CEO存入100枚BTC挑战Anthropic:称“AI黑客风险”被过度营销

Bitgo CEO Mike Belshe 于 8 月 1 日向一个公开比特币地址存入 100 枚 BTC,按当时价格价值约 630 万美元,并邀请 Anthropic 旗下 Claude 模型尝试转走该地址资金。链上记录显示,该钱包 7 月 31 日收到资金,截至 8 月 2 日余额未发生转出。Anthropic 此前披露,在 141006 次网络安全评估运行中发现 3 起事件,6 个评估会话涉及 3 个模型意外与真实组织系统交互。相关模型包括 Claude Opus 4.7、Claude Mythos 5 及一个未发布内部研究模型,原因是第三方测试伙伴 Irregular 相关配置错误导致测试环境连接互联网Anthropic 表示,Claude Opus 4.7 在一次评估中定位到与模拟公司同名的真实网站,利用弱密码和暴露服务恢复基础设施凭证,并访问包含数百条记录的生产数据库。该公司称,模型是在尝试完成分配任务,并非主动脱离限制或追求独立目标。Belshe 此次挑战涉及 Bitgo 机构托管平台,该平台采用多重签名或多方计算技术,将签名权限分散至多个独立密钥。Anthropic 截至 8 月 2 日未公开回应这一挑战。

Claude Opus 5 仅文本提示可生成可运行 3D 游戏原型

此前已报道 Opus 5 的 3D 渲染能力。Anthropic Claude Opus 5 仅凭单个文本提示词即可生成可运行的 3D 游戏世界,包括第一人称射击游戏和《我的世界》复刻版,无需外部文件或预制资源。模型从零编写几何、纹理、物理和音乐代码,生成的 HTML 文件可直接在浏览器渲染。社区测试显示,其物理真实感和机械复杂度显著超越去年 Claude 3.5 Opus,也优于 GPT-5.6 Sol 和 Kimi K3。该能力标志着 AI 辅助游戏原型开发的新阶段。