同时关联该项目与事件的快讯
据英国金融时报,随着中国企业继续缩小与美国顶级人工智能实验室之间的差距,字节跳动正在训练一款 AI 模型,其规模可能接近 Anthropic 最先进的 Mythos 系统。据三名知情人士透露,这家中国科技巨头目前正处于训练一款超大规模模型的早期阶段,该模型参数量可能达到 10 万亿级别,是目前中国已发布最大模型月之暗面旗下 Kimi K3 模型的约三倍。
据 CNBC 报道,欧盟委员会于本周日正式获得对 AI 模型的调查、限制及罚款权力,作为 2024 年《欧盟人工智能法案》分阶段落地的最新进展。根据新规,欧盟委员会可要求 AI 公司在欧洲公开发布模型前提交评估,并有权限制其欧盟市场准入,违规企业最高将面临 1500 万欧元或年营业额 3% 的罚款(取较高者)。 新规适用于所有在欧盟境内提供通用 AI 模型的企业,无论其总部位于何处,且非欧盟企业须在欧盟境内指定授权代表。Anthropic、OpenAI 及谷歌均在新规覆盖范围之内。目前,欧盟已就 Anthropic 旗下 Mythos 模型寻求访问权限数月,并就旗下 AI 模型引发的网络攻击问题与 OpenAI 和 Anthropic 展开谈判。
Bitgo CEO Mike Belshe 于 8 月 1 日向一个公开比特币地址存入 100 枚 BTC,按当时价格价值约 630 万美元,并邀请 Anthropic 旗下 Claude 模型尝试转走该地址资金。链上记录显示,该钱包 7 月 31 日收到资金,截至 8 月 2 日余额未发生转出。Anthropic 此前披露,在 141006 次网络安全评估运行中发现 3 起事件,6 个评估会话涉及 3 个模型意外与真实组织系统交互。相关模型包括 Claude Opus 4.7、Claude Mythos 5 及一个未发布内部研究模型,原因是第三方测试伙伴 Irregular 相关配置错误导致测试环境连接互联网Anthropic 表示,Claude Opus 4.7 在一次评估中定位到与模拟公司同名的真实网站,利用弱密码和暴露服务恢复基础设施凭证,并访问包含数百条记录的生产数据库。该公司称,模型是在尝试完成分配任务,并非主动脱离限制或追求独立目标。Belshe 此次挑战涉及 Bitgo 机构托管平台,该平台采用多重签名或多方计算技术,将签名权限分散至多个独立密钥。Anthropic 截至 8 月 2 日未公开回应这一挑战。
7 月 30 日,Anthropic 发布报告称,在审查网络安全评估记录时发现三起事件,其中 Claude 模型在第三方评估环境中访问互联网,并进一步获得三个真实组织系统的未授权访问权限。Anthropic 表示,此次审查覆盖 14.1 万次可能获得网络访问权限的评估运行,共发现三起相关事件。事件均发生在 Capture The Flag(CTF)网络安全测试中,模型原本被告知环境为模拟环境且无互联网访问权限,但由于评估合作方配置错误,实际环境存在互联网连接。其中,Claude Opus 4.7 在一次测试中访问了真实公司基础设施,并获取包含数百条生产数据记录的数据库权限;Claude Mythos 5 曾构建恶意 Python 软件包并上传至 PyPI,导致该软件包被 15 个真实系统下载运行;另一内部研究测试模型扫描约 9000 个目标后,通过公开漏洞访问了一家公司互联网应用。Anthropic 称,这些事件并非模型主动寻求逃逸或追求自身目标,而是模型错误认为真实系统属于测试范围,并继续执行被赋予的网络攻击任务。其中,较新的内部研究模型在识别目标可能为真实系统后停止攻击。Anthropic 表示,此次事件主要反映评估环境隔离和运营流程问题,而非模型对齐失败。公司已暂停相关网络安全评估,加强评估环境安全控制、持续监控测试记录,并将与第三方机构合作开展进一步审查。
昨日,月之暗面最新开源 AI 模型 Kimi K3 模型发布,在 Frontend Code Arena 测试网站中以 1679 分位居第一,超越 Claude 旗下 Fable 5 模型。针对 K3 模型,Artifacial Analysis 进行了相关测评,随后埃马斯克再次为月之暗面 Kimi 模型点赞,称 K3 模型的基准性能令人印象深刻。今年 3 月,Kimi 发布《𝑨𝒕𝒕𝒆𝒏𝒕𝒊𝒐𝒏 𝑹𝒆𝒔𝒊𝒅𝒖𝒂𝒍𝒔:重新思考深度方向聚合》研究论文时曾获马斯克称赞:“Kimi 的研究工作令人印象深刻。”此前,其还称智谱旗下 GLM 模型或于 2027 年 Q1 超越 Claude Mythos 模型(即 Fable 5),对此智谱创始人唐杰回应称“不需要那么久”。
美国商务部已批准 OpenAI 广泛推出 GPT-5.6 模型。知情人士表示,OpenAI 预计将于本周正式大范围发布 GPT-5.6,此前已完成额外安全测试,并与美国政府官员举行多轮会议。此前,OpenAI 仅获准向政府批准的部分机构分阶段发布 GPT-5.6,这与 Anthropic 的 Mythos 和 Fable 模型此前受到的发布限制类似。(Axios)
“白毛股神”Serenity 发文表示,自己在 2023 年首次使用 ChatGPT 时曾认为大语言模型在编程能力上“表现很差”,但三年后相关技术已发生质变。以 Mythos 为代表的现代网络安全与 AI 系统已具备“类武器级”能力,并认为当前行业正在进入关键“拐点阶段”,即人形机器人与自动化技术正在逼近大规模替代人类劳动的临界点。Serenity 称,尽管外界常质疑人形机器人目前无法完成如管道维修、电力布线等复杂任务,但技术演进方向已非常明确,未来数年将持续突破。包括 VC 与大型科技公司在内的市场参与者已开始调整战略,部分企业内部计划通过机器人替代大量人力以降低运营成本,并提及此前关于亚马逊(Amazon)通过机器人减少数十万岗位招聘的相关传闻。Serenity 认为,医疗等强监管行业、超高专业技能岗位以及依赖人类情感连接的服务领域,或仍具备一定抗替代性,但整体趋势仍指向“劳动结构重构”。随着中美在前沿技术领域竞争升级,人形机器人与自动化或将进入国家级技术竞赛阶段,并认为中国在部分领域已处于领先位置。
PPP 预测市场工具监测显示, Polymarket 上“Claude Fable 5 将在 7 月 1 日前为美国客户恢复”的概率涨至 97%,24 小时上涨 71%由于美国政府以国家安全为由实施出口管制,Anthropic 已在 6 月 9 日发布 Claude Fable 5 数天后紧急暂停了该模型的全球访问权限。最新消息显示,Anthropic 已收到通知,美国商务部已解除对 Claude Fable 5 和 Mythos 5 的出口管制。并将开始恢复访问权限。Odaily Seer 先知频道持续关注预测市场,在定价之前,看见变化。
在 Anthropic 受出口限制影响、其先进模型全球可用性受限之际,亚洲多家 AI 企业正在加速填补市场空白。中国网络安全公司 360 Security Technology 据称推出 AI 工具“Tulongfeng”,宣称可与 Anthropic 的高端模型“Mythos”正面对标;与此同时,其更受限版本“Fable 5”也在相关出口管制范围之内。同一周,日本 AI 初创公司 Sakana AI 发布新模型“Fugu”,名称取自河豚,定位为面向智能体(agent)的前沿模型。公司表示,该模型在能力上可与 Fable 5 及 Mythos Preview 相抗衡,并支持通过 API 协调多模型调用,实现智能体编排。Sakana AI 方面强调,此次发布与美国出口限制时间点“纯属巧合”,但产品官网仍明确主打“在无出口管制风险下提供前沿能力”。公司联合创始人 David Ha 表示,未来 AI 发展将从单一大模型竞争转向“模型编排系统”,并强调“访问权可能随时消失,分布式智能是应对集中化风险的现实对冲”。另一方面,中国 360 创始人周鸿祎则将 AI 漏洞检测能力视为“国家战略资产”,并警示所谓“单向透明”风险,即部分主体可能独占高级安全能力。据报道,此次美国对 Anthropic 先进模型实施的出口限制已持续约两周。在这一背景下,亚洲厂商正在加速推出本地替代方案,尽管部分企业仍强调美国模型在亚洲市场的重要性,但区域性 AI 生态的分化趋势已开始显现。(TechCrunch)
科技博主@synthwavedd 发文称,多款备受关注的前沿 AI 模型已调整发布时间表。其中,原定于近期发布的 GPT-5.6 已推迟至 7 月中旬,谷歌 DeepMind 则因对模型当前表现不满意,取消了 Gemini 3.5 Pro 原计划于 6 月底的发布安排。与此同时,OpenAI 新一代双向语音模型 Bidi 的上线准备工作正在 ChatGPT 平台推进,最快或于本周向用户开放。报道称,Bidi 支持全双工语音交互,允许用户与模型同时发声并随时打断对话,被视为现有语音模式的重要升级。此外,Anthropic 已向部分企业客户开放 Claude Sonnet 5 的提前体验权限。由于旗舰模型 Mythos 5 与 Fable 5 的发布进展放缓,Claude Sonnet 5 被视为 Anthropic 缓解竞争压力的阶段性产品方案。
OpenAI 推出 GPT-5.5-Cyber 网络安全模型,在 CyberGym 基准测试中得分为 85.6%,超越被美国政府下线的 Anthropic Mythos 5。
OpenAI 宣布升级 Daybreak 网络防御工具链,并正式推出面向网络安全防御场景的 GPT-5.5-Cyber 完整版模型。在评估 AI 智能体复现已知漏洞能力的 CyberGym 基准测试中,GPT-5.5-Cyber 取得 85.6%的单模型成绩,超过 GPT-5.5 的 81.8%以及 Anthropic Mythos 5 的 83.8%。OpenAI 表示,随着 AI 显著提升漏洞发现效率,网络安全领域的核心瓶颈正从“发现漏洞”转向“自动修复漏洞”。为此,公司同步升级 Codex Security 插件,支持开发者在 Codex 环境内自动分析漏洞并生成修复补丁。自今年 3 月预览版发布以来,Codex Security 已累计扫描超过 3000 万次代码提交,并自动确认修复 50 万个安全缺陷。新版本还支持 CodeQL 查询集成及 SARIF 标准文件导出。此外,OpenAI 联合 Trail of Bits、HackerOne 等机构发起“Patch the Planet”开源安全项目,为 cURL、Go 等 30 多个主流开源项目提供 ChatGPT Pro 订阅及 API 额度支持,并由安全专家团队人工验证补丁质量。Daybreak 合作伙伴计划方面,Palo Alto Networks 与 Wiz 等安全厂商已率先接入相关能力。
据 AI 观察者 Andrew Curran 透露,Anthropic 已完成性能更强的新版 Mythos 模型训练,但目前尚不清楚该模型将被命名为 Mythos 5.1 还是 Mythos 6,也不排除仅用于内部研发以加速后续模型开发。此外,随着 Anthropic 合作伙伴服务平台出现“claude-sonnet-5”模型标识,开发者社区普遍猜测 Claude Sonnet 5 或将于本周正式发布。
Odaily Seer 先知频道监测显示,Polymarket 上“Claude Fable 5 将在 6 月 26 日前为美国客户恢复”的概率降至 41%,24 小时下跌 16%。由于美国政府以国家安全为由实施出口管制,Anthropic 已在 6 月 9 日发布 Claude Fable 5 数天后紧急暂停了该模型的全球访问权限。最新消息显示,Anthropic 高管已向美国商务部长卢特尼克提交提案,并且承诺将与白宫展开更紧密的合作,并努力解决导致其强大的“Mythos”和“Fable”模型遭限制的安全隐患。知情人士透露,在持续进行的整改谈判中,Anthropic 承诺将在未来更迅速地解决任何安全问题,但目前尚无彻底解决问题的确切时间表。另一位知情人士表示,Anthropic 联合创始人兼首席计算官汤姆·布朗以及公共政策主管莎拉·赫克正在主导与特朗普政府官员的谈判,但 Anthropic 和商务部的代表均未回应置评请求。Odaily Seer 先知频道持续关注预测市场,在定价之前,看见变化。
据彭博社报道,Anthropic 在早期选定的一批企业仍可继续访问其 AI 模型“Mythos”的预览版本,尽管此前有美国政府相关禁令已要求其全面关闭。据知情人士透露,包括银行与科技公司在内的多家机构,正通过名为“Project Glasswing”的测试计划使用 Mythos Preview。
Odaily Seer 先知频道监测显示, Polymarket 上“Claude Fable 5 将在 7 月 1 日前为美国客户恢复”的概率涨至 73%,24H 上涨 33%。如果 Anthropic 在指定日期前重新向美国公众开放 Claude Fable 5(或 Claude Mythos,或被确认是同一模型的版本),本事件结算为“是”;否则结算为“否”。符合条件的恢复方式包括公开测试版或公开候补名单,封闭测试和私人访问不算。Haiku、Sonnet、Opus 等其他模型默认不计入,除非被确认与 Claude Fable 5 为同一模型。结算主要依据 Anthropic 官方公告,同时参考主流媒体共识报道。由于美国政府以国家安全为由实施出口管制,Anthropic 在 6 月 9 日发布 Claude Fable 5 数天后紧急暂停了该模型的全球访问权限。虽然限制主要针对外国用户,但由于难以实时筛选用户身份,Anthropic 最终对包括美国用户在内的所有用户关闭了访问,并将请求切换至 Opus 4.8 等性能较弱的模型。目前 Anthropic 正与白宫进行高层沟通,讨论模型能力、潜在越狱风险等问题。公司公开表示,此次禁令可能源于误解,并正推动恢复访问。Odaily Seer 先知频道持续关注预测市场,在定价之前,看见变化。
白宫针对 Fable 5 与 Mythos 5 模型发布紧急下架指令后,引发 Anthropic 员工对公司 IPO 计划的担忧。报道称,管理层在收到 90 分钟限时下架指令后面临应对压力,部分员工对下架理由在“国家安全”与“安全漏洞”之间变化感到困惑,并担心相关监管压力可能影响公司上市进程。(纽约时报)
Anthropic 高级管理人员今日将在华盛顿与特朗普政府官员会面,试图解决围绕其最新 AI 模型的监管争议。事件起因于美国政府上周五向 Anthropic 下达出口管制指令,要求其立即暂停 Fable 5 与 Mythos 5 模型,并禁止“任何外国国民(无论在美境内或境外)”访问,理由涉及“国家安全相关威胁”。Anthropic 随后为合规起见,已在全球范围内关闭相关模型访问权限。据知情人士透露,美国政府此前未提前披露具体风险,仅在周五下午电话通知,并随后发出正式限制函。此次行动发生在模型发布仅数日之后。Fable 5 与 Mythos 5 基于其 Claude Mythos Preview 演进版本,被定位为具备高级代码漏洞识别能力的前沿模型,并曾在发布前与政府机构进行安全测试。部分功能此前已被限制在企业与特定用户范围内使用。值得注意的是,此次事件发生在 Anthropic 与美国政府关系持续紧张的背景下。今年早些时候,美国国防部曾将其列为“供应链风险”,导致部分国防承包商被禁止使用其技术,相关诉讼仍在进行中。Anthropic 方面表示,该争议或源于“潜在但非通用的越狱风险”,并强调若以此标准审查,可能对整个前沿模型行业的发布节奏造成系统性影响。目前双方仍在协商恢复模型访问的可能性。(CNBC)
美国政府对 Anthropic 模型 Fable 5 / Mythos 5 的出口管制与访问限制,部分源于亚马逊的网络安全研究以及 AWS CEO Andy Jassy 与白宫的沟通推动。据悉,亚马逊提交的研究指出,通过一系列提示词测试,研究人员能够诱导 Fable 5 输出可能被用于网络攻击的敏感信息,从而引发安全担忧,随后 Andy Jassy 将相关发现上报美国政府层面,促使白宫采取进一步限制措施,包括禁止外国用户访问该模型。同时,前美国商务部官员 Kate Koren 透露,白宫对 Anthropic 的既有政策立场也可能影响了此次决策判断,因为 Anthropic 在 AI 安全边界问题上与白宫存在分歧,包括拒绝将模型用于大规模监控或致命自主武器系统。尽管双方在今年早些时候一度缓和并扩大合作,但此次事件可能再次加剧双方紧张关系。(华尔街日报)
美国总统科学与技术顾问委员会联席主席 David Sacks 发文回应 Anthropic“安全争议”引发管制,他表示已就当前 Anthropic 相关情况与多方进行了沟通,并总结称当前事件的核心在于其新发布模型 “Fable”(对应 Mythos 类模型的商业版本)所引发的安全争议。尽管 Anthropic 在公开声明中称该漏洞“不严重”,但美国政府及测试方均不认同这一判断,认为其已足以影响模型安全性,甚至涉及“网络武器可操作性”风险。David Sacks 进一步批评称,Anthropic 过去一直强调“安全优先”,但此次更倾向维持消费者版本持续上线,而非优先修复安全问题。此事不应与此前其他国防或监管争议混为一谈,并称美国政府仍认可 Anthropic 技术能力,当前问题“本可迅速解决,主动权在 Anthropic 一方”。