据 TechCrunch 报道,AI 语音模型公司 Fish Audio 宣布完成 5000 万美元种子轮融资,由 Coreline Ventures和 Capital Today 领投,359 Capital、Parable、Play Time 等机构参投。公司表示,目前其开源及托管模型累计用户已超过 800 万,年经常性收入达到 2100 万美元。
波兰创立的语音 AI 公司 ElevenLabs 发布 Music v2,该模型可在同一音轨中切换曲风、按前奏、主歌、副歌等段落生成歌曲,并支持对指定片段进行局部重绘。Music v2 现已上线 ElevenMusic 和 ElevenCreative,ElevenAPI 的访问目前通过销售团队提供早期入口。 Stability AI 发布 Stable Audio 3.0,包含 Small SFX、Small、Medium 和 Large 四个模型,其中三个变体在 Hugging Face 开放权重。该系列基于授权数据训练,Medium 支持生成最长 6 分 20 秒音轨,Large 仅通过 Stability AI API 提供。 ElevenLabs 已与 Believe、Kobalt 和 Merlin 达成授权协议,Stability AI 已与 Warner Music Group 和 Universal Music Group 建立合作。Suno 在 2025 年 11 月估值达 24.5 亿美元,年度经常性收入超过 3 亿美元,约有 1 亿用户,日均生成约 700 万首歌曲。
据 Cryptopolitan 报道,韩国金融监督服务(FSS)已启动为期三个月、预算约 1.19 亿韩元的欺诈退款系统重建工程。此次升级旨在配合今年 3月 31 日修订的《电信欺诈损害赔偿法》——该法案将于 10月 1 日正式生效,正式将虚拟资产纳入"受损财产"及"可退款财产"范畴。 新系统将支持按代币类型及数量计算赔偿金额,并以资金被冻结时的韩元价值作为参考基准,同时具备拆解多账户混合诈骗资金的能力。Upbit、Bithumb、Coinone、Korbit及 GOPAX 等主要交易所届时须承担与银行同等的反诈骗及受害者救济义务,包括核查交易目的、监控可疑资金及冻结涉嫌账户。
据韩联社报道,韩国科学技术信息通信部宣布,通过第二次 ICT 监管沙盒快速处理专家委员会书面审议,批准 4 项服务获得实证特例资格。其中,三星电子与国立科学调查研究院联合申请的"声纹识别移动端语音诈骗检测服务"最受关注——该服务将经 AI 训练的语音诈骗识别模型内置于手机端 App,可实时提醒用户疑似诈骗来电;此前因诈骗犯声纹属个人信息、未经当事人同意不得使用,此次特例打破了这一限制。
微软已将拟人化聊天机器人 Mico 从 Copilot 语音功能中撤下,转移至 Learn Live 学习中心充当「导师」。支持页面称,Mico 积累的交互经验正塑造 Copilot 未来方向,且 Copilot 语音交互功能依然保留。Mico 于 2025 年 10 月推出,默认在语音模式启用,曾内置点击变 Clippy 的彩蛋。
据 Cryptopolitan 报道,韩国金融监督服务(FSS)已启动为期三个月、预算约 1.19 亿韩元的欺诈退款系统重建工程。此次升级旨在配合今年 3月 31 日修订的《电信欺诈损害赔偿法》——该法案将于 10月 1 日正式生效,正式将虚拟资产纳入"受损财产"及"可退款财产"范畴。 新系统将支持按代币类型及数量计算赔偿金额,并以资金被冻结时的韩元价值作为参考基准,同时具备拆解多账户混合诈骗资金的能力。Upbit、Bithumb、Coinone、Korbit及 GOPAX 等主要交易所届时须承担与银行同等的反诈骗及受害者救济义务,包括核查交易目的、监控可疑资金及冻结涉嫌账户。
字节跳动 Seed 团队发布 SeedRealtime,一款原生音视频全双工大模型,已上线豆包 App。该模型将音频、视频和文本统一在端到端架构中,并行处理感知、理解、决策与表达,并将轮次切换内化到模型内部,取代外部语音活动检测器。字节内部人工评估显示,其节奏问题相比级联架构减半,但未发布技术报告、参数规模、开源权重或 API。
千问 APP和 PC 端功能上新,推出思考研究、定时任务、办公助理、智能体广场、语音通话等多项新功能,同时支持阿里最新旗舰模型 Qwen3.8-MAX。上述功能所有用户均可免费使用。
科技博主@synthwavedd 发文称,多款备受关注的前沿 AI 模型已调整发布时间表。其中,原定于近期发布的 GPT-5.6 已推迟至 7 月中旬,谷歌 DeepMind 则因对模型当前表现不满意,取消了 Gemini 3.5 Pro 原计划于 6 月底的发布安排。与此同时,OpenAI 新一代双向语音模型 Bidi 的上线准备工作正在 ChatGPT 平台推进,最快或于本周向用户开放。报道称,Bidi 支持全双工语音交互,允许用户与模型同时发声并随时打断对话,被视为现有语音模式的重要升级。此外,Anthropic 已向部分企业客户开放 Claude Sonnet 5 的提前体验权限。由于旗舰模型 Mythos 5 与 Fable 5 的发布进展放缓,Claude Sonnet 5 被视为 Anthropic 缓解竞争压力的阶段性产品方案。
波兰创立的语音 AI 公司 ElevenLabs 发布 Music v2,该模型可在同一音轨中切换曲风、按前奏、主歌、副歌等段落生成歌曲,并支持对指定片段进行局部重绘。Music v2 现已上线 ElevenMusic 和 ElevenCreative,ElevenAPI 的访问目前通过销售团队提供早期入口。 Stability AI 发布 Stable Audio 3.0,包含 Small SFX、Small、Medium 和 Large 四个模型,其中三个变体在 Hugging Face 开放权重。该系列基于授权数据训练,Medium 支持生成最长 6 分 20 秒音轨,Large 仅通过 Stability AI API 提供。 ElevenLabs 已与 Believe、Kobalt 和 Merlin 达成授权协议,Stability AI 已与 Warner Music Group 和 Universal Music Group 建立合作。Suno 在 2025 年 11 月估值达 24.5 亿美元,年度经常性收入超过 3 亿美元,约有 1 亿用户,日均生成约 700 万首歌曲。
据韩联社报道,韩国语音诈骗信息共享与分析 AI 平台 ASAP 启动约 9 个月来,已对逾 7000 个账户采取止付措施,并拦截约 660 亿韩元损失。
据 The Verge 报道,Reddit 正在进行一项新实验,通过 AI 语音技术将平台上的文字帖子及评论自动转化为音频视频内容。视频播放时会同步高亮显示正在朗读的文字,并标注"真实对话由 AI 配音"。用户可通过页面顶部的切换按钮在"阅读"和"播放"两种模式间自由切换。
微软已将拟人化聊天机器人 Mico 从 Copilot 语音功能中撤下,转移至 Learn Live 学习中心充当「导师」。支持页面称,Mico 积累的交互经验正塑造 Copilot 未来方向,且 Copilot 语音交互功能依然保留。Mico 于 2025 年 10 月推出,默认在语音模式启用,曾内置点击变 Clippy 的彩蛋。
据 Cryptopolitan 报道,韩国金融监督服务(FSS)已启动为期三个月、预算约 1.19 亿韩元的欺诈退款系统重建工程。此次升级旨在配合今年 3月 31 日修订的《电信欺诈损害赔偿法》——该法案将于 10月 1 日正式生效,正式将虚拟资产纳入"受损财产"及"可退款财产"范畴。 新系统将支持按代币类型及数量计算赔偿金额,并以资金被冻结时的韩元价值作为参考基准,同时具备拆解多账户混合诈骗资金的能力。Upbit、Bithumb、Coinone、Korbit及 GOPAX 等主要交易所届时须承担与银行同等的反诈骗及受害者救济义务,包括核查交易目的、监控可疑资金及冻结涉嫌账户。
字节跳动 Seed 团队发布 SeedRealtime,一款原生音视频全双工大模型,已上线豆包 App。该模型将音频、视频和文本统一在端到端架构中,并行处理感知、理解、决策与表达,并将轮次切换内化到模型内部,取代外部语音活动检测器。字节内部人工评估显示,其节奏问题相比级联架构减半,但未发布技术报告、参数规模、开源权重或 API。
千问 APP和 PC 端功能上新,推出思考研究、定时任务、办公助理、智能体广场、语音通话等多项新功能,同时支持阿里最新旗舰模型 Qwen3.8-MAX。上述功能所有用户均可免费使用。