GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

上线/更新

同时关联该项目与事件的快讯

微软将 Mico 从 Copilot 语音撤下,转入学习中心担任导师

微软已将拟人化聊天机器人 Mico 从 Copilot 语音功能中撤下,转移至 Learn Live 学习中心充当「导师」。支持页面称,Mico 积累的交互经验正塑造 Copilot 未来方向,且 Copilot 语音交互功能依然保留。Mico 于 2025 年 10 月推出,默认在语音模式启用,曾内置点击变 Clippy 的彩蛋。

韩国 FSS 升级反诈系统,加密资产纳入语音诈骗赔偿范围

据 Cryptopolitan 报道,韩国金融监督服务(FSS)已启动为期三个月、预算约 1.19 亿韩元的欺诈退款系统重建工程。此次升级旨在配合今年 3月 31 日修订的《电信欺诈损害赔偿法》——该法案将于 10月 1 日正式生效,正式将虚拟资产纳入"受损财产"及"可退款财产"范畴。 新系统将支持按代币类型及数量计算赔偿金额,并以资金被冻结时的韩元价值作为参考基准,同时具备拆解多账户混合诈骗资金的能力。Upbit、Bithumb、Coinone、Korbit及 GOPAX 等主要交易所届时须承担与银行同等的反诈骗及受害者救济义务,包括核查交易目的、监控可疑资金及冻结涉嫌账户。

字节跳动 Seed 发布原生音视频全双工模型 SeedRealtime

字节跳动 Seed 团队发布 SeedRealtime,一款原生音视频全双工大模型,已上线豆包 App。该模型将音频、视频和文本统一在端到端架构中,并行处理感知、理解、决策与表达,并将轮次切换内化到模型内部,取代外部语音活动检测器。字节内部人工评估显示,其节奏问题相比级联架构减半,但未发布技术报告、参数规模、开源权重或 API。

千问 APP 更新,推出五项新功能

千问 APP和 PC 端功能上新,推出思考研究、定时任务、办公助理、智能体广场、语音通话等多项新功能,同时支持阿里最新旗舰模型 Qwen3.8-MAX。上述功能所有用户均可免费使用。

传GPT-5.6与Gemini 3.5 Pro延期至7月发布,OpenAI新语音模型或本周上线

科技博主@synthwavedd 发文称,多款备受关注的前沿 AI 模型已调整发布时间表。其中,原定于近期发布的 GPT-5.6 已推迟至 7 月中旬,谷歌 DeepMind 则因对模型当前表现不满意,取消了 Gemini 3.5 Pro 原计划于 6 月底的发布安排。与此同时,OpenAI 新一代双向语音模型 Bidi 的上线准备工作正在 ChatGPT 平台推进,最快或于本周向用户开放。报道称,Bidi 支持全双工语音交互,允许用户与模型同时发声并随时打断对话,被视为现有语音模式的重要升级。此外,Anthropic 已向部分企业客户开放 Claude Sonnet 5 的提前体验权限。由于旗舰模型 Mythos 5 与 Fable 5 的发布进展放缓,Claude Sonnet 5 被视为 Anthropic 缓解竞争压力的阶段性产品方案。

ElevenLabs与Stability AI发布新AI音乐模型

波兰创立的语音 AI 公司 ElevenLabs 发布 Music v2,该模型可在同一音轨中切换曲风、按前奏、主歌、副歌等段落生成歌曲,并支持对指定片段进行局部重绘。Music v2 现已上线 ElevenMusic 和 ElevenCreative,ElevenAPI 的访问目前通过销售团队提供早期入口。 Stability AI 发布 Stable Audio 3.0,包含 Small SFX、Small、Medium 和 Large 四个模型,其中三个变体在 Hugging Face 开放权重。该系列基于授权数据训练,Medium 支持生成最长 6 分 20 秒音轨,Large 仅通过 Stability AI API 提供。 ElevenLabs 已与 Believe、Kobalt 和 Merlin 达成授权协议,Stability AI 已与 Warner Music Group 和 Universal Music Group 建立合作。Suno 在 2025 年 11 月估值达 24.5 亿美元,年度经常性收入超过 3 亿美元,约有 1 亿用户,日均生成约 700 万首歌曲。

OpenClaw 发布 v2026.4.25 版本,TTS 全面升级并新增六大语音服务商支持

据 OpenClaw 官方 GitHub 发布说明,OpenClaw 于 4 月 27 日发布 v2026.4.25 版本,本次更新涵盖语音、插件、可观测性、浏览器自动化等多个核心模块,主要亮点如下: • TTS 全面升级:新增 Azure Speech、小米 MiMo、ElevenLabs v3、Inworld、Volcengine 火山引擎、本地 CLI 六大语音服务商支持,并新增聊天会话级自动 TTS 控制、TTS 人格(Personas)绑定及跨 Agent/账户级别覆盖配置; • 插件注册表优化:插件启动与安装路径迁移至冷持久化注册表,减少全量 Manifest 扫描,提升插件更新、修复与发现的确定性; • OpenTelemetry 扩展:覆盖模型调用、Token 使用、工具循环、Harness 运行、进程执行、消息投递、上下文组装及内存压力等全链路可观测指标; • 浏览器自动化增强:支持 iframe 感知角色快照、CDP 就绪调优、无头一键启动及更深层的浏览器诊断探针; • 安装稳定性提升:修复 Windows、macOS、Linux、Docker 多平台安装与更新问题

特斯拉将上线AI语音功能

据网信上海消息,上海新增1款已完成备案的生成式人工智能服务,为特斯拉车机语音大模型服务。对此,4月22日,特斯拉方面人士回应称:“敬请期待”。(一财)

SlowMist 发出安全预警:伪造"Harmony Voice"软件正被用于社交工程攻击

据 SlowMist 安全团队(@SlowMist_Team)发布的威胁情报,其旗下威胁情报系统 MistEye 已收到社区反馈,发现一起针对加密用户的活跃社交工程攻击活动。 攻击者以项目合作为由接触目标用户,诱导其使用伪造的"Harmony Voice"软件(域名:harmony-voice[.]app)进行所谓的实时翻译,实为恶意程序。SlowMist 已将相关威胁情报(IOC)同步至其企业客户。