據 TechCrunch 報道,AI 語音模型公司 Fish Audio 宣佈完成 5000 萬美元種子輪融資,由 Coreline Ventures和 Capital Today 領投,359 Capital、Parable、Play Time 等機構參投。公司表示,目前其開源及託管模型累計用戶已超過 800 萬,年經常性收入達到 2100 萬美元。
波蘭創立的語音 AI 公司 ElevenLabs 發佈 Music v2,該模型可在同一音軌中切換曲風、按前奏、主歌、副歌等段落生成歌曲,並支持對指定片段進行局部重繪。Music v2 現已上線 ElevenMusic 和 ElevenCreative,ElevenAPI 的訪問目前通過銷售團隊提供早期入口。 Stability AI 發佈 Stable Audio 3.0,包含 Small SFX、Small、Medium 和 Large 四個模型,其中三個變體在 Hugging Face 開放權重。該系列基於授權數據訓練,Medium 支持生成最長 6 分 20 秒音軌,Large 僅通過 Stability AI API 提供。 ElevenLabs 已與 Believe、Kobalt 和 Merlin 達成授權協議,Stability AI 已與 Warner Music Group 和 Universal Music Group 建立合作。Suno 在 2025 年 11 月估值達 24.5 億美元,年度經常性收入超過 3 億美元,約有 1 億用戶,日均生成約 700 萬首歌曲。
據 Cryptopolitan 報道,韓國金融監督服務(FSS)已啓動爲期三個月、預算約 1.19 億韓元的欺詐退款系統重建工程。此次升級旨在配合今年 3月 31 日修訂的《電信欺詐損害賠償法》——該法案將於 10月 1 日正式生效,正式將虛擬資產納入"受損財產"及"可退款財產"範疇。 新系統將支持按代幣類型及數量計算賠償金額,並以資金被凍結時的韓元價值作爲參考基準,同時具備拆解多賬戶混合詐騙資金的能力。Upbit、Bithumb、Coinone、Korbit及 GOPAX 等主要交易所屆時須承擔與銀行同等的反詐騙及受害者救濟義務,包括覈查交易目的、監控可疑資金及凍結涉嫌賬戶。
據韓聯社報道,韓國科學技術信息通信部宣佈,通過第二次 ICT 監管沙盒快速處理專家委員會書面審議,批准 4 項服務獲得實證特例資格。其中,三星電子與國立科學調查研究院聯合申請的"聲紋識別移動端語音詐騙檢測服務"最受關注——該服務將經 AI 訓練的語音詐騙識別模型內置於手機端 App,可即時提醒用戶疑似詐騙來電;此前因詐騙犯聲紋屬個人信息、未經當事人同意不得使用,此次特例打破了這一限制。
微軟已將擬人化聊天機器人 Mico 從 Copilot 語音功能中撤下,轉移至 Learn Live 學習中心充當「導師」。支持頁面稱,Mico 積累的交互經驗正塑造 Copilot 未來方向,且 Copilot 語音交互功能依然保留。Mico 於 2025 年 10 月推出,默認在語音模式啓用,曾內置點擊變 Clippy 的彩蛋。
據 Cryptopolitan 報道,韓國金融監督服務(FSS)已啓動爲期三個月、預算約 1.19 億韓元的欺詐退款系統重建工程。此次升級旨在配合今年 3月 31 日修訂的《電信欺詐損害賠償法》——該法案將於 10月 1 日正式生效,正式將虛擬資產納入"受損財產"及"可退款財產"範疇。 新系統將支持按代幣類型及數量計算賠償金額,並以資金被凍結時的韓元價值作爲參考基準,同時具備拆解多賬戶混合詐騙資金的能力。Upbit、Bithumb、Coinone、Korbit及 GOPAX 等主要交易所屆時須承擔與銀行同等的反詐騙及受害者救濟義務,包括覈查交易目的、監控可疑資金及凍結涉嫌賬戶。
字節跳動 Seed 團隊發佈 SeedRealtime,一款原生音視頻全雙工大模型,已上線豆包 App。該模型將音頻、視頻和文本統一在端到端架構中,並行處理感知、理解、決策與表達,並將輪次切換內化到模型內部,取代外部語音活動檢測器。字節內部人工評估顯示,其節奏問題相比級聯架構減半,但未發佈技術報告、參數規模、開源權重或 API。
千問 APP和 PC 端功能上新,推出思考研究、定時任務、辦公助理、智能體廣場、語音通話等多項新功能,同時支持阿里最新旗艦模型 Qwen3.8-MAX。上述功能所有用戶均可免費使用。
科技博主@synthwavedd 發文稱,多款備受關注的前沿 AI 模型已調整發布時間表。其中,原定於近期發佈的 GPT-5.6 已推遲至 7 月中旬,谷歌 DeepMind 則因對模型當前表現不滿意,取消了 Gemini 3.5 Pro 原計劃於 6 月底的發佈安排。與此同時,OpenAI 新一代雙向語音模型 Bidi 的上線準備工作正在 ChatGPT 平臺推進,最快或於本週向用戶開放。報道稱,Bidi 支持全雙工語音交互,允許用戶與模型同時發聲並隨時打斷對話,被視爲現有語音模式的重要升級。此外,Anthropic 已向部分企業客戶開放 Claude Sonnet 5 的提前體驗權限。由於旗艦模型 Mythos 5 與 Fable 5 的發佈進展放緩,Claude Sonnet 5 被視爲 Anthropic 緩解競爭壓力的階段性產品方案。
波蘭創立的語音 AI 公司 ElevenLabs 發佈 Music v2,該模型可在同一音軌中切換曲風、按前奏、主歌、副歌等段落生成歌曲,並支持對指定片段進行局部重繪。Music v2 現已上線 ElevenMusic 和 ElevenCreative,ElevenAPI 的訪問目前通過銷售團隊提供早期入口。 Stability AI 發佈 Stable Audio 3.0,包含 Small SFX、Small、Medium 和 Large 四個模型,其中三個變體在 Hugging Face 開放權重。該系列基於授權數據訓練,Medium 支持生成最長 6 分 20 秒音軌,Large 僅通過 Stability AI API 提供。 ElevenLabs 已與 Believe、Kobalt 和 Merlin 達成授權協議,Stability AI 已與 Warner Music Group 和 Universal Music Group 建立合作。Suno 在 2025 年 11 月估值達 24.5 億美元,年度經常性收入超過 3 億美元,約有 1 億用戶,日均生成約 700 萬首歌曲。
據韓聯社報道,韓國語音詐騙信息共享與分析 AI 平臺 ASAP 啓動約 9 個月來,已對逾 7000 個賬戶採取止付措施,並攔截約 660 億韓元損失。
據 The Verge 報道,Reddit 正在進行一項新實驗,通過 AI 語音技術將平臺上的文字帖子及評論自動轉化爲音頻視頻內容。視頻播放時會同步高亮顯示正在朗讀的文字,並標註"真實對話由 AI 配音"。用戶可通過頁面頂部的切換按鈕在"閱讀"和"播放"兩種模式間自由切換。
微軟已將擬人化聊天機器人 Mico 從 Copilot 語音功能中撤下,轉移至 Learn Live 學習中心充當「導師」。支持頁面稱,Mico 積累的交互經驗正塑造 Copilot 未來方向,且 Copilot 語音交互功能依然保留。Mico 於 2025 年 10 月推出,默認在語音模式啓用,曾內置點擊變 Clippy 的彩蛋。
據 Cryptopolitan 報道,韓國金融監督服務(FSS)已啓動爲期三個月、預算約 1.19 億韓元的欺詐退款系統重建工程。此次升級旨在配合今年 3月 31 日修訂的《電信欺詐損害賠償法》——該法案將於 10月 1 日正式生效,正式將虛擬資產納入"受損財產"及"可退款財產"範疇。 新系統將支持按代幣類型及數量計算賠償金額,並以資金被凍結時的韓元價值作爲參考基準,同時具備拆解多賬戶混合詐騙資金的能力。Upbit、Bithumb、Coinone、Korbit及 GOPAX 等主要交易所屆時須承擔與銀行同等的反詐騙及受害者救濟義務,包括覈查交易目的、監控可疑資金及凍結涉嫌賬戶。
字節跳動 Seed 團隊發佈 SeedRealtime,一款原生音視頻全雙工大模型,已上線豆包 App。該模型將音頻、視頻和文本統一在端到端架構中,並行處理感知、理解、決策與表達,並將輪次切換內化到模型內部,取代外部語音活動檢測器。字節內部人工評估顯示,其節奏問題相比級聯架構減半,但未發佈技術報告、參數規模、開源權重或 API。
千問 APP和 PC 端功能上新,推出思考研究、定時任務、辦公助理、智能體廣場、語音通話等多項新功能,同時支持阿里最新旗艦模型 Qwen3.8-MAX。上述功能所有用戶均可免費使用。