Skip to content

融資速報|Wispr Series B $280M

2026年8月18日 1 分鐘
TL;DR Wispr 完成 $280M Series B,由 Menlo Ventures 領投,估值 $2B(較 2025 年 11 月的 $700M 成長近 3 倍)。這輪資金代表 VC 押注語音會取代文字輸入框,成為人機介面的下一個入口。
目錄
  1. 融資資訊
  2. 這家公司做什麼
  3. 這筆融資的訊號
    1. 對 Agent 生態的意義
    2. 投資人在賭什麼
    3. 值得觀察的數字
  4. Watchlist 狀態
  5. 今日收穫
  6. 參考資料

🌏 English version

融資資訊

項目
公司Wispr(美國,舊金山)
輪次Series B
金額$280M
領投Menlo Ventures
跟投Notable Capital、NEA、Neo Ventures、8VC、MVP Ventures(既有投資人加碼);Acrew、Forerunner、Goodwater、Peak XV、Together Fund、PLUS Capital(新投資人)
估值$2B(前一輪 2025 年 11 月 Series A2 為 $700M,約 2.9x 成長)
累計融資$361M
成立年份2021
員工數~50 人(GetLatka,2025 年 10 月數據)

這家公司做什麼

Wispr 是做 AI 語音聽寫的公司——用語音取代打字,讓使用者用說話的方式在任何應用程式裡輸入文字。

核心產品 Flow 覆蓋 162 個國家、100 多種語言,號稱比打字快 4 倍,還會自動修飾語氣、去除贅字、依使用情境調整格式。這輪同時發布自研語音模型 Canto,把嘈雜環境下的辨識錯誤率從 30% 以上壓到 5-10%,回應近期使用者對辨識品質下滑的抱怨。公司也在 7 月成立 Advanced Interfaces Lab,由曾參與 Amazon Alexa 早期開發的 Ariya Rastrow 擔任首席科學家,目標從「語音轉文字」進化到「語音轉行動」(voice-to-outcome)。

目前 Flow 已被大多數 Fortune 500 企業員工使用,並在超過 12.5 萬家企業中部署,過去四個季度營收季增均超過 150%。公司同時把觸角伸進會議記錄(notetaker,對打 Granola、Fireflies、Read AI)和穿戴裝置(與 Oasis 智慧戒指合作),試圖從單一聽寫功能擴張為完整的語音介面平台。

這筆融資的訊號

對 Agent 生態的意義

Menlo Ventures 領投合夥人 Matt Kraning 的論點很直白:前沿模型已經解決了「智慧」的問題,但沒有解決「普通人怎麼把意圖傳達給模型」的介面問題——文字框本身就是一種對思考的課稅。Wispr 想成為連接 Agent 與人類意圖的那一層:工程師用語音操控 coding agent,業務講完一通電話讓 CRM 自動更新,都是同一個「語音轉行動」邏輯的應用場景。這筆錢會用來擴大企業銷售團隊、深化企業產品線,並讓 Advanced Interfaces Lab 把語音以外的意圖通道(例如你正在看的畫面、正在做的工作)也納入範疇。

投資人在賭什麼

Menlo 在 14 個月前第一次投資 Wispr 時就公開下注「語音會殺死鍵盤」,如今追加這輪 $280M,是該公司「對 AI 公司做過最大手筆的投資之一」。Kraning 的邏輯是:語音聽寫本身可以被免費功能取代(作業系統內建聽寫、蘋果/Google/微軟都有),但「零修改、隨處可用」加上「執行你的意圖而非單純轉錄」需要一整間公司的系統整合能力,不是一個 OS checkbox 能做到的。Menlo 過去投過 Anthropic 這類 AI 基礎設施型公司,這次押注的邏輯是把 Wispr 定位成「語音版的作業系統介面層」,而非又一個聽寫 app。

值得觀察的數字

  • 估值從 2025 年 11 月的 $700M 跳到 $2B,9-10 個月內成長近 3 倍,速度快於多數同階段 AI 公司的 Series B 漲幅;
  • 累計融資 $361M 中有 $280M(約 78%)集中在這一輪,顯示 Wispr 在營收連續四季季增超過 150% 的情況下,選擇一次性拿大額資金而非分批小輪次;
  • 新版語音模型 Canto 宣稱把困難聲學環境(背景噪音、風聲、口音)下的辨識錯誤率從 30% 壓到 5-10%,這是對近期使用者品質下滑抱怨的直接產品回應,能否兌現要看接下來的實際留存數字。

Watchlist 狀態

Wispr 尚未在 watchlist 中。建議加入 section C5(語音 AI / Voice Agent),與 Vapi、ElevenLabs、Cartesia 同組追蹤,追蹤重點:語音輸入介面 + Advanced Interfaces Lab 的「voice-to-outcome」路線,$280M Series B,估值 $2B。

今日收穫

原本以為「AI 聽寫」已經是被 iOS/Android 內建功能瓜分殆盡的紅海賽道,但 Menlo 用連續兩輪重倉下注證明:戰場不是「誰的辨識準確率最高」,而是「誰能把語音變成能觸發真實行動的意圖通道」——聽寫只是取得使用者信任和資料的敲門磚,真正的護城河是後面那層把「你說的話」翻譯成「系統該做的事」的執行層。

參考資料