聽得懂臺灣的語音 AI,
跑在你自己的機房裡。
國語、台語、客語、原住民族語、英語,全部轉為繁體中文。語音辨識、語者分離、對話生成、語音合成——所有模型運行在貴單位自有的伺服器上,不呼叫任何雲端 AI 服務。
三項產品,同一個原則
一個負責「即時對話」,一個負責「事後記錄」,一個負責「把錄音變成可查的資料」。三者都在你的機房裡跑完整條流程。
MosaTalk
客戶打開網頁按下通話、或直撥既有客服專線,就能和 AI 自然對談——聽得懂臺灣口音、答得出你的業務問題,說完話到 AI 開口約一秒,而且可以隨時插話。
MosaMinutes
錄音或上傳檔案,系統自動產出逐字稿、分辨誰在說話、寫出摘要與待辦,並讓你在同一個畫面裡邊聽邊改到能直接發出去。
MosaScore
把過去只能抽查 1~3% 的客服與電銷錄音,變成每一通都被完整聽過、逐句轉成文字、標上情緒與意圖分數的可查資料。
技術實力
可重現的評測報告
我們的立場是:行銷數字沒有意義,可重現的數字才有。字元錯誤率、競品對照、測試方法論與原始音檔,將以符合學術規範的方式完整公開,並可依貴單位指定的公開基準或自備音檔另行評測。
為什麼一定要地端
臺灣已經有能處理台語的語音服務,但它們全是雲端形態。能把臺灣的語言做好、又能整套跑在你自己機房裡的,這才是我們的位置。更完整的說明見地端 AI。
我們不追求適用於所有場景,而是專注於滿足最高規格的資安需求。對於沒有數據合規壓力或資安顧慮的單位,雲端訂閱服務無疑是更為經濟彈性的選擇。但若您的會議內容與核心數據絕不能離廠,我們便是為此而設計的私有化解決方案——這是一項專為資安合規所做的明確定位,而非盲目的全面優勢。
產業情境與合規
對這些單位而言,情境就是合規。我們依產業的實際法規與內控要求,客製化存取控制、稽核紀錄與資料保存機制,而不是套用單一制式方案。
發展路線
以下項目仍在開發規劃中,非現有可交付功能。我們選擇公開,因為方向本身就是說明我們在想什麼。
MosaTalk
MosaMinutes
團隊與研究
核心研發團隊具有深厚的學術與開源社群血統,長期專注於臺灣多語言(台語、客語、族語、中英混合等)語音辨識技術。
團隊主導之開源語音專案 FormoSpeech(公開於 Hugging Face)已累積豐富的社群調用與技術驗證實績。我們的語音辨識模型採全自主架構訓練,非僅調整市面通用模型之參數——這代表我們能針對貴單位的特定領域用語、特殊收音環境與專業聲學情境進行深度客製與持續優化,是採用標準通用雲端 API 所無法達到的精準度與資料安全性。
研究筆記
技術文章、評測方法論、臺灣語音資料的觀察。這一區會是我們把「學術精神」講清楚的地方。
研究網絡
臺灣的本土語言不是一個模型就能涵蓋的題目。族語的語音辨識、語音合成與機器翻譯模型,以及客語的語音辨識與語音合成模型,都由本團隊研發;兩者的語料整理也有一部分由本團隊承擔,透過長期合作的單位落地與公開。
族群與語言數依原住民族委員會的族語分類,客語腔調依客家委員會的六腔分類——兩者都可以逐項查證。各語言的完整涵蓋範圍見臺灣本土語言。
獲獎與榮譽
媒體報導
研究發表
核心團隊成員與語音相關之同儕審查發表,涵蓋 Interspeech、ICASSP、IEEE ASRU、SLT、TASLP 等領域主要會議與期刊。這裡列出的是與語音技術直接相關的部分。
常見問題
採購與技術審查時最常被問到的幾件事。答案裡沒有我們還沒驗證過的數字。
先用你自己的音檔
驗證一次,再談導入。
我們可以用貴單位實際的會議錄音或客服對話做一次概念驗證,並提供方法論明確、可重現的評測報告,作為採購與技術審查的佐證。