Product 02 · On-Premise

MosaMinutes地端 AI 會議記錄平台

會議結束,紀錄已經
改到能直接發出去。

錄音或上傳檔案,系統自動產出逐字稿、分辨誰在說話、寫出摘要與待辦,並讓你在同一個畫面裡邊聽邊改——而且錄音、逐字稿、摘要全程不離開貴單位的網路——地端部署的完整說明在這裡

校對工作區
自動儲存
1.5×
00:14
王主任
彼个案子的預算,咱敢有確定落來?
00:19
李專員
上禮拜董事會通過了,我等一下把會議紀錄寄給你
00:26
王主任
好,數字若有 update 你直接 tag 我就好。
待辦事項
李專員寄送董事會決議之會議紀錄
預算數字更新後通知王主任
示意畫面 · 實際互動示範即將上線

你遇到的麻煩,我們怎麼解

On-Premise
會議記錄的痛點很少在「轉錄」,而在轉錄之後。
麻煩 01

會議錄音不能上傳到別人的伺服器

法規或內部規範讓雲端會議工具在評估的第一關就出局。台語能力再好也沒用。
我們的解法

辨識、語者分離、聲紋比對、摘要——所有模型都在你的伺服器上,不呼叫任何雲端 AI 服務。

容器化部署,不需連外即可運作
身分驗證可用自架的身分提供者,適用封閉網路
沒有按次計費的 API 成本,會議開再多都不加價
麻煩 02

校對比重打逐字稿還累,改到一半還會被蓋掉

多數工具在「兩邊同時改」時是後蓋前,一整個下午的修改就這樣消失。
我們的解法

文字修改、段落結構、語者指派、語者命名是四條互不干擾的獨立通道——這是這個平台的設計底線,不是盡力而為。

真的衝突時不自作主張選一邊,精確標示到那一句
任何修改都不會在未經你明確同意的情況下被丟棄
邊聽邊改、逐字稿隨播放捲動、一鍵還原辨識原文
麻煩 03

會議裡大家講國台語夾雜,工具只聽得懂一種

這是臺灣會議的實際語音型態,不是教科書式的單一語言。能處理台語的工具並非沒有,但都在雲端。

我們的解法

國語、台語、客語、原住民族語、英語,一律轉為繁體中文逐字稿(各語言的涵蓋範圍);國台語模型由團隊自行微調,已在生產環境服役、處理真實會議。

真正的差異在「地端」:本土台語服務皆為雲端形態
介面上不出現任何模型代號或技術術語
可設定個人預設語言/口音,日常不必每次重選
新增語言是一筆設定變更,不需改版或重新部署
麻煩 04

每場會議都要重新標註誰是誰

固定班底的例會,每週都在做同一件無聊的事。
我們的解法

聲紋註冊與自動比對:為某位發言者命名一次,之後的會議會自動認出同一個人。會議開得越多,標註工作越少。

上傳時可指定預期發言人數,讓分離更貼近實際
語者辨識失敗不會讓整場會議失敗,仍產出完整逐字稿
麻煩 05

辨識引擎憑空生出會議裡沒說過的話

最讓人不安的失效不是「聽錯」,而是無中生有。這類問題只有在真實會議上才會現形。
我們的解法

我們的模型已在實際環境處理真實會議,以下三項都是上線後實測發現並修正的問題,不是規格書上的宣稱。

太短的聲音不會被當成話:設有語音長度下限,兩百毫秒的環境雜音根本不會進入辨識,也不會計費
不會陷入重複迴圈:找出成因並在系統層修掉,不是靠事後過濾遮掩
辨識器對自己的信心會被記錄:異常輸出可追溯與稽核,不會無聲混進逐字稿

還有這些

現有功能
即時錄音
開網頁按下錄製,逐字稿與語者標籤即時出現,會議還在進行就能看到內容成形。
AI 摘要與待辦
一鍵產生摘要並整理待辦。AI 產出的是草稿,最終版本由你決定。
三種匯出格式
Word 含出席者與摘要區塊、待辦渲染為勾選清單;另有純文字與 SRT 字幕。
OIDC 單一登入
接上既有身分驗證系統,沒有另一組獨立帳密要管理;支援自架身分提供者。
權限與稽核
分層權限、管理操作留下紀錄且須填寫原因、可設定結果保留期限。
程式化 API
以存取權杖供內部系統呼叫,支援非同步與同步;重複請求只執行一次。
單張 GPU 跑完整系統

辨識、語者分離、聲紋擷取與摘要模型共用一張 GPU,硬體門檻與機房空間需求都低。

模型可抽換,不被綁定

建構於業界標準開源技術與相容介面。若採購規範要求非紅色供應鏈,可評估替換為其他來源的開放權重模型。

用量控管

瀏覽器使用者以額度管理、程式化呼叫以點數管理,兩者分開計算,管理員可調整並留下紀錄。

不會半路壞掉的處理流程
每份錄音進入系統前先完成驗證,能不能處理當場就知道,不會排到最後才失敗
收下的那一刻即記錄雜湊值與位元組數,原始錄音的完整性有據可查
重複送出的請求只會被執行一次,不會產生重複的會議與重複計費

讓紀錄自己走到該去的地方

開發規劃中
以下為下一階段的發展方向,仍在開發規劃中,非現有可交付功能。
會議紀錄自動送達

完成後自動寄 Email、推送 Teams/Mattermost/LINE,或以 Webhook 通知內部系統

敏感資料自動遮罩
姓名、身分證號、病歷號、金額自動偵測遮罩,並記錄誰檢視了原始內容
專有名詞辨識強化
由貴單位維護人名、單位、產品與術語對照表,產出時自動修正為正確寫法
線上會議直接擷取
直接擷取電腦上正在進行的線上會議音訊,不需要外部帳號加入會議
會議範本與公文格式
董事會、專案進度、訪談各有格式;公部門的案由、決議、列席人員直接成形
跨會議 AI 問答
「上次談到預算是怎麼決定的?」附上出處會議與時間點,地端運行不出網
企業級管理規則
依群組或會議類型自動套用處理規則與不同的保存年限
團隊共享與協作
分享給同事、部門層級可見性、共同校對,以及發言時間統計
可疑段落自動標示

辨識引擎對每一段輸出的信心已被記錄,將據此在校對畫面主動標出「這段最可能有問題,請優先檢查」——把注意力放在真正需要的地方,而不是從頭聽到尾

系統需求

摘要
伺服器

一台 NVIDIA DGX Spark GB10(GB10 Grace Blackwell 超級晶片,128 GB 統一記憶體,原廠 DGX OS 為 Ubuntu 基礎)

處理容量

單台 NVIDIA DGX Spark GB10 可支援即時 10 線同時轉錄;離線上傳以批次佇列處理,不受線數限制

部署形態
容器化部署,單機即可運行;封閉網路友善,不需連外
使用者端
任何現代瀏覽器,無需安裝軟體;電腦與行動裝置皆可

若需求超出單機容量,可規模化為多機配置。實際併發量與硬體配置建議,我們會依貴單位的會議量與使用型態評估後提供,並可供應完整主機硬體與到場安裝部署。

不只是一套軟體

導入與維運

地端 AI 最實際的門檻往往不在軟體,而在硬體選型、環境建置與後續維護。這些我們一起承擔。

主機供應與到場安裝

可提供完整主機硬體,經測試驗證後協助完成安裝部署,貴單位不需自行摸索硬體選型與環境建置。

辨識模型持續改進

模型由團隊自行訓練,可依貴單位的實際語音情境與領域用語持續優化——採用通用雲端服務時做不到。

可重現的評測報告

以貴單位指定的公開基準或自備的實際會議音檔評測,提供方法論明確、可重現的正式報告,而不是行銷數字。

產業合規與供應鏈客製

依政府、金融、醫療、法律的法規與內控要求客製存取控制與稽核;採購規範指定模型來源時可替換後重新驗證。

場景客製化
協助將既有的會議紀錄格式、專有名詞表與摘要需求整理成系統設定。
維護、更新與教育訓練

模型升級、效能調校與安全性更新由團隊持續維護,貴單位不需自建 AI/MLOps 團隊。

常見問題

FAQ

還在開發規劃中的功能,答案裡會直說。

AI 會議轉錄是什麼?

把會議錄音自動轉成逐字稿,同時分辨誰在說話、寫出摘要與待辦事項。MosaMinutes 讓你在同一個畫面裡邊聽邊改,改到能直接發出去為止。

會議錄音可以完全不上雲嗎?

可以,而且這是預設形態、不是附加選項。錄音、逐字稿、摘要與待辦全程在貴單位自己的伺服器上完成,容器化部署、單機即可運行,封閉網路不需連外也能使用。

聽得懂台語和客語的會議嗎?

國語、台語、客語、原住民族語、英語五種語言一律轉為繁體中文逐字稿,並自動標點分段。客語涵蓋四縣、海陸、大埔、饒平、詔安、南四縣六腔。

可以直接接 Google Meet、Microsoft Teams 或 Zoom 嗎?

目前不行。 現在的做法是錄音或上傳音檔。直接擷取電腦上正在進行的線上會議音訊(不需要外部帳號加入會議)列在下一階段的開發方向,還不是現有可交付功能。

一台機器可以同時轉錄幾場會議?

一台 NVIDIA DGX Spark GB10 可支援 10 線即時轉錄;離線上傳走批次佇列處理,不受線數限制。需求超出單機容量時可以規模化為多機配置。

多人同時校對,改的東西會不會被蓋掉?

不會。校對走四條獨立通道,彼此互不覆蓋,所以不會發生後改的蓋掉先改的。

用你自己的會議錄音,驗證一次。

我們可以用貴單位實際的會議音檔做一次概念驗證,並提供方法論明確、可重現的評測報告,作為採購與技術審查的技術佐證。