ZaoSeq 造序科技Labs

RESEARCH PREVIEW / TECHNICAL NOTES

研究狀態與資料來源

這是架構開發所用的 104 題 DEV set,並非未觸碰的最終測試集。下列數字是特定版本的離線結果,不代表公開 Demo 的即時準確率。

Pairwise Laya 與信心感知 Hybrid 未在整體 DEV 上證明穩定超越詞頻基線,因此目前不宣稱準確率提升。

DEV benchmark

Temporal 指目標段從初始輸入到得到後文時的排序;final sequence top-1 衡量完整句。數值越高越好,但少量改善與退步須一起看。

Temporal,104 題
排序方式最終 top-1完整句 top-1錯→對對→錯
Baseline0.6730.64400
Laya Multi-choice0.4230.240252
Laya Pairwise0.3750.192191
Hybrid 固定權重0.7120.67312
Hybrid 信心感知/Multi-choice0.6540.62502
Hybrid 信心感知/Pairwise0.6730.64410

同一批 DEV 的完整序列排名如下;這是另一個評估指標,勿與上表的最終目標段 top-1 混為一談。

Composition reranking,104 題
排序方式Top-1MRR退步改善
Baseline0.6440.79800
Laya Multi-choice0.2400.489486
Laya Pairwise0.1920.457514
Hybrid 固定權重0.6730.80025
Hybrid 信心感知/Multi-choice0.6250.78820
Hybrid 信心感知/Pairwise0.6440.80011

完整指標、條件、延遲與逐題資料請見 Pairwise/Hybrid DEV 記錄其他 DEV 記錄

實際使用的資料

CNS11643 字音資料:數位發展部,政府資料開放授權條款第 1 版。內建詞條:專案人工整理。Laya Multilingual:第三方模型,Apache-2.0。

其他 corpus 仍在評估,尚不列為已使用來源。資料來源細節 · 第三方授權