Paper Review: Towards Digital Preservation of Efik: TTS for a Low-Resource African Language

论文类型: 数据型 + benchmark型(混合)

主要贡献是新的 Efik 语料库(2,632 句 / 3 小时 / 单说话人)+ 对四个现有 TTS 模型的微调对比评测,提供 Efik TTS 的首个可复现 baseline。无新方法提出。

公理审查结果

公理一:对象公理

公理二:识别公理

公理三:独立性公理

公理四:压缩公理

公理五:效用公理

公理六:新颖性公理

公理七:可复现公理

总评

核心问题:作为 Interspeech 接收的 benchmark/数据型论文,证据标准应当更严而非更松。论文在 (a) 训练配置不均衡导致横向对比不可解释、(b) 评测者仅 5 人且无 IRR 与客观声调指标、(c) 数据/代码受限访问且无 URL 三个方面均未达到 benchmark 型论文应有的严谨度。其作为”社区证据基础设施”的可信度因此打折扣。建议作者补:(1) 统一训练 compute 后的重新对比;(2) F0 RMSE / tonal error rate / ASR-WER 客观指标 + 评测者 IRR;(3) 数据/代码开放 URL 与清晰许可。

打分

Axiom 判定 分数 权重 加权分
一 对象公理 8 1.0 8
二 识别公理 2 1.5 3
三 独立性公理 ⚠️ 5 1.0 5
四 压缩公理 3 1.0 3
五 效用公理 ⚠️ 5 2.0 10
六 新颖性公理 ⚠️ 4 2.0 8
七 可复现公理 ⚠️ 5 1.0 5

加权总分: 4.42/10(加权分之和 42 / 权重之和 9.5) 最终建议: Weak Reject