论文审稿:ASR-Roundtrip 评估可能掩盖中文新闻 TTS 中依赖上下文和惯例的朗读错误

论文类型:分析型

该论文记录了 ASR-roundtrip 评估在中文新闻 TTS 中的一个特定失效模式:即 TTS 朗读对听众来说是错误的,但 ASR 转录出的却是预期的或表面正确的文本。它提供了有针对性的审计、跨系统验证和一种 span-isolation 诊断方法。它没有提出新的 TTS 前端、新的模型架构或新的训练方法。核心贡献在于表征评估的失效模式——这是分析型论文。

公理审查结果

公理一:对象公理

公理二:识别公理

公理三:独立性公理

公理四:压缩公理

公理五:效用公理

公理六:新颖性公理

公理七:可复现公理

日报摘要

总评

打分

Axiom 判定 分数 权重 加权分
一 对象公理 8 1.0 8.0
二 识别公理 ⚠️ 6 1.5 9.0
三 独立性公理 ⚠️ 5 1.0 5.0
四 压缩公理 8 1.0 8.0
五 效用公理 ⚠️ 5 2.0 10.0
六 新颖性公理 ⚠️ 6 2.0 12.0
七 可复现公理 8 1.0 8.0

加权总分: 6.2/10(加权分之和 60.0 / 权重之和 9.5) 最终建议: Weak Accept 6.5-8 → 实际 6.2 落在 Borderline 5-6.5 区间

最终建议: Borderline

论文对象真实、可复现性强、压缩性良好,识别和独立性有可控但真实的缺口(同厂商主要证据链 + 因果解释不完整),效用和新颖性受限于窄范围和中等增量。论文对其主张的边界非常诚实(”deliberately narrow”,”mechanism not prevalence”),这种科学诚实度值得肯定,但也不可避免地限制了其贡献的上限。建议作为 workshop paper 或 short paper 接受;若要作为 conference full paper,需要补充:(1) 随机抽样生产基线估计,(2) 跨 ASR 差异的根因消融,(3) 至少一个 non-vendor primary 系统对。