我已经有了足够多的锚点。论文全文已阅读。正在撰写最终评审。

Paper Review: Evaluating the Effect of Linguistic Relatedness on Cross-Lingual Transfer in Large Multilingual Automatic Speech Recognition

论文类型: 分析型

这是一项受控实验研究,目的是检验一个广为流传的经验假设(”语言学相关性 → 跨语言迁移增益”)在大型多语言 ASR 上是否仍然成立。核心产出是一个阴性结论(negative result)和一个边界刻画(”1 小时目标语微调即可使各组等价”)。不是新方法、新数据集、新基准。审稿尺度按分析型 + 部分问题定义型对待。


公理审查结果

公理一:对象公理

公理二:识别公理

公理三:独立性公理

公理四:压缩公理

公理五:效用公理

公理六:新颖性公理

公理七:可复现公理


总评

核心问题摘要(按严重度):

  1. [Major] 没有 small-model 对照复现 Khare 2021 / Nowakowski 2023 的正向结果,因此”我们反驳了前人”的 claim 缺少同一 setup 下的直接对照——可能只是目标语数据下限(1h vs <1h)不同导致的。
  2. [Major] Δ=5 WER pt 等价界偏粗,无 sensitivity analysis(Δ=1/2/3);<5pt 的 relatedness 增益可能真实存在且实用。
  3. [Minor] 摘要 claim 外延(”may not constitute an effective strategy”)比实验验证范围(minimal target data, 4 models, 2 corpora)宽。
  4. [Minor] 缺少与非-relatedness 迁移策略(joint multilingual FT、transliteration)的对比,因此”relatedness 不 work”不能直接推广到”跨语言迁移不 work”。
  5. [Minor] 没有把结论嵌入绝对 WER 坐标,未引用 OmniASR 论文中报告的低资源语 WER 作为锚点。

打分

Axiom 判定 分数 权重 加权分
一 对象公理 ⚠️ 7 1.0 7.0
二 识别公理 9 1.5 13.5
三 独立性公理 8 1.0 8.0
四 压缩公理 ⚠️ 6 1.0 6.0
五 效用公理 ⚠️ 5 2.0 10.0
六 新颖性公理 ⚠️ 5 2.0 10.0
七 可复现公理 8 1.0 8.0

加权总分: 6.27/10(加权分之和 62.5 / 权重之和 9.5) 最终建议: Borderline (5-6.5) — 严谨的阴性结论,统计骨架强,但缺少 small-model 直接对照复现,且 Δ=5 等价界偏粗,导致”反驳前人”的核心 claim 强度不足。建议作者补做 (a) 在 wav2vec2 small 模型上复现 Khare/Nowakowski 的正向结果作为对照、(b) Δ=1/2/3 的 sensitivity analysis、(c) 报告绝对 WER 与 OmniASR 论文低资源语 WER 的对比锚点。