Paper Review: What does the model actually see? Evaluation protocols and input availability in data-driven prediction of room acoustic parameters

论文类型: 分析型(兼问题定义型)

本文定义了一个评估协议分类体系(split design × input availability 的 2×4 grid),并通过控制性因子消融实验在两个厅堂上量化了协议选择对报告精度的影响。核心贡献是揭示了一个领域内广泛存在的评估错误模式,而非提出新模型或新数据。按分析型论文的尺子审查。

公理审查结果

公理一:对象公理

公理二:识别公理

公理三:独立性公理

公理四:压缩公理

公理五:效用公理

公理六:新颖性公理

公理七:可复现公理

日报摘要

总评

打分

Axiom 判定 分数 权重 加权分
一 对象公理 9 1.0 9.0
二 识别公理 9 1.5 13.5
三 独立性公理 9 1.0 9.0
四 压缩公理 8 1.0 8.0
五 效用公理 ⚠️ 6 2.0 12.0
六 新颖性公理 8 2.0 16.0
七 可复现公理 ⚠️ 6 1.0 6.0

加权总分: 7.7/10(加权分之和 73.5 / 权重之和 9.5) 最终建议: Weak Accept (6.5-8)

核心理由: 论文在识别公理和独立性公理上表现突出——因子消融设计干净、因果归因明确、自我批评诚实。协议网格和 position fingerprint 发现是真实的领域增量,reporting checklist 有直接操作价值。主要扣分来自效用公理(单 campaign、honest 协议下多数参数不可用)和可复现公理(数据非完全开源、CNN 超参数未报告)。建议接收的条件是:(1) 补充第三个厅堂的 grouped-position replication(作者已在 [19] 中预注册);(2) 论文发表时同步公开代码、splits、seeds 和 per-fold results;(3) 补充 hybrid CNN 的训练超参数表。