我已获取全文及研究背景。以下是我的结构化综述。


Paper Review: Do Text-to-Music Models Really Follow Instructions? A Counterfactual Evaluation of Key and Beat Grouping

论文类型: Benchmark型 + 分析型

该论文提出一个 matched counterfactual 评测框架,用于区分 text-to-music 模型的”目标出现率”与”指令可归因控制”,并应用于三个开放系统的 global key 和 beat grouping。核心贡献是评测方法论 + 经验发现,归为 benchmark 型(附带分析型特征)。

公理审查结果

公理一:对象公理

公理二:识别公理

公理三:独立性公理

公理四:压缩公理

公理五:效用公理

公理六:新颖性公理

公理七:可复现公理

日报摘要

总评

打分

Axiom 判定 分数 权重 加权分
一 对象公理 9 1.0 9.0
二 识别公理 9 1.5 13.5
三 独立性公理 9 1.0 9.0
四 压缩公理 9 1.0 9.0
五 效用公理 9 2.0 18.0
六 新颖性公理 9 2.0 18.0
七 可复现公理 ⚠️ 7 1.0 7.0

加权总分: 8.4/10(加权分之和 83.5 / 权重之和 9.5) 最终建议: Accept ≥8