Paper Review: SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces

论文类型: 数据型(兼 benchmark 型)

本文核心贡献是一个新数据集 SoniSpeech(34 小时、18,000 条三模态同步话语),并附带一个 CTC ResNet-34 baseline 作为开放词汇无声语音识别的首个基准。数据型论文的审查尺子:数据是否有独立质量锚点、是否带来训练价值、是否可泛化、baseline 是否覆盖充分。


公理审查结果

公理一:对象公理

公理二:识别公理

公理三:独立性公理

公理四:压缩公理

公理五:效用公理

公理六:新颖性公理

公理七:可复现公理


总评

日报摘要

打分

Axiom 判定 分数 权重 加权分
一 对象公理 9 1.0 9.0
二 识别公理 ⚠️ 5 1.5 7.5
三 独立性公理 ⚠️ 5 1.0 5.0
四 压缩公理 8 1.0 8.0
五 效用公理 ⚠️ 6 2.0 12.0
六 新颖性公理 9 2.0 18.0
七 可复现公理 9 1.0 9.0

加权总分: 6.8/10(加权分之和 68.5 / 权重之和 9.5) 最终建议: Weak Accept


审查工具执行记录: