Research
我们在打造这个产品时做过的测量,连同方法和局限一起公开,方便你核查。有意保持短清单——只有在背后有实验或数据集的内容,才会上这一页。
这里什么才算研究
只有背后有实验或数据集的内容,才会出现在这个栏目里。这把行业里大多数所谓“研究”排除在外:改写的新闻稿、样本不透明的问卷,或没有方法的跑分。如果我们不能告诉你如何复现实验数据,我们就不发布这个数字。
每一页都会把方法写到可复现的细度,原样报告测量结果,并把局限放在和结果一样显眼的位置。局限不是免责声明——它告诉你发现是否适用于你的情形。对合成测试音的测量能精准说明算法,却很难说明一首商业母带;把话说清,才是研究,不是营销。
所有图表都标注采集日期。在模型版本按月发布的领域里,一个没日期的基准更像传闻而非事实;这里任何超过一个季度的内容,在你依赖它之前都该重新核对。
内页
我们测了什么
实验在内部完成,方法公开,方便你复现。
1 / 5
这个圈子的大多说法都没出处
在几乎没人可信的领域,公开方法是最省事也最靠谱的做法。
负面结果也有用
什么都没发现的实验也会发,因为知道什么不管用能省时间。
也能约束我们自己的文案
公开过的指标,让我们以后没法悄悄往上抬。
读者能来验我们
最好的纠错,是有人重跑测试告诉我们错了。
常见问题
这里发布什么类型的研究?
原创测量——比如怎么测试分离质量、搜索引擎如何索引 AI 音乐网站——每个数字都配上方法,方便复现。
这些研究经过同行评审吗?
没有。是内部测量,连同方法和局限一起公开。这跟学术发表不是一回事,读的时候也该按这个标准来看。
我可以引用这些研究吗?
可以,但要带日期和文中列出的局限。每项研究都会写明没测到什么,这和测到什么同样重要。
为什么要把局限写出来?
因为没有边界的测量只是一句营销话。要复现实验的人需要知道它在哪个点之后就不再有效。
会不会发布负面结果?
会。没能验证预期的方法,对读者比验证成功的更有用;把这些删掉,研究页就会变成营销页。
我可以提需求让你们做一项研究吗?
欢迎提建议,尤其是那些到处流传却没有任何量化数据的说法。它们最值得拿来测。











