把报告当作一张快照,而不是身份证

一份报告回答的是“这段录音呈现出怎样的听感”。它不是给人永久贴标签,也不是对身份、年龄或价值作出判断。

主音色与三音色组合

主音色是当前录音中匹配度最高的声音印象。它抓住最突出的方向,但不会覆盖全部细节。第二、第三音色补充温度、稳定度、活跃感或声音位置,因此三音色组合通常比只看一个名称更完整。

这些名称是为了帮助阅读声学特征而设计的娱乐性词条。同一个人改变语气、设备或录音环境后,主音色变化属于正常现象。

人群占比与稀有度称号

人群占比来自匿名累计记录:主音色占比比较“多少次分析以这个词条作为第一项”,组合占比比较“不区分顺序的三音色组合出现了多少次”。它反映系统记录中的常见程度,而不是现实人口比例。

稀有度称号依据精确的出现次数除以总次数计算。样本不断增加,某个组合的百分比和称号可能随时间变化。稀有并不代表更好,常见也不代表平庸。

为什么有时显示 0%页面为了易读会限制小数位;一个组合即使出现过一次,也可能因为总体样本很大而四舍五入为 0%。称号判断使用未四舍五入的真实比率。

女性、男性与中性声线倾向

这三项是声音听感方向的相对分布,来源于音高、共振结构和多项声学信号的综合推断。页面取最高百分比作为公开倾向,但当几项十分接近时,结果本身就代表边界模糊。

“女性声线倾向”不等于女性,“男性声线倾向”不等于男性,“中性”也不是身份分类。算法无法从一段普通录音可靠确认说话人的生理信息。

年龄感为什么只是听感

年龄感描述声音给人的年轻、成熟或稳定印象。语速、表达方式、音色位置与录音质量都会改变这种感觉。成年人可以呈现年轻听感,年轻人也可能呈现沉稳听感,所以报告不会把它写成真实年龄。

八项声音质感应该怎样比较

音调、明亮、轻柔、厚重、活跃、稳定、温暖与清晰是同一段录音的不同投影。单项高低没有统一优劣;播报需要的稳定和清晰,与角色配音需要的变化和张力并不相同。

最有意义的比较方式,是让同一个人在相似设备和环境下录制不同表达,再观察哪些维度随语气变化、哪些相对稳定。

先看录音质量,再看标签

有效人声过短、背景音乐过强、削波爆音或降噪过度,都可能让标签看起来很确定却缺少可靠基础。如果质量提示异常,应先重新录制,而不是反复尝试直到得到喜欢的结果。