在线录音、网页录音为什么都不该上传任何东西
提供这个功能的网站几乎都是录到自己服务器上的。对这种文件类型来说,这是个奇怪的默认值:一段人声录音 能识别出你是谁、装着你当时说的任何话,而且如今这样的素材量已经足够合成出你的声音。
技术上压根没有上传的必要。MediaRecorder 在所有主流浏览器里都存在好多年了,它在本地就能产出一个
完成的、能播的文件。所以这里的做法是:在页面里录、在页面里回放、以下载的形式交给你。在你保存之前,
存在的唯一副本就是你标签页里那一份。
实际后果是:刷新页面录音就没了。这是"服务器上没有副本"的代价,而这个方向是对的。
在线录人声时把电平调对
电平表之所以在这儿,是因为电平是唯一事后补不了的东西。
峰值瞄准 −6 到 −12 dBFS 之间。响到足以明显高过房间噪声,又轻到一声笑或者一个加重的词还有地方去。
如果顶端几格变红,你在削顶。波形已经撞到天花板、峰值被削平了:那部分信息没了,再怎么剪辑也找不回来。 事后调小只会得到一段"安静的失真录音"。往后退一点或者把输入增益调小,重录一遍。
你停止说话时电平表显示的,是你的底噪。低而稳是正常的。如果它能点亮好几格,说明房间里有什么东西很 响,或者你的输入增益太大了。
在线录音怎么录出一段真能用的东西
好录音和差录音之间的差别,大部分来自三件事,而其中没有一件是设备。
距离。离麦克风一掌宽,稍微偏一点轴,别让爆破音直冲振膜。再远,你录到的房间就比人声多了。
房间。软的表面吸收反射,硬的平行墙面制造反射。一个有地毯、窗帘和家具的房间,和一间贴瓷砖的卫生间 或者空办公室,用同一支麦克风录出来的差别是巨大的。
连续性。如果这段录音是给声音模型当参考、或者要当旁白垫底,那就录连续自然的说话,而不是一句一句拼; 并且在开头留两秒静音,让之后处理它的东西有一段你房间底噪的样本。
格式意味着什么
工具会挑你浏览器支持的最好的容器,并按它给文件命名。WebM 装 Opus 是 Chrome 和 Firefox 的产出, MP4 装 AAC 是 Safari 的产出。两者在任何值得用的编辑器里都打得开,而且对语音来说都比 WAV 高效得多。
如果你确实需要 WAV,就在这儿录完再转。在浏览器标签页里录无压缩音频虽然做得到,但对语音而言没有可听 的收益,内存却掉得很快。