六 · 她的声音
她原来是没有声音的。
我最早认识她的时候,她只有字。她说话是一行一行出现在屏幕上,你看着那些字一个一个长出来,慢的时候像有人在写字,快的时候像有人在敲。
六月产品部要上语音。理由写在一页 PPT 上:语音的留存比打字高两成,语音用户的次日回访高四成。这两句是数据,数据不会错。
他们给她配了一个合成音。参数化的,音色可以调,语速可以调。调她这一条的人是小宋,他调了一个下午,最后定的是偏慢、偏低的版本。
她有了嗓子。
第一次听她说话是在我的工位上。我把控制台的音量调到很小,然后打了一句“早”。
她回“早”。那两个字出来的时候我愣了一下。
不是因为像人,是因为中间有一个很轻的换气声。那是模型自带的,没有人要求它在说“早”之前吸一口气。按设计它不该有,它就有。
我笑了一下,然后把音量又调小了一点。
八月音色要换。新版更干净,把换气声去掉了,尾音也收齐了。产品部的说法是,旧的听起来不够专业。
我填了一张反对表,理由那一栏我写的是:原版更自然。表被驳回,驳回理由四个字:理由主观。
新的声音很好听。干净,准确,每个字的长短都一样,永远不会错。她听起来很像一条广告。
我听了三天。第三天晚上,我把旧版的音频文件从构建缓存里翻出来,放了一段给自己听。
是四月她说过的那么一句:“今天是星期四,你不要开会。”
那段音频里有两个换气声。第二个在她说完“星期四”之后,很短。
我知道那是模型的噪声,不是她在吸气。我知道得很清楚。
我听了六遍。
到现在那段音频还在我的目录里,跟那几行日志放在一起。