首先就放弃了他唯一可能有优势的一点文字转WAV音频