本論文提出一個新的可變速率語音編碼器,可操作於不同的位元率,且提供合理的語音品質。系統的主要架構採用一個適應性的語音預測器,並將所得的誤差語音信號作離散餘弦轉換,最後再根據人類聽覺系統的心理聲學特性來對離散餘弦轉換的係數加以量化。換言之,人類的聽覺特徵,以及語音信號本身所具有的特性,將同時被列入考量,以獲得更佳的演算法。此外,這個以離散餘弦轉換為基礎的編碼器,將可藉由傳送不同數量的離散餘弦轉換之係數,以達到可變位元率的要求,同時而不破壞基本的演算架構。 接著,我們更進一步地在一顆單獨的TMS320C30數位信號處理器上,實現了一個包含編碼以及解碼的完整系統。經由系統的整體評估,我們相信所提出的語音編碼器,將得以在合理的運算複雜度之下,提供可接受的語音品質。是故,這個語音編碼器架構,亦相當適於應用在實際的通訊設備上,以負責語音相關的服務。
|