|
[1]Xinhui Hu, Xugang Lu, and Chiori Hori."Mandarin “Speech Recognition Using Convolution Neural Network with Augmented Tone Features” International Symposium on Chinese Spoken Language Processing (ISCSLP), 2014. [2]Takuya Yoshioka, Shigeki Karita, and Tomohiro Nakatani. “Far-Field Speech Recognition using CNN-DNN-HMM with Convolution in time” IEEE ICASSP, 2015. [3]Mirco Ravanellix, Philemon Brakely, Maurizio Omologox, and Yoshua Bengioy. “Batch-Normalized Joint Training for DNN-Based Distant Speech Recognition” IEEE GlobalSIP, 2016. [4]Yuan Liu, Yanmin Qian, Nanxin Chen, Tianfan Fu, Ya Zhang, and Kai Yu. “Deep feature for text-dependent speaker verification” ScienceDirect.Speech.Communication.73, July 2015. [5]Omid Ghahabi and Javier “Hernando Deep Learning Backend for Single and Multi-Session i-Vector Speaker Recognition” IEEE/ACM Transactions on Audio, Speech, and Language Processing. , 2017. [6]Ehsan Variani, Xin Lei, Erik McDermott, Ignacio Lopez Moreno, and Javier Gonzalez-Dominguez “Deep Neural Networks for Small Footprint text-dependent Speaker Vverification,” IEEE.International Conference on Acoustic, Speech and Signal Processing., 2014. [7]Panu Somervuo, Aki Härmä, and Seppo and Fagerlund “Parametric Representations of Bird Sounds for Automatic Species Recognition” IEEE Transactions on Audio, Speech, and Language Processing, 2006 [8]Amirsina Torfi, Jeremy Dawson, and Nasser M. Nasrabadi “Text-Independent Speaker Verification Using 3D Convolutional Neural Networks” cornell university Computer Science > Computer Vision and Pattern Recognition, 2017 [9]IEEE Subcommittee, IEEE Recommended Practice for Speech Quality Measurements. IEEE Trans. Audio and Electroacoustics, AU-17(3), 225-246, 1969.
|