[1] E. M. Grais and M. D. Plumbley, Combining Fully Convolutional and Recurrent Neural Networks for Single Channel Audio Source Separation, In Audio Engineering Society Convention 144. Audio Engineering Society, 2018.
[2] M. H. Kolekar, Intelligent Video Surveillance Systems: An Algorithmic Approach, CRC Press, 2018.
[3] Y. Kortli, M. Jridi, A. Al Falou and M. Atri, Face recognition systems: A Survey, Sensors, 20 (2020) 342.
[4] J. Kotus, K. Lopatka, A. Czyz˙ewski, G. Bogdanis and June, Audio-visual surveillance system for application in bank operating room, Int Conf Multimedia Commun Serv Secur., Springer, Berlin, Heidelberg, 2013, pp. 107-120.
[5] G. O’Regan, Artificial Intelligence and Applications, Springer, 2018.
[6] C. H. Taal, R. C. Hendriks, R. Heusdens and J. A. Jensen, short-time objective intelligibility measure for timefrequency weighted noisy speech, In 2010 IEEE Int. Conf. Acoustics, Speech and Signal processing, IEEE, (2010) pp.4214-4217.
[7] A. Torfi, S. M. Iranmanesh, N. Nasrabadi and J. Dawson, 3d convolutional neural networks for cross audio-visual matching recognition, IEEE Access, 5 (2017) 22081–22091.