Papers

반위상 주요성분에 기반을 둔 개선된 음수 채널간 상관도 파라미터 합성 기법

Domestic Journal
2011~2015
작성자
한혜원
작성일
2012-08-01 01:49
조회
1238
Authors : 현동일, 이석필, 박영철, 윤대희

Year : 2012

Publisher / Conference : 한국음향학회지

Volume : 31, 제 6호

Page : 410-418

파라메트릭 스테레오와 MPEG 서라운드는 대표적인 공간 오디오 부호화 기법이다. 본 논문에서는 기존의 공간 오디오 부호화 기법에서 채널간 상관도 합성의 문제점을 분석하였다. 기존의 방법에서는 출력신호에 합성되는 주요성분들은 서로 동위상 관계에 있는 반면 잔향성분들은 서로 반위상 관계에 있다고 가정하고 있다. 음수 채널간 상관도에 대해서 이러한 가정은 잔향성분을 과도하게 포함하도록 하는 문제점을 야기할 수 있다. 이에 대한 해결책으로 음수 채널간 상관도를 가지는 경우에 대해서는 주요성분들이 반위상 관계에 있다는 가정을 기반으로 새로운 채널간 상관도 합성 기법을 제안하였다. 제안된 기법은 실제 부호화 및 복호화기에서 동작하는 근사화 과정에도 적용되었다. 컴퓨터 시뮬레이션을 통하여 제안된 기법의 성능을 평가하였으며 주관적 청취 실험을 통하여 제안된 방법이 헤드폰 환경뿐만 아니라 스피커 환경에서도 효과적으로 동작함을 검증하였다.
전체 344
344 International Conference Zhenyu Piao, Hyungseob Lim, Miseul Kim, Hong-goo Kang "PDF-NET: Pitch-adaptive Dynamic Filter Network for Intra-gender Speaker Verification" in APSIPA ASC, 2023
343 International Conference WooSeok Ko, Seyun Um, Zhenyu Piao, Hong-goo Kang "Consideration of Varying Training Lengths for Short-Duration Speaker Verification" in APSIP ASC, 2023
342 International Journal Hyungchan Yoon, Changhwan Kim, Seyun Um, Hyun-Wook Yoon, Hong-Goo Kang "SC-CNN: Effective Speaker Conditioning Method for Zero-Shot Multi-Speaker Text-to-Speech Systems" in IEEE Signal Processing Letters, vol.30, pp.593-597, 2023
341 International Conference Miseul Kim, Zhenyu Piao, Jihyun Lee, Hong-Goo Kang "BrainTalker: Low-Resource Brain-to-Speech Synthesis with Transfer Learning using Wav2Vec 2.0" in The IEEE-EMBS International Conference on Biomedical and Health Informatics (BHI), 2023
340 International Conference Seyun Um, Jihyun Kim, Jihyun Lee, Hong-Goo Kang "Facetron: A Multi-speaker Face-to-Speech Model based on Cross-Modal Latent Representations" in EUSIPCO, 2023
339 International Conference Hejung Yang, Hong-Goo Kang "Feature Normalization for Fine-tuning Self-Supervised Models in Speech Enhancement" in INTERSPEECH, 2023
338 International Conference Jihyun Kim, Hong-Goo Kang "Contrastive Learning based Deep Latent Masking for Music Source Seperation" in INTERSPEECH, 2023
337 International Conference Woo-Jin Chung, Doyeon Kim, Soo-Whan Chung, Hong-Goo Kang "MF-PAM: Accurate Pitch Estimation through Periodicity Analysis and Multi-level Feature Fusion" in INTERSPEECH, 2023
336 International Conference Hyungchan Yoon, Seyun Um, Changhwan Kim, Hong-Goo Kang "Adversarial Learning of Intermediate Acoustic Feature for End-to-End Lightweight Text-to-Speech" in INTERSPEECH, 2023
335 International Conference Hyungchan Yoon, Changhwan Kim, Eunwoo Song, Hyun-Wook Yoon, Hong-Goo Kang "Pruning Self-Attention for Zero-Shot Multi-Speaker Text-to-Speech" in INTERSPEECH, 2023