
TTS
Text-to-Speech
Bert-VITS2를 활용한 중국어(표준어) 음성 합성 시스템 구축
AISHELL-3 데이터셋과 Bert-VITS2 프레임워크를 활용한 중국어 음성 합성(TTS) 시스템 개발 연구입니다.
Boxuan Lyu - Tokyo Institute of Technology
3 min
VoicePing의 벤치마크, 연구 방법론, 모델 평가 및 제품 연구를 확인하세요.
27개의 글

AISHELL-3 데이터셋과 Bert-VITS2 프레임워크를 활용한 중국어 음성 합성(TTS) 시스템 개발 연구입니다.

Llama 3.1을 활용한 영중 양방향 번역에서의 RAFT 방법론 탐구

Llama 3.1의 중영 번역 파인튜닝과 환각 완화 전략에 관한 연구

DER 분석과 실시간 애플리케이션 개발을 통한 화자 분리 프레임워크 비교 평가. Pyannote.audio와 Nvidia NeMo의 성능 차이를 검증합니다.
영어 발화에서 음절별 강세 수준을 식별하는 Self-Attention 모델 연구

TF-IDF 검색을 활용하여 GPT-4 번역의 In-Context Learning 성능을 향상시키는 방법에 관한 연구 보고서입니다.