VoiceSplit
VoiceSplit: Targeted Voice Separation by Speaker-Conditioned Spectrogram
파일 탐색기
최종 버전 다운로드 (.zip)- 1701-141760-0023.251-136532-0023.wav
- 1988-147956-0028.84-121123-0026.wav
- 2078-142845-0028.4153-186222-0000.wav
- 251-137823-0002.6455-67803-0007.wav
- 2902-9008-0008.116-288045-0003.wav
- 3081-166546-0036.3170-137482-0042.wav
- 4831-18525-0005.3576-138058-0010.wav
- 5849-50964-0009.6267-65525-0027.wav
- 6241-61943-0015.84-121123-0002.wav
- 6841-88291-0003.1585-157660-0013.wav
- 1701-141760-0023.251-136532-0023-norm.wav
- 1701-141760-0023.251-136532-0023.wav
- 1988-147956-0028.84-121123-0026-norm.wav
- 1988-147956-0028.84-121123-0026.wav
- 2078-142845-0028.4153-186222-0000-norm.wav
- 2078-142845-0028.4153-186222-0000.wav
- 251-137823-0002.6455-67803-0007-norm.wav
- 251-137823-0002.6455-67803-0007.wav
- 2902-9008-0008.116-288045-0003-norm.wav
- 2902-9008-0008.116-288045-0003.wav
- 3081-166546-0036.3170-137482-0042-norm.wav
- 3081-166546-0036.3170-137482-0042.wav
- 4831-18525-0005.3576-138058-0010-norm.wav
- 4831-18525-0005.3576-138058-0010.wav
- 5849-50964-0009.6267-65525-0027-norm.wav
- 5849-50964-0009.6267-65525-0027.wav
- 6241-61943-0015.84-121123-0002-norm.wav
- 6241-61943-0015.84-121123-0002.wav
- 6841-88291-0003.1585-157660-0013-norm.wav
- 6841-88291-0003.1585-157660-0013.wav
- 1701-141760-0023.251-136532-0023.wav
- 1988-147956-0028.84-121123-0026.wav
- 2078-142845-0028.4153-186222-0000.wav
- 251-137823-0002.6455-67803-0007.wav
- 2902-9008-0008.116-288045-0003.wav
- 3081-166546-0036.3170-137482-0042.wav
- 4831-18525-0005.3576-138058-0010.wav
- 5849-50964-0009.6267-65525-0027.wav
- 6241-61943-0015.84-121123-0002.wav
- 6841-88291-0003.1585-157660-0013.wav
- 116-288045-0003-norm.wav
- 116-288045-0003.wav
- 1585-157660-0013-norm.wav
- 1585-157660-0013.wav
- 1701-141760-0023-norm.wav
- 1701-141760-0023.wav
- 1988-147956-0028-norm.wav
- 1988-147956-0028.wav
- 2078-142845-0028-norm.wav
- 2078-142845-0028.wav
- 251-136532-0023-norm.wav
- 251-136532-0023.wav
- 251-137823-0002-norm.wav
- 251-137823-0002.wav
- 2902-9008-0008-norm.wav
- 2902-9008-0008.wav
- 3081-166546-0036-norm.wav
- 3081-166546-0036.wav
- 3170-137482-0042-norm.wav
- 3170-137482-0042.wav
- 3576-138058-0010-norm.wav
- 3576-138058-0010.wav
- 4153-186222-0000-norm.wav
- 4153-186222-0000.wav
- 4831-18525-0005-norm.wav
- 4831-18525-0005.wav
- 5849-50964-0009-norm.wav
- 5849-50964-0009.wav
- 6241-61943-0015-norm.wav
- 6241-61943-0015.wav
- 6267-65525-0027-norm.wav
- 6267-65525-0027.wav
- 6455-67803-0007-norm.wav
- 6455-67803-0007.wav
- 6841-88291-0003-norm.wav
- 6841-88291-0003.wav
- 84-121123-0002-norm.wav
- 84-121123-0002.wav
- 84-121123-0026-norm.wav
- 84-121123-0026.wav
- 1701-141759-0022-norm.wav
- 1701-141759-0022.wav
- 1988-148538-0011-norm.wav
- 1988-148538-0011.wav
- 2078-142845-0015-norm.wav
- 2078-142845-0015.wav
- 251-137823-0003-norm.wav
- 251-137823-0003.wav
- 2902-9006-0010-norm.wav
- 2902-9006-0010.wav
- 3081-166546-0016-norm.wav
- 3081-166546-0016.wav
- 4831-29134-0017-norm.wav
- 4831-29134-0017.wav
- 5849-50873-0018-norm.wav
- 5849-50873-0018.wav
- 6241-66616-0019-norm.wav
- 6241-66616-0019.wav
- 6841-88294-0035-norm.wav
- 6841-88294-0035.wav
- 1701-141760-0023.wav
- 1988-147956-0028.wav
- 2078-142845-0028.wav
- 251-137823-0002.wav
- 2902-9008-0008.wav
- 3081-166546-0036.wav
- 4831-18525-0005.wav
- 5849-50964-0009.wav
- 6241-61943-0015.wav
- 6841-88291-0003.wav
- 1701-141760-0023.wav
- 1988-147956-0028.wav
- 2078-142845-0028.wav
- 251-137823-0002.wav
- 2902-9008-0008.wav
- 3081-166546-0036.wav
- 4831-18525-0005.wav
- 5849-50964-0009.wav
- 6241-61943-0015.wav
- 6841-88291-0003.wav
- dev.csv
- README.md
- test_config.csv
- test_demo.csv
- train.csv
- train_small.csv
- dev.csv
- model.py
- model.py
- embedder.pt
- GE2E-CorentinJ-ExtractSpeakerEmbedding.ipynb
- GE2E-Seungwonpark-ExtractSpeakerEmbedding-adaptado-para-openvoicefilter.ipynb
- GE2E-Seungwonpark-ExtractSpeakerEmbedding-adaptado-para-openvoicefilter.py
- GE2E-Seungwonpark-ExtractSpeakerEmbedding.ipynb
- nohup.out
- Speech2Phone-ExtractSpeakerEmbeddings.ipynb
- generate_VCTK_dev_csv.py
- normalise-resample.sh
- resample-audio-files.sh
- test_extract_audio.py
- test_extract_audio_torch.py
- .goutputstream-LQ55M0
- .goutputstream-YRB4M0
- audio.py
- audio_processor.py
- dataset.py
- generic_utils.py
- stft.py
- tensorboard.py
- .gitignore
- config.json
- convert.py
- Final Report.pdf
- generator_paper.py
- LICENSE
- log-out.txt
- Partial Report.pdf
- preprocess_by_csv.py
- preprocess_by_csv_without_voice_overlay.py
- README.md
- requirements.txt
- run_train.sh
- run_train.sh.save
- test.py
- test_all_checkpoints.py
- test_fast_all_checkpoints.py
- train.py
- VoiceSplit presentation.pdf
# 설치 가이드
1. 코드 내려받기
git clone https://github.com/Edresson/VoiceSplit
깃허브에서 프로젝트 코드 전체를 내 컴퓨터로 내려받습니다.
cd VoiceSplit
방금 내려받은 프로젝트 폴더 안으로 이동합니다.
2. Python
쉬움 추천사전 준비물
pip install -r requirements.txt
requirements.txt 등에 명시된 파이썬 라이브러리를 설치합니다.
jupyter notebook
브라우저에서 노트북(.ipynb) 파일들을 열람하고 실행할 수 있는 Jupyter 화면을 켭니다.
에러 메시지 없이 실행되고 터미널에 안내 문구가 출력되면 정상입니다.
// repository documentation
Was this content helpful?
(0 ratings)
