aliang-voice
Popular repositories Loading
-
bddm
bddm PublicForked from tencent-ailab/bddm
BDDM: Bilateral Denoising Diffusion Models for Fast and High-Quality Speech Synthesis
Python
-
FastDiff
FastDiff PublicForked from Rongjiehuang/FastDiff
PyTorch Implementation of FastDiff (IJCAI'22)
Python
-
audioset_tagging_cnn
audioset_tagging_cnn PublicForked from qiuqiangkong/audioset_tagging_cnn
AI听曲识歌
Python
-
demucs
demucs PublicForked from facebookresearch/demucs
Code for the paper Hybrid Spectrogram and Waveform Source Separation
Python
-
-
vits
vits PublicForked from jaywalnut310/vits
VITS: Conditional Variational Autoencoder with Adversarial Learning for End-to-End Text-to-Speech
Python
Repositories
- python-audio-separator Public Forked from nomadkaraoke/python-audio-separator
Easy to use stem (e.g. instrumental/vocals) separation from CLI or as a python package, using a variety of amazing pre-trained models (primarily from UVR)
- DiffRhythm Public Forked from ASLP-lab/DiffRhythm
Di♪♪Rhythm: Blazingly Fast and Embarrassingly Simple End-to-End Full-Length Song Generation with Latent Diffusion
- fast-whisper-server Public Forked from plaggy/fast-whisper-server
ASR + diarization model server with speculative decoding
- stable-audio-tools Public Forked from Stability-AI/stable-audio-tools
Generative models for conditional audio generation
- translation-starter Public Forked from synchronicity-labs/translation-starter
translation-starter是一个开源项目,它允许你很快地部署一个应用程序,这个应用可以将任何视频翻译成任何语言,并通过AI技术实现口型与声音的完美同步。如果你需要快速集成视频翻译、声音克隆和口型同步到你的业务或流程中,这个工具可以在15分钟内帮助你搭建起来。
- stable-audio-metrics Public Forked from Stability-AI/stable-audio-metrics
Metrics for evaluating music and audio generative models – with a focus on long-form, full-band, and stereo generations.
People
This organization has no public members. You must be a member to see who’s a part of this organization.
Top languages
Loading…
Most used topics
Loading…