由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

speech-synthesis

话题找到数量

OpenBMB/VoxCPM

VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统

30k
3.4k
701
+418
排名 #5
6月17日
查看详情

NVIDIA-NeMo/Speech

一个可扩展的生成式 AI 框架,专为从事大语言模型、多模态及语音 AI(自动语音识别与文本转语音)的研究人员和开发者构建。

17k
3.5k
445
+19
排名 #12
8月5日
查看详情

NVIDIA-NeMo/NeMo

专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架

17k
3.4k
962
+9
排名 #22
6月12日
查看详情

NVIDIA/DeepLearningExamples

按模型组织的尖端深度学习脚本——易于在企业级基础设施上进行训练和部署,并具备可复现的准确性与性能。

14k
3.4k
523
排名 #8
5月16日
查看详情

supertone-inc/supertonic

闪电般快速、设备端运行的多语言TTS——通过ONNX原生执行。

13k
1.4k
498
+8
排名 #8
7月31日
查看详情

abus-aikorea/voice-pro

为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。

12k
1.7k
65
+46
排名 #11
8月3日
查看详情

huggingface/speech-to-speech

语音转语音:致力于构建开源模块化GPT4-o的项目

10k
1.3k
564
+4k
排名 #11
8月2日
查看详情

espeak-ng/espeak-ng

eSpeak NG是开源语音合成器,支持上百种语言和口音

6.6k
1.3k
562
+4
排名 #9
7月12日
查看详情

snakers4/silero-models

Silero模型:提供预训练语音转文本、文本转语音和文本增强模型,极致简化实现

6k
370
70
+5
排名 #15
8月4日
查看详情

openutau/OpenUtau

开放歌唱合成平台 / 开源UTAU继任者

4.1k
534
394
+5
排名 #16
7月31日
查看详情

stakira/OpenUtau

开放歌声合成平台/开源UTAU后继项目

3.9k
492
623
+6
排名 #6
6月1日
查看详情
助手