由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
项目竞品项目
RVC-Boss/GPT-SoVITS
1分钟的语音数据也可以用来训练一个好的TTS模型! (几张声音克隆镜头)
debpalash/VoiceStudio
VoiceStudio 是 ElevenLabs 的开源、完全本地化替代方案 — 提供 646 种语言的语音克隆、语音设计、视频配音、听写、转录和有声读物创建。
jamiepine/voicebox
开源语音合成工作室
fishaudio/fish-speech
顶尖开源文本转语音系统
RVC-Project/Retrieval-based-Voice-Conversion-WebUI
用不超过10分钟的语音数据轻松训练优质语音克隆模型!
ATH-MaaS/Pixelle-Video
🚀 AI 短视频引擎 | AI全自动短视频引擎
index-tts/index-tts
工业级可控高效的零样本文本转语音系统
OpenBMB/VoxCPM
VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统
myshell-ai/OpenVoice
MIT与MyShell联合开发的即时语音克隆技术
huggingface/speech-to-speech
语音转语音:致力于构建开源模块化GPT4-o的项目
NVIDIA-NeMo/NeMo
专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架
Huanshere/VideoLingo
Netflix级字幕切割、翻译、对齐、甚至加上配音,一键全自动AI视频字幕团队
AIDC-AI/Pixelle-Video
🚀 AI全自动短视频引擎
yt-dlp/yt-dlp
功能丰富的命令行音视频下载器
NVIDIA-NeMo/Speech
一个可扩展的生成式 AI 框架,专为从事大语言模型、多模态及语音 AI(自动语音识别与文本转语音)的研究人员和开发者构建。
AUTOMATIC1111/stable-diffusion-webui
Stable Diffusion网页界面
calesthio/OpenMontage
全球首个开源智能体视频制作系统,集成12条流水线、52种工具及500余项智能体技能,可将您的AI编程助手转变为完整的视频制作工作室。
modelscope/FunASR
端到端语音识别基础工具包与开源SOTA预训练模型,支持语音识别、语音活动检测、文本后处理等功能。
DrewThomasson/ebook2audiobook
从电子书生成有声书,支持语音克隆及1107种以上语言!
krillinai/KrillinAI
基于大语言模型的视频翻译配音工具,支持99种语言双向翻译,提供一键式全流程部署,可生成适配YouTube、TikTok和Shorts等平台的内容
相关项目推荐
public-apis/public-apis
免费API资源汇总列表
EbookFoundation/free-programming-books
📚 免费提供的编程书籍
vinta/awesome-python
回答“我想用 Python 做 X,我应该使用哪个工具?”的最终列表。
practical-tutorials/project-based-learning
基于项目的教程精选列表
NousResearch/hermes-agent
与你共同成长的智能体
TheAlgorithms/Python
所有算法均使用Python实现