由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
项目竞品项目
AIDC-AI/Pixelle-Video
🚀 AI全自动短视频引擎
Comfy-Org/ComfyUI
最强大且模块化的扩散模型图形用户界面、应用程序接口及后端,提供基于图或节点的交互界面。
NVIDIA-NeMo/NeMo
专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架
calesthio/OpenMontage
全球首个开源智能体视频制作系统,集成12条流水线、52种工具及500余项智能体技能,可将您的AI编程助手转变为完整的视频制作工作室。
abus-aikorea/voice-pro
为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。
invoke-ai/InvokeAI
Invoke是面向Stable Diffusion模型的领先创意引擎,助力专业人士、艺术家和爱好者运用尖端AI驱动技术生成与创作视觉媒体。
fishaudio/fish-speech
顶尖开源文本转语音系统
NVIDIA-NeMo/Speech
一个可扩展的生成式 AI 框架,专为从事大语言模型、多模态及语音 AI(自动语音识别与文本转语音)的研究人员和开发者构建。
AUTOMATIC1111/stable-diffusion-webui
Stable Diffusion网页界面
RVC-Boss/GPT-SoVITS
1分钟的语音数据也可以用来训练一个好的TTS模型! (几张声音克隆镜头)
DrewThomasson/ebook2audiobook
从电子书生成有声书,支持语音克隆及1107种以上语言!
microsoft/TRELLIS
论文《结构化三维潜空间:可扩展与多功能三维生成》(CVPR'25焦点论文)官方代码库。
OpenBMB/VoxCPM
VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统
khoj-ai/khoj
您的AI第二大脑。支持自托管。从网络或文档中获取答案。构建自定义智能体、调度自动化任务、进行深度研究。将任何在线或本地大语言模型转化为您的个人自主AI(支持GPT、Claude、Gemini、Llama、Qwen、Mistral)。立即开始——免费使用。
unslothai/unsloth
大语言模型微调与强化学习 🦥 以2倍速度训练OpenAI gpt-oss、Qwen3、Llama 4、DeepSeek-R1、Gemma 3,节省70%显存
myshell-ai/OpenVoice
MIT与MyShell联合开发的即时语音克隆技术
index-tts/index-tts
工业级可控高效的零样本文本转语音系统
debpalash/VoiceStudio
VoiceStudio 是 ElevenLabs 的开源、完全本地化替代方案 — 提供 646 种语言的语音克隆、语音设计、视频配音、听写、转录和有声读物创建。
duixcom/Duix-Avatar
🚀 真正开源的 AI 数字人工具包,支持离线视频生成与数字人克隆
mudler/LocalAI
🤖 开源免费的OpenAI、Claude及其他AI平台的替代方案。支持自主托管且本地优先,可作为OpenAI的即插即用替代方案运行于消费级硬件,无需GPU。兼容gguf、transformers、diffusers等多种模型架构。功能包括:文本生成、音频处理、视频制作、图像生成、语音克隆、分布式点对点推理。
相关项目推荐
public-apis/public-apis
免费API资源汇总列表
EbookFoundation/free-programming-books
📚 免费提供的编程书籍
vinta/awesome-python
回答“我想用 Python 做 X,我应该使用哪个工具?”的最终列表。
practical-tutorials/project-based-learning
基于项目的教程精选列表
NousResearch/hermes-agent
与你共同成长的智能体
TheAlgorithms/Python
所有算法均使用Python实现