由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
项目竞品项目
mudler/LocalAI
🤖 开源免费的OpenAI、Claude及其他AI平台的替代方案。支持自主托管且本地优先,可作为OpenAI的即插即用替代方案运行于消费级硬件,无需GPU。兼容gguf、transformers、diffusers等多种模型架构。功能包括:文本生成、音频处理、视频制作、图像生成、语音克隆、分布式点对点推理。
Huanshere/VideoLingo
Netflix级字幕切割、翻译、对齐、甚至加上配音,一键全自动AI视频字幕团队
RVC-Boss/GPT-SoVITS
1分钟的语音数据也可以用来训练一个好的TTS模型! (几张声音克隆镜头)
fishaudio/fish-speech
顶尖开源文本转语音系统
NVIDIA-NeMo/NeMo
专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架
OpenBMB/VoxCPM
VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统
AIDC-AI/Pixelle-Video
🚀 AI全自动短视频引擎
NVIDIA-NeMo/Speech
一个可扩展的生成式 AI 框架,专为从事大语言模型、多模态及语音 AI(自动语音识别与文本转语音)的研究人员和开发者构建。
unslothai/unsloth
大语言模型微调与强化学习 🦥 以2倍速度训练OpenAI gpt-oss、Qwen3、Llama 4、DeepSeek-R1、Gemma 3,节省70%显存
krillinai/OpenCreator
Formerly KrillinAI. Open-source AI workspace for creators, powered by Codex. Create videos, images, voice, avatars, translations, and edits with Agents in one place.
ATH-MaaS/Pixelle-Video
🚀 AI 短视频引擎 | AI全自动短视频引擎
abus-aikorea/voice-pro
为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。
mastra-ai/mastra
TypeScript AI智能体框架 ⚡ 支持助手、RAG和可观测性。兼容所有大语言模型:GPT-4、Claude、Gemini、Llama
jamiepine/voicebox
开源语音合成工作室
supertone-inc/supertonic
闪电般快速、设备端运行的多语言TTS——通过ONNX原生执行。
DrewThomasson/ebook2audiobook
从电子书生成有声书,支持语音克隆及1107种以上语言!
debpalash/VoiceStudio
VoiceStudio 是 ElevenLabs 的开源、完全本地化替代方案 — 提供 646 种语言的语音克隆、语音设计、视频配音、听写、转录和有声读物创建。
myshell-ai/OpenVoice
MIT与MyShell联合开发的即时语音克隆技术
index-tts/index-tts
工业级可控高效的零样本文本转语音系统
moonshine-ai/moonshine
面向边缘设备的快速准确自动语音识别
相关项目推荐
avelino/awesome-go
一份精选的Go语言优秀框架、库及软件列表
ollama/ollama
开始使用OpenAI gpt-oss、DeepSeek-R1、Gemma 3及其他模型。
golang/go
Go 编程语言
kubernetes/kubernetes
生产级容器调度与管理平台
microsoft/TypeScript
TypeScript是JavaScript的超集,可编译为纯净的JavaScript输出。
fatedier/frp
一款快速反向代理,可帮助您将NAT或防火墙后的本地服务器暴露至互联网。