由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

tts

话题找到数量

unslothai/unsloth

大语言模型微调与强化学习 🦥 以2倍速度训练OpenAI gpt-oss、Qwen3、Llama 4、DeepSeek-R1、Gemma 3,节省70%显存

76k
7k
1.5k
+68
排名 #14
9月19日
查看详情

RVC-Boss/GPT-SoVITS

1分钟的语音数据也可以用来训练一个好的TTS模型! (几张声音克隆镜头)

61k
6.6k
1.1k
+24
排名 #19
8月27日
查看详情

jamiepine/voicebox

开源语音合成工作室

55k
6.9k
1.1k
+416
排名 #16
9月18日
查看详情

mudler/LocalAI

🤖 开源免费的OpenAI、Claude及其他AI平台的替代方案。支持自主托管且本地优先,可作为OpenAI的即插即用替代方案运行于消费级硬件,无需GPU。兼容gguf、transformers、diffusers等多种模型架构。功能包括:文本生成、音频处理、视频制作、图像生成、语音克隆、分布式点对点推理。

48k
4.4k
1.5k
+40
排名 #2
9月7日
查看详情

OpenBMB/VoxCPM

VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统

37k
4.3k
1.3k
+99
排名 #18
9月16日
查看详情

myshell-ai/OpenVoice

MIT与MyShell联合开发的即时语音克隆技术

37k
4.2k
913
+141
排名 #15
8月30日
查看详情

debpalash/VoiceStudio

VoiceStudio 是 ElevenLabs 的开源、完全本地化替代方案 — 提供 646 种语言的语音克隆、语音设计、视频配音、听写、转录和有声读物创建。

32k
3.8k
444
+10k
排名 #15
9月16日
查看详情

fishaudio/fish-speech

顶尖开源文本转语音系统

31k
2.7k
1.2k
+88
排名 #14
7月31日
查看详情

mastra-ai/mastra

TypeScript AI智能体框架 ⚡ 支持助手、RAG和可观测性。兼容所有大语言模型:GPT-4、Claude、Gemini、Llama

27k
2.7k
1.6k
+30
排名 #8
8月25日
查看详情

ATH-MaaS/Pixelle-Video

🚀 AI 短视频引擎 | AI全自动短视频引擎

27k
3.9k
741
+90
排名 #7
8月20日
查看详情

readest/readest

Readest是一款功能丰富的现代电子书阅读器,专为热爱阅读的用户设计,提供无缝跨平台访问、强大工具和直观界面,以提升您的阅读体验。

23k
1.5k
890
+39
排名 #13
8月30日
查看详情

index-tts/index-tts

工业级可控高效的零样本文本转语音系统

22k
2.8k
410
+492
排名 #12
8月16日
查看详情

AIDC-AI/Pixelle-Video

🚀 AI全自动短视频引擎

21k
3k
1.3k
+125
排名 #15
6月4日
查看详情

DrewThomasson/ebook2audiobook

从电子书生成有声书,支持语音克隆及1107种以上语言!

19k
1.7k
1.2k
+141
排名 #10
8月19日
查看详情

pot-app/pot-desktop

🌈 一款跨平台的划词翻译与OCR软件

18k
929
995
+13
排名 #9
6月26日
查看详情

NVIDIA-NeMo/Speech

一个可扩展的生成式 AI 框架,专为从事大语言模型、多模态及语音 AI(自动语音识别与文本转语音)的研究人员和开发者构建。

18k
3.6k
1.1k
+42
排名 #17
8月24日
查看详情

NVIDIA-NeMo/NeMo

专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架

17k
3.4k
1.6k
+9
排名 #22
6月12日
查看详情

supertone-inc/supertonic

闪电般快速、设备端运行的多语言TTS——通过ONNX原生执行。

13k
1.5k
1k
+8
排名 #15
9月8日
查看详情

abus-aikorea/voice-pro

为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。

12k
1.7k
668
+46
排名 #11
8月3日
查看详情

krillinai/KrillinAI

基于大语言模型的视频翻译配音工具,支持99种语言双向翻译,提供一键式全流程部署,可生成适配YouTube、TikTok和Shorts等平台的内容

11k
1.1k
1.2k
+34
排名 #6
8月17日
查看详情

moonshine-ai/moonshine

面向边缘设备的快速准确自动语音识别

10k
603
1.2k
+12
排名 #16
9月2日
查看详情

VoltAgent/voltagent

基于开源TypeScript AI智能体框架构建的AI智能体工程平台

8.8k
891
1k
+38
排名 #10
5月12日
查看详情

santinic/audiblez

将电子书转换为有声读物

7.8k
672
862
+28
排名 #17
6月20日
查看详情

GetStream/Vision-Agents

Stream 推出的开放视觉智能体平台。使用任意模型或视频提供商快速构建视觉智能体。利用 Stream 的边缘网络实现超低延迟。

7.1k
536
1k
+121
排名 #13
3月1日
查看详情
助手