由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
项目竞品项目
moona3k/macparakeet
适用于Mac的快速本地语音应用——系统级听写、文件与YouTube转录,以及会议录制。基于Apple Silicon上的Parakeet TDT驱动。免费且开源。
handy-computer/transcribe.cpp
支持16+模型家族的ggml语音转文本推理
amicalhq/amical
🎙️ AI Dictation App - Open Source and Local-first ⚡ Type 3x faster, no keyboard needed. 🆓 Powered by open source models, works offline, fast and accurate.
FluidInference/FluidAudio
在您的应用中集成前沿CoreML音频模型——文本转语音、语音转文本、语音活动检测及说话人分离。基于Swift开发,由顶尖开源技术驱动。
Zackriya-Solutions/meetily
Meetily是一款隐私优先的AI会议助手,基于Rust构建,提供比Parakeet/Whisper快4倍的实时转录、说话人分离及Ollama摘要功能。100%本地处理,无需云端。作为排名第一的自托管开源AI会议记录工具,支持macOS与Windows系统。
argmaxinc/argmax-oss-swift
面向苹果芯片的端侧语音人工智能
Blaizzy/mlx-audio-swift
一个用于在Apple Silicon上使用MLX进行音频处理的模块化Swift SDK
OpenWhispr/openwhispr
支持本地模型(Nvidia Parakeet/Whisper)与云端模型(BYOK)的语音转文字听写应用,注重隐私优先,并实现跨平台兼容。
ggml-org/whisper.cpp
OpenAI Whisper模型的C/C++移植版本
modelscope/FunASR
端到端语音识别基础工具包与开源SOTA预训练模型,支持语音识别、语音活动检测、文本后处理等功能。
abus-aikorea/voice-pro
为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。
alphacep/vosk-api
适用于Android、iOS、树莓派及服务端的离线语音识别API,支持Python、Java、C#和Node.js开发语言。
相关项目推荐
tensorflow/tensorflow
面向所有人的开源机器学习框架
react/react-native
一个使用React构建原生应用程序的框架
facebook/react-native
一个使用React构建原生应用程序的框架
ggml-org/llama.cpp
使用 C/C++ 实现的大语言模型推理框架
electron/electron
使用 JavaScript、HTML 和 CSS 构建跨平台桌面应用程序
godotengine/godot
Godot引擎——跨平台2D与3D游戏引擎