由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

ecog

话题找到数量

huggingface/transformers

🤗 Transformers:面向文本、视觉、音频及多模态模型的尖端机器学习模型定义框架,支持推理与训练全流程。

166k
34k
1.8k
+1.3k
排名 #10
9月16日
查看详情

ggml-org/whisper.cpp

OpenAI Whisper模型的C/C++移植版本

53k
6.2k
2.2k
+173
排名 #9
9月16日
查看详情

paperless-ngx/paperless-ngx

社区支持的超级文档管理系统:扫描、索引和归档所有文档

43k
3k
1.3k
+352
排名 #10
7月26日
查看详情

opendataloader-project/opendataloader-pdf

面向AI就绪数据的PDF解析器。

29k
2.8k
1.1k
+17
排名 #6
9月17日
查看详情

pot-app/pot-desktop

🌈 一款跨平台的划词翻译与OCR软件

18k
929
997
+13
排名 #9
6月26日
查看详情

antlr/antlr4

ANTLR(语言识别另一工具)是强大的解析器生成器,用于读取、处理、执行或翻译结构化文本及二进制文件。

18k
3.4k
1.6k
+3
排名 #8
5月27日
查看详情

modelscope/FunASR

端到端语音识别基础工具包与开源SOTA预训练模型,支持语音识别、语音活动检测、文本后处理等功能。

18k
1.9k
1.3k
+2.1k
排名 #14
6月30日
查看详情

NVIDIA-NeMo/Speech

一个可扩展的生成式 AI 框架,专为从事大语言模型、多模态及语音 AI(自动语音识别与文本转语音)的研究人员和开发者构建。

18k
3.6k
1.1k
+42
排名 #17
8月24日
查看详情

NVIDIA-NeMo/NeMo

专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架

17k
3.4k
1.6k
+9
排名 #22
6月12日
查看详情

alphacep/vosk-api

适用于Android、iOS、树莓派及服务端的离线语音识别API,支持Python、Java、C#和Node.js开发语言。

15k
1.8k
1k
+27
排名 #16
9月6日
查看详情

NVIDIA/DeepLearningExamples

按模型组织的尖端深度学习脚本——易于在企业级基础设施上进行训练和部署,并具备可复现的准确性与性能。

14k
3.4k
1.1k
排名 #8
5月16日
查看详情

T8RIN/ImageToolbox

🖼️ 图像工具箱是一款支持高级图像处理的强大应用,提供从基础裁剪绘制到滤镜、OCR及多种图像处理功能的数十种特性

13k
598
1.3k
+14
排名 #6
7月29日
查看详情

kmario23/deep-learning-drizzle

通过聆听这些精彩讲座,沉浸式学习深度学习、强化学习、机器学习、计算机视觉和自然语言处理!!

12k
3k
742
+9
排名 #4
7月20日
查看详情

run-llama/liteparse

一款快速、实用且开源的文件解析工具

12k
848
866
+7
排名 #4
8月29日
查看详情

abus-aikorea/voice-pro

为创作者和开发者打造的Gradio WebUI,具备核心TTS功能(Edge-TTS、kokoro)和零样本声音克隆(E2与F5-TTS、CosyVoice),并集成Whisper音频处理、YouTube下载、Demucs人声分离和多语言翻译。

12k
1.7k
670
+46
排名 #11
8月3日
查看详情

moonshine-ai/moonshine

面向边缘设备的快速准确自动语音识别

10k
603
1.2k
+12
排名 #16
9月2日
查看详情

openvinotoolkit/openvino

OpenVINO™是用于优化和部署AI推理的开源工具套件

10k
3.4k
1.7k
+6
排名 #8
9月19日
查看详情

pyannote/pyannote-audio

说话人日志神经构建模块:语音活动检测、说话人变更检测、重叠语音检测、说话人嵌入

10k
1.1k
1.2k
+4
排名 #9
8月25日
查看详情

microsoft/presidio

一个用于在文本、图像和结构化数据中检测、编辑、掩码和匿名化敏感数据的开源框架。支持自然语言处理、模式匹配和可定制流水线。

9.4k
1.1k
1.3k
+787
排名 #7
6月21日
查看详情

QwenAudio/SenseVoice

开源 SenseVoiceSmall 模型,适用于普通话、粤语、英语、日语和韩语 ASR、语言 ID、情绪识别和音频事件检测。

9.3k
821
467
+74
排名 #11
9月6日
查看详情

exadel-inc/CompreFace

领先的免费开源人脸识别系统

8.2k
1.2k
1.1k
+71
排名 #9
8月16日
查看详情

all-contributors/allcontributors.org

✨ 全贡献者机器人网站与文档。认可所有贡献者,而不仅仅是推送代码的人 ✨

8.1k
1.7k
1.1k
+1
排名 #11
9月7日
查看详情

Blaizzy/mlx-audio

基于 Apple MLX 框架构建的文本转语音 (TTS)、语音转文本 (STT) 和语音转语音 (STS) 库,可在 Apple Silicon 上提供高效的语音分析。

7.8k
689
1.1k
+12
排名 #15
8月17日
查看详情

vas3k/TaxHacker

自托管人工智能会计应用。支持收据、发票及交易的LLM智能分析器,具备自定义提示词与分类功能

6.4k
1k
1k
+37
排名 #8
7月1日
查看详情
助手