由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

speaker-recognition

话题找到数量

NVIDIA-NeMo/Speech

一个可扩展的生成式 AI 框架,专为从事大语言模型、多模态及语音 AI(自动语音识别与文本转语音)的研究人员和开发者构建。

17k
3.5k
457
+19
排名 #12
8月5日
查看详情

NVIDIA-NeMo/NeMo

专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架

17k
3.4k
973
+9
排名 #22
6月12日
查看详情

pyannote/pyannote-audio

说话人日志神经构建模块:语音活动检测、说话人变更检测、重叠语音检测、说话人嵌入

10k
1.1k
663
+5
排名 #16
7月31日
查看详情

FluidInference/FluidAudio

在您的应用中集成前沿CoreML音频模型——文本转语音、语音转文本、语音活动检测及说话人分离。基于Swift开发,由顶尖开源技术驱动。

2.6k
364
325
+13
排名 #11
8月3日
查看详情
助手