由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
项目竞品项目
FluidInference/FluidAudio
在您的应用中集成前沿CoreML音频模型——文本转语音、语音转文本、语音活动检测及说话人分离。基于Swift开发,由顶尖开源技术驱动。
modelscope/FunASR
端到端语音识别基础工具包与开源SOTA预训练模型,支持语音识别、语音活动检测、文本后处理等功能。
snakers4/silero-models
Silero模型:提供预训练语音转文本、文本转语音和文本增强模型,极致简化实现
huggingface/pytorch-image-models
规模最大的PyTorch图像编码器/骨干网络集合。包含训练、评估、推理、导出脚本与预训练权重——支持ResNet、ResNeXT、EfficientNet、NFNet、Vision Transformer(ViT)、MobileNetV4、MobileNet-V3和V2、RegNet、DPN、CSPNet、Swin Transformer、MaxViT、CoAtNet、ConvNeXt等模型
soniqo/speech-swift
面向 Apple Silicon 的 AI 语音工具包 — 基于 MLX 和 CoreML 的 ASR、TTS、语音到语音、VAD 及说话人分离功能。
huggingface/transformers
🤗 Transformers:面向文本、视觉、音频及多模态模型的尖端机器学习模型定义框架,支持推理与训练全流程。
相关项目推荐
jackfrued/Python-100-Days
Python - 100天从新手到大师
microsoft/generative-ai-for-beginners
21堂课带你入门生成式AI开发
rasbt/LLMs-from-scratch
使用PyTorch从零开始逐步实现类ChatGPT大型语言模型
microsoft/ML-For-Beginners
12周、26节课、52个测验,面向所有人的经典机器学习课程
openai/openai-cookbook
OpenAI API 使用示例与指南
CompVis/stable-diffusion
潜在文本到图像扩散模型