由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

vision-transformer

话题找到数量

huggingface/pytorch-image-models

规模最大的PyTorch图像编码器/骨干网络集合。包含训练、评估、推理、导出脚本与预训练权重——支持ResNet、ResNeXT、EfficientNet、NFNet、Vision Transformer(ViT)、MobileNetV4、MobileNet-V3和V2、RegNet、DPN、CSPNet、Swin Transformer、MaxViT、CoAtNet、ConvNeXt等模型

36k
5.2k
1.2k
+8
排名 #19
5月13日
查看详情

NielsRogge/Transformers-Tutorials

本仓库包含使用HuggingFace Transformers库构建的演示案例

11k
1.7k
731
+17
排名 #11
8月5日
查看详情

adithya-s-k/omniparse

摄取、解析并优化任意数据格式 ➡️ 从文档到多媒体 ➡️ 以增强与GenAI框架的兼容性

7.4k
610
728
+100
排名 #13
5月28日
查看详情

Blaizzy/mlx-vlm

MLX-VLM:基于MLX在Mac上进行视觉语言模型推理与微调的工具包

4.7k
522
941
+50
排名 #11
5月7日
查看详情

liustack/modlens

DeepSeek Harness 的第一个视觉插件,以及每个纯文本编码代理的视觉桥。粘贴图像,获取结构化 JSON 证据(OCR、布局、语义)。 | 全网第一个 DeepSeek Harness 视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得格式化 JSON 证据(OCR、版面、语义)。

2.8k
76
548
+441
排名 #4
8月17日
查看详情

thu-ml/SpargeAttn

SpargeAttention:一种免训练的稀疏注意力机制,可加速任何模型推理

1.2k
105
1.1k
+21
排名 #6
9月19日
查看详情
助手