My Obsidian Blog
Search
搜索
暗色模式
亮色模式
探索
标签: r/transformer
此标签下有14条笔记。
2026年6月17日
CAT-Cross Attention in Vision Transformer
r/transformer
2026年6月17日
CFT-Cross-Modality Fusion Transformer for Multispectral Object Detection
r/multi-modality
r/transformer
r/object-detection
2026年6月17日
CeiT-Incorporating Convolution Designs into Visual Transformers
r/transformer
2026年6月17日
ConViT - Improving Vision Transformers with Soft Convolutional Inductive Biases
r/transformer
2026年6月17日
CrossViT - Cross-Attention Multi-Scale Vision Transformer for Image Classification
r/transformer
2026年6月17日
CvT-Introducing Convolutions to Vision Transformers
r/transformer
2026年6月17日
DeiT-Training data-efficient image transformers and distillation through attention
r/transformer
2026年6月17日
HAT - Hierarchical Aggregation Transformers for Person Re-identification
r/multi-modality
r/transformer
2026年6月17日
MutualFormer - Multi-Modality Representation Learning via Mutual Transformer
r/transformer
r/multi-modality
2026年6月17日
SwinFuse - A Residual Swin Transformer Fusion Network for Infrared and Visible Images
r/multi-modality
r/transformer
2026年6月17日
SwinTransformer-Swin Transformer-Hierarchical Vision Transformer using Shifted Windows
r/transformer
2026年6月17日
ViT-An Image is Worth 16x16 Words-Transformers for Image Recognition at Scale
r/transformer
r/backbone
2026年6月17日
beyer-Better plain ViT baselines for ImageNet-1k
r/transformer
2026年6月17日
cordonnier-On the Relationship between Self-Attention and Convolutional Layers
r/transformer