Papers tagged “vision”
31 papers · All papers →
-
3D Gaussian Splatting for Real-Time Radiance Field Rendering
-
Adding Conditional Control to Text-to-Image Diffusion Models
-
Segment Anything
-
High-Resolution Image Synthesis with Latent Diffusion Models
-
Video Diffusion Models
-
Diffusion Models Beat GANs on Image Synthesis
-
Emerging Properties in Self-Supervised Vision Transformers
-
Masked Autoencoders Are Scalable Vision Learners
-
Swin Transformer: Hierarchical Vision Transformer using Shifted Windows
-
Zero-Shot Text-to-Image Generation
-
A Simple Framework for Contrastive Learning of Visual Representations
-
An Image Is Worth 16x16 Words: Transformers for Image Recognition at Scale
-
Bootstrap Your Own Latent: A New Approach to Self-Supervised Learning
-
End-to-End Object Detection with Transformers
-
Momentum Contrast for Unsupervised Visual Representation Learning
-
NeRF: Representing Scenes as Neural Radiance Fields for View Synthesis
-
A Style-Based Generator Architecture for Generative Adversarial Networks
-
EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks
-
Group Normalization
-
Densely Connected Convolutional Networks
-
Instance Normalization: The Missing Ingredient for Fast Stylization
-
Mask R-CNN
-
Deep Residual Learning for Image Recognition
-
You Only Look Once: Unified, Real-Time Object Detection
-
Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks
-
Going Deeper with Convolutions
-
U-Net: Convolutional Networks for Biomedical Image Segmentation
-
Unsupervised Representation Learning with Deep Convolutional Generative Adversarial Networks
-
Very Deep Convolutional Networks for Large-Scale Image Recognition
-
ImageNet Classification with Deep Convolutional Neural Networks
-
Gradient-based learning applied to document recognition