Res2Net: A New Multi-scale Backbone Architecture
CE-Net: Context Encoder Network for 2D Medical Image Segmentation
Mixed Precision Training
BitTrain: Sparse Bitmap Compression for Memory-Efficient Training on the Edge
Massively Multilingual Neural Machine Translation
Adversarial NLI: A New Benchmark for Natural Language Understanding
Grad-CAM: Visual Explanations from Deep Networks via Gradient-based Localization
DeepLab: Semantic Image Segmentation with Deep Convolutional Nets, Atrous Convolution, and Fully Connected CRFs
Distilling the Knowledge in a Neural Network
BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension
Gaussian Error Linear Units (GELUs)
Robust Optimization for Multilingual Translation with Imbalanced Data
Webly Supervised Joint Embedding for Cross-Modal Image-Text Retrieval
Deep Fragment Embeddings for Bidirectional Image Sentence Mapping
An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale
Denoising Diffusion Implicit Models
Adversarial Representation Learning for Robust Privacy Preservation in\n Audio
Ecological Consequences of Trophic Cascades: A Global Perspective
TextBoxes++: A Single-Shot Oriented Scene Text Detector