Res2Net: A New Multi-scale Backbone Architecture
CE-Net: Context Encoder Network for 2D Medical Image Segmentation
Massively Multilingual Neural Machine Translation
Adversarial NLI: A New Benchmark for Natural Language Understanding
BitTrain: Sparse Bitmap Compression for Memory-Efficient Training on the Edge
Mixed Precision Training
Adversarial Representation Learning for Robust Privacy Preservation in\n Audio
Distilling the Knowledge in a Neural Network
Deep Directed Generative Autoencoders
An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale
DeepLab: Semantic Image Segmentation with Deep Convolutional Nets, Atrous Convolution, and Fully Connected CRFs
Grad-CAM: Visual Explanations from Deep Networks via Gradient-based Localization
Webly Supervised Joint Embedding for Cross-Modal Image-Text Retrieval
Deep Fragment Embeddings for Bidirectional Image Sentence Mapping
TextBoxes++: A Single-Shot Oriented Scene Text Detector
BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension
Robust Optimization for Multilingual Translation with Imbalanced Data
Whitening Sentence Representations for Better Semantics and Faster Retrieval
Ecological Consequences of Trophic Cascades: A Global Perspective
Denoising Diffusion Implicit Models