Paper 5
- [Paper] You Only Look Once: Unified, Real-Time Object Detection
- [Paper] Vision Transformer: An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale
- [Paper] AlexNet: ImageNet Classification with Deep CNN
- [Paper] GPT-1: Improving Language Understanding by Generative Pre-Training
- [Paper] LoRA: Low-Rank Adaptation of Large Language Models