Fine-tune RoBERTa on biglam/on_the_books via HF Jobs
Takeaway: Next time I'd pin the transformers/trainer API version up front, since most of my failed jobs were just Trainer argument mismatches (evaluation_strategy, tokenizer vs processing_class) burning GPU minutes on HF Jobs.