glaive-7b-training / train.py

Commit History

L40S optimization: batch 8, disable gradient checkpointing, parallel dataloader
113833d

Hajime MATSUMOTO commited on

Speed optimization: 1 epoch, larger batch, shorter seq, no packing
c179929

Hajime MATSUMOTO commited on

Fix f-string format specifier error in logging callback
29f5c51

Hajime MATSUMOTO commited on

Reduce batch size to avoid OOM on L40S 48GB
702c22f

Hajime MATSUMOTO commited on

Fix SFTTrainer: use tokenizer instead of processing_class
a6b7407

Hajime MATSUMOTO commited on

Use separate model name for cloud training
20d518a

Hajime MATSUMOTO commited on

Use single GPU with larger batch size for L40S 48GB
b491772

Hajime MATSUMOTO commited on

Add 7B QLoRA training + AWQ quantization scripts
6d8a316

Hajime MATSUMOTO commited on