Overview
Transformers 4.30 from Hugging Face, released on May 20, 2023, integrates PEFT for efficient fine-tuning and improves large language model support.
Main Features
PEFT integration
PEFT (Parameter-Efficient Fine-Tuning) integration enables fine-tuning massive models with LoRA, drastically reducing required memory.
python
from transformers import AutoModelForCausalLM, AutoTokenizer
from peft import LoraConfig, get_peft_model
model = AutoModelForCausalLM.from_pretrained('gpt2')
tokenizer = AutoTokenizer.from_pretrained('gpt2')
# LoRA configuration for efficient fine-tuning
lora_config = LoraConfig(
r=8, lora_alpha=32,
target_modules=['c_attn'],
lora_dropout=0.1,
)
model = get_peft_model(model, lora_config)
model.print_trainable_parameters()
# trainable params: 0.1% of total
Improved LLM support
Large language model (LLM) support is improved with 4-bit/8-bit loading, generation with KV-cache, and conversation pipelines.
python
from transformers import pipeline
# Text generation pipeline
generator = pipeline(
'text-generation',
model='gpt2',
max_new_tokens=50,
)
result = generator('Python is a language')
print(result[0]['generated_text'])
