Vue d'ensemble

Transformers 4.48, publie le 15 janvier 2025, ajoute le support de DeepSeek et ameliore le pipeline de generation de texte.

Fonctionnalites principales

Support DeepSeek

Les modeles DeepSeek sont integres nativement dans la bibliotheque, permettant leur utilisation directe via l'API AutoModel.

python
from transformers import AutoTokenizer, AutoModelForCausalLM

tokenizer = AutoTokenizer.from_pretrained('deepseek-ai/deepseek-coder-1.3b-base')
model = AutoModelForCausalLM.from_pretrained('deepseek-ai/deepseek-coder-1.3b-base')

inputs = tokenizer('def fibonacci(n):', return_tensors='pt')
outputs = model.generate(**inputs, max_new_tokens=50)
print(tokenizer.decode(outputs[0]))

Generation amelioree

Le pipeline generate() est optimise avec un meilleur support du batching et des strategies de decodage.

python
from transformers import pipeline

gen = pipeline('text-generation', model='gpt2')
result = gen(
    'Python is',
    max_new_tokens=30,
    num_return_sequences=2,
    do_sample=True,
    temperature=0.7,
)
for r in result:
    print(r['generated_text'])

Sources