File size: 748 Bytes
92c4d54 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 | import torch
from transformers import pipeline, AutoTokenizer, AutoModelForSeq2SeqLM
from sentence_transformers import SentenceTransformer
device = 0 if torch.cuda.is_available() else -1
tokenizer = AutoTokenizer.from_pretrained("Salesforce/codet5-base-multi-sum")
model = AutoModelForSeq2SeqLM.from_pretrained("Salesforce/codet5-base-multi-sum")
func_summarizer = pipeline(
"text2text-generation",
model=model,
tokenizer=tokenizer,
device=device,
batch_size=8,
)
embed_model = SentenceTransformer("all-MiniLM-L6-v2")
file_summarizer = pipeline(
"summarization",
model="allenai/led-base-16384",
tokenizer="allenai/led-base-16384",
device=device,
truncation=True,
max_length=128,
min_length=64,
) |