File size: 748 Bytes
92c4d54
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
import torch
from transformers import pipeline, AutoTokenizer, AutoModelForSeq2SeqLM
from sentence_transformers import SentenceTransformer

device = 0 if torch.cuda.is_available() else -1

tokenizer = AutoTokenizer.from_pretrained("Salesforce/codet5-base-multi-sum")
model = AutoModelForSeq2SeqLM.from_pretrained("Salesforce/codet5-base-multi-sum")

func_summarizer = pipeline(
    "text2text-generation",
    model=model,
    tokenizer=tokenizer,
    device=device,
    batch_size=8,
)

embed_model = SentenceTransformer("all-MiniLM-L6-v2")

file_summarizer = pipeline(
    "summarization",
    model="allenai/led-base-16384",
    tokenizer="allenai/led-base-16384",
    device=device,
    truncation=True,
    max_length=128,
    min_length=64,
)