(self, gpu=0)
| 17 | |
| 18 | class Model: |
| 19 | def __init__(self, gpu=0): |
| 20 | self.inuse = False |
| 21 | print("Initializing...") |
| 22 | starting_time = time.time() |
| 23 | self.args = self.get_args() |
| 24 | self.pipeline = pipeline_runner(self.args, add_retrieval=False, server=True) |
| 25 | print("Loading model...") |
| 26 | self.llm = self.pipeline.get_backbone_model() |
| 27 | print("Model loaded in {} seconds".format(time.time() - starting_time)) |
| 28 | starting_time = time.time() |
| 29 | print("Loading retriever...") |
| 30 | self.retriever = self.pipeline.get_retriever() |
| 31 | print("Retriever loaded in {} seconds".format(time.time() - starting_time)) |
| 32 | self.query_id = 0 |
| 33 | # self.process_num = self.args.process_num |
| 34 | |
| 35 | self.queue = Queue() |
| 36 | self.callback = ServerEventCallback(self.queue) |
| 37 | self.occupied = False |
| 38 | |
| 39 | print("Server ready") |
| 40 | |
| 41 | def run_pipeline(self, user_input, method, top_k): |
| 42 | # empty the queue |
nothing calls this directly
no test coverage detected