MCPcopy Create free account
hub / github.com/VectifyAI/PageIndex / extract_text_from_pdf

Function extract_text_from_pdf

pageindex/utils.py:221–228  ·  view source on GitHub ↗
(pdf_path)

Source from the content-addressed store, hash-verified

219
220
221def extract_text_from_pdf(pdf_path):
222 pdf_reader = PyPDF2.PdfReader(pdf_path)
223 ###return text not list
224 text=""
225 for page_num in range(len(pdf_reader.pages)):
226 page = pdf_reader.pages[page_num]
227 text+=page.extract_text()
228 return text
229
230def get_pdf_title(pdf_path):
231 pdf_reader = PyPDF2.PdfReader(pdf_path)

Callers

nothing calls this directly

Calls

no outgoing calls

Tested by

no test coverage detected