import PyPDF2 reader = PyPDF2.PdfReader('db.pdf') print(f'Total pages: {len(reader.pages)}') for i, page in enumerate(reader.pages[:10]): text = page.extract_text() print(f'\n--- Page {i+1} ---') print(text[:3000] if text else '[No text extracted]')