/
maratn
/
CountDiffPagePdf
Обзор
Документация
Войти
/
maratn
/
CountDiffPagePdf
Код
Запросы
0
Задачи
Вики
Пакеты
0
Релизы
0
CI/CD
Аналитика
Безопасность
master
DoubleAndLostPages.py
41 строка
1 KB
maratn
create: DoubleAndLostPages.py
06 мар 2026, 20:41
Верифицирован
06 мар 2026, 20:41
4f59e23
Код
Авторство
О чём код?
from pypdf import PdfReader def text(page): # Извлекаем текст text = page.extract_text() if text: data = text.split('\n') # cleaned_data = [x for x in data if x] cleaned_data = [s for s in data if s.strip()] return cleaned_data[-1] # 1. Открываем PDF-файл file_a = input('Enter link to pdf file:\n') reader = PdfReader(file_a) number = 0 for i in range(len(reader.pages)-1): # 2. Получаем конкретную страницу (например, первую - 0) first_page = reader.pages[i] second_page = reader.pages[i+1] text_1 = text(first_page) text_2 = text(second_page) try: number_new = abs(int(text_1)) if number_new == number + 1: number = number_new else: print('maybe lost page', number_new - 1) number = number_new except: number += 1 if text_1 == text_2: print('Double:', i+1, 'and', i+2) input('Complete. Press Enter\n')