PDFをWordに変換するツール

import textract
import docx

def pdf_to_word(pdf_file, output_file):
# PDFファイルからテキストを抽出
text = textract.process(pdf_file)

# 新しいWord文書を作成
document = docx.Document()

# テキストを文書に追加
document.add_paragraph(text)

# Word文書を保存
document.save(output_file)

# PDFファイルをWord文書に変換
pdf_to_word(‘input.pdf’, ‘output.docx’)