PDFをWordに変換するツール
import textract
import docx
def pdf_to_word(pdf_file, output_file):
# PDFファイルからテキストを抽出
text = textract.process(pdf_file)
# 新しいWord文書を作成
document = docx.Document()
# テキストを文書に追加
document.add_paragraph(text)
# Word文書を保存
document.save(output_file)
# PDFファイルをWord文書に変換
pdf_to_word(‘input.pdf’, ‘output.docx’)