(post-correcting_intro)=
# OCR-Nachbearbeitung: manuell, automatisch, LLMs

````{margin}
```{admonition} Fragen oder Feedback 
:class: frage-feedback

<a href="https://github.com/quadriga-dk/Text-Fallstudie-1/issues/new?assignees=&labels=question&projects=&template=frage.yml" class="external-link" target="_blank">
    Stellen Sie eine Frage.
</a> <br>
<a href="https://github.com/quadriga-dk/Text-Fallstudie-1/issues/new?assignees=&labels=feedback&projects=&template=feedback.yml" class="external-link" target="_blank">
    Geben Sie uns Feedback.
</a>

Mit Ihren Rückmeldungen können wir unser interaktives Lehrbuch gezielt an Ihre Bedürfnisse anpassen.

```
````

```{include} ../introduction/learning-outcomes.md
:start-after: "<!-- START: OCR-Nachbearbeitung: manuell, automatisch, LLMs -->"
:end-before: "<!-- END: OCR-Nachbearbeitung: manuell, automatisch, LLMs -->"
```

Im vorherigen [Kapitel](ocr) haben wir die Scans der Zeitungen mithilfe von OCR automatisch in Klartext umgewandelt. In diesem Kapitel werden wir die Ergebnisse der OCR nachbearbeiten. 

```{figure} ../assets/images/flow-chart_ocr-postprocessing.jpeg
---
name: flussdiagramm-post-correction
---
Flussdiagramm der Fallstudie. Wir befinden uns im vierten Arbeitspaket.
```

Wie Sie [bereits wissen](../ocr/ocr_ocr-quality), sind OCR-Ergebnisse selten perfekt. Dies gilt insbesondere für historische Texte. Daher ist in der Regel eine Nachbearbeitung erforderlich, um die üblichen Fehler zu korrigieren.
