90 Prozent weg – was bei der PDF-Konvertierung in XML verloren geht | Gespräch mit Elena Montero
カートのアイテムが多すぎます
カートに追加できませんでした。
ウィッシュリストに追加できませんでした。
ほしい物リストの削除に失敗しました。
ポッドキャストのフォローに失敗しました
ポッドキャストのフォロー解除に失敗しました
-
ナレーター:
-
著者:
Viele Verlage und Bildungsanbieter sitzen auf einem großen Schatz an PDF-Inhalten. Wer daraus jedoch ein RAG-System aufbauen möchte, steht vor einer Herausforderung, die häufig unterschätzt wird: PDFs sind für KI nicht automatisch nutzbar.
Gemeinsam mit Elena Montero habe ich darüber gesprochen, warum der eigentliche Engpass oft schon vor der KI beginnt – nämlich bei der Konvertierung in strukturierte Formate wie XML oder Markdown.
In dieser Episode geht es daher unter anderem darum:
- warum die Wahl des Konvertierungswerkzeugs entscheidend ist,
- weshalb ein auf den ersten Blick gutes Ergebnis täuschen kann,
- welche Unterschiede sich zwischen LLMs und klassischen Konvertierungstools zeigen,
- und warum es keine Universallösung für alle Dokumenttypen gibt.
Und Elena erzählt mir, wie es ist, im Jahr 2026 eine Ausbildung zur Mediengestalterin zu machen – einen Beruf, der durch KI massiv bedroht ist.
Über Elena Montero Maousidou:
Elena ist 18 Jahre alt und macht eine Ausbildung zur Mediengestalterin Digital/Print bei data2type und parsQube in Heidelberg, parallel zur Berufsschule an der Johannes-Gutenberg-Schule. Im Juni 2026 hat sie auf der XML Prague die Ergebnisse ihrer ersten eigenen Studie vorgestellt – ein Vergleich von sechs Tools zur Konvertierung von PDF in KI-lesbare Formate wie Markdown und XML.
Über Christina Lauer:
Christina unterstützt Verlage und Bildungsanbieter dabei, Content, Prozesse und Menschen fit für das KI-Zeitalter zu machen.
- Website: christina-lauer.de
- LinkedIn: linkedin.com/in/drchristinalauer