Text aus PDF holen – Was ist neu in FileMaker 2026? (Teil 1)

Shownotes

Die Folge auf YouTube ansehen: https://www.youtube.com/watch?v=bJN5cmx7HmE

Mehr zu Think7: https://think7.de

Transkript anzeigen

00:00:00: Hallo und herzlich willkommen bei Clarice FileMaker in fünf Minuten!

00:00:06: Heute geht es um eine praktische Frage.

00:00:09: Wie bekommen wir Text aus einer PDF-Datei in unsere FileMakerdatenbank?

00:00:16: Und was ist dabei in FileMAKER-sweißtausendsechsundzwanzig neu dazugekommen, das ist der erste Teil unserer kleinen Serie.

00:00:24: Heute schauen wir uns die Funktion HoldText aus pdf an.

00:00:30: In den nächsten Folgen geht es um Live-Text, Positionsdaten und die Frage wie aus einem ausgelesenen Dokument sinnvoll gefüllte Datenbankfelder werden.

00:00:41: Starten wir mit der Neuerung!

00:00:43: In FileMaker-swei-tausendsechsundzwanzig kann Whole Text aus PDF auf dem Mac auch Text aus gescannten bzw.

00:00:53: bildbasierten pdf erkennen – also aus Dokumenten in denen die Schrift zunächst nur als Bild vorliegt.

00:01:03: Die Funktion selbst gibt es bereits seit FileMaker twenty-fünfundzwanzig.

00:01:09: Schon damals konnte sie Text aus PDFs mit einer vorhandenen Textebene auslesen, auch unter Windows.

00:01:16: Diese Unterscheidung ist mir besonders wichtig!

00:01:19: Ich entwickle FileMakers Lösungen möglichst so dass Sie auf verschiedenen Plattformen funktionieren – auch wenn ein Kunde heute sagt Bei uns arbeiten alle am Mac.

00:01:31: Denn morgen kommt vielleicht doch ein Windows-Rechner dazu, dann möchte ich möglichst vermeiden dass eine wichtige Funktion dort plötzlich ausfällt.

00:01:41: Natürlich ist das kein starres Prinzip gegen den Kundenwunsch.

00:01:45: Aufwand nutzen und die konkrete Umgebung müssen zusammenpassen Aber wenn nicht die Plattform Unabhängigkeit mit vertretbarem Aufwand erhalten kann mache Ich Das.

00:01:58: Bevor wir uns die Funktion anschauen, müssen wir zwei Arten von PDFs unterscheiden.

00:02:03: Die erste ist eine pdf-Datei mit einer Textebene – beispielsweise eine Rechnung, die direkt aus einer Bürosoftware oder einem wahren Wirtschaftssystem exportiert wurde.

00:02:16: Die Buchstaben sind darin tatsächlich als Text gespeichert.

00:02:20: Häufig merkt man das daran, dass sich einzelne Wörter im PDF markieren und kopieren lassen.

00:02:27: Die zweite Variante ist ein Scan.

00:02:29: Hier wurde ein Papierdokument fotografiert oder eingescannt und als PDF gespeichert.

00:02:36: Für uns sieht das ebenfalls wie eine Rechnung aus.

00:02:39: Technisch kann die Seite aber einfach nur ein Bild sein.

00:02:43: Damit daraus Text wird, braucht es Texterkennung auch OCR genannt Wobei ein Scan durchaus bereits eine Textebene enthalten kann.

00:02:53: Manche Scanner-Programme führen die Texterkennung schon beim Speichern durch.

00:02:58: Entscheidend ist deshalb nicht allein, wie das Dokument entstanden ist sondern was tatsächlich in der PDF-Datei steckt.

00:03:06: Schauen wir uns das jetzt im FileMaker an.

00:03:09: Ich habe hier eine pdf Datei in einem Containerfeld abgelegt.

00:03:14: Daneben befindet sich ein Textfeld für das Ergebnis.

00:03:18: Über einen Button starte ich ein kleines Skript.

00:03:21: Der entscheidende Ausdruck ist sehr übersichtlich.

00:03:24: Hol Text aus PDF, gefolgt von unserem Containerfeld in Klammern.

00:03:30: Das Skript schreibt das Ergebnis in das Textfeld.

00:03:33: Ein Klick und wir sehen den ausgelesenen Inhalt.

00:03:37: Bei meiner Beispielrechnung fällt auf Beschriftungen und die dazugehörigen Werte stehen häufig gemeinsam in einer Zeile Also beispielsweise Datum bezahlt Unterneben das entsprechende Datum.

00:03:52: Das ist für die weitere Verarbeitung angenehm, es ist aber keine garantierte Ordnung auf die ich mich bei jedem Dokument verlassen würde.

00:04:02: Wie der Text zurückkommt hängt vom Aufbau der pdf-Datei ab.

00:04:08: Bei einer anderen Rechnung können die Reihenfolge und die Zeilenumbrüche anders aussehen.

00:04:14: Schriftarten, Farben und das genaue Seiten-Layout werden ebenfalls nicht übernommen.

00:04:20: Wir erhalten Text keine Kopie des gestalteten Dokuments – jetzt kommt der interessante Vergleich!

00:04:27: Was passiert mit einer PDF-Datei die nur einen Scan enthält und noch keine Textebene besitzt?

00:04:34: Auf dem Mac bietet FileMaker für die erwähnte Erweiterung.

00:04:41: Whole Text aus PDF kann jetzt auch aus solchen bildbasierten pdf-Text gewinnen.

00:04:47: Unter Windows dürfen wir diese Möglichkeit nicht einfach voraussetzen.

00:04:51: Dort unterstützt die Funktion weiterhin das Auslesen einer vorhandenen Textebene.

00:04:57: Ein reines ScanPDF ohne diese Ebene gehört nicht dazu.

00:05:03: Für eine plattformübergreifende Lösung bedeutet das Ich muss sowohl die Plattform als auch die Art meiner Dokumente berücksichtigen.

00:05:13: Ein erfolgreicher Test auf meinem Mac reicht nicht aus, um dieselbe Funktion unter Windows zu versprechen.

00:05:21: Noch eine Abgrenzung?

00:05:23: Hold Text aus PDF erwartet eine pdf-Datei.

00:05:28: Ein direkt eingefügtes PNG oder JPEG ist etwas anderes – für solche Bilder schauen wir uns in der nächsten Folge die Livetextfunktionen an!

00:05:38: Was bringt uns der gewonnene Text nun im Alltag?

00:05:41: Wir können beispielsweise ein Dokumentenarchiv durchsuchbar machen.

00:05:46: Wir können nach einer Rechnungsnummer oder einem Begriff suchen, ohne jedes PDF einzeln zu öffnen und wir schaffen eine Grundlage für weitere Verarbeitungsschritte.

00:05:59: aber nur weil wir den Text einer Rehnung ausgelesen haben sind Rechnungsnummer, Zahlungsdatum und Gesamtbetrag noch nicht automatisch den richtigen FileMaker-Feldern zugeordnet.

00:06:11: Dafür brauchen wir zusätzliche Logik – genau dort setzen unsere nächsten Folgen an!

00:06:18: Zunächst betrachten wir LiveText und die Ausgabe als JSON.

00:06:22: Dabei geht es auch um Positionsdaten.

00:06:25: Sie können bei der weiteren Verarbeitung helfen, ersetzen aber keine zuverlässige Prüfung der Zuordnung.

00:06:32: Im dritten Teil schauen wir uns an, wie künstliche Intelligenz beim Auslesen von Belegen unterstützen kann.

00:06:39: Für heute nehme ich vor allem drei Punkte mit!

00:06:43: Erstens müssen wir zwischen einer vorhandenen Textebene und einem reinen Scan unterscheiden.

00:06:51: Zweitens müssen die Funktionen auf den tatsächlich eingesetzten Plattformen testen.

00:06:57: Und drittens ist ausgelesener Text erst der Anfang.

00:07:02: Bevor daraus automatisch ausgefüllte Felder werden, brauchen wir passende Regeln und Kontrollen.

00:07:08: Damit haben wir die Grundlage für unsere nächsten beiden Folgen!

00:07:13: Vielen Dank fürs Zuhören – bis zum nächsten Mal bei Claris FileMaker in fünf Minuten von THINK-Sieben.

Neuer Kommentar

Dein Name oder Pseudonym (wird öffentlich angezeigt)
Mindestens 10 Zeichen
Durch das Abschicken des Formulars stimmst du zu, dass der Wert unter "Name oder Pseudonym" gespeichert wird und öffentlich angezeigt werden kann. Wir speichern keine IP-Adressen oder andere personenbezogene Daten. Die Nutzung deines echten Namens ist freiwillig.