Text aus PDF holen – Was ist neu in FileMaker 2026? (Teil 1)
Shownotes
Die Folge auf YouTube ansehen: https://www.youtube.com/watch?v=bJN5cmx7HmE
Mehr zu Think7: https://think7.de
Transkript anzeigen
00:00:00: Hallo und herzlich willkommen bei Clarice FileMaker in fünf Minuten!
00:00:06: Heute geht es um eine praktische Frage.
00:00:09: Wie bekommen wir Text aus einer PDF-Datei in unsere FileMakerdatenbank?
00:00:16: Und was ist dabei in FileMAKER-sweißtausendsechsundzwanzig neu dazugekommen, das ist der erste Teil unserer kleinen Serie.
00:00:24: Heute schauen wir uns die Funktion HoldText aus pdf an.
00:00:30: In den nächsten Folgen geht es um Live-Text, Positionsdaten und die Frage wie aus einem ausgelesenen Dokument sinnvoll gefüllte Datenbankfelder werden.
00:00:41: Starten wir mit der Neuerung!
00:00:43: In FileMaker-swei-tausendsechsundzwanzig kann Whole Text aus PDF auf dem Mac auch Text aus gescannten bzw.
00:00:53: bildbasierten pdf erkennen – also aus Dokumenten in denen die Schrift zunächst nur als Bild vorliegt.
00:01:03: Die Funktion selbst gibt es bereits seit FileMaker twenty-fünfundzwanzig.
00:01:09: Schon damals konnte sie Text aus PDFs mit einer vorhandenen Textebene auslesen, auch unter Windows.
00:01:16: Diese Unterscheidung ist mir besonders wichtig!
00:01:19: Ich entwickle FileMakers Lösungen möglichst so dass Sie auf verschiedenen Plattformen funktionieren – auch wenn ein Kunde heute sagt Bei uns arbeiten alle am Mac.
00:01:31: Denn morgen kommt vielleicht doch ein Windows-Rechner dazu, dann möchte ich möglichst vermeiden dass eine wichtige Funktion dort plötzlich ausfällt.
00:01:41: Natürlich ist das kein starres Prinzip gegen den Kundenwunsch.
00:01:45: Aufwand nutzen und die konkrete Umgebung müssen zusammenpassen Aber wenn nicht die Plattform Unabhängigkeit mit vertretbarem Aufwand erhalten kann mache Ich Das.
00:01:58: Bevor wir uns die Funktion anschauen, müssen wir zwei Arten von PDFs unterscheiden.
00:02:03: Die erste ist eine pdf-Datei mit einer Textebene – beispielsweise eine Rechnung, die direkt aus einer Bürosoftware oder einem wahren Wirtschaftssystem exportiert wurde.
00:02:16: Die Buchstaben sind darin tatsächlich als Text gespeichert.
00:02:20: Häufig merkt man das daran, dass sich einzelne Wörter im PDF markieren und kopieren lassen.
00:02:27: Die zweite Variante ist ein Scan.
00:02:29: Hier wurde ein Papierdokument fotografiert oder eingescannt und als PDF gespeichert.
00:02:36: Für uns sieht das ebenfalls wie eine Rechnung aus.
00:02:39: Technisch kann die Seite aber einfach nur ein Bild sein.
00:02:43: Damit daraus Text wird, braucht es Texterkennung auch OCR genannt Wobei ein Scan durchaus bereits eine Textebene enthalten kann.
00:02:53: Manche Scanner-Programme führen die Texterkennung schon beim Speichern durch.
00:02:58: Entscheidend ist deshalb nicht allein, wie das Dokument entstanden ist sondern was tatsächlich in der PDF-Datei steckt.
00:03:06: Schauen wir uns das jetzt im FileMaker an.
00:03:09: Ich habe hier eine pdf Datei in einem Containerfeld abgelegt.
00:03:14: Daneben befindet sich ein Textfeld für das Ergebnis.
00:03:18: Über einen Button starte ich ein kleines Skript.
00:03:21: Der entscheidende Ausdruck ist sehr übersichtlich.
00:03:24: Hol Text aus PDF, gefolgt von unserem Containerfeld in Klammern.
00:03:30: Das Skript schreibt das Ergebnis in das Textfeld.
00:03:33: Ein Klick und wir sehen den ausgelesenen Inhalt.
00:03:37: Bei meiner Beispielrechnung fällt auf Beschriftungen und die dazugehörigen Werte stehen häufig gemeinsam in einer Zeile Also beispielsweise Datum bezahlt Unterneben das entsprechende Datum.
00:03:52: Das ist für die weitere Verarbeitung angenehm, es ist aber keine garantierte Ordnung auf die ich mich bei jedem Dokument verlassen würde.
00:04:02: Wie der Text zurückkommt hängt vom Aufbau der pdf-Datei ab.
00:04:08: Bei einer anderen Rechnung können die Reihenfolge und die Zeilenumbrüche anders aussehen.
00:04:14: Schriftarten, Farben und das genaue Seiten-Layout werden ebenfalls nicht übernommen.
00:04:20: Wir erhalten Text keine Kopie des gestalteten Dokuments – jetzt kommt der interessante Vergleich!
00:04:27: Was passiert mit einer PDF-Datei die nur einen Scan enthält und noch keine Textebene besitzt?
00:04:34: Auf dem Mac bietet FileMaker für die erwähnte Erweiterung.
00:04:41: Whole Text aus PDF kann jetzt auch aus solchen bildbasierten pdf-Text gewinnen.
00:04:47: Unter Windows dürfen wir diese Möglichkeit nicht einfach voraussetzen.
00:04:51: Dort unterstützt die Funktion weiterhin das Auslesen einer vorhandenen Textebene.
00:04:57: Ein reines ScanPDF ohne diese Ebene gehört nicht dazu.
00:05:03: Für eine plattformübergreifende Lösung bedeutet das Ich muss sowohl die Plattform als auch die Art meiner Dokumente berücksichtigen.
00:05:13: Ein erfolgreicher Test auf meinem Mac reicht nicht aus, um dieselbe Funktion unter Windows zu versprechen.
00:05:21: Noch eine Abgrenzung?
00:05:23: Hold Text aus PDF erwartet eine pdf-Datei.
00:05:28: Ein direkt eingefügtes PNG oder JPEG ist etwas anderes – für solche Bilder schauen wir uns in der nächsten Folge die Livetextfunktionen an!
00:05:38: Was bringt uns der gewonnene Text nun im Alltag?
00:05:41: Wir können beispielsweise ein Dokumentenarchiv durchsuchbar machen.
00:05:46: Wir können nach einer Rechnungsnummer oder einem Begriff suchen, ohne jedes PDF einzeln zu öffnen und wir schaffen eine Grundlage für weitere Verarbeitungsschritte.
00:05:59: aber nur weil wir den Text einer Rehnung ausgelesen haben sind Rechnungsnummer, Zahlungsdatum und Gesamtbetrag noch nicht automatisch den richtigen FileMaker-Feldern zugeordnet.
00:06:11: Dafür brauchen wir zusätzliche Logik – genau dort setzen unsere nächsten Folgen an!
00:06:18: Zunächst betrachten wir LiveText und die Ausgabe als JSON.
00:06:22: Dabei geht es auch um Positionsdaten.
00:06:25: Sie können bei der weiteren Verarbeitung helfen, ersetzen aber keine zuverlässige Prüfung der Zuordnung.
00:06:32: Im dritten Teil schauen wir uns an, wie künstliche Intelligenz beim Auslesen von Belegen unterstützen kann.
00:06:39: Für heute nehme ich vor allem drei Punkte mit!
00:06:43: Erstens müssen wir zwischen einer vorhandenen Textebene und einem reinen Scan unterscheiden.
00:06:51: Zweitens müssen die Funktionen auf den tatsächlich eingesetzten Plattformen testen.
00:06:57: Und drittens ist ausgelesener Text erst der Anfang.
00:07:02: Bevor daraus automatisch ausgefüllte Felder werden, brauchen wir passende Regeln und Kontrollen.
00:07:08: Damit haben wir die Grundlage für unsere nächsten beiden Folgen!
00:07:13: Vielen Dank fürs Zuhören – bis zum nächsten Mal bei Claris FileMaker in fünf Minuten von THINK-Sieben.
Neuer Kommentar