Flower

← Alle Module · Daten & Formate

html

Liest HTML-Dateien per XPath aus, extrahiert Werte, Tabellen, Links und reinen Text und kann Elemente, Texte oder Attribute ändern und zurückschreiben. So lassen sich Berichte aus Webseiten-Exporten gewinnen oder HTML-Vorlagen automatisch befüllen.

Block-Einstellungen

Gelten für den ganzen Modul-Block (im Editor oben im Inspektor, in YAML direkt unter dem Modulnamen).

FeldTypPflichtBeschreibung
dateiTextPfad zur .html-Datei. Beim Block-Eintritt wird sie geladen; fehlt sie oder wird kein Pfad angegeben, startet das Modul mit einem leeren <html><body></body></html>. Für 'speichern' ist 'datei' Pflicht.
einrückungWahrheitSteuert die Einrückung beim Speichern (Vorgabe: an). Wird derzeit nur gemerkt.

Aktionen

parsenverändernd

Lädt einen HTML-String direkt als aktuelles Dokument (statt aus einer Datei).

Eingaben

FeldTypPflichtBeschreibung
textTextDer HTML-Text, der als Dokument geladen wird (leer = leeres Dokument).

wert-lesenlesend

Liest den Textinhalt des ersten Elements, das auf den XPath passt.

Eingaben

FeldTypPflichtBeschreibung
xpathTextjaXPath-Ausdruck, z.B. //h1 oder //a[@href].
standardTextRückgabewert, falls kein Element gefunden wird.

Ausgaben (über ergebnis:)

wertDer getrimmte Textinhalt des Treffers oder der Standard.

werte-lesenlesend

Liest den Textinhalt aller Elemente, die auf den XPath passen, als Liste.

Eingaben

FeldTypPflichtBeschreibung
xpathTextjaXPath-Ausdruck, der mehrere Elemente treffen kann.

Ausgaben (über ergebnis:)

werteListe der Texte aller Treffer.

attribut-lesenlesend

Liest den Wert eines Attributs am ersten passenden Element.

Eingaben

FeldTypPflichtBeschreibung
xpathTextjaXPath-Ausdruck zur Auswahl des Elements.
nameTextjaName des Attributs, z.B. href oder class.
standardTextRückgabewert, falls Element oder Attribut fehlt.

Ausgaben (über ergebnis:)

wertDer Attributwert oder der Standard.

abfragenlesend

Liefert den äußeren HTML-Code aller passenden Elemente.

Eingaben

FeldTypPflichtBeschreibung
xpathTextjaXPath-Ausdruck zur Auswahl der Elemente.

Ausgaben (über ergebnis:)

trefferListe mit dem vollständigen HTML jedes Treffer-Knotens.

existiertlesend

Prüft, ob mindestens ein Element auf den XPath passt.

Eingaben

FeldTypPflichtBeschreibung
xpathTextjaXPath-Ausdruck, dessen Vorhandensein geprüft wird.

Ausgaben (über ergebnis:)

vorhandenWahr, wenn ein Treffer existiert, sonst falsch.

anzahllesend

Zählt die Elemente, die auf den XPath passen.

Eingaben

FeldTypPflichtBeschreibung
xpathTextjaXPath-Ausdruck, dessen Treffer gezählt werden.

Ausgaben (über ergebnis:)

anzahlAnzahl der gefundenen Elemente.

tabellenlesend

Liest alle HTML-Tabellen als verschachtelte Listen (Tabelle > Zeile > Zelle).

Ausgaben (über ergebnis:)

tabellenListe aller Tabellen; jede ist eine Liste von Zeilen, jede Zeile eine Liste der Zelltexte.

linkslesend

Listet alle Links (a-Elemente mit href) mit Anzeigetext und Ziel.

Ausgaben (über ergebnis:)

linksListe von Objekten mit 'text' (Linktext) und 'ziel' (href).

text-extrahierenlesend

Extrahiert den gesamten sichtbaren Text des Dokuments ohne HTML-Tags.

Ausgaben (über ergebnis:)

textDer reine Textinhalt des Dokuments.

nach-markdownlesend

Wandelt das HTML in Markdown um (Überschriften, Fett/Kursiv, Listen, Links, Code usw.).

Ausgaben (über ergebnis:)

markdownDer Markdown-Text des Dokuments.

wert-setzenverändernd

Ersetzt den Textinhalt des ersten passenden Elements.

Eingaben

FeldTypPflichtBeschreibung
xpathTextjaXPath-Ausdruck zur Auswahl des Elements (kein Treffer = Fehler).
wertTextDer neue Textinhalt (leer = leerer Inhalt).

attribut-setzenverändernd

Setzt oder ergänzt ein Attribut am ersten passenden Element.

Eingaben

FeldTypPflichtBeschreibung
xpathTextjaXPath-Ausdruck zur Auswahl des Elements (kein Treffer = Fehler).
nameTextjaName des zu setzenden Attributs.
wertTextDer Attributwert (leer = leerer Wert).

element-entfernenverändernd

Entfernt alle Elemente, die auf den XPath passen.

Eingaben

FeldTypPflichtBeschreibung
xpathTextjaXPath-Ausdruck der zu entfernenden Elemente (kein Treffer = Fehler).

schreibenverändernd

Ersetzt das gesamte Dokument durch neuen HTML-Inhalt.

Eingaben

FeldTypPflichtBeschreibung
inhaltTextDer neue komplette HTML-Inhalt (Vorgabe: leeres Dokument).

speichernverändernd

Schreibt das aktuelle Dokument zurück in die Block-Datei.

speichern-unterverändernd

Schreibt das aktuelle Dokument in eine angegebene Datei.

Eingaben

FeldTypPflichtBeschreibung
pfadTextjaZielpfad der zu schreibenden HTML-Datei.

Beispiele

Tabelle und Links aus einem HTML-Export auslesen

Liest die Überschrift, alle Tabellenzeilen und die Links aus einer gespeicherten Webseite.

html
wert-lesen
xpath//h1
ergebnistitel
html
tabellen
ergebnisdaten
html
links
ergebnisverweise
- html:
    datei: "C:\\Berichte\\export.html"
    aktionen:
      - wert-lesen:
          xpath: "//h1"
          ergebnis: titel
      - tabellen:
          ergebnis: daten
      - links:
          ergebnis: verweise

HTML-Vorlage befüllen und speichern

Setzt den Überschriftentext und einen Link in einer Vorlage und schreibt das Ergebnis in eine neue Datei.

html
wert-setzen
xpath//h1
wertMonatsbericht Juni
html
attribut-setzen
xpath//a
namehref
werthttps://intranet/bericht
html
speichern-unter
pfadC:\\Berichte\\juni.html
- html:
    datei: "C:\\Vorlagen\\bericht.html"
    aktionen:
      - wert-setzen:
          xpath: "//h1"
          wert: "Monatsbericht Juni"
      - attribut-setzen:
          xpath: "//a"
          name: href
          wert: "https://intranet/bericht"
      - speichern-unter:
          pfad: "C:\\Berichte\\juni.html"