Bild-URLs, Link-URLs und passendes inneres HTML aus einem eingefügten Fragment auslesen

Fügen Sie ein HTML-Fragment oder eine ganze Seite ein und nutzen Sie einen der drei Modi: alle Bild-src-Werte auflisten, alle Link-href-Werte auflisten oder das innere HTML der Elemente auflisten, die zu einem CSS-Selektor passen (jQuery-kompatible Selektoren, keine XPath-Ausdrücke). Werte werden unverändert ausgegeben, eine Seite mit /images/hero.jpg behält also diesen relativen Pfad.

Das Fragment wird in diesem Browser in ein inertes Dokument geparst. Bilder werden nicht geladen, Inline-Event-Handler laufen nicht, und es verlässt keine Anfrage die Seite, auch wenn das Markup auf entfernte Hosts zeigt.

  1. Fügen Sie das HTML oben ein oder drücken Sie Bild-URLs extrahieren, um mit dem Beispiel der Seite zu beginnen.
  2. Drücken Sie Bild-URLs extrahieren oder Link-URLs extrahieren, oder geben Sie einen CSS-Selektor ein und drücken Sie CSS-Selektor auswerten.
  3. Lesen Sie die Ergebnisliste: ein Wert pro Zeile, in Dokumentreihenfolge. Die Hinweise unter dem Feld nennen, was übersprungen oder wiederholt wurde.
  4. Drücken Sie Ergebnis kopieren, um die Liste zu kopieren, oder markieren Sie den Text von Hand.
  5. Drücken Sie Leeren, um Eingabe und Ergebnis vor dem nächsten Fragment zu leeren.

Was das Werkzeug misst und was es auslässt

Wie das Fragment geparst wird

Die Eingabe läuft durch denselben HTML-Parser, den der Browser für eine Seite nutzt. Nicht geschlossene Tags werden repariert, Attributwerte werden dekodiert (<img src="a&amp;b.png"> erscheint als a&b.png), und ein vollständiges Dokument samt <!DOCTYPE html>-Zeile wird akzeptiert. Inhalte in <textarea>, Kommentare und SVG-<image>-Elemente gelten nicht als Bild.

Elemente auf oberster Ebene zählen mit. Ein Fragment, das nur aus <img src="c.png"> oder <a href="/a"> besteht, wird wie jeder andere Treffer gelesen; die Hinweise nennen, wie viele Treffer kein nutzbares Attribut hatten und wie viele im Selektor-Modus kein inneres HTML besaßen (etwa ein <img> oder ein <br>).

Selektoren und Ausgabe

Das Selektorfeld akzeptiert jQuery-kompatible CSS-Selektoren, also die Sprache der Seite selbst (Sizzle): .klasse, #id, [data-id], div > p, li:nth-child(2) und Erweiterungen wie :eq(1) oder :contains(text). Ein Selektor, der nicht gelesen werden kann, wird als Fehler gemeldet statt als leeres Ergebnis.

Der Selektor-Modus schreibt das innere HTML jedes Treffers in eine eigene Zeile, damit Kind-Markup beim Kopieren erhalten bleibt. Doppelte Werte erscheinen einmal pro Vorkommen, und die Hinweise sagen, wie viele sich wiederholen.

Datenschutz, Grenzen und Genauigkeit

Alles läuft lokal. In dieser Version gemessen: Ein Fragment mit <img src="https://example.com/x.png"> erzeugt keine Netzwerkanfrage, und ein onerror-Attribut im eingefügten Markup wird nicht ausgeführt. Nichts wird hochgeladen, und nach dem Laden der Seite arbeitet das Werkzeug offline weiter.

Verarbeitet wird nur eingefügter Text: kein Datei-Upload, kein Abruf von URLs, kein Stapelmodus. Relative URLs bleiben relativ, weil das Fragment keine eigene Basis-URL hat. Die Liste steht in Dokumentreihenfolge; sie ist eine Prüfhilfe, kein Crawler.

Zuletzt verwendet: