Wayback Machine und YouTube: was gespeichert wird und wie man es findet
Die Wayback Machine fotografiert das Web seit 1996, und YouTube-Seiten kamen mit aufs Bild. Verschwindet ein Video, ist dieser Schnappschuss oft das Einzige, was davon übrig bleibt. Hier steht, was das Archiv zu einer YouTube-URL tatsächlich hat, was es nie hatte, und wie man darin sucht, wenn der Link weg ist.
Was ein Schnappschuss einer YouTube-Seite enthält
Eine Aufnahme ist das HTML, das der Crawler in einem bestimmten Moment bekommen hat, nicht das Video. Aus einer gespeicherten Seite lässt sich meist herausholen:
- Der Titel, so wie er am Tag der Aufnahme lautete.
- Die Beschreibung, samt der Links, die der Kanal dort hinterlegt hatte.
- Der Kanal, Name und Id, und damit der Schlüssel zu allen anderen Uploads.
- Das Upload-Datum, dazu Aufrufe und Likes, eingefroren im Moment der Aufnahme.
- Das Vorschaubild, separat als Bilddatei gespeichert.
- Untertitel, wenn der Crawler die Spur mitgenommen hat.
Das sind Metadaten und kein Video, und sie bringen mehr, als es klingt: Sie identifizieren das Video, belegen, dass es existiert hat, sagen, worum es ging, und mit Untertiteln bewahren sie oft auch, was gesagt wurde.
Warum der Player auf der archivierten Seite leer bleibt
YouTube hat das Video nie von der Seite ausgeliefert, die du dort siehst. Auf der Seite sitzt ein Player, und der fragt den Stream bei Googles Medienservern an, über eine signierte Adresse, die nach Stunden abläuft. Ein Crawler, der die Seite speichert, folgt diesem Stream nicht, und selbst dann wäre die Adresse längst tot, bevor jemand die Kopie öffnet. Deshalb sieht die archivierte Seite richtig aus und spielt nichts ab.
Die Datei liegt, falls es sie gibt, auf einem eigenen Weg: Das Archiv hat manchmal die rohe Videoantwort zu einer Video-Id, und dann kann die Wayback Machine sie abspielen. Das ist der seltene Fall, nicht der Normalfall. In den Ergebnissen tragen Videos mit gesicherter Datei die Markierung Video vorhanden. Mehr dazu: archivierte Dateien ansehen und herunterladen.
"We have not been able to archive the video associated with this YouTube page"
Dieser englische Satz landet oft genug in Suchmaschinen, um eine klare Antwort zu verdienen. Er heißt: Die Wayback Machine hat die Seite gespeichert und das Video dahinter nicht. Die üblichen Gründe sind, dass das Video zum Zeitpunkt der Aufnahme schon weg war, dass die Anfrage nach der Mediendatei abgelehnt wurde oder in einen Timeout lief, oder dass der Stream für den Crawler schlicht unerreichbar ist.
Es ist der Bericht über einen Versuch, kein Urteil über das Video. Was du als Nächstes probieren kannst:
- Nach einer älteren Aufnahme suchen. Ein gescheiterter Versuch sagt nichts über Schnappschüsse von vor Jahren, und die können vor der Löschung entstanden sein und die vollständige Seite enthalten.
- Direkt nach der Mediendatei fragen. Das Ansehen eines Schnappschusses fragt das Archiv nicht, ob es die Videodatei hat. Füge den Link oder die Video-Id in die Suche ein, dann fragen wir für dich.
- Anderswo nach einer Kopie suchen. Gelöschtes wird oft neu hochgeladen: einen Reupload finden.
Suchen, wenn du den Link noch hast
Füge die vollständige YouTube-URL ein, den kurzen youtu.be-Link oder einfach die 11-stellige Video-Id. Du bekommst, was die Archive behalten haben: Titel, Beschreibung, Vorschaubild, Untertitel und ob eine Videodatei existiert. Schritt für Schritt: ein gelöschtes Video per URL oder Id finden.
Suchen, wenn der Link fehlt
Hier endet die Wayback Machine für sich genommen. Ihre Oberfläche beantwortet genau eine Frage, "habt ihr eine Aufnahme von genau dieser Adresse", man muss die Adresse also vorher kennen. Man kann sie nicht fragen, welche Videos eines Kanals sie gespeichert hat, und man kann nicht im Gespeicherten suchen.
Genau diese Lücke füllt diese Seite. Über 1,5 Milliarden Video-Ids aus Wayback Machine und Common Crawl, so indexiert, dass drei weitere Wege offenstehen:
- Über den Kanal. Eine Kanal-URL, ein @handle oder eine Kanal-Id liefern alle Videos, die wir von ihm kennen, gelöschte eingeschlossen. Der schnellste Weg, wenn das Video weg ist, der Kanal aber nicht: nach Kanal suchen.
- Über Wörter. Volltextsuche über archivierte Titel und Beschreibungen, für den Fall, dass du nur noch weißt, wie es hieß: nach Titel und Beschreibung suchen.
- Über das Gesagte. Archivierte Untertitel sind ebenfalls im Index, ein erinnerter Satz aus dem Video kann es also finden.
Archiviert Save Page Now das Video?
Der Save-Page-Now-Knopf auf web.archive.org speichert die Seite. Bei einem noch laufenden Video nimmt er manchmal auch den Stream mit, ohne jede Garantie und ohne klares Signal, ob es geklappt hat. Betrachte es als Chance, nicht als Plan: Wenn dir ein Video wichtig ist, sichere deine eigene Kopie, solange es online ist. Das Archiv ist ein Notausgang, kein Backup-Dienst.
Was das Archiv nie hergeben wird
- Videos, die niemand gecrawlt hat. Wurde die Seite vor der Löschung nie aufgenommen, gibt es nichts wiederherzustellen. Abdeckung folgt der Aufmerksamkeit: populäre Kanäle und verlinkte Videos werden oft aufgenommen, bei einem Video mit vierzig Aufrufen war womöglich nie ein Crawler.
- Private und nicht gelistete Videos ohne jeden öffentlichen Link. Ein Crawler speichert keine Seite, die er nicht erreicht.
- Die meisten Kommentare. Fast die gesamte YouTube-Geschichte über wurden Kommentare nach der Seite nachgeladen, im gespeicherten HTML stehen sie deshalb meist nicht.
- Alles, was das Archiv entfernt hat, weil ein Rechteinhaber es verlangt hat.