Ein Nutzer speichert einen Dokumentarfilm in seiner Mediathek. Einen Monat später sind Titel, Cover und Beschreibung noch vorhanden, doch die Wiedergabe startet nicht. Für den Nutzer ist der Inhalt defekt. Aus Entwicklersicht kann der Katalogeintrag völlig intakt sein: Tatsächlich ist die Dateiquelle offline.

Dieser Fehler zeigt drei eigenständige Fragen einer Mediathek: Können Menschen Inhalte finden, sind die erhaltenen Daten korrekt und lassen sie sich jetzt abrufen? Ein gemeinsamer Status „veröffentlicht“ für alle drei lässt die Oberfläche mehr versprechen, als das System leisten kann.

Ein Index beschreibt Inhalte; Dateien brauchen eigene Quellen

Titel, Autoren, Kanäle, Tags und Versionsbeziehungen bilden einen Inhaltskatalog. Die öffentliche GUN-Dokumentation beschreibt Graphdaten und die Echtzeitsynchronisierung von Zuständen zwischen Peers. Solche Werkzeuge können Anwendungen beim Organisieren und Synchronisieren von Beziehungen helfen. GUN-Projektübersicht

Die Dateiverteilung wirft andere Fragen auf: Wer besitzt eine vollständige Kopie, welche Knoten sind online, lassen sich Verbindungen herstellen und fehlende Teilstücke beschaffen? Ein gespeicherter Katalogeintrag erfüllt keine dieser Bedingungen automatisch.

Für Medienanwendungen empfehlen wir, Katalog- und Abrufstatus getrennt anzuzeigen. Nutzer können zunächst einen Eintrag speichern; die Seite sollte jedoch erklären, ob die Verfügbarkeit kürzlich geprüft wurde. Auch „zuletzt erfolgreich abgerufen“ und „jetzt von einer Quelle verfügbar“ benötigen unterschiedliche Formulierungen, damit historische Ergebnisse nicht zu Echtzeitversprechen werden.

Diese Unterscheidung hilft auch bei der Fehlersuche. Synchronisiert sich der Katalog, während die Datei unerreichbar ist, prüfen Sie zuerst Speicherung und Transport. Wird die Datei geliefert, aber die falsche Version angezeigt, untersuchen Sie die Zuordnung von Katalogeinträgen zu Inhaltskennungen. Beide Probleme brauchen unterschiedliche Lösungen.

Inhaltsadressen lösen ein Identifikationsproblem

IPFS identifiziert Inhalte mithilfe von CIDs. Eine CID enthält Angaben zu Hashverfahren und Kodierung und ist nicht einfach eine gewöhnliche SHA-256-Zeichenfolge einer beliebigen Datei. Auch die Datenorganisation kann die erzeugte Kennung beeinflussen. IPFS-Inhaltsadressierung

Für einen Medienkatalog ist eine eindeutige Zuordnung zwischen Anzeigeinformationen und einer bestimmten Dateiversion sinnvoll. Eine geänderte Beschreibung erfordert möglicherweise nur eine Katalogänderung. Beim erneuten Schnitt eines Videos sollte die Beziehung zwischen alter und neuer Version erhalten bleiben, damit Lesezeichen, Kommentare und Prüfinformationen dem richtigen Inhalt zugeordnet bleiben.

Eine erfolgreiche Prüfung erhöht das Vertrauen in die Datenintegrität, belegt allein aber weder die Identität des Autors noch die Gültigkeit einer Lizenz oder die Eignung für einen bestimmten Nutzer. Eine Oberfläche sollte eine bestimmte Prüfung nicht als universelles „vertrauenswürdig“-Abzeichen darstellen. Zeigen Sie Belege für die jeweils konkrete Aussage.

Dauerhafte Speicherung braucht fortlaufende Vereinbarungen

Die IPFS-Dokumentation unterscheidet Inhaltsadressierung von dauerhafter Speicherung und beschreibt Aufbewahrungsmethoden wie Pinning. Selbst wenn ein Knoten Inhalte speichert, sind angemessene Verfügbarkeit und Wartung nötig, damit sie erreichbar bleiben. Dauerhafte Speicherung bei IPFS

Ein Veröffentlichungsablauf sollte daher eine konkrete Aufbewahrungsregelung enthalten: Wer hält vollständige Kopien vor, wie lange, wer übernimmt bei Vertragsende und wie wird die Verantwortung beim Ausscheiden eines Betreuers übertragen? Ein erfolgreicher Upload beantwortet keine Fragen, die Monate später entstehen.

Mindestens sollte geprüft werden, ob Kopien gemeinsame Abhängigkeiten haben. Zwei Adressen können auf dasselbe Konto, Gerät oder denselben Dienstanbieter verweisen. Mehrere eingetragene Quellen bedeuten nicht automatisch, dass bei Ausfall einer Quelle die anderen weiterarbeiten.

Bei selten abgerufenen Inhalten können langfristige Aufbewahrung und das Caching beliebter Inhalte getrennte Budgets haben. Caches reagieren auf wechselnde Nachfrage; langfristige Speicherung braucht eine ausdrücklich verantwortliche Stelle. „Gerade schaut niemand zu“ darf nicht mit „nicht mehr aufbewahrenswert“ gleichgesetzt werden.

Verfügbarkeitsprüfungen müssen echte Abrufe durchführen

Der folgende Ablauf ist ein Ausgangspunkt für Prüfungen. Ihre Häufigkeit richtet sich nach Inhaltsmenge und Dienstzielen:

  1. Dateiversion, Inhaltskennung und mögliche Quellen aus dem Katalog lesen.
  2. Eine Verbindung versuchen und tatsächliche Daten abrufen, statt nur die Erfolgsmeldung der Katalog-API zu prüfen.
  3. Die abgerufenen Daten protokollgemäß verifizieren. Stichproben belegen nur die geprüften Teile und dürfen nicht als Prüfung der gesamten Datei ausgegeben werden.
  4. Zeitpunkt, erfolgreiche Quelle, Fehlergrund und Prüfumfang festhalten.
  5. Bei schrumpfender Quellenzahl oder anhaltenden Fehlern Kopien ergänzen oder den Nutzern einen klaren Status anzeigen.

Planen Sie für diese Prüfungen ein eigenes Datenverkehrsbudget. Ein gleichzeitiger vollständiger Download einer großen Sammlung kann die Prüfung selbst zur Hauptlast machen. Leichte Sondierungen, Wiedergabetests und regelmäßige vollständige Wiederherstellungstests lassen sich gestaffelt planen; jeweils muss klar sein, was sie belegen.

Zeitüberschreitungen, fehlende Rechte, zurückgezogene Inhalte und fehlgeschlagene Integritätsprüfungen sollten nicht gemeinsam als „fehlende Dateien“ gelten. Diese Unterscheidungen helfen zu entscheiden, ob ein neuer Versuch, eine Zugriffsanfrage, eine Kopienreparatur oder das Respektieren des Rückzugs angebracht ist.

Nutzern einen konkreten nächsten Schritt zeigen

Ein endlos drehender Ladeindikator liefert kaum handlungsrelevante Informationen. Besser erklärt die Oberfläche die aktuelle Phase: Quellen suchen, Verbindung aufbauen, vorübergehend unerreichbare Quellen vorfinden oder Daten nach fehlgeschlagener Prüfung zurückweisen.

Startet die Wiedergabe nicht sofort, sollten Nutzer wissen, ob ein erneuter Versuch sinnvoll ist, eine andere Quelle existiert und sie das Lesezeichen für später behalten können. Entwickler können außerdem einen Meldeweg anbieten, der Inhaltskennung und Fehlerkategorie in Diagnosedaten aufnimmt, ohne dass Nutzer sämtliche Schritte nacherzählen müssen.

AlphaBiz nennt in seiner öffentlichen Architekturübersicht GUN und WebTorrent. Damit ist die Trennung von Katalogdaten und Medientransport ein relevantes Entwurfsthema. Die hier vorgeschlagenen technischen Methoden sind zu prüfende Optionen, keine Behauptung, dass eine bestimmte Überwachungs- oder Replikationsstrategie bereits im Produkt umgesetzt wurde. AlphaBiz-Projektübersicht

Beginnen Sie beim Aufbau einer Mediathek mit einer Wiederherstellungsübung für einen Inhalt: Schalten Sie die ursprüngliche Quelle ab und versuchen Sie, den Zugriff aus dem erhaltenen Katalog und den Kopien wiederherzustellen. Das Ergebnis sagt mehr als ein attraktiver Eintrag, der niemals aus dem Katalog verschwindet. Teilen Sie Ihren Verfügbarkeitsentwurf und Prüfumfang in AlphaBiz Discussions.