Thumbnails aus Videos extrahieren
🤖/video/thumbs extrahiert beliebig viele Bilder aus Videos, um sie als Vorschaubilder zu verwenden.

Mit smart: true wählt die KI aussagekräftige Thumbnails aus, anstatt Frames nur in regelmäßigen Abständen zu erfassen. Der Robot bewertet Kandidaten-Frames nach Klarheit, Helligkeit, Komposition, Gesichtern, Gesichtsausdrücken, Handlung und visueller Wirkung und gibt anschließend die besten count Frames in chronologischer Reihenfolge zurück. Intelligente Ergebnisse enthalten file.meta.smart_score und file.meta.smart_reasons. Wenn die KI-Bewertung nicht verfügbar ist, wird die Assembly mit den Kandidaten-Frames in der Ausweichreihenfolge fortgesetzt. Es sind keine eigenen KI-Zugangsdaten erforderlich.
KI-Preise
Die regulären Verarbeitungskosten für /video/thumbs fallen weiterhin an. Die KI-Analyse der Frames wird separat zu den Kosten des zugrunde liegenden Anbieters zuzüglich eines Transloadit-Aufschlags von 50 % berechnet. Die genauen KI-Kosten hängen von der Anzahl der Kandidaten-Frames, dem intern ausgewählten Modell und Anbieterpreis sowie der Größe der Bilddaten ab.
smart_max_candidates ist der wichtigste Regler für Kosten und Latenz. Der Robot analysiert bis zu drei Kandidaten pro angefordertem Thumbnail, begrenzt durch smart_max_candidates, jedoch nie weniger als count. Mit den Standardwerten count: 8 und smart_max_candidates: 20 analysiert er 20 Frames und gibt die besten 8 zurück. Ein niedrigerer Grenzwert reduziert KI-Kosten und Latenz; ein höherer gibt der KI mehr Frames zur Auswahl.
Verwenden Sie count für die intelligente Auswahl. Um mit offsets zuverlässig exakte Zeitstempel zu extrahieren, setzen Sie smart: false.
Obwohl Thumbnails parallel aus Videos extrahiert werden, sortieren wir sie, bevor wir sie den Ergebnissen der Assembly hinzufügen. Ihre dortige Reihenfolge entspricht daher ihrem Auftreten im Video. Sie können dies auch anhand des Metadatenschlüssels thumb_index überprüfen.
Ein Template vom Upload bis zum Poster, SDK-Code und Prüfungen vor der Veröffentlichung finden Sie im HTML-Video-Workflow-Guide. Die Video-und-S3-Demo (English) enthält eine aufgezeichnete Eingabe und extrahierte Frames.
Anwendungsbeispiel
Drei visuell ansprechende Thumbnails aus jedem hochgeladenen Video mit KI auswählen:
{
"steps": {
"thumbnailed": {
"count": 3,
"ffmpeg_stack": "v7",
"robot": "/video/thumbs",
"smart": true,
"smart_max_candidates": 12,
"use": ":original"
}
}
}Parameter
interpolateboolean | Record<string, boolean>Steuert, ob einzelne Robot-Anweisungsfelder Assembly Variables interpolieren.
Standardmäßig interpolieren die meisten Robot-Anweisungsfelder Assembly Variables. Mit dem Wert
falsebehandeln Sie alle Anweisungsfelder als Literaltext. Wenn Sie stattdessen einen einzelnen Feldpfad auffalsesetzen, wird nur dieses Feld als Literaltext behandelt. Bei Feldern eines bestimmten Robots, die standardmäßig als Literaltext behandelt werden, aktivieren Sie die Interpolation wieder, indem Sie hierfürtruefestlegen oder für den jeweiligen Feldpfad den Werttrueverwenden.Verwenden Sie Feldnamen wie
pathoder für verschachtelte Objekte Punktpfade wieffmpeg.vfals Pfadangabe.output_metaRecord<string, boolean> | boolean | Array<string>Damit können Sie eine Reihe von Metadaten festlegen, deren Berechnung mehr CPU-Ressourcen beansprucht. Sie sind daher standardmäßig deaktiviert, damit Ihre Assemblies schnell verarbeitet werden.
Für Bilder können Sie diesem Objekt den Eintrag
"has_transparency": truehinzufügen, um zu ermitteln, ob das Bild transparente Bereiche enthält. Mit dem Eintrag"dominant_colors": truekönnen Sie außerdem ein Array mit hexadezimalen Farbcodes aus dem Bild extrahieren.Für Bilder können Sie auch den Eintrag
"blurhash": truehinzufügen, um einen BlurHash als String zu extrahieren – eine kompakte Darstellung eines Platzhalters für das Bild, mit der Sie eine unscharfe Vorschau anzeigen können, während das vollständige Bild geladen wird.Für Bilder extrahiert der Eintrag
"thumbhash": truestattdessen einen base64-codierten ThumbHash nachmeta.thumbhash, zusammen mitmeta.has_alpha(gibt an, ob ein Alphakanal vorhanden ist, auch wenn das Bild vollständig deckend ist). Der Hash beschreibt die Pixel gemäß EXIF-Ausrichtung und verwendet bei animierten Bildern das erste Frame. Die Extraktion erfolgt nach dem Best-Effort-Prinzip: Bilder über 40 Megapixeln, nicht unterstützte Formate oder ein fehlgeschlagener bzw. durch Grenzwerte beschränkter Decodiervorgang erzeugen keinen Platzhalter. Eine erfolgreiche Extraktion verursacht eine zusätzliche Metadatengebühr in Höhe von 20 % der Bytes dieser Datei. Ist die Option deaktiviert oder wird kein Hash erzeugt, fällt kein ThumbHash-Aufschlag an.Setzen Sie diese Option für den Step, der das Bild erzeugt, etwa
/upload/handlefür hochgeladene Originale oder/image/resizefür verarbeitete Ausgaben. Wird sie nur für/transloadit/storegesetzt, wird keine Extraktion angefordert: Die Speicherung behält die Metadaten des erzeugenden Steps bei. Transloadit Storage speichert einen erzeugten Hash dauerhaft zusammen mit seiner unveränderlichen Version und gibt ihn in gespeicherten Ergebnissen sowie beim nativen Lesen von Assets zurück. Direkte S3-Uploads erzeugen keine Platzhalter. Ein Platzhalter enthält Bildinformationen; schützen Sie ihn daher mit denselben Zugriffskontrollen wie das vollständige Bild.Für Videos können Sie den Parameter
"colorspace": truehinzufügen, um den Farbraum des Ausgabevideos zu extrahieren.Für Videos können Sie außerdem den Eintrag
"interlaced": truehinzufügen, um zu erkennen, ob das Video im Zeilensprungverfahren vorliegt. Dazu wird die ressourcenschonende ffprobe-Optionfield_ordermit einem begrenzten Stichprobendurchlauf mithilfe vonidetüber die ersten Frames der Quelle kombiniert. Die Ergebnisseinterlacedundfield_ordersowie das Diagnoseobjektinterlace_detectionwerden dabei unterfile.metaausgegeben. Dies ist rechenintensiv und wird entsprechend abgerechnet.Für Audio können Sie den Eintrag
"mean_volume": truehinzufügen, um einen einzelnen Wert für die durchschnittliche Lautstärke der Audiodatei zu erhalten.Sie können diesen Parameter auch auf
falsesetzen, um die Metadatenextraktion zu überspringen und das Transkodieren zu beschleunigen.user_metaRecord<string, any>(Standard:{})Fügt jeder ausgegebenen Datei benutzerdefinierte JSON-Metadaten hinzu, ohne den Dateiinhalt zu verändern. Verschachtelte Objekte und Arrays werden unterstützt.
Die Vererbung hängt vom Robot ab. Die Werte werden mit vorhandenen
user_metader Ausgabedatei zusammengeführt; der aktuelle Step ersetzt übereinstimmende Schlüssel auf oberster Ebene. Weisen Sie erforderliche Schlüssel explizit zu, wenn ein Robot neue Ausgabedateien erstellt.In Steps zur Verarbeitung bezieht sich
${file.*}auf die erste Eingabe und${result.*}auf die ausgegebene Datei. Die Werte werden nach der Ausführung des Robots für jede Ausgabedatei ausgewertet, bevor die anschließende Metadatenextraktion und temporäre Speicherung erfolgen. Bei:originalwerden die Werte für jeden Upload vor der Metadatenextraktion ausgewertet.Nachfolgende Steps lesen
${file.user_meta.key}. Ein vollständiges Beispiel und die Vererbungsregeln finden Sie unter Benutzerdefinierte Metadaten.resultboolean(Standard:false)Ob die Ergebnisse dieses Steps im Assembly Status JSON enthalten sein sollen
queuebatchWenn Sie die Queue auf „batch“ setzen, wird die Priorität der Jobs für diesen Step manuell herabgestuft. So vermeiden Sie, Priority Job Slots für Jobs zu belegen, die keine Wartezeit von null in der Queue benötigen.
force_acceptboolean(Standard:false)Erzwingt, dass ein Robot einen Dateityp akzeptiert, den er sonst ignorieren würde.
Standardmäßig ignorieren Robots Dateien, deren Typ sie nicht kennen. 🤖/video/encode ignoriert beispielsweise problemlos Eingabebilder.
Wenn Sie den Parameter
force_acceptauftruesetzen, können Sie erzwingen, dass Robots alle übergebenen Dateien akzeptieren. Dies führt in der Regel zu Fehlern und sollte nur zur Fehlersuche oder zur Behandlung von Grenzfällen verwendet werden.ignore_errorsboolean | Array<meta | execute>(Standard:[])Fehler in bestimmten Verarbeitungsphasen ignorieren.
Wenn Sie hierfür
["meta"]festlegen, ignoriert der Robot Fehler bei der Metadatenextraktion.Wenn Sie hierfür
["execute"]festlegen, ignoriert der Robot Fehler während der Hauptausführungsphase.Wenn Sie hierfür
truefestlegen, entspricht dies["meta", "execute"]und Fehler in beiden Phasen werden ignoriert.usestring | Array<string> | Array<object> | objectGibt an, welche Steps als Eingabe verwendet werden sollen.
- Sie können beliebige Namen für Steps wählen, außer
":original"(reserviert für von Transloadit verarbeitete Benutzer-Uploads) - Sie können mehrere Steps mithilfe von Arrays als Eingabe angeben:
{ "use": [ ":original", "encoded", "resized" ] } - Sie können Eingabe-Steps außerdem mit
askennzeichnen, um Robots die semantische Funktion zu übermitteln:{ "use": [ { "name": ":original", "as": "image" }, { "name": ":original", "as": "mask" } ] }
TippDas ist wahrscheinlich alles, was Sie über
usewissen müssen. Sie können sich jedoch auch die erweiterten Anwendungsfälle ansehen.- Sie können beliebige Namen für Steps wählen, außer
ffmpegobjectEin Parameterobjekt, das an FFmpeg übergeben wird. Wenn eine Voreinstellung verwendet wird, werden die angegebenen Optionen mit deren Optionen zusammengeführt. Verfügbare Optionen finden Sie in der FFmpeg-Dokumentation. Die hier angegebenen Optionen haben Vorrang vor den Optionen der Voreinstellung.
ffmpeg_stackv6 | v7 | v8 | string(Standard:"v6.0.0")Wählt die Version des FFmpeg-Stacks aus, die zum Encoding verwendet werden soll. Derzeit empfehlen wir „v7“. Die exakten Versionen „v6.0.0“, „v7.0.0“ und „v8.0.0“ sind Legacy-Werte, die aus Gründen der Abwärtskompatibilität weiterhin akzeptiert werden. Veraltete „v5.x“-Werte werden ebenfalls akzeptiert.
countstring | number(Standard:8)Die Anzahl der zu extrahierenden Thumbnails. Da einige Videos falsche Laufzeitangaben enthalten, kann die tatsächlich erzeugte Anzahl in seltenen Fällen geringer sein. Derzeit sind maximal 999 Thumbnails zulässig.
Die Thumbnails werden in regelmäßigen Abständen erstellt, die sich aus der Division der Videolaufzeit durch die Anzahl ergeben. Eine Anzahl von 3 erzeugt beispielsweise Thumbnails bei 25 %, 50 % und 75 % innerhalb des Videos.
Um Thumbnails für bestimmte Zeitstempel zu extrahieren, verwenden Sie den Parameter
offsets.offsetsArray<string | number> | Array<string>(Standard:[])Ein Array mit Zeitpositionen in Sekunden innerhalb der Dateidauer, beispielsweise
[ 2, 45, 120 ]. Positionen in Millisekunden können auch durch Dezimalwerte angegeben werden. Eine Zeitposition bei 1250 Millisekunden würde beispielsweise als1.25dargestellt. Zeitpositionen können auch als Prozentwerte wie[ "2%", "50%", "75%" ]angegeben werden.Diese Option kann nicht zusammen mit dem Parameter
countverwendet werden und hat Vorrang, wenn beide angegeben sind. Zeitpositionen außerhalb des gültigen Bereichs werden ohne Meldung ignoriert.Wenn
smartauftruegesetzt ist, ignoriert die intelligente Auswahloffsetsund verwendetcount, um aus ihren eigenen Kandidatenzeitpunkten auszuwählen. Können keine Smart-Kandidaten extrahiert werden, fällt der Robot auf die Standardextraktion zurück, bei deroffsetsVorrang hat. Verwenden Siesmart: false, um die angegebenen Zeitstempel zuverlässig zu extrahieren.formatjpeg | jpg | png(Standard:"jpeg")Das Format des extrahierten Thumbnails. Unterstützte Werte sind
"jpg","jpeg"und"png". Selbst wenn Sie als Format"jpeg"angeben, erhalten die resultierenden Thumbnails die Dateierweiterung"jpg".widthstring | numberDie Breite des Thumbnails in Pixeln. Standardmäßig wird die ursprüngliche Breite des Videos verwendet.
heightstring | numberDie Höhe des Thumbnails in Pixeln. Standardmäßig wird die ursprüngliche Höhe des Videos verwendet.
resize_strategycrop | fit | fillcrop | min_fit | pad | stretch(Standard:"pad")backgroundstring(Standard:"#00000000")Die Hintergrundfarbe der resultierenden Thumbnails im Format
"rrggbbaa"(Rot, Grün, Blau, Alpha), wenn sie mit der Größenänderungsstrategie"pad"verwendet wird. Die Standardfarbe ist Schwarz.rotate0 | 90 | 180 | 270 | 360(Standard:0)Erzwingt die Drehung des Videos um den angegebenen ganzzahligen Gradwert. Derzeit werden nur Vielfache von 90 unterstützt. Wir korrigieren die Ausrichtung vieler Videos automatisch, wenn die Kamera Ausrichtungsinformationen bereitstellt. Diese Option ist nur für Videos nützlich, die gedreht werden müssen, weil die Kamera ihre Ausrichtung nicht erkannt hat.
input_codecstringGibt den Eingabe-Codec an, der beim Decodieren des Videos verwendet werden soll. Dies ist bei Videos mit speziellen Codecs nützlich, die bestimmte Decoder erfordern.
smartboolean(Standard:false)Wenn dieser Parameter auf
truegesetzt ist, aktiviert er die KI-gestützte intelligente Auswahl von Thumbnails. Statt Thumbnails in regelmäßigen Abständen zurückzugeben, analysiert der Robot infrage kommende Kandidaten-Frames und wählt die visuell ansprechendsten aus.Die KI bewertet Frames anhand folgender Kriterien:
- Visuelle Klarheit (unscharfe oder dunkle Frames werden vermieden)
- Qualität der Bildkomposition
- Vorhandensein von Gesichtern und Gesichtsausdrücken
- Aktivität und Bewegung (Übergangsframes werden vermieden)
- Visuelle Gesamtwirkung
Die regulären Verarbeitungskosten für
/video/thumbsfallen weiterhin an. Die KI-Analyse der Frames wird separat zu den Kosten des zugrunde liegenden Anbieters zuzüglich eines Transloadit-Aufschlags von 50 % berechnet. Sie müssen keine eigenen KI-Zugangsdaten angeben.Der Smart-Modus erzeugt eigene, regelmäßig verteilte Kandidatenzeitpunkte. Verwenden Sie
smart: falsemitoffsets, wenn Sie bestimmte Zeitpunkte benötigen. Ausgewählte Smart-Thumbnails werden chronologisch zurückgegeben, nicht nach Bewertung. Prüfen Siemeta.thumb_offset,meta.smart_scoreundmeta.smart_reasons, um die Auswahl zu beurteilen.Schlägt die KI-Bewertung fehl, wählt der Robot die extrahierten Kandidaten in chronologischer Reihenfolge aus und vermerkt den Grund für diesen Fallback. Können keine Kandidaten extrahiert werden, versucht er die Standard-Thumbnail-Extraktion. Eine abgeschlossene Assembly garantiert kein repräsentatives oder zur Veröffentlichung geeignetes Poster. Prüfen Sie, ob Ergebnisse vorhanden sind, und wenden Sie die Prüfrichtlinie Ihrer Anwendung an.
smart_max_candidatesstring | number(Standard:20)Die maximale Größe des Pools von Kandidaten-Frames, wenn
smartauftruegesetzt ist. Der Robot analysiert bis zu drei Kandidaten-Frames pro angefordertem Thumbnail, begrenzt durch diesen Wert. Er analysiert jedoch nie weniger Kandidaten-Frames als durchcountangefordert.Eine höhere Anzahl kann bessere Ergebnisse liefern, erhöht jedoch die Verarbeitungszeit und die KI-Kosten. Mit den Standardwerten
count: 8undsmart_max_candidates: 20analysiert der Robot 20 Frames und gibt die besten 8 in chronologischer Reihenfolge zurück.Dieser Parameter wird nur verwendet, wenn
smartauftruegesetzt ist.