Wellenformbilder aus Audio erzeugen
🤖/audio/waveform erzeugt Wellenformbilder für Ihre Audiodateien und ermöglicht es Ihnen, deren Farben und Abmessungen zu ändern.

Wir empfehlen, einen Step mit 🤖/audio/encode vor Ihrem Step zur Wellenform-Erzeugung zu verwenden, um Audiodateien in MP3 zu konvertieren. So ist sichergestellt, dass 🤖/audio/waveform Ihre Audiodatei akzeptiert, und Sie können bei großen Audiodateien zudem die Abtastrate reduzieren und so Kosten sparen.
Ebenso gilt: Wenn Sie das Ausgabebild in einem anderen Format benötigen, leiten Sie das Ergebnis von diesem Robot bitte an 🤖/image/resize weiter.
Anwendungsbeispiel
Eine Wellenform mit 400×200 in der Farbe #0099cc aus einer hochgeladenen Audiodatei erzeugen:
{
"steps": {
"waveformed": {
"center_color": "0099ccff",
"height": 200,
"outer_color": "0099ccff",
"robot": "/audio/waveform",
"use": ":original",
"width": 400
}
}
}Parameter
interpolateboolean | Record<string, boolean>Steuert, ob einzelne Robot-Anweisungsfelder Assembly Variables interpolieren.
Standardmäßig interpolieren die meisten Robot-Anweisungsfelder Assembly Variables. Mit dem Wert
falsebehandeln Sie alle Anweisungsfelder als Literaltext. Wenn Sie stattdessen einen einzelnen Feldpfad auffalsesetzen, wird nur dieses Feld als Literaltext behandelt. Bei Feldern eines bestimmten Robots, die standardmäßig als Literaltext behandelt werden, aktivieren Sie die Interpolation wieder, indem Sie hierfürtruefestlegen oder für den jeweiligen Feldpfad den Werttrueverwenden.Verwenden Sie Feldnamen wie
pathoder für verschachtelte Objekte Punktpfade wieffmpeg.vfals Pfadangabe.output_metaRecord<string, boolean> | boolean | Array<string>Damit können Sie eine Reihe von Metadaten festlegen, deren Berechnung mehr CPU-Ressourcen beansprucht. Sie sind daher standardmäßig deaktiviert, damit Ihre Assemblies schnell verarbeitet werden.
Für Bilder können Sie diesem Objekt den Eintrag
"has_transparency": truehinzufügen, um zu ermitteln, ob das Bild transparente Bereiche enthält. Mit dem Eintrag"dominant_colors": truekönnen Sie außerdem ein Array mit hexadezimalen Farbcodes aus dem Bild extrahieren.Für Bilder können Sie auch den Eintrag
"blurhash": truehinzufügen, um einen BlurHash als String zu extrahieren – eine kompakte Darstellung eines Platzhalters für das Bild, mit der Sie eine unscharfe Vorschau anzeigen können, während das vollständige Bild geladen wird.Für Bilder extrahiert der Eintrag
"thumbhash": truestattdessen einen base64-codierten ThumbHash nachmeta.thumbhash, zusammen mitmeta.has_alpha(gibt an, ob ein Alphakanal vorhanden ist, auch wenn das Bild vollständig deckend ist). Der Hash beschreibt die Pixel gemäß EXIF-Ausrichtung und verwendet bei animierten Bildern das erste Frame. Die Extraktion erfolgt nach dem Best-Effort-Prinzip: Bilder über 40 Megapixeln, nicht unterstützte Formate oder ein fehlgeschlagener bzw. durch Grenzwerte beschränkter Decodiervorgang erzeugen keinen Platzhalter. Eine erfolgreiche Extraktion verursacht eine zusätzliche Metadatengebühr in Höhe von 20 % der Bytes dieser Datei. Ist die Option deaktiviert oder wird kein Hash erzeugt, fällt kein ThumbHash-Aufschlag an.Setzen Sie diese Option für den Step, der das Bild erzeugt, etwa
/upload/handlefür hochgeladene Originale oder/image/resizefür verarbeitete Ausgaben. Wird sie nur für/transloadit/storegesetzt, wird keine Extraktion angefordert: Die Speicherung behält die Metadaten des erzeugenden Steps bei. Transloadit Storage speichert einen erzeugten Hash dauerhaft zusammen mit seiner unveränderlichen Version und gibt ihn in gespeicherten Ergebnissen sowie beim nativen Lesen von Assets zurück. Direkte S3-Uploads erzeugen keine Platzhalter. Ein Platzhalter enthält Bildinformationen; schützen Sie ihn daher mit denselben Zugriffskontrollen wie das vollständige Bild.Für Videos können Sie den Parameter
"colorspace": truehinzufügen, um den Farbraum des Ausgabevideos zu extrahieren.Für Videos können Sie außerdem den Eintrag
"interlaced": truehinzufügen, um zu erkennen, ob das Video im Zeilensprungverfahren vorliegt. Dazu wird die ressourcenschonende ffprobe-Optionfield_ordermit einem begrenzten Stichprobendurchlauf mithilfe vonidetüber die ersten Frames der Quelle kombiniert. Die Ergebnisseinterlacedundfield_ordersowie das Diagnoseobjektinterlace_detectionwerden dabei unterfile.metaausgegeben. Dies ist rechenintensiv und wird entsprechend abgerechnet.Für Audio können Sie den Eintrag
"mean_volume": truehinzufügen, um einen einzelnen Wert für die durchschnittliche Lautstärke der Audiodatei zu erhalten.Sie können diesen Parameter auch auf
falsesetzen, um die Metadatenextraktion zu überspringen und das Transkodieren zu beschleunigen.user_metaRecord<string, any>(Standard:{})Fügt jeder ausgegebenen Datei benutzerdefinierte JSON-Metadaten hinzu, ohne den Dateiinhalt zu verändern. Verschachtelte Objekte und Arrays werden unterstützt.
Die Vererbung hängt vom Robot ab. Die Werte werden mit vorhandenen
user_metader Ausgabedatei zusammengeführt; der aktuelle Step ersetzt übereinstimmende Schlüssel auf oberster Ebene. Weisen Sie erforderliche Schlüssel explizit zu, wenn ein Robot neue Ausgabedateien erstellt.In Steps zur Verarbeitung bezieht sich
${file.*}auf die erste Eingabe und${result.*}auf die ausgegebene Datei. Die Werte werden nach der Ausführung des Robots für jede Ausgabedatei ausgewertet, bevor die anschließende Metadatenextraktion und temporäre Speicherung erfolgen. Bei:originalwerden die Werte für jeden Upload vor der Metadatenextraktion ausgewertet.Nachfolgende Steps lesen
${file.user_meta.key}. Ein vollständiges Beispiel und die Vererbungsregeln finden Sie unter Benutzerdefinierte Metadaten.resultboolean(Standard:false)Ob die Ergebnisse dieses Steps im Assembly Status JSON enthalten sein sollen
queuebatchWenn Sie die Queue auf „batch“ setzen, wird die Priorität der Jobs für diesen Step manuell herabgestuft. So vermeiden Sie, Priority Job Slots für Jobs zu belegen, die keine Wartezeit von null in der Queue benötigen.
force_acceptboolean(Standard:false)Erzwingt, dass ein Robot einen Dateityp akzeptiert, den er sonst ignorieren würde.
Standardmäßig ignorieren Robots Dateien, deren Typ sie nicht kennen. 🤖/video/encode ignoriert beispielsweise problemlos Eingabebilder.
Wenn Sie den Parameter
force_acceptauftruesetzen, können Sie erzwingen, dass Robots alle übergebenen Dateien akzeptieren. Dies führt in der Regel zu Fehlern und sollte nur zur Fehlersuche oder zur Behandlung von Grenzfällen verwendet werden.ignore_errorsboolean | Array<meta | execute>(Standard:[])Fehler in bestimmten Verarbeitungsphasen ignorieren.
Wenn Sie hierfür
["meta"]festlegen, ignoriert der Robot Fehler bei der Metadatenextraktion.Wenn Sie hierfür
["execute"]festlegen, ignoriert der Robot Fehler während der Hauptausführungsphase.Wenn Sie hierfür
truefestlegen, entspricht dies["meta", "execute"]und Fehler in beiden Phasen werden ignoriert.usestring | Array<string> | Array<object> | objectGibt an, welche Steps als Eingabe verwendet werden sollen.
- Sie können beliebige Namen für Steps wählen, außer
":original"(reserviert für von Transloadit verarbeitete Benutzer-Uploads) - Sie können mehrere Steps mithilfe von Arrays als Eingabe angeben:
{ "use": [ ":original", "encoded", "resized" ] } - Sie können Eingabe-Steps außerdem mit
askennzeichnen, um Robots die semantische Funktion zu übermitteln:{ "use": [ { "name": ":original", "as": "image" }, { "name": ":original", "as": "mask" } ] }
TippDas ist wahrscheinlich alles, was Sie über
usewissen müssen. Sie können sich jedoch auch die erweiterten Anwendungsfälle ansehen.- Sie können beliebige Namen für Steps wählen, außer
ffmpegobjectEin Parameterobjekt, das an FFmpeg übergeben wird. Wenn eine Voreinstellung verwendet wird, werden die angegebenen Optionen mit deren Optionen zusammengeführt. Verfügbare Optionen finden Sie in der FFmpeg-Dokumentation. Die hier angegebenen Optionen haben Vorrang vor den Optionen der Voreinstellung.
ffmpeg_stackv6 | v7 | v8 | string(Standard:"v6.0.0")Wählt die Version des FFmpeg-Stacks aus, die zum Encoding verwendet werden soll. Derzeit empfehlen wir „v7“. Die exakten Versionen „v6.0.0“, „v7.0.0“ und „v8.0.0“ sind Legacy-Werte, die aus Gründen der Abwärtskompatibilität weiterhin akzeptiert werden. Veraltete „v5.x“-Werte werden ebenfalls akzeptiert.
formatimage | json(Standard:"image")Das Format der Ergebnisdatei. Möglich sind
"image"oder"json". Wenn"image"angegeben wird, wird ein PNG-Bild erstellt, andernfalls eine JSON-Datei. Wennstyle"spectrogram"ist, wird nur"image"unterstützt.widthstring | number(Standard:256)Die Breite des resultierenden Bildes, wenn das Format
"image"gewählt wurde.heightstring | number(Standard:64)Die Höhe des resultierenden Bildes, wenn das Format
"image"gewählt wurde.antialiasing0 | 1 | boolean(Standard:0)Entweder ein Wert von
0oder1bzw.true/false, je nachdem, ob Sie Antialiasing für weichere Kanten im Wellenform-Diagramm aktivieren möchten oder nicht.background_colorstring(Standard:"#00000000")Die Hintergrundfarbe des resultierenden Bildes im Format „rrggbbaa“ (Rot, Grün, Blau, Alpha), wenn das Format
"image"gewählt wurde.center_colorstring(Standard:"000000ff")Die Farbe, die in der Mitte des Verlaufs verwendet wird. Das Format ist „rrggbbaa“ (Rot, Grün, Blau, Alpha).
outer_colorstring(Standard:"000000ff")Die Farbe, die in den äußeren Bereichen des Verlaufs verwendet wird. Das Format ist „rrggbbaa“ (Rot, Grün, Blau, Alpha).
stylev0 | v1 | spectrogramVersion des Wellenform-Stils.
"v0": Legacy-Wellenform-Erzeugung (Standard)."v1": Erweiterte Wellenform-Erzeugung mit zusätzlichen Parametern."spectrogram": Spektrogramm-Visualisierung, die den Frequenzinhalt über die Zeit darstellt.
Aus Gründen der Abwärtskompatibilität werden auch die numerischen Werte
0und1akzeptiert und auf"v0"und"v1"abgebildet.split_channelsbooleanVerfügbar, wenn style
"v1"ist. Wenn auftruegesetzt, werden mehrkanalige Wellenform-Daten oder Bilddateien ausgegeben, eine pro Kanal.zoomstring | numberVerfügbar, wenn style
"v1"ist. Zoomstufe in Samples pro Pixel. Dieser Parameter kann nicht zusammen mitpixels_per_secondverwendet werden.pixels_per_secondstring | numberVerfügbar, wenn style
"v1"ist. Zoomstufe in Pixeln pro Sekunde. Dieser Parameter kann nicht zusammen mitzoomverwendet werden.bits8 | 16Verfügbar, wenn style
"v1"ist. Bittiefe für die Wellenform-Daten. Möglich sind 8 oder 16.startstring | numberVerfügbar, wenn style
"v1"ist. Startzeit in Sekunden.endstring | numberVerfügbar, wenn style
"v1"ist. Endzeit in Sekunden (0 bedeutet Ende des Audios).colorsaudition | audacityVerfügbar, wenn style
"v1"ist. Zu verwendendes Farbschema. Möglich sind „audition“ oder „audacity“.border_colorstringVerfügbar, wenn style
"v1"ist. Rahmenfarbe im Format „rrggbbaa“.waveform_stylenormal | barsVerfügbar, wenn style
"v1"ist. Wellenform-Stil. Möglich sind „normal“ oder „bars“.bar_widthstring | numberVerfügbar, wenn style
"v1"ist. Breite der Balken in Pixeln, wenn waveform_style „bars“ ist.bar_gapstring | numberVerfügbar, wenn style
"v1"ist. Abstand zwischen den Balken in Pixeln, wenn waveform_style „bars“ ist.bar_stylesquare | roundedVerfügbar, wenn style
"v1"ist. Balkenstil, wenn waveform_style „bars“ ist.axis_label_colorstringVerfügbar, wenn style
"v1"ist. Farbe für die Achsenbeschriftungen im Format „rrggbbaa“.no_axis_labelsbooleanVerfügbar, wenn style
"v1"ist. Wenn auftruegesetzt, wird das Wellenform-Bild ohne Achsenbeschriftungen gerendert.with_axis_labelsbooleanVerfügbar, wenn style
"v1"ist. Wenn auftruegesetzt, wird das Wellenform-Bild mit Achsenbeschriftungen gerendert.amplitude_scalestring | numberVerfügbar, wenn style
"v1"ist. Skalierungsfaktor für die Amplitude.compressionstring | numberVerfügbar, wenn style
"v1"ist. PNG-Kompressionsstufe: 0 (keine) bis 9 (beste) oder -1 (Standard). Gilt nur, wenn format „image“ ist.color_mapviridis | plasma | magma | cividis | cool | rainbow | moreland |Verfügbar, wenn style
"spectrogram"ist. Farbschema für die Spektrogramm-Visualisierung. Standard ist"viridis".frequency_scalelinear | logarithmicVerfügbar, wenn style
"spectrogram"ist. Frequenzskala für das Spektrogramm."linear"stellt die Frequenzen gleichmäßig verteilt dar,"logarithmic"betont niedrigere Frequenzen. Standard ist"logarithmic".frequency_minstring | numberVerfügbar, wenn style
"spectrogram"ist. Minimale anzuzeigende Frequenz in Hz. Standard ist0.frequency_maxstring | numberVerfügbar, wenn style
"spectrogram"ist. Maximale anzuzeigende Frequenz in Hz. Standard ist die Hälfte der Abtastrate (Nyquist-Frequenz).legendbooleanVerfügbar, wenn style
"spectrogram"ist. Ob eine Legende mit den Frequenz- und Zeitskalen eingeblendet wird. Standard istfalse.gainstring | numberVerfügbar, wenn style
"spectrogram"ist. Linearer Verstärkungsfaktor für die Intensität des Spektrogramms. Standard ist1.orientationvertical | horizontalVerfügbar, wenn style
"spectrogram"ist. Ausrichtung des Spektrogramms."horizontal"stellt die Zeit auf der x-Achse dar (Standard),"vertical"stellt die Zeit auf der y-Achse dar.