Transloadit
Precios
  • Subida de archivos
  • Importación de archivos
  • Procesamiento por lotes (English)
  • Encoding de video
  • Encoding de audio
  • Procesamiento de imágenes
  • Procesamiento de documentos
  • Inteligencia artificial
  • Filtrado y seguridad de archivos
  • Catalogación de medios
  • Compresión de archivos
  • Evaluación de código
  • Exportación de archivos
  • Smart CDN
  • Ver todos los servicios
  • Explora integraciones (English)
  • Explora demos en vivo (English)
  • Uppy
  • TransloaditKit
  • SDK para Android
  • SDK para Node.js
  • SDK para Python
  • SDK para Ruby
  • SDK para Go
  • SDK para Java
  • SDK para PHP
  • Zapier
  • Servidor MCP
  • Transloadit CLI
  • Terraform
  • Conceptos esenciales
  • Prácticas recomendadas
  • FAQ
  • Robots
  • Endpoints de la API
  • Formatos
  • Crea tu primera app
  • Acerca de Transloadit
  • Comparaciones
  • Código abierto
  • Testimonios
  • Empleos (English)
  • Seguridad
  • Entradas
  • Actualidad para desarrolladores (English)
  • Consejos para desarrolladores
  • Prensa (English)
  • Investigación (English)
  • Casos de éxito
  • Soluciones
  • Guías
  • Glosario (English)
  • Legal (English)
  • Herramientas
  • Cómo ayudamos a Coursera a llevar educación a millones de personas en todo el mundo
  • Soporte de Transloadit
  • Soporte para código abierto
  • Acuerdo de nivel de servicio (English)
Conceptos esencialesRobotsFAQEndpoints de la APIFormatosPrácticas recomendadas
Subida de archivos
  • /upload/handle
    Gestionar subidas
Importación de archivos
  • /azure/import
    Importar archivos desde Azure
  • /backblaze/import
    Importar archivos desde Backblaze
  • /box/import
    Importar archivos desde Box
  • /mega/import
    Importar archivos desde el almacenamiento de objetos MEGA S4
  • /cloudfiles/import
    Importar archivos desde Rackspace Cloud Files
  • /cloudflare/import
    Importar archivos desde Cloudflare R2
  • /digitalocean/import
    Importar archivos desde DigitalOcean Spaces
  • /dropbox/import
    Importar archivos desde Dropbox
  • /ftp/import
    Importar archivos desde servidores FTP
  • /google/import
    Importar archivos desde Google Cloud Storage
  • /http/import
    Importar archivos desde servidores web
  • /minio/import
    Importar archivos desde MinIO
  • /s3/import
    Importar archivos desde Amazon S3
  • /sftp/import
    Importar archivos desde servidores SFTP
  • /supabase/import
    Importar archivos desde Supabase Storage
  • /swift/import
    Importar archivos desde OpenStack Swift
  • /tigris/import
    Importar archivos desde Tigris
  • /transloadit/import
    Importar archivos del almacenamiento de Transloadit
    EN (English)
  • /vimeo/import
    Importar videos desde Vimeo
  • /wasabi/import
    Importar archivos desde Wasabi
Encoding de video
  • /video/adaptive
    Convertir videos a HLS, MPEG-Dash y CMAF
  • /video/artwork
    Extraer o insertar carátulas de video
  • /video/concat
    Concatenar videos
  • /video/encode
    Transcodificar, redimensionar o añadir marcas de agua a videos
  • /video/merge
    Combinar video, audio e imágenes en un solo video
  • /video/ondemand
    Transmitir videos con encoding bajo demanda
  • /video/split
    Dividir video
  • /video/subtitle
    Añadir subtítulos a videos
  • /video/thumbs
    Extraer miniaturas de videos
  • Ajustes preestablecidos de encoding de video
Encoding de audio
  • /audio/artwork
    Extraer o insertar carátulas de audio
  • /audio/concat
    Concatenar audio
  • /audio/split
    Dividir audio
  • /audio/encode
    Codificar audio
  • /audio/loop
    Repetir audio en bucle
  • /audio/merge
    Combinar archivos de audio en uno solo
  • /audio/waveform
    Generar imágenes de forma de onda a partir de audio
  • Ajustes preestablecidos de encoding de audio
Procesamiento de imágenes
  • /image/bgremove
    Eliminar el fondo de imágenes
  • /image/enhance
    Mejorar imágenes
    EN (English)
  • /image/merge
    Combinar varias imágenes en una sola imagen
  • /image/optimize
    Optimizar imágenes sin pérdida de calidad
  • /image/resize
    Convertir, redimensionar o añadir marcas de agua a imágenes
Procesamiento de documentos
  • /document/autorotate
    Rotar documentos automáticamente
  • /document/convert
    Convertir documentos a distintos formatos
  • /document/extract
    Extraer texto e imágenes incrustadas
  • /document/merge
    Combinar documentos en uno
  • /document/optimize
    Optimizar el tamaño de archivos PDF
    EN (English)
  • /file/read
    Leer el contenido de archivos
  • /document/split
    Extraer páginas
  • /document/thumbs
    Extraer imágenes en miniatura de documentos
  • /html/convert
    Tomar capturas de pantalla de páginas web o archivos HTML
Inteligencia artificial
  • /document/ocr
    Reconocer texto en documentos (OCR)
  • /image/describe
    Reconocer objetos en imágenes
  • /image/facedetect
    Detectar rostros en imágenes
  • /image/generate
    Generar imágenes a partir de prompts de texto
  • /image/upscale
    Aumentar la resolución de imágenes
    EN (English)
  • /image/ocr
    Reconocer texto en imágenes (OCR)
  • /speech/transcribe
    Transcribir voz en archivos de audio o video
  • /text/speak
    Sintetizar voz a partir de documentos
  • /text/translate
    Traducir texto en documentos
  • /ai/chat
    Generar respuestas de chat con IA
    EN (English)
  • /video/generate
    Generar videos a partir de prompts de texto
Filtrado y seguridad de archivos
  • /file/filter
    Filtrar archivos
  • /file/verify
    Verificar el tipo de archivo
  • /file/virusscan
    Escanear archivos en busca de virus
Catalogación de medios
  • /file/hash
    Calcular el hash de archivos
  • /file/preview
    Generar una miniatura de vista previa
    EN (English)
  • /meta/write
    Escribir metadatos en archivos multimedia
Compresión de archivos
  • /file/compress
    Comprimir archivos
  • /file/decompress
    Descomprimir archivos comprimidos
Evaluación de código
  • /http/request
    Llamar a endpoints HTTP
    EN (English)
  • /script/run
    Ejecutar scripts en Assemblies
Exportación de archivos
  • Descarga
  • /azure/store
    Exportar archivos a Microsoft Azure
  • /backblaze/store
    Exportar archivos a Backblaze
  • /box/store
    Exportar archivos a Box
  • /mega/store
    Exportar archivos al almacenamiento de objetos de MEGA S4
  • /cloudfiles/store
    Exportar archivos a Rackspace Cloud Files
  • /cloudflare/store
    Exportar archivos a Cloudflare R2
  • /digitalocean/store
    Exportar archivos a DigitalOcean Spaces
  • /dropbox/store
    Exportar archivos a Dropbox
  • /ftp/store
    Exportar archivos a servidores FTP
  • /google/store
    Exportar archivos a Google Cloud Storage
  • /minio/store
    Exportar archivos a MinIO
  • /s3/store
    Exportar archivos a Amazon S3
  • /sftp/store
    Exportar archivos a servidores SFTP
  • /supabase/store
    Exportar archivos a Supabase Storage
  • /swift/store
    Exportar archivos a OpenStack Swift
  • /tigris/store
    Exportar archivos a Tigris
  • /transloadit/store
    Almacenar archivos en el almacenamiento de Transloadit
    EN (English)
  • /tus/store
    Exportar archivos a servidores compatibles con el protocolo tus
  • /vimeo/store
    Exportar archivos a Vimeo
  • /wasabi/store
    Exportar archivos a Wasabi
  • /youtube/store
    Exportar archivos a YouTube
Smart CDN
  • /file/serve
    Servir archivos a navegadores web
  • /tlcdn/deliver
    Almacenar en caché y entregar archivos globalmente
  • Precios

Detectar rostros en imágenes

🤖/image/facedetect detecta rostros en imágenes y puede devolver sus coordenadas o los rostros mismos como imágenes nuevas.

Robot /image/facedetect

Puedes especificar un relleno alrededor de los rostros extraídos para adaptar el resultado a tus necesidades.

Este Robot funciona bien junto con 🤖/image/resize para que aproveches todo el potencial de las imágenes redimensionadas y optimizadas en tu sitio web o aplicación.

Cómo mejorar la precisión:

  • Asegúrate de que tus imágenes tengan la orientación correcta. Este Robot alcanza el mejor rendimiento cuando los rostros de la imagen están orientados verticalmente y no están rotados.
  • Si el Robot detecta objetos que no sean rostros, puedes usar "faces": "max-confidence" dentro de tu Template para seleccionar únicamente la detección con el mayor nivel de confianza.
  • También puedes controlar el número de detecciones devueltas mediante el parámetro min_confidence. Aumentar su valor producirá menos resultados, pero cada uno tendrá un mayor nivel de confianza. Disminuirlo, por otro lado, proporcionará más resultados, aunque también podría incluir objetos que no sean rostros.

Ejemplo de uso

Detecta todos los rostros en imágenes subidas, recórtalos y guárdalos como imágenes separadas:

{
  "steps": {
    "faces_detected": {
      "crop": true,
      "crop_padding": "10px",
      "faces": "each",
      "robot": "/image/facedetect",
      "use": ":original"
    }
  }
}

Parámetros

  • interpolate

    boolean | Record<string, boolean>

    Controla si las Assembly Variables se interpolan en campos de instrucciones individuales.

    De forma predeterminada, la mayoría de los campos de instrucciones de los Robots interpolan Assembly Variables. Establece esta opción en false para tratar todos los campos de instrucciones como texto literal, o establece la ruta de un campo individual en false para tratar únicamente ese campo como texto literal. En el caso de los campos específicos de un Robot que son literales de forma predeterminada, establece esta opción en true o la ruta de ese campo en true para volver a habilitar la interpolación.

    Usa nombres de campos como path o rutas con puntos como ffmpeg.vf para los objetos anidados.

  • output_meta

    Record<string, boolean> | boolean | Array<string>

    Te permite especificar un conjunto de metadatos cuyo cálculo requiere más recursos de CPU y que, por lo tanto, está desactivado de forma predeterminada para mantener el procesamiento de tus Assemblies rápido.

    Para imágenes, puedes añadir "has_transparency": true en este objeto para extraer si la imagen contiene partes transparentes y "dominant_colors": true para extraer un array de códigos de color hexadecimales de la imagen.

    Para imágenes, también puedes añadir "blurhash": true para extraer una cadena BlurHash⁠, una representación compacta de un marcador de posición para la imagen que resulta útil para mostrar una vista previa desenfocada mientras se carga la imagen completa.

    Para imágenes, "thumbhash": true extrae en su lugar un ThumbHash⁠ codificado en base64 en meta.thumbhash, junto con meta.has_alpha (si existe un canal alfa, incluso cuando es totalmente opaco). Describe píxeles orientados según EXIF y usa el primer fotograma en el caso de imágenes animadas. La extracción se realiza según el mejor esfuerzo posible: las imágenes de más de 40 megapíxeles, los formatos no compatibles o una decodificación fallida o limitada no generan ningún marcador de posición. Una extracción exitosa añade un cargo de metadatos equivalente al 20 % de los bytes de ese archivo. No se aplica ningún recargo por ThumbHash cuando está desactivado o cuando no se genera ningún hash.

    Configura esta opción en el Step que genera la imagen, como /upload/handle para los originales subidos o /image/resize para las salidas procesadas. Configurarla únicamente en /transloadit/store no solicita la extracción: el almacenamiento conserva los metadatos del origen. Transloadit Storage conserva un hash generado junto con su versión inmutable y lo devuelve en los resultados almacenados y en las lecturas nativas de activos. Las subidas directas a S3 no generan marcadores de posición. Un marcador de posición contiene información de la imagen, por lo que debes protegerlo con los mismos controles de acceso que la imagen completa.

    Para videos, puedes añadir el parámetro "colorspace": true para extraer el espacio de color del video de salida.

    Para videos, también puedes añadir "interlaced": true para detectar si el video está entrelazado. Esto combina el indicador field_order de ffprobe, cuyo costo computacional es bajo, con una pasada de muestreo limitada mediante idet sobre los primeros fotogramas de la fuente, y expone interlaced, field_order y un objeto de diagnóstico interlace_detection en file.meta. Esto requiere muchos recursos computacionales y se factura en consecuencia.

    Para audio, puedes añadir "mean_volume": true para obtener un único valor que represente el volumen promedio del archivo de audio.

    También puedes establecer esto en false para omitir la extracción de metadatos y acelerar la transcodificación.

  • user_meta

    Record<string, any>(valor predeterminado: {})

    Añade metadatos JSON personalizados a cada archivo emitido sin modificar su contenido. Se admiten objetos y arrays anidados.

    La herencia depende del Robot. Los valores se combinan con los user_meta existentes en el archivo de salida; el Step actual reemplaza las claves coincidentes de nivel superior. Asigna explícitamente las claves necesarias cuando un Robot cree nuevos archivos de salida.

    En los Steps de procesamiento, ${file.*} hace referencia a la primera entrada y ${result.*} al archivo emitido. Los valores se evalúan para cada salida después de ejecutarse el Robot, antes de la posterior extracción de metadatos y del almacenamiento temporal. En :original, los valores se evalúan para cada subida antes de la extracción de metadatos.

    Los Steps posteriores leen ${file.user_meta.key}. Consulta Metadatos personalizados para ver un ejemplo completo y las reglas de herencia.

  • result

    boolean(valor predeterminado: false)

    Indica si los resultados de este Step deben aparecer en el Assembly Status JSON

  • queue

    batch

    Establecer la cola en «batch» reduce manualmente la prioridad de los Jobs de este Step para evitar consumir cupos prioritarios con Jobs que no necesitan un tiempo de espera cero en la cola

  • force_accept

    boolean(valor predeterminado: false)

    Forzar a un Robot a aceptar un tipo de archivo que habría ignorado.

    De forma predeterminada, los Robots ignoran los archivos que no reconocen. 🤖/video/encode, por ejemplo, ignorará sin problemas las imágenes de entrada.

    Si configuras el parámetro force_accept como true, puedes forzar a los Robots a aceptar todos los archivos que reciban. Esto normalmente provocará errores y solo debe usarse para depuración o para abordar casos extremos.

  • ignore_errors

    boolean | Array<meta | execute>(valor predeterminado: [])

    Ignorar errores durante fases específicas del procesamiento.

    Establecer este parámetro en ["meta"] hará que el Robot ignore los errores durante la extracción de metadatos.

    Establecer este parámetro en ["execute"] hará que el Robot ignore los errores durante la fase principal de ejecución.

    Configurar este parámetro como true equivale a ["meta", "execute"] y hará que se ignoren los errores en ambas fases.

  • use

    string | Array<string> | Array<object> | object

    Especifica qué Step o Steps se usarán como entrada.

    • Puedes elegir cualquier nombre para los Steps, excepto ":original" (reservado para las subidas de usuarios gestionadas por Transloadit)
    • Puedes proporcionar varios Steps como entrada mediante arrays:
      {
        "use": [
          ":original",
          "encoded",
          "resized"
        ]
      }
      
    • También puedes etiquetar los Steps de entrada con as para comunicar la intención semántica a los Robots:
      {
        "use": [
          {
            "name": ":original",
            "as": "image"
          },
          {
            "name": ":original",
            "as": "mask"
          }
        ]
      }
      
    Consejo

    Probablemente eso sea todo lo que necesitas saber sobre use, pero puedes consultar los casos de uso avanzados.

  • provider

    auto | aws | gcp(valor predeterminado: "auto")

    Se selecciona automáticamente el mejor proveedor según tu solicitud.

    Selecciona un proveedor específico para anular la selección automática.

  • crop

    boolean(valor predeterminado: false)

    Determina si se deben extraer los rostros detectados. Si esta opción se establece en false, el Robot devuelve nuevamente la imagen de entrada, pero con las coordenadas de todos los rostros detectados adjuntas a file.meta.faces en el JSON del resultado. Si este parámetro se establece en true, el Robot generará todos los rostros detectados como imágenes.

  • crop_padding

    string(valor predeterminado: "5px")

    Especifica cuánto relleno se añade a las imágenes de rostros extraídas si crop se establece en true. Los valores pueden expresarse en px (píxeles) o % (porcentaje del ancho y la altura de la imagen del rostro correspondiente).

  • format

    jpg | png | preserve | tiff(valor predeterminado: "preserve")

    Determina el formato de salida de las imágenes de rostros extraídas si crop se establece en true.

    El valor predeterminado "preserve" significa que se reutiliza el formato de la imagen de entrada.

  • min_confidence

    string | number(valor predeterminado: 70)

    Especifica la confianza mínima que debe tener un rostro detectado. Solo se incluirán en el resultado los rostros cuyo valor de confianza sea superior a este umbral.

  • faces

    each | group | max-confidence | max-size | string | number(valor predeterminado: "each")

    Determina cuáles de los rostros detectados deben devolverse. Los valores válidos son:

    • "each" hace que cada rostro se devuelva por separado.
    • "max-confidence" hace que solo se devuelva el rostro con el valor de confianza más alto.
    • "max-size" hace que solo se devuelva el rostro con el área más grande.
    • "group" hace que todos los rostros detectados se agrupen en un único rectángulo que los contenga.
    • Cualquier número entero hace que los rostros se ordenen según su esquina superior izquierda; el entero determina el índice del rostro devuelto. Ten en cuenta que los valores usan índices que comienzan en cero, lo que significa que faces: 0 devolverá el primer rostro. Si no existe ningún rostro para un índice determinado, no se genera ninguna salida.

    En los siguientes ejemplos, la imagen de entrada es:


    Se aplica faces: "each":


    Se aplica faces: "max-confidence":


    Se aplica faces: "max-size":


    Se aplica faces: "group":


    Se aplica faces: 0:

Demos

  • Automatic face detection service EN (English)
  • Automatic face detection service EN (English)

Publicaciones relacionadas del blog

  • Lanzamiento del Robot de detección de rostros para imágenes 5 de febrero de 2016
  • Nuevo modelo de precios para futuros clientes de Transloadit 7 de febrero de 2018
  • Nuevo parámetro «faces» en la detección facial de imágenes 25 de octubre de 2019
  • Exporta archivos a DigitalOcean Spaces con facilidad 9 de diciembre de 2019
  • Tech preview: nuevos Robots de IA para procesar mejor multimedia 17 de febrero de 2020
  • Hitos y avances de Transloadit en 2021 31 de enero de 2022
  • Smart CDN mejorado con detección facial impulsada por IA 21 de junio de 2022
  • Hitos de Transloadit en 2022: crecimiento e innovaciones 7 de febrero de 2023
  • Cómo difuminar rostros en fotos con Transloadit 4 de julio de 2023
  • Presentamos la extracción de texto de PDF con un Robot de IA 9 de noviembre de 2023
Página anterior ← /image/describePágina siguiente /image/generate →
Contactar a soporte⁠

TransloaditVerificando el estado…

Producto

  • Servicios
  • Precios
  • Demos EN (English)
  • Herramientas
  • Seguridad
  • Soporte

Empresa

  • Acerca de Transloadit/Prensa EN (English)
  • Blog/Empleos EN (English)
  • Comparaciones/Matriz de cumplimiento EN (English)
  • Investigación EN (English)
  • Código abierto
  • Soluciones
  • Pioneros de la web

Documentación

  • Primeros pasos
  • Transcodificación
  • FAQ
  • Endpoints de la API
  • Guías/Consejos para desarrolladores
  • Formatos compatibles

Más

  • Estado de la plataforma⁠
  • Foro de la comunidad⁠
  • StackOverflow⁠
  • Uppy
  • tus⁠

© 2009–2026 Transloadit-II GmbH

Privacidad EN (English)Términos EN (English)Aviso legal EN (English)
EnglishDeutschEspañolPortuguês (Brasil)