Detectar rostros en imágenes
🤖/image/facedetect detecta rostros en imágenes y puede devolver sus coordenadas o los rostros mismos como imágenes nuevas.

Puedes especificar un relleno alrededor de los rostros extraídos para adaptar el resultado a tus necesidades.
Este Robot funciona bien junto con 🤖/image/resize para que aproveches todo el potencial de las imágenes redimensionadas y optimizadas en tu sitio web o aplicación.
Cómo mejorar la precisión:
- Asegúrate de que tus imágenes tengan la orientación correcta. Este Robot alcanza el mejor rendimiento cuando los rostros de la imagen están orientados verticalmente y no están rotados.
- Si el Robot detecta objetos que no sean rostros, puedes usar
"faces": "max-confidence"dentro de tu Template para seleccionar únicamente la detección con el mayor nivel de confianza. - También puedes controlar el número de detecciones devueltas mediante el parámetro
min_confidence. Aumentar su valor producirá menos resultados, pero cada uno tendrá un mayor nivel de confianza. Disminuirlo, por otro lado, proporcionará más resultados, aunque también podría incluir objetos que no sean rostros.
Ejemplo de uso
Detecta todos los rostros en imágenes subidas, recórtalos y guárdalos como imágenes separadas:
{
"steps": {
"faces_detected": {
"robot": "/image/facedetect",
"use": ":original",
"crop": true,
"faces": "each",
"crop_padding": "10px"
}
}
}Parámetros
interpolateboolean | Record<string, boolean>Controla si las Assembly Variables se interpolan en campos de instrucciones individuales.
De forma predeterminada, la mayoría de los campos de instrucciones de los Robots interpolan Assembly Variables. Establece esta opción en
falsepara tratar todos los campos de instrucciones como texto literal, o establece la ruta de un campo individual enfalsepara tratar únicamente ese campo como texto literal. En el caso de los campos específicos de un Robot que son literales de forma predeterminada, establece esta opción entrueo la ruta de ese campo entruepara volver a habilitar la interpolación.Usa nombres de campos como
patho rutas con puntos comoffmpeg.vfpara los objetos anidados.output_metaRecord<string, boolean> | boolean | Array<string>Te permite especificar un conjunto de metadatos cuyo cálculo requiere más recursos de CPU y que, por lo tanto, está desactivado de forma predeterminada para que tus Assemblies se procesen rápidamente.
Para imágenes, puedes añadir
"has_transparency": truea este objeto para determinar si la imagen contiene partes transparentes y"dominant_colors": truepara extraer un array de códigos de color hexadecimales de la imagen.Para imágenes, también puedes añadir
"blurhash": truepara extraer una cadena BlurHash, una representación compacta de un marcador de posición para la imagen que resulta útil para mostrar una vista previa desenfocada mientras se carga la imagen completa.Para videos, puedes añadir el parámetro
"colorspace": truepara extraer el espacio de color del video de salida.Para videos, también puedes añadir
"interlaced": truepara detectar si el video está entrelazado. Esto combina el indicadorfield_orderde ffprobe, cuyo costo en recursos de procesamiento es bajo, con una pasada de muestreo limitada medianteidetsobre los primeros fotogramas de la fuente, y exponeinterlaced,field_ordery un objeto de diagnósticointerlace_detectionenfile.meta. Esto requiere muchos recursos computacionales y se factura en consecuencia.Para audio, puedes añadir
"mean_volume": truepara obtener un único valor que represente el volumen promedio del archivo de audio.También puedes establecerlo en
falsepara omitir la extracción de metadatos y acelerar la transcodificación.user_metaRecord<string, any>(valor predeterminado:{})Añade metadatos personalizados a cada archivo emitido por este Robot sin modificar el contenido del archivo.
Los valores se combinan con los
user_metaexistentes en el archivo de entrada. Si ambos objetos contienen la misma clave, el valor de este Robot tiene prioridad. Se admiten Assembly Variables, por ejemplo{ "internal_file_id": "${file.id}" }.resultboolean(valor predeterminado:false)Indica si los resultados de este Step deben aparecer en el Assembly Status JSON
queuebatchEstablecer la cola en «batch» reduce manualmente la prioridad de los Jobs de este Step para evitar consumir cupos prioritarios con Jobs que no necesitan un tiempo de espera cero en la cola
force_acceptboolean(valor predeterminado:false)Forzar a un Robot a aceptar un tipo de archivo que habría ignorado.
De forma predeterminada, los Robots ignoran los archivos que no reconocen. 🤖/video/encode, por ejemplo, ignorará sin problemas las imágenes de entrada.
Si configuras el parámetro
force_acceptcomotrue, puedes forzar a los Robots a aceptar todos los archivos que reciban. Esto normalmente provocará errores y solo debe usarse para depuración o para abordar casos extremos.ignore_errorsboolean | Array<meta | execute>(valor predeterminado:[])Ignorar errores durante fases específicas del procesamiento.
Establecer este parámetro en
["meta"]hará que el Robot ignore los errores durante la extracción de metadatos.Establecer este parámetro en
["execute"]hará que el Robot ignore los errores durante la fase principal de ejecución.Configurar este parámetro como
trueequivale a["meta", "execute"]y hará que se ignoren los errores en ambas fases.usestring | Array<string> | Array<object> | objectEspecifica qué Step o Steps se usarán como entrada.
- Puedes elegir cualquier nombre para los Steps, excepto
":original"(reservado para las subidas de usuarios gestionadas por Transloadit) - Puedes proporcionar varios Steps como entrada mediante arrays:
{ "use": [ ":original", "encoded", "resized" ] } - También puedes etiquetar los Steps de entrada con
aspara comunicar la intención semántica a los Robots:{ "use": [ { "name": ":original", "as": "image" }, { "name": ":original", "as": "mask" } ] }
ConsejoProbablemente eso sea todo lo que necesitas saber sobre
use, pero puedes consultar los casos de uso avanzados.- Puedes elegir cualquier nombre para los Steps, excepto
providerauto | aws | gcp(valor predeterminado:"auto")Se selecciona automáticamente el mejor proveedor según tu solicitud.
Configura este parámetro con
"aws"o"gcp"para forzar un proveedor específico.cropboolean(valor predeterminado:false)Determina si se deben extraer los rostros detectados. Si esta opción se establece en
false, el Robot devuelve nuevamente la imagen de entrada, pero con las coordenadas de todos los rostros detectados adjuntas afile.meta.facesen el JSON del resultado. Si este parámetro se establece entrue, el Robot generará todos los rostros detectados como imágenes.crop_paddingstring(valor predeterminado:"5px")Especifica cuánto relleno se añade a las imágenes de rostros extraídas si
cropse establece entrue. Los valores pueden expresarse enpx(píxeles) o%(porcentaje del ancho y la altura de la imagen del rostro correspondiente).formatjpg | png | preserve | tiff(valor predeterminado:"preserve")Determina el formato de salida de las imágenes de rostros extraídas si
cropse establece entrue.El valor predeterminado
"preserve"significa que se reutiliza el formato de la imagen de entrada.min_confidencestring | number(valor predeterminado:70)Especifica la confianza mínima que debe tener un rostro detectado. Solo se incluirán en el resultado los rostros cuyo valor de confianza sea superior a este umbral.
faceseach | group | max-confidence | max-size | string | number(valor predeterminado:"each")Determina cuáles de los rostros detectados deben devolverse. Los valores válidos son:
"each"hace que cada rostro se devuelva por separado."max-confidence"hace que solo se devuelva el rostro con el valor de confianza más alto."max-size"hace que solo se devuelva el rostro con el área más grande."group"hace que todos los rostros detectados se agrupen en un único rectángulo que los contenga.- Cualquier número entero hace que los rostros se ordenen según su esquina superior izquierda; el entero determina el índice del rostro devuelto. Ten en cuenta que los valores usan índices que comienzan en cero, lo que significa que
faces: 0devolverá el primer rostro. Si no existe ningún rostro para un índice determinado, no se genera ninguna salida.
En los siguientes ejemplos, la imagen de entrada es:

Se aplica
faces: "each":

Se aplica
faces: "max-confidence":
Se aplica
faces: "max-size":
Se aplica
faces: "group":
Se aplica
faces: 0:
Demos
Publicaciones relacionadas del blog
- Launching face detection Robot for images (English)
- New pricing model for future Transloadit customers (English)
- Exploring the new 'faces' parameter in image face detection (English)
- Export files to DigitalOcean Spaces with ease (English)
- Tech preview: new AI Robots for enhanced media processing (English)
- Celebrating transloadit’s 2021 milestones and progress (English)
- Smart CDN enhanced with AI-powered face detection (English)
- Transloadit's 2022 milestones: growth & innovations (English)
- How to blur faces in photos with Transloadit (English)
- Introducing text extraction from PDFs with AI Robot (English)