14.3.1 Dos modalidades de inteligencia artificial en Ergoniza Intelligent
Ergoniza Intelligent implementa la detección de posturas con dos filosofías complementarias que responden a necesidades distintas en términos de privacidad, rapidez y precisión. La primera, denominada Inteligencia Artificial Rápida, ejecuta la inferencia en el propio equipo del usuario mediante código que se ejecuta en el navegador. Esta aproximación reduce de forma notable la latencia de respuesta y, sobre todo, evita el envío de imágenes y vídeos a los servidores de Ergonautas, con lo que se preserva la privacidad del material audiovisual desde el origen.
La segunda, llamada Inteligencia Artificial Precisa, delega el procesamiento en la infraestructura de servidores de Ergonautas. Esta opción prioriza la calidad de la estimación y la robustez en escenarios complejos, asumiendo un tiempo de proceso superior y la necesidad de transferir los datos fuera del equipo local. En ambos casos, la experiencia de uso es homogénea: el usuario aporta la captura, revisa el resultado proyectado en la interfaz de Ergoniza Intelligent, realiza los ajustes que considere oportunos y aplica inmediatamente los datos de la postura detectada a los métodos de valoración disponibles.
14.3.1.1 Inteligencia Artificial Rápida (en el equipo del usuario)
En la modalidad de Inteligencia Artificial Rápida toda la detección se realiza localmente, sin que los archivos multimedia abandonen el dispositivo del usuario. Esta decisión técnica se traduce en respuestas ágiles que facilitan la iteración durante la captura, por ejemplo, para repetir una toma o afinar el encuadre, y evita que la imagen o el vídeo seleccionados se envíen a los servidores de Ergonautas para realizar la inferencia.
La modalidad admite tanto el trabajo con imágenes como con secuencias de vídeo. En el primer caso, la estimación se centra en una postura fija representativa del instante capturado y ofrece de inmediato la superposición de los puntos anatómicos y los segmentos sobre la fotografía, así como la consulta de los ángulos articulares derivados en la interfaz, lo que facilita una verificación visual rápida y, si fuese necesario, una corrección puntual por parte del evaluador.
En el segundo caso, el sistema procesa la secuencia completa y mantiene una coherencia básica entre fotogramas suficiente para observar la evolución temporal de una tarea, identificar cambios de postura y extraer las métricas necesarias para el análisis ergonómico.
El rendimiento práctico depende de las capacidades del dispositivo (tanto de CPU como de la aceleración disponible en el navegador) de la calidad de la captura y de la ausencia de oclusiones pronunciadas. Cuando la iluminación es uniforme, el cuerpo aparece completo en el encuadre y el punto de vista es semilateral, la detección local puede ofrecer resultados adecuados para una primera estimación, que deberá ser revisada por el evaluador para una toma de decisiones ágil, especialmente cuando la rapidez y la privacidad son prioritarias.
14.3.1.2 Inteligencia Artificial Precisa (en servidores de Ergonautas)
La modalidad de Inteligencia Artificial Precisa traslada la inferencia a los servidores de Ergonautas, donde se dispone de pipelines especializados y recursos computacionales que permiten mejorar la calidad de la estimación en condiciones exigentes. En este esquema, el usuario autoriza el envío de la imagen o del vídeo a la plataforma, que devuelve un resultado con mayor estabilidad y una lectura más sólida en escenas complejas, ya sea por oclusiones, perspectivas menos favorables o movimientos con amplitudes extremas.
En el caso de imagen, el sistema reconstruye la postura a partir de una única fotografía, lo que resulta especialmente útil cuando no existe material de vídeo o no se requiere continuidad temporal, y proporciona una cobertura anatómica amplia adecuada para la documentación técnica.
En el caso de vídeo, la plataforma genera una serie temporal coherente de posturas y ángulos, estabilizada frente a variaciones espurias entre fotogramas, que facilita la identificación de fases del ciclo de trabajo, de picos de esfuerzo y de posturas límite. Los resultados se entregan en formatos estructurados para su integración directa en los métodos de valoración ergonómica de Ergoniza Intelligent y para su trazabilidad en informes. A cambio de este incremento de precisión y robustez se acepta una mayor latencia asociada a la transferencia y al procesamiento remoto, aspecto que suele ser asumible cuando el objetivo principal es disponer de un mayor grado de confianza en la estimación.
14.3.1.3 Modalidades de captura con imagen y con vídeo
Tanto en la modalidad rápida como en la precisa, Ergoniza Intelligent permite trabajar con imagen fija y con vídeo, adaptándose al problema ergonómico que se pretende resolver. Cuando se emplea imagen, la herramienta está orientada a evaluar posturas puntuales a partir de fotografías representativas, de forma que el profesional pueda revisar con claridad la superposición de la estimación sobre la captura, confirmar la corrección de los puntos clave y realizar ajustes si detecta algún desalineamiento debido a oclusiones o a perspectivas desfavorables. Esta vía es especialmente eficiente para elaborar fichas técnicas, documentar casos singulares y extraer métricas estáticas sin necesidad de continuidad temporal. Cuando se emplea vídeo, la herramienta aborda el análisis de tareas dinámicas y genera una secuencia de posturas a lo largo del tiempo que permite estudiar la evolución cinemática, detectar momentos críticos y comparar el efecto de cambios en el método de trabajo o en el diseño del puesto. La coherencia temporal que se obtiene en esta modalidad facilita la interpretación de patrones de movimiento y aporta un contexto más rico para la valoración del riesgo asociado.
14.3.1.4 Flujo de trabajo y criterios de elección
El flujo de trabajo ha sido diseñado para ser sencillo y consistente. El usuario selecciona, en primer término, la filosofía de procesamiento que mejor se ajusta a sus prioridades (rapidez y privacidad con procesamiento local, o precisión reforzada con procesamiento en servidores) y, a continuación, decide si el caso exige una captura con imagen o con vídeo. A partir de ahí, aporta el material, visualiza la estimación superpuesta que devuelve el sistema, confirma o corrige los detalles pertinentes y aplica inmediatamente los datos de postura en los métodos de evaluación disponibles. La elección entre una u otra filosofía suele resolverse considerando el equilibrio entre tiempo de respuesta, sensibilidad de los datos y complejidad del caso. En situaciones donde prima la confidencialidad y se requieren resultados inmediatos, la Inteligencia Artificial Rápida resulta adecuada. Cuando se prefiere el procesamiento remoto y se acepta una mayor latencia y la transferencia del material audiovisual, puede optarse por la Inteligencia Artificial Precisa. En ambos casos es necesario revisar y validar la postura obtenida.
14.3.1.5 Buenas prácticas de captura
La calidad de los resultados depende de forma significativa de cómo se realiza la captura. Es recomendable encuadrar el cuerpo completo de la persona desde la cabeza hasta los pies, mantener una iluminación homogénea que evite contraluces y sombras duras y escoger un punto de vista que reduzca las superposiciones y permita observar las articulaciones relevantes; en muchas tareas puede resultar adecuado un punto de vista semilateral. En vídeo, conviene asegurar la estabilidad de la cámara y una cadencia de fotogramas suficiente para describir con claridad el movimiento. La observación de estas pautas incrementa la fiabilidad de la estimación tanto en la modalidad rápida como en la precisa y reduce la necesidad de correcciones manuales posteriores.