Orga AI es una empresa española de IA multimodal en tiempo real: creamos sistemas que ven, escuchan y hablan, combinando IA conversacional (voz y LLMs) y visión por computador. Desarrollamos el Orga SDK y nuestro propio motor TTS, con foco en una interacción fluida, natural y de baja latencia.
Contamos con el respaldo del CDTI, el Sello de Excelencia del European Innovation Council (EIC) 2025 y presencia en medios como TechCrunch, Forbes y El País. Atravesamos una fase de fuerte crecimiento, con proyectos enterprise en marcha y un pipeline sólido por delante. Para liderar esta etapa, incorporamos a nuestro próximo CTO.
El rol
Buscamos un/a especialista excepcional en visión por computador para impulsar el núcleo de visión del Orga SDK. No es un rol de visión "de manual": vas a resolver problemas de visión de grado de producción en entornos reales y exigentes —detección, seguimiento multiobjeto, reidentificación y análisis de vídeo en tiempo real sobre redes multicámara— donde la precisión y la robustez importan de verdad.
Trabajarás junto a nuestro equipo de research, con impacto directo en el producto desde el primer día.
Responsabilidades
- Diseñar, entrenar y optimizar modelos de visión: detección, segmentación, seguimiento multiobjetos (MOT), reidentificación (re-ID) y embeddings de apariencia.
- Construir y mejorar pipelines de análisis de vídeo en tiempo real para redes multicámara.
- Resolver problemas reales de visión en entornos operativos exigentes (oclusiones, escenas concurridas, iluminación variable, robustez).
- Optimizar la inferencia para tiempo real y despliegue edge/on-premise (latencia, rendimiento).
- Elevar las capacidades de visión del Orga SDK con datos y escenarios reales.
- Curar y etiquetar datasets, diseñar experimentos y evaluar con métricas rigurosas.
Perfil
Requisitos
- Titulación universitaria o máster en visión por computador, IA, informática, telecomunicaciones, matemáticas, física o áreas afines.
- Excelencia demostrable en visión por computador (proyectos, publicaciones, competiciones o experiencia equivalente).
- Dominio de Python y PyTorch.
- Fundamentos sólidos: detección, segmentación, tracking, reidentificación, metric learning y arquitecturas modernas (CNNs, Vision Transformers).
- Experiencia entrenando, evaluando e iterando modelos de visión sobre datos reales.
- Español e inglés profesionales (equipo internacional).
- Autonomía y hambre por resolver problemas difíciles.
Se valorará
- Seguimiento multicámara, re-ID a escala, geometría y calibración de cámaras.
- Análisis de vídeo en tiempo real y optimización de modelos (ONNX Runtime, TensorRT); despliegue en edge/on-premise.
- Experiencia con visión por computador en producción y entornos operativos reales.
- Modelos multimodales y Transformers de visión.
- MLOps, Docker, pipelines de datos y/o construcción de datasets propios.
Qué ofrecemos
- Ser una pieza clave del núcleo de visión de una empresa de IA en tiempo real.
- Aprender y crecer junto a un equipo de research senior, con impacto real desde el primer día.
- Tecnología puntera y un equipo internacional (España, Francia, EE. UU., Japón, Argentina).
- Contrato fijo y condiciones competitivas acordes a la etapa, a concretar durante el proceso.