De un prototipo de laboratorio a terminales desplegados en planta
La historia del proyecto se entiende mejor por etapas que por fechas. Cada salto vino de un problema concreto que apareció al llevar la inferencia biométrica fuera del servidor central.
-
Primera etapa
Verificación facial en un solo SoC
El punto de partida fue un terminal de control de acceso con 512 MB de RAM y un NPU modesto. La pregunta inicial no era de precisión sino de viabilidad: qué red cabía realmente en ese presupuesto de memoria sin degradar la tasa de verificación en condiciones de luz variable. La respuesta llegó tras podar capas redundantes y aplicar cuantización int8 sobre los pesos.
-
Segunda etapa
Plantillas que no salen del dispositivo
Con la inferencia resuelta, el siguiente cuello de botella fue el almacenamiento. Guardar el embedding en claro era un riesgo legal y técnico. Se adoptó una proyección unidireccional que genera plantillas cancelables: si un terminal se pierde, la plantilla se revoca sin afectar al resto del parque. El coste de cómputo adicional en el MCU resultó aceptable.
-
Tercera etapa
Operación con red intermitente
El despliegue en una planta con 40 terminales y enlace satelital inestable obligó a rediseñar el pipeline. Se añadió caché cifrada de plantillas, política de decisión local y sincronización diferida por lotes. La reconciliación al recuperar la conexión fue la parte más delicada: había que evitar duplicados y conflictos de estado sin bloquear la operación.
-
Cuarta etapa
Micromodelos por debajo de 2 MB
La comparación entre un modelo de 6 MB y otro de 1.8 MB mostró algo contraintuitivo: en capturas con movimiento, el más pequeño ganaba en latencia por fotograma sin perder precisión útil. Ese hallazgo reorientó la línea de trabajo hacia el destilado agresivo y la medición de consumo energético en el propio dispositivo, no en banco de pruebas.
Cada etapa dejó documentación técnica abierta: decisiones de poda, parámetros de cuantización, esquemas de protección de plantillas y compromisos entre frescura de datos y tamaño de caché. Esa documentación es la base sobre la que se sigue trabajando hoy.