Inteligencia Artificial 6 min lectura
Mismo cluster, 33 puntos más de utilización: el orden lo cambió todo
Un equipo desarrolló un asignador de GPUs que, al cambiar el orden de asignación, mejoró drásticamente la utilización y el valor priorizado frente a un scheduler FIFO. La clave: tratar la inferencia en tiempo real como una curva de demanda y ordenar los trabajos batch por prioridad en todo el horizonte temporal.