Machine learningAvanzado
Amazon Elastic Inference
Permitía añadir una fracción de GPU a una instancia EC2 para abaratar la inferencia sin pagar una GPU entera.
Cuándo aplicarlo
Ya no es la vía recomendada: AWS dirige estos casos a las instancias con Inferentia o a las de GPU.
Descripción
Elastic Inference conectaba aceleradores por red a una instancia normal, de modo que se pagaba solo la capacidad de inferencia necesaria en lugar de una instancia con GPU completa.
Se documenta por completitud del catálogo; antes de plantear su uso conviene comprobar su disponibilidad actual en la página oficial.
Nota: AWS dejó de recomendar este servicio. La ruta vigente para abaratar inferencia son las instancias basadas en AWS Inferentia.