Saltar al contenido
← Catálogo
Machine learningAvanzado

Amazon Elastic Inference

Permitía añadir una fracción de GPU a una instancia EC2 para abaratar la inferencia sin pagar una GPU entera.

Cuándo aplicarlo

Ya no es la vía recomendada: AWS dirige estos casos a las instancias con Inferentia o a las de GPU.

Descripción

Elastic Inference conectaba aceleradores por red a una instancia normal, de modo que se pagaba solo la capacidad de inferencia necesaria en lugar de una instancia con GPU completa.

Se documenta por completitud del catálogo; antes de plantear su uso conviene comprobar su disponibilidad actual en la página oficial.

Nota: AWS dejó de recomendar este servicio. La ruta vigente para abaratar inferencia son las instancias basadas en AWS Inferentia.