Descrição
Modelos transformer e diffuser podem ser otimizados para hardware específico e backends de inferência. Engenheiros de ML usam Optimum em exportação, quantização, aceleração e experimentos de implantação em torno de modelos Hugging Face. Pesos de modelos, datasets, prompts e resultados específicos de hardware precisam de validação.