Descrição
Fornece Triton, uma linguagem e compilador para escrever kernels personalizados de alto desempenho para deep learning. Ajuda pesquisadores e engenheiros de desempenho a criar primitivas GPU otimizadas para treino e inferência de modelos.
Desenvolvedores usam isto como biblioteca especializada de computação. Código de kernel depende de hardware e drivers, então valide correção, comportamento numérico e uso de recursos antes de depender de kernels personalizados.