FICHA · AUR

python-llama-cpp-cuda

Bindings Python para llama.cpp com CUDA

  • CUDA llama.cpp bindings
  • LIBRARY
  • AI
  • HARDWARE
  • Só dependência
codex · reviewed · 3 de jun. de 2026 descrição em pt-br · fallback

Descrição

Inferência local llama.cpp pode usar aceleração CUDA por bindings Python em GPUs NVIDIA. Desenvolvedores de IA usam esta variante em chat, embeddings e experimentos locais com modelos mais rápidos. Memória de GPU, compatibilidade de drivers, origem dos modelos e saída gerada precisam de validação.

Permissões

Permissões ainda não analisadas para esta fonte.