Como rodar Ollama com aceleração de GPU em Docker sem quebrar seus drivers CUDA
Fala pessoal! Com o custo das APIs de LLM subindo e a necessidade de manter dados sensíveis dentro de casa (LGPD e soberania de dados), cada vez mais desenvolvedores e times de infraestru...