Módulo
Dimensionamento
Define recursos necessários para rodar LLMs locais com desempenho e custo otimizados.

- 01CPU, RAM ou GPU? Dimensionando recursos para Ollama e QdrantDimensionar recursos para LLMs locais exige entender o impacto real de CPU, RAM e GPU em cada cenário. O tamanho do modelo, embeddings e banco vetorial determinam o hardware mínimo necessário para desempenho e custo otimizados.
- 02Custos ocultos: energia, armazenamento e manutençãoExecutar LLMs locais envolve custos além do hardware inicial. Energia, armazenamento, backup e manutenção impactam o orçamento e a confiabilidade da operação. Planejar esses fatores evita surpresas e interrupções.
Voltar ao curso IA aplicada com Ollama e modelos abertos: LLMs locais, RAG e agentes
