# Protocolo: Qual o impacto do tamanho do contexto do LLM no tempo de resposta do Ollama em execução local?

Este protocolo avalia como o aumento do tamanho do contexto (prompt + histórico) afeta a latência das respostas do Ollama rodando localmente. O objetivo é medir o tempo de resposta em função do contexto, usando apenas ferramentas de código aberto.

Pergunta: Como o tempo de resposta do Ollama varia conforme o tamanho do contexto fornecido ao modelo?

Hipótese: Aumentar o tamanho do contexto do LLM eleva linearmente o tempo de resposta do Ollama.

- Ollama Docs https://ollama.com/docs
- Ollama GitHub https://github.com/ollama/ollama
- LLM HuggingFace https://huggingface.co/docs/transformers/main/en/model_doc/llama

Fonte: https://ulc.upnetix.com.br/labs/protocolo-qual-o-impacto-do-tamanho-do-contexto-do-llm-no-tempo-de-resposta-do-ollama-em-execucao-local/ · Upnetix Learning Center · uso com citação obrigatória.
