Skip to content
AI Model Radar

Glossário

System prompt (instrução de sistema)

O system prompt é a instrução permanente que um modelo lê antes da sua conversa: quem ele deve ser, o que pode fazer e como responder. Quem define é o aplicativo ou você, não o modelo.

Toda conversa com um modelo começa com um texto que você normalmente não vê. Antes da sua primeira mensagem, o aplicativo insere um bloco de instruções — «Você é um assistente de programação. Responda no idioma do usuário. Nunca invente caminhos de arquivo» — e o modelo o trata como as regras da sala. Esse bloco é o system prompt, e ele define tom, formato e recusas muito mais do que qualquer pergunta isolada.

Localmente ele é seu. Runtimes como Ollama e LM Studio permitem definir um system prompt por modelo ou por conversa, e um bom system prompt vale muitas vezes mais do que um modelo maior: diga a um modelo pequeno exatamente que papel ele tem e que saída você espera, e as respostas ficam visivelmente mais precisas. É também onde moram as regras de privacidade — «use apenas os documentos fornecidos» — e onde você fixa o idioma do qual um modelo insiste em escapar.

O custo são tokens. O system prompt é enviado a cada requisição e ocupa a janela de contexto durante toda a conversa, então uma folha de instruções de duas páginas consome contexto e memória de cache KV antes de você digitar uma palavra. Mantenha-o tão curto quanto possível sem ficar ambíguo.

Onde você vê isso no radar

O comprimento de contexto que o motor de compatibilidade calcula inclui tudo o que está na janela: seu system prompt, os trechos recuperados e a própria conversa. Se as suas instruções forem longas, escolha um contexto maior no buscador e veja o que isso faz com a memória.

Conferir a compatibilidade no seu contexto

Termos relacionados

Janela de contextoTokenRAG (geração aumentada por recuperação)

Também em:EnglishEspañol

← Todos os termos