Skip to content
AI Model Radar

Glosario

System prompt (instrucción de sistema)

El system prompt es la instrucción permanente que un modelo lee antes de tu conversación: quién debe ser, qué puede hacer y cómo responder. La fija la aplicación o tú, no el modelo.

Cada chat con un modelo empieza con un texto que normalmente no ves. Antes de tu primer mensaje, la aplicación inserta un bloque de instrucciones —«Eres un asistente de programación. Responde en el idioma del usuario. Nunca inventes rutas de archivos»— y el modelo lo trata como las reglas de la sala. Ese bloque es el system prompt, y define el tono, el formato y las negativas mucho más que cualquier pregunta suelta.

En local es tuyo. Runtimes como Ollama y LM Studio permiten fijar un system prompt por modelo o por chat, y uno bueno vale a menudo más que un modelo más grande: dile a un modelo pequeño exactamente qué papel juega y qué salida esperas, y sus respuestas mejoran de forma visible. También es donde viven las reglas de privacidad —«usa solo los documentos proporcionados»— y donde fijas el idioma del que un modelo se desvía una y otra vez.

El costo son tokens. El system prompt se envía con cada petición y ocupa la ventana de contexto durante toda la conversación, así que una hoja de instrucciones de dos páginas consume contexto y memoria de caché KV antes de que escribas una palabra. Mantenlo tan corto como sea posible sin volverse ambiguo.

Dónde lo ves en el radar

La longitud de contexto que calcula el motor de compatibilidad incluye todo lo que hay en la ventana: tu system prompt, los pasajes recuperados y la propia conversación. Si tus instrucciones son largas, elige un contexto mayor en el buscador y mira qué le hace eso a la memoria.

Comprobar la compatibilidad con tu contexto

Términos relacionados

Ventana de contextoTokenRAG (generación aumentada por recuperación)

También en:EnglishPortuguês

← Todos los términos