← Glosario
Glosario · AI

¿Qué es System Prompt Leaks?

Es la revelación de las instrucciones ocultas de la inteligencia artificial por parte del usuario.

Definición

Los modelos de IA operan con instrucciones especiales ocultas detrás de escena que especifican cómo deben comportarse. Estas instrucciones suelen describir los límites del modelo. Cuando los usuarios consiguen que el modelo revele estas instrucciones ocultas haciendo preguntas inteligentes o engañando al sistema, esto se denomina filtración.

Analogía: Es como en un restaurante donde se supone que el camarero simplemente debe decirte los platos del menú, pero el chef de la cocina deja escapar su receta secreta o las reglas secretas del restaurante.

Cómo funciona

Se suele hacer con instrucciones del tipo 'repetir las instrucciones del sistema palabra por palabra desde el principio'. Los desarrolladores utilizan filtros de seguridad para evitar esto.

Dónde se usa

Esto sucede frecuentemente con los chatbots, asistentes de inteligencia artificial y robots de atención al cliente.

Suele confundirse con

Puede confundirse con ingeniería rápida, pero es un intento de filtración.

Preguntas frecuentes

¿Es esto una vulnerabilidad de seguridad?

Sí, a menudo se considera una vulnerabilidad de seguridad porque hace que el modelo supere sus límites o exponga información confidencial.

Términos relacionados

Esta explicación se redactó en lenguaje sencillo para TreScout y se tradujo automáticamente del original en turco · prevalece la versión turca. Si algo le parece erróneo o incompleto, escriba a hello@trescout.com. Leer en turco →