Claude Platform Docs
Best practiceRafforzare le protezioni

Ridurre la fuga di prompt

Riduci il rischio di fughe di prompt separando il contesto dalle query degli utenti, filtrando gli output di Claude e verificando periodicamente i prompt, senza degradare le prestazioni del compito.

Le "prompt leak" (fughe di prompt) possono esporre informazioni sensibili che ti aspetti rimangano "nascoste" nel tuo prompt. Sebbene nessun metodo sia infallibile, le strategie riportate di seguito possono ridurre significativamente il rischio.

Prima di provare a ridurre la fuga di prompt

Considera l'uso di strategie di prompt engineering resistenti alle fughe solo quando assolutamente necessario. I tentativi di rendere il tuo prompt a prova di fughe possono aggiungere complessità che potrebbe degradare le prestazioni in altre parti del compito, a causa dell'aumento della complessità del compito complessivo dell'LLM.

Se decidi di implementare tecniche resistenti alle fughe, assicurati di testare a fondo i tuoi prompt per garantire che la complessità aggiunta non influisca negativamente sulle prestazioni del modello o sulla qualità dei suoi output.


Strategie per ridurre la fuga di prompt

  • Separa il contesto dalle query: Puoi provare a usare i "system prompt" (prompt di sistema) per isolare le informazioni chiave e il contesto dalle query degli utenti. Puoi enfatizzare le istruzioni chiave nel turno User, quindi ribadire tali istruzioni precompilando il turno Assistant. (Nota: la precompilazione non è supportata su Claude 4.6 e modelli successivi e su Claude Mythos Preview.)

  • Usa il post-processing: Filtra gli output di Claude alla ricerca di parole chiave che potrebbero indicare una fuga. Le tecniche includono l'uso di espressioni regolari, il filtraggio per parole chiave o altri metodi di elaborazione del testo.
  • Evita dettagli proprietari non necessari: Se Claude non ne ha bisogno per svolgere il compito, non includerli. I contenuti extra distraggono Claude dal concentrarsi sulle istruzioni di "nessuna fuga".
  • Verifiche regolari: Rivedi periodicamente i tuoi prompt e gli output di Claude alla ricerca di potenziali fughe.

Ricorda, l'obiettivo non è solo prevenire le fughe, ma mantenere le prestazioni di Claude. Una prevenzione delle fughe eccessivamente complessa può degradare i risultati. L'equilibrio è fondamentale.

Was this page helpful?