Back to explore

Por qué la salida estructurada de Jev resiste la inyección de prompts

El post sostiene que la inyección de prompts funciona porque el modelo puede escribir la siguiente instrucción, mientras que el modelo de evaluación estructurada de Jev solo emite una probabilidad, etiqueta o punto en una escala tipados; el texto secuestrador puede mover el número pero no convertirse en comando.

Prompt injection works because the model can write the next instruction. A structured evaluation model cannot. Jev's only output is typed a probability, a label, a point on a scale. Text that tries to hijack an agent can move the number. It cannot become a command. That is why

Por qué la salida estructurada de Jev resiste la inyección de prompts 1
· 0 likesOpen on X