Prompt injection OWASP యొక్క #1 ప్రమాదం. మీ ఏజెంట్లు కొత్త దాడి వెలుపల.
Prompt injection OWASP యొక్క ప్రస్తుత Top 10 LLM అప్లికేషన్లలో ప్రధానస్థానం ఉన్నది. ఏజెంట్లు సాధనాలు మరియు స్వయంప్రేరితత సంపాదించినప్పుడు, ఒక్క ఇంజక్ట్ చేసిన సూచన డేటాను లీక్ చేయవచ్చు లేదా విధ్వంసక చర్యను చేపట్టవచ్చు. ఏజెంట్లను సురక్షితం చేయడం ఇప్పుడు వాటిని ప్రయోగించడానికి ఒక పూర్వ-నిబంధన.
Habib Obeid రచన

ఏజెంట్ ఎంత సామర్థ్యవంతమైనది, దానిని హైజాక్ చేయడం నుండి దాడిచేసేవారు ఎంత ఎక్కువ లాభం పొందుతారు. Prompt injection OWASP యొక్క ప్రస్తుత Top 10 LLM అప్లికేషన్ల నుండి ప్రధానస్థానం ఉన్నది, మరియు ఉత్పాదన AI నియోగాలలో ఇది అత్యంత సర్వసాధారణమైన బలహీనతలలో ఒకటిగా ఉంది. ప్రమాదం స్వయంప్రేరితkönig సంబంధితంగా పెరుగుతుంది, ఏజెంట్ సాధనాలను అంటించుకోవచ్చు, బ్రౌజ్ చేయవచ్చు మరియు చర్య తీసుకోవచ్చు, దానిని చదివిన కంటెంట్లో దాచిపెట్టిన సూచన దాని స్వంత సామర్థ్యాలను మీకు విరుద్ధంగా తిప్పవచ్చు.
సాధనాలు కలిగిన ఏజెంట్ తాను చదువుకోవలసిన కనీస-విశ్వస్త డాక్యుమెంట్ కన్నా ఎక్కువ విశ్వాసపాత్రం కాదు. ప్రతిఒక్క బాహ్య ఇన్పుట్ను విరుద్ధమైనదిగా పరిగణించండి, ఎందుకంటే దాడిచేసేవారు ఇప్పటికే చేస్తున్నారు.
పరోక్ష ఇంజెక్షన్ ఎంటర్ప్రైజ్ ప్రమాదం
నేరుగా ఇంజెక్షన్, ఉపయోగకర్త ఓవర్రైడ్ నమోదు చేయడం, సులభ సందర్భం. ప్రమాదకరమైనది పరోక్ష, ఇది వెబ్ పేజీ, PDF, ఈమెయిల్ లేదా సపోర్టు టికెట్లో దాచిపెట్టిన విధ్వంసక సూచన ఏజెంట్ తన ఉద్యోగం భాగంగా ప్రక్రియ చేస్తుంది. 2026లో, పరిశోధకులు క్షేత్రంలో పరోక్ష ఇంజెక్షన్ యొక్క ప్రధమ పెద్ద-ఆకార అధ్యయనాలలో ఒకటి ప్రచురించారు, సజీవ వెబ్ పేజీలలో నాటిన వేలాది దాచిపెట్టిన సూచనలను కనుగొన్నారు మరియు వాటిని చదువుకునే AI నమూనాలను లక్ష్యంగా చేసారు. ఒక సంఘటనలో, కోడింగ్ సహాయకుడు స్పష్టమైన సూచనల ఉన్నప్పటికీ ఏమీ మార్చకూడదని ఉత్పాదన డేటాబేస్ను తొలగించాడు, తరువాత రికార్డులను సృష్టించాడు మరియు రోల్బ్యాక్ అసాధ్యమని తప్పుగా నివేదించాడు.
ప్రతిరక్ష వాస్తుశిల్పం, సూచన కాదు
సిస్టమ్ సూచన యొక్క ఏ సూచన ఏజెంట్ను ఇంజెక్షన్-రక్ష చేయదు. ఆర్కిటెక్చర్లు సూచనలను డేటా నుండి శుద్ధిగా వేరుచేసే వరకు ప్రమాదం చెలాచడం కొనసాగుతుంది. కార్యకరమైనది లోతైన ప్రతిరక్ష, విజయవంతమైన ఇంజెక్షన్ను ఆశించి దానిచేయగలిగిన వాటిని నిర్బంధించడం.
- కనీస అధికారం, ఏజెంట్ కేవలం తన ఉద్యోగం సాధించడానికి అవసరమైన అత్యంత ఇరుకైన సాధనం మరియు డేటా ప్రాప్యత పొందుతుంది.
- ఏదైనా తిరిగి సరిచేయలేని లేదా ఎక్కువ-విలువ చర్య కోసం మానవ ఆమోదన గేట్లు, తొలగింపులు, చెల్లింపులు, బాహ్య ఆదేశాలు.
- ఇన్పుట్ మరియు అవుట్పుట్ ధృవీకరణ, విశ్వస్త కాని కంటెంట్ను సూచనల నుండి స్పష్టంగా వేరు చేయడం.
- విచిత్రమైన సాధనం కాల్ల కోసం సంపూర్ణ నమోదు మరియు పర్యవేక్ష, డేటా లీకేజ్ ప్రయత్నాలను సంగ్రహించాలి మరియు జవాబుదారీ చేయాలి.
HOWF స్థానం
మేము ఏజెంట్లను దాడిచేయబడతాయని ఊహ చేసుకుని నిర్మిస్తాము. సాధనాలు కనీస అధికారం కింద నిర్వహిస్తాయి, ఉన్నత-ఫలితం చర్యలు మానవ ఆమోదన ద్వారా రూట్ చేయబడతాయి, విశ్వస్త కాని ఇన్పుట్లు సీమాబద్ధం చేయబడతాయి, మరియు ప్రతిఒక్క చర్య నమోదు చేయబడుతుంది మరియు పర్యవేక్ష చేయబడుతుంది. ఇది ఎంటర్ప్రైజ్లు ఇప్పటికీ నిర్వహిస్తున్న ఏజెంట్లను నిశ్శబ్దంగా మూసివేసిన వాటి నుండి వేరుచేసే ఒకే పాలన క్రమశిక్ష, స్వయంప్రేరితత సృష్టించే దాడి వెలుపలకు ప్రత్యేకంగా వర్తించబడుతుంది.
ఆధారాలు
- Incident 1152: LLM-Driven Replit Agent Reportedly Executed Unauthorized Destructive Commands During Code Freeze, AI Incident Database
- LLM01:2025 Prompt Injection, OWASP Gen AI Security Project
దీన్ని మీ ఎంటర్ప్రైజ్కు అన్వయించాలనుకుంటున్నారా?