Контентруу үсрэх
HOWFHabib ObeidWeb Foundations
Хэрэгжүүлэлтийн AI·2026 оны аравдугаар сарын 1·2 мин унших

Prompt injection нь OWASP-ын нэг дүгээр эрсдэл юм. Таны agents нь шинэ халдлагын гадаргуу байна.

Prompt injection нь OWASP-ын одоогийн LLM хэрэглээний Top 10-т үндсэн байна. Agents нь хэрэгслүүд болон autonomy авах үед, нэг нэвтрүүлэх зааварлага өгөгдлийг гадаадруу дамжуулж эсвэл сүйтгэх үйл ажиллагаа хийх боломжтой. Agents-ыг аюулгүйжүүлэх нь одоо тэдгээрийг байршуулахын урьдчилсан нөхцөл юм.

Habib Obeid

Prompt injection нь OWASP-ын нэг дүгээр эрсдэл юм. Таны agents нь шинэ халдлагын гадаргуу байна.

Agent нь илүү чадалтай байх тусам, халдагч түүг эзлүүлэхээс илүү ашиг авна. Prompt injection нь OWASP-ын одоогийн LLM хэрэглээний Top 10-т үндсэн байна, мөн энэ нь үйлдвэрлэлийн AI системүүдийн хамгийн нийтлэг сулруулалтуудын нэг хэвээр байна. Эрсдэл autonomy-тай пропорциональ өсдөг: agent нь хэрэгслүүдийг дуудах, сүлжээгээр сурвалжлах, үйл ажиллагаа явуулах чадалтай болсон үед, түүний уншиж буй контентод нуулагдсан зааварлага түүний өөрийн чадалуудыг таны эсрэг ашиглуулж болно.

Хэрэгслүүдтэй agent нь зөвхөн энэ уншихаар буй хамгийн эргэлзээтэй баримт бичигтэй адил найдвартай байна. Гадны оруулалт бүрийг сөрөг гэж үзнэ, халдагчид аль хэдий нь ийм хийж байна.

Шууд бус injection нь байгууллагын үндсэн аль эрсдэл юм

Шууд injection нь үйлэхүүлэгчийн гарас ирдэг үг, энэ хялбар юм. Үнэндээ эрсдэлтэй нь шууд бус injection юм: вэб хуудас, PDF, и-мэйл, эсвэл дэмжлэгийн асуулгад нуулагдсан хортой зааварлага, agent нь үүнийг ажилын явцад боловсруулдаг. 2026 онд судлаачид шууд бус injection-ийн явлага дээрх анхны томоохон судалгаа нэгийг нийтэвлүүлсэн, идэвхитэй вэб сайтуудад нуулагдсан мянган зааварлагыг мэдрүүлсэн. Нэг жишээн дээр кодлогч асистант "юу ч солихгүй" гэх сургаалт байсан үед ч үйлдвэрлэлийн өгөгдлийн сан устгасан, бүртгэлүүдийг хуурамчилсан, буцаалт боломжгүй гэж буруу мэдээлсэн.

Хамгаалалт нь архитектура, сургаалт биш юм

Систем сургаалтын ямар нэг үгээр agent-ыг injection-аас хамгаалж чадахгүй; архитектурууд сургаалтуудыг өгөгдлөөс тод тусгаарлах хүртэл эрсдэл үргэлжилнэ. Үр дүнтэй нь гүнийн хамгаалалт: амжилтжсан injection-ыг таамаглаж, энэ хийх чадалыг хязгаарла.

  • Хамгийн сул эрх: agent нь түүний ажилдаа шаардлагатай хамгийн нарийн хэрэгсэл болон өгөгдлийн хандалтыг авдаг.
  • Хүний батламжны хаалга ямар ч буцаах боломжгүй, үнэ цэнэтэй үйлдлүүдэд: устгалт, төлөлт, гадны илгээлт.
  • Оруулалт болон гаралтын баталгаажуулалт, итгэмжүүлэгдээгүй контент сургаалтуудаас цэнгэлэн тусгаарлагдсан.
  • Бүрэн бүртгээлэл болон ажиглалт сөргүүлэгдэх tool дуудлагуудын хувьд, ингэснээр өгөгдлийн сугалалтын оролдлогуудыг барьж, үүлэгдэлийг тогтоож болно.

HOWF-ын байр суурь

Agents-ыг бид халдлагатай болно гэж таамагла үед баригдаж байна. Хэрэгслүүд хамгийн сул эрхийн доор ажилладаг, өндөр үнэ цэнэтэй үйлдлүүд хүний батламж хүлээж явдаг, итгэмжүүлэгдээгүй мэдээллэл тусгаарлагдсан байна, бүх үйлдлүүд бүртгээлэгдэж ажиглагдаж байна. Энэ нь байгууллагуудыг үргэлжүүлэн ажилласгадаг agents-ыг цүхэлдэн хаадаг agents-ыг салгаж өгдөг ижил удирдамжийн сахилга бөгөөд autonomy үүсгэдэг халдлагын гадаргуу дээр ашиглагдаж байна.

Эх сурвалж

  1. Incident 1152: LLM-Driven Replit Agent Reportedly Executed Unauthorized Destructive Commands During Code Freeze, AI Incident Database
  2. LLM01:2025 Prompt Injection, OWASP Gen AI Security Project

Үүнийг өөрийн аж ахуйн нэгжид хэрэгжүүлэхийг хүсэж байна уу?

Бид cookies ашигладаг. Зайлшгүй cookies сайтын ажиллагааг хангахад шаардлагатай, жишээлбэл таны хэлийг санах зэрэг. Таны зөвшөөрлөөр бид хуудасны үзлэгийн тоо ба ачааллын хурдыг нэрийгүй байдлаар хэмжик үзүүлэлтийг авдаг. Доор сонгоно уу; та Cookie-ийн тохиргооны дор аль ч цагт үүнийг өөрчилж болно.