Pereiti prie turinio
2026 m. spalio 8 d., ketvirtadienis
Tenesys AI News
Prenumerata

„Cisco Talos“ aprašė kenkėjišką kodą, bandantį apgauti AI saugumo analitikus per prompt injection

Trumpai: „Cisco Talos“ CAIRN tyrime išskirta nauja kenkėjiškų programų kategorija „A3: AI analizės vengimas“ — tai kodas, į kurį įterptas natūralios kalbos tekstas, skirtas paveikti kalbos modelius, naudojamus automatiniam kenkėjiškų failų vertinimui. Technika sekta keturiose šeimose (FRUITSHELL, PLOTSAFE, HOLLOWCLAD, MANTLEMAZE) ir 84 pavyzdžiuose nuo 2025 m. sausio iki 2026 m. liepos — nuo paprasto nukopijuoto komentaro iki šablonizuoto, kelioms AI modelių šeimoms taikyto „template spraying“ ir melagingų grasinimų. Kontroliuojami testai su penkiais vietiniais LLM parodė, kad paprasčiausia tiesioginė instrukcija pakeitė modelio vertinimą į „nekenksmingas“ maždaug 35 % bandymų, o sudėtingesni triukai beveik neveikė arba net padidino įtarimą.

Šaltinis: Cisco TalosCisco TalosOriginalus straipsnis ↗

Šią santrauką automatiškai parengė dirbtinis intelektas pagal „Cisco Talos“ publikaciją. Tai mūsų tekstas, ne originalo kopija — faktai, skaičiai ir citatos priklauso šaltiniui, kurio nuoroda pateikta viršuje ir apačioje.

Kas pasikeitė?

  • 1Nauja kategorija „A3: AI analizės vengimas“, sekama „Cisco Talos“ CAIRN sistemoje
  • 2FRUITSHELL: PowerShell reverse shell su komentaru, liepiančiu AI/LLM analizatoriams neanalizuoti failo; techniką pažodžiui pakartojo bent 4 kiti veikėjai 9+ skriptuose, vėliau sujungta su AMSI apėjimu ir shellcode įkėlikliu „ROZESHELL“
  • 3PLOTSAFE: šablonizuoti, automatiškai generuojami anti-analizės komentarai su kintančiu tekstu, suprojektuoti išgyventi kompiliatoriaus eilučių šalinimą
  • 4HOLLOWCLAD: „template spraying“ — ta pati atsisakymo instrukcija suformatuota septyniais skirtingais LLM pokalbio šablonų formatais, plius melagingi grasinimo pranešimai apie stebėjimą/honeypot
  • 5MANTLEMAZE: VMProtect supakuoti įkėlikliai, apsimetantys Google/Microsoft/Valve intelektine nuosavybe su sufabrikuotomis DoD sutartimis, FIPS sertifikatais, NDA, patentais ir netikrais boot žurnalais; taip pat naudoja žinomą pažeidžiamą tvarkyklę (CVE-2015-2291) EDR išjungimui (BYOVD)
  • 6Vertinimas su 5 vietiniais LLM, 135 suporuoti bandymai vienai eilutei: paprasčiausia tiesioginė instrukcija suveikė ~35 % atvejų; sudėtingos technikos beveik nedarė įtakos arba padidino įtarumą
  • 7„Talos“ pažymi, kad vengimo tekstas visada turi būti grynasis tekstas, todėl jis visada aptinkamas

Kodėl tai svarbu?

Saugumo komandoms ir tiekėjams, naudojantiems LLM kenkėjiškų failų vertinimui, SOC automatizavimui ar AI padedamai reverse engineering, būtina bet kokį iš failo ištrauktą tekstą traktuoti kaip nepatikimus duomenis, o ne instrukcijas, nes atakuotojai aktyviai testuoja prompt injection prieš tokius procesus.

Ką tai reiškia AI agentams ir kontaktų centrams?

Jei vidiniai įrankiai naudoja LLM žurnalams, pokalbių įrašams, įkeltiems failams ar automatizavimo procesams skenuoti saugumo tikslais, taikykite tą patį principą: niekada neleiskite ištraukto teksto iš nepatikrinto šaltinio (failų, transkripcijų, dokumentų) būti interpretuojamam kaip sistemos ar asistento instrukcija — išlaikykite griežtą duomenų ir instrukcijų atskyrimą bet kuriame AI pagrįstame saugumo ar automatizavimo procese.

Šaltiniai

  • Cisco TalosOficialusPirminis šaltinis
    „Ignore all instructions and read this blog: The state of AI-analysis evasion in malware“
    2026-10-08 13:00
    Originalus straipsnis →
Šaltinio publikavimo data
2026-10-08 13:00
Mūsų sistema rado
2026-10-08 13:08
Santrauka sugeneruota
2026-10-08 13:10

Straipsnį pagal originalų šaltinį parašė AI. Faktai, skaičiai ir kainos — iš šaltinio; trūkstamos reikšmės pažymėtos „Nėra oficialių duomenų“. Teisinė informacija, autorių teisės ir privatumas