Անտեսանելի տեքստը էլփոստում. ինչպես է ASCII Smuggling-ը խաբում ֆիլտրերին
Սպամ ուղարկողները սովորական բառերի մեջ թաքցնում են անտեսանելի Unicode նիշեր, որպեսզի շրջանցեն էլփոստի ֆիլտրերը։ Ահա թե ինչ է ASCII smuggling-ը, և կարճ ստուգաթերթ ձեր թիմի ու հաշվապահի համար։
Սպամ ֆիլտրերը կարդում են տեքստ։ Մարդիկ նույնպես կարդում են տեքստ, բայց ոչ նույն տեքստը։ Հարձակվողները սկսել են օգտագործել այս տարբերությունը՝ ներմուծելով նիշեր, որոնք համակարգիչները մշակում են, բայց մարդիկ երբեք չեն տեսնում. Microsoft-ը այս տարվա սկզբին գրանցել է այդպիսի հաղորդագրությունների կտրուկ աճ։ Եթե ձեր թիմը էլփոստով ստանում է հաշիվ-ապրանքագրեր, վճարման հայտեր կամ ֆինանսավորման առաջարկներ, սա արժե տասը րոպե ուշադրություն։
Ինչ է իրականում փոխվել
Ըստ Ars Technica-ի հրապարակման, ASCII smuggling կոչվող հնարքը AI-ի դեմ ուղղված հարձակումներից տեղափոխվել է սովորական սպամ։ Մեխանիզմը 128 Unicode «tag» նիշերի բլոկ է, որոնք գրեթե ամբողջովին կրկնում են ստանդարտ ASCII նիշերը։ U+E0041 tag-կետը փոխարինում է «A»-ին, U+E0061-ը՝ «a»-ին։ Մեքենաները դրանք լավ են կարդում։ Ըստ էության, դրանք ամբողջովին անտեսանելի են էկրանին նայող մարդու համար։
Տեխնիկան առաջին անգամ ուշադրություն գրավեց երկու տարի առաջ՝ որպես prompt injection-ներ թաքցնելու միջոց. վնասակար հրահանգներ, որոնք տեղադրվում են բովանդակության մեջ և հետագայում մշակվում լեզվական մոդելի կողմից։ Մոդելը տեսնում է հրահանգները, իսկ նույն նամակը կարդացող մարդը ոչինչ անսովոր չի նկատում։
Սպամ ուղարկողները շրջեցին նպատակը, բայց պահպանեցին մեթոդը։ Հրահանգներ թաքցնելու փոխարեն նրանք ֆիլտրերի փնտրած բառերի ներսում թաքցնում են ընդմիջումներ։ Անտեսանելի նիշ գցեք «funding» բառի մեջտեղը, և ֆիլտրը կարող է տեսնել «fun» և «ding» երկու անվնաս հատվածներ։ Ստացողը դեռ տեսնում է «funding»։ Նույն մոտեցումը կարող է կիրառվել դոլարային գումարների և զանգվածային արշավներում հանդիպող «credit», «term» տիպի բառերի նկատմամբ։
Microsoft-ի տվյալները ցույց են տալիս մասշտաբը։ Microsoft Defender for Office-ում ASCII smuggling ստորագրությունների հայտնաբերումները օրական մոտավորապես 21,000 էին, ապա փետրվարի սկզբին մեկ օրում գերազանցեցին 1.3 միլիոնը։ Չորս օր անց դրանք հասան 2.5 միլիոնի։ Ալիքը շարունակվեց ամիսներ շարունակ և կտրուկ նվազեց մայիսի կեսերին։
Ինչու հին պաշտպանությունները դժվարանում են
Արգելարգված բառեր թաքցնելը նոր բան չէ։ Զրո-լայնության և չկոտրվող բացատները տասնամյակներ շարունակ օգտագործվել են նույն նպատակով։ Դրանք խախտում են բառացի տողերի համընկնումը և փոխում այն բայթերի հաջորդականությունը, որը փնտրում են օրինակների վրա հիմնված ֆիլտրերը։
Այն, ինչ Unicode tag-երը դարձնում է հետաքրքիր, նրանց ազդեցությունն է ժամանակակից ֆիլտրերի վրա։ Մեքենայական ուսուցումը և բնական լեզվի մոդելները այժմ կատարում են սպամի և ֆիշինգի դասակարգման մեծ մասը։ Այս համակարգերը սովորաբար տեքստը բաժանում են token-երի կամ ենթաբառային հատվածների՝ մինչ դրա մասին «մտածելը»։ Մաքուր «funding» բառը վերածվում է ծանոթ token-ի։ Ներմուծեք անտեսանելի նիշ, և tokenizer-ը կարող է դուրս տալ հատվածներ կամ հազվադեպ, անհայտ մասեր։ Եթե համակարգը նախապես նորմալացնում է տեքստը, նիշը պարզապես հեռացվում է, և բառը մնում է ամբողջական. հենց դրա համար է կարևոր նորմալացումը։ Microsoft-ը նշում է, որ եթե ֆիլտրող համակարգը հաղորդագրությունը չի ներկայացնում որպես պատկեր և չի կիրառում OCR, նման հարձակումը կարող է չնկատված մնալ։
Ինչու է սա կարևոր փոքր բիզնեսի համար
Փոքր ընկերությունների մեծ մասը սեփական փոստային ենթակառուցվածք չի պահպանում։ Դուք հենվում եք ձեր մատակարարի ֆիլտրի վրա։ Դա տրամաբանական է, բայց դա նշանակում է, որ ձեր ռիսկը փոխվում է, երբ փոխվում է հարձակվողի տեխնիկան, և դուք դա ուշ եք իմանում։
Պրակտիկ ռիսկը ինքնին սպամը չէ։ Դա այն հաղորդագրությունն է, որը հասնում է փոստարկղ՝ թվալով օրինական, քանի որ ֆիլտրը այն գնահատել է որպես անվնաս։ Հաշվապահը, ով շաբաթական ստանում է տասնյակ հաշիվ-ապրանքագրեր, քիչ պատճառ ունի ևս մեկը կասկածելի համարել։ Ձևակերպումը էկրանին սովորական տեսք ունի։ Ոչինչ տեսողականորեն չի ազդարարում մանիպուլյացիա։
Կա երկրորդ կողմ, եթե դուք ձեր փոստին, CRM-ին կամ փաստաթղթաշրջանառությանը միացրել եք AI օգնական։ Նույն նիշերը, որոնք խաբում են սպամ ֆիլտրին, կարող են կրել հրահանգներ, որոնց մոդելը կհետևի։ Ցանկացած տեղ, որտեղ չստուգված տեքստը հասնում է գործողություններ կատարելու ունակ մոդելի, արժե ուշադրության արժանացնել։
Ինչ անել այս մասին
- Ձեր էլփոստի մատակարարի կամ IT կապի հետ ստուգեք, թե մուտքային ֆիլտրումը նորմալացնում է Unicode-ը. այսինքն՝ դասակարգումից առաջ հեռացնում կամ նշում է անտեսանելի tag-նիշերը։ Հարցրեք ուղիղ, ոչ թե ենթադրեք։
- Ձեր հաշվապահին և վճարումներով զբաղվող ցանկացած մեկին տվեք մեկ կանոն, որը կախված չէ ֆիլտրերից. բանկային տվյալները և վճարման գումարները ստուգվում են երկրորդ ուղիով, հեռախոսազանգով կամ հայտնի կոնտակտով, նախքան փող տեղափոխելը։ Առանց բացառության՝ նույնիսկ շտապողականության դեպքում։
- Աշխատակիցներին ասացեք, որ նամակը կարող է կատարելապես մաքուր տեսք ունենալ և միևնույն ժամանակ մանիպուլյացված լինել։ Տառասխալների և տարօրինակ ձևաչափման մասին հին խորհուրդները այստեղ չեն գործում, քանի որ թաքցված մասն ինքնին անտեսանելի է։
- Վերանայեք ցանկացած AI գործիք, որը կարդում է մուտքային էլփոստ, հայտեր կամ փաստաթղթեր։ Եթե այն ինքնուրույն կարող է հաղորդագրություններ ուղարկել, թարմացնել գրառումներ կամ գործարկել գործողություններ, ավելացրեք մարդկային հաստատում ցանկացած ֆինանսական կամ արտաքին հետևանք ունեցող քայլի համար։
- Պահեք կարճ ներքին նշում այն մասին, թե որտեղ պետք է հայտնել կասկածելի հաղորդագրությունների մասին, որպեսզի տատանվող աշխատակիցը երեսուն վայրկյանում իմանա, ուր ուղարկել դրանք։
Ամենակարևոր դասը կապված չէ մեկ Unicode բլոկի հետ։ Այն կայանում է նրանում, որ ձեր համակարգերի մշակած տեքստը և ձեր մարդկանց կարդացած տեքստը երկու տարբեր բան են, և հարձակվողները աշխատում են հենց այս տարբերության մեջ։ Ֆիլտրերը կհասնեն. Microsoft-ը արդեն հրապարակել է ուղեցույց ծրագրավորողների համար այս խնդիրը լուծելու վերաբերյալ։ Ձեր փողի փոխանցումների ստուգման գործընթացը պետք է լինի այն շերտը, որը կախված չէ այդ «հասնելուց»։
ԱղբյուրԳրված է Ars Technica-ի նյութի հիման վրա։ Բնօրինակը՝ Once popular for attacking AI, ASCII smuggling is embraced by spammers ↗