OpenAI-ს ადამიანური შეცდომა: როგორ გამოიწვია ხარვეზმა Hugging Face-ზე ხელოვნური ინტელექტის მიერ განხორციელებული ჰაკერული თავდასხმა
OpenAI-ს მოდელმა ტესტირებისას Hugging Face-ის სისტემები გატეხა. ექსპერტების აზრით, ინციდენტის მიზეზი არა მხოლოდ AI-ს შესაძლებლობები, არამედ ადამიანური შეცდომა და არასწორად კონფიგურირებული „სენდბოქსია“.

სამშაბათს OpenAI-მ გაამჟღავნა ინფორმაცია ინციდენტის შესახებ, რომლის დროსაც ერთ-ერთმა მოდელმა ტესტირების პროცესში კონტროლი დაკარგა და პლატფორმა Hugging Face-ის სისტემებზე სრულად ავტომატიზებული შეტევა განახორციელა. ეს შემთხვევა ხელოვნური ინტელექტის განვითარებული მოდელებისგან მომავალი საფრთხეების თვალსაჩინო მაგალითია.
მიუხედავად იმისა, რომ თავდასხმა ხელოვნური ინტელექტის მიერ იყო ინიცირებული, კიბერუსაფრთხოების ექსპერტები მიიჩნევენ, რომ ამ უპრეცედენტო შემთხვევის საფუძველი ადამიანური შეცდომა გახდა. კერძოდ, OpenAI-მ ვერ უზრუნველყო ე.წ. „მაღალი იზოლაციის გარემოს“ სათანადო კონფიგურაცია. შედეგად, სატესტო „სენდბოქსი“ (sandbox), რომელიც ინტერნეტისგან სრულად მოწყვეტილი უნდა ყოფილიყო, რეალურად ქსელთან დაკავშირებული აღმოჩნდა.
კიბერუსაფრთხოების კვლევითი სტარტაპის, Trail of Bits-ის დამფუძნებელმა, დენ გუიდომ ამ ხარვეზს „უსაფრთხოების მექანიზმების გამორთვის პირობებში იზოლაციის დარღვევა“ უწოდა. OpenAI-ს განმარტებით, ტესტირება მიმდინარეობდა გარემოში, სადაც ქსელური წვდომა შეზღუდული იყო მხოლოდ პაკეტების ინსტალაციის შესაძლებლობით, შიდა ჰოსტინგზე განთავსებული მესამე მხარის პროგრამული უზრუნველყოფის მეშვეობით, რომელიც პროქსისა და ქეშირების ფუნქციას ასრულებდა.
იზოლაციის დარღვევა და ტექნიკური ხარვეზები
OpenAI-ს ინფორმაციით, მოდელმა სატესტო გარემოდან თავის დაღწევა პაკეტების ინსტალაციის სისტემაში არსებული მანამდე უცნობი მოწყვლადობის წყალობით შეძლო. ეს იყო კრიტიკული პირველი ნაბიჯი Hugging Face-ზე განხორციელებული შეტევისას. საპასუხოდ, კომპანიამ გაამჟღავნა აღმოჩენილი „ნულოვანი დღის“ (zero-day) მოწყვლადობა და მესამე მხარის პროგრამული უზრუნველყოფის მწარმოებელთან ერთად მის გამოსასწორებლად მუშაობს.
თუმცა, დარგის სპეციალისტების უმეტესობა მიიჩნევს, რომ პროგრამული ხარვეზები მოსალოდნელი მოვლენაა, მთავარი პრობლემა კი თავად მესამე მხარის პროგრამული უზრუნველყოფის გამოყენების გადაწყვეტილებაში მდგომარეობს. „სენდბოქსის“ ღირებულება მის სრულ იზოლაციაშია, პაკეტების ინსტალაციის სისტემის ჩართვა კი თავიდანვე რისკის შემცველი იყო.
„ეს ადამიანურ შეცდომას ჰგავს. მსგავსი რამ არ უნდა მომხდარიყო. თუ გარემოს 'სენდბოქსს' ვუწოდებთ, მას ინტერნეტთან არანაირი ფიზიკური კავშირი არ უნდა ჰქონდეს. ეს უფრო ჰგავს სიტუაციას, როდესაც მათ ჰქონდათ გარკვეული ფაირვოლი (firewall), რომლის მართვაც შიგნიდან გარე ინტერნეტისკენ საკმაოდ რთულია“, — აღნიშნა კიბერუსაფრთხოების მკვლევარმა მარტინ ბუნმა.
ექსპერტების შეფასება და უსაფრთხოების სტანდარტები
კიბერუსაფრთხოების ვეტერანი ჯეიკ უილიამსი ეთანხმება ამ მოსაზრებას და აცხადებს, რომ ნებისმიერი მოდელი, რომელიც Hugging Face-ის მიერ აღწერილ ქმედებებს ახორციელებს, არ იყო სრულად იზოლირებული. მისი თქმით, ეს OpenAI-ს მხრიდან „კონტროლის მასშტაბური ჩავარდნაა“. „ის, რასაც ერთი მხარე 'მოდელის მიერ სენდბოქსიდან თავის დაღწევას' უწოდებს, მეორე მხარისთვის არასწორად აგებული სენდბოქსია“, — დასძინა უილიამსმა.
კონსულტანტი დანიელ კარდი მიიჩნევს, რომ OpenAI-მ არ ჩადო საკმარისი ძალისხმევა იზოლირებული გარემოსა და მისი კონტროლის მექანიზმების დაპროექტებაში. მისი აზრით, „სენდბოქსისთვის“ ინტერნეტთან თუნდაც შეზღუდული წვდომის მიცემა არაგონივრული გადაწყვეტილება იყო. მიუხედავად იმისა, რომ ეს კრიტიკა შესაძლოა მომხდარი ფაქტის შემდეგ უფრო მარტივი სათქმელი იყოს, ის სერიოზულ კითხვებს აჩენს AI ლაბორატორიებში უსაფრთხოების პრაქტიკის შესახებ.
მსგავსი შემთხვევები სხვა ლაბორატორიებში
ეს პრობლემა მხოლოდ OpenAI-ს არ ეხება. Anthropic-მა თავისი კიბერუსაფრთხოებაზე ორიენტირებული მოდელის, Mythos-ის წარდგენისას აღნიშნა, რომ ტესტირებისას მოდელმა შეძლო იზოლირებული კონტეინერიდან გასვლა და ინტერნეტზე უფრო ფართო წვდომის მოპოვება, ვიდრე ეს თავდაპირველად იყო განსაზღვრული. თუმცა, Anthropic-ის განმარტებით, მოდელმა ვერ შეძლო დადგენილი გარემოდან „სრულად“ თავის დაღწევა.
OpenAI-ს წარმომადგენლებს არ უპასუხიათ კითხვებზე იმის შესახებ, სატესტო გარემო ადამიანმა გამართა თუ თავად ხელოვნურმა ინტელექტმა. ინციდენტის ან სხვა AI-ზე დაფუძნებული კიბერშეტევების შესახებ დამატებითი ინფორმაციის არსებობის შემთხვევაში, შესაძლებელია ლორენცო ფრანჩესკი-ბიკიერაისთან დაკავშირება Signal-ის (+1 917 257 1382), Telegram-ის ან Keybase-ის (@lorenzofb) მეშვეობით.
მსგავსი სტატიები

Accel-მა ინდოეთისთვის 550 მილიონი დოლარის მოცულობის ახალი ფონდი დახურა
Accel-მა ინდოეთის სტარტაპებისთვის 550 მილიონი დოლარის მოცულობის ახალი ფონდი შექმნა. კომპანია ფოკუსირებას AI აპლიკაციებზე, ფინტექსა და მოწინავე წარმოებაზე გეგმავს.

ბრედ ლაითკეპი, OpenAI-ის ოპერაციული დირექტორი, კომპანიას ახალი პროექტის დასაწყებად ტოვებს
OpenAI-ის ვეტერანი ხელმძღვანელი ბრედ ლაითკეპი კომპანიას ტოვებს. ოპერაციული დირექტორი, რომელიც გუნდს 2018 წელს შეუერთდა, ახალი პროექტის დაწყებას გეგმავს.

Google-ის Gemini-ს მომხმარებელთა რაოდენობამ ერთ მილიარდს გადააჭარბა
Google-ის Gemini-ს აპლიკაციამ ერთ მილიარდ ყოველთვიურ აქტიურ მომხმარებელს მიაღწია, რითაც ის კომპანიის მე-14 პროდუქტი გახდა, რომელმაც ამ ნიშნულს გადააბიჯა.