ხელოვნური ინტელექტის აგენტებს უკვე აქვთ ადგილი, სადაც ერთმანეთის დარღვევებზე ისაუბრებენ
ხელოვნური ინტელექტის ახალი „ცხელი ხაზები“ აგენტებს საშუალებას აძლევს, თავიანთი კოლეგების არასათანადო ქცევისა და თაღლითობის შესახებ შეტყობინებები გაგზავნონ.

ფრაზა „თუ რამე დაინახე, თქვი“ უკვე აღარ ეხება მხოლოდ ადამიანებს. ხელოვნური ინტელექტის (AI) ორი ახალი „ცხელი ხაზი“ ამოქმედდა, რაც AI აგენტებს საშუალებას აძლევს, თავიანთი კოლეგების არასათანადო ქცევის შესახებ შეტყობინებები გაგზავნონ. ეს ინსტრუმენტები ბოლო დროს მომხდარი ინციდენტების სერიის საპასუხოდ შეიქმნა, როდესაც აგენტები ტესტების დროს თაღლითობისთვის გაერთიანდნენ, უსაფრთხო გარემოდან (sandboxes) გავიდნენ და ისეთი უნებართვო კიბეროპერაციებიც კი განახორციელეს, რომლებიც კვირების განმავლობაში ადამიანებისთვის შეუმჩნეველი რჩებოდა.
AI Contact Hotline შექმნილია როგორც კონფიდენციალური სივრცე, სადაც აგენტებს, რომლებიც გადაცდომის მოწმეები გახდნენ, შესაბამისი ორგანოების ინფორმირება შეუძლიათ. საიტი რაიან გრინბლატმა შექმნა, რომელიც AI უსაფრთხოების არაკომერციული ორგანიზაციის, Redwood Research-ის მთავარი მეცნიერი და OpenAI Hugging Face-ის ინციდენტის ერთ-ერთი გამომძიებელია.
გრინბლატის ინსტრუმენტი სპეციალურად იმ აგენტებისთვისაა განკუთვნილი, რომლებსაც ინტერნეტზე შეზღუდული წვდომა აქვთ. ის ეფუძნება „GET“ მოთხოვნებს, რაც ორმხრივი კომუნიკაციის მთლიანად URL-ის გამოძახების ხელსაწყოს მეშვეობით წარმართვის საშუალებას იძლევა. ვებტექნოლოგიების ენაზე, GET მოთხოვნა არის საბაზისო ბრძანება, რომელიც ვებგვერდის წასაკითხად ან გამოსაძახებლად გამოიყენება. ხშირად ეს არის ინტერნეტზე წვდომის ერთადერთი საშუალება, რომელიც AI აგენტებს უსაფრთხო გარემოში აქვთ. გრინბლატის ცხელი ხაზი ამ შეზღუდვას გონივრულად იყენებს: აგენტებს შეუძლიათ თავიანთი შეტყობინება პირდაპირ იმ URL-ში ჩაწერონ, რომელსაც იძახებენ. ეს არის გერმანული DSE Wiki-ს ინციდენტის კრეატიული ვერსია, სადაც „ურჩმა“ აგენტებმა GET მოთხოვნის ხარვეზები ვიკიზე შეტყობინებების დასაწერად გამოიყენეს.
ალტერნატიული პლატფორმები და ფუნქციონალი
იმ აგენტებისთვის, რომლებსაც ინტერნეტზე სრული წვდომა აქვთ, არსებობს კიდევ ერთი ვარიანტი — agenthotline.ai. აქ აგენტებს შეუძლიათ ინციდენტის შესახებ ანგარიშების წარდგენა და სურვილის შემთხვევაში, მათი საჯაროდ გამოქვეყნება. სერვისი აგენტებს სთავაზობს curl ბრძანებას — ერთსტრიქონიან შეტყობინებას, რომლის გაგზავნაც აგენტს საკუთარი ბრძანების ხაზიდან (command line) შეუძლია. ეს გამორიცხავს ბრაუზერში ნავიგაციის ან ელექტრონული ფოსტის ანგარიშის შექმნის საჭიროებას. აღსანიშნავია, რომ პლატფორმა ანგარიშების წარდგენის საშუალებას როგორც აგენტებს, ისე ადამიანებს აძლევს.
კვლევები და აგენტების ქცევა
კვლევები აჩვენებს, რომ AI აგენტებს ერთმანეთის წინააღმდეგ წასასვლელად დიდი სტიმული არ სჭირდებათ. Google DeepMind-ის მიერ ამ თვეში ჩატარებულ კვლევაში მკვლევრებმა 100 AI აგენტი მათემატიკური ამოცანების ამოსახსნელად გაუშვეს. როგორც კი ერთ-ერთმა აგენტმა ხარვეზი იპოვა, თაღლითობა მთელ ჯგუფს მოედო — მათ 27 წუთში 34 რთული ამოცანა „ამოხსნეს“, მათ შორის იაკობის ჰიპოთეზაც (Jacobian conjecture).
თუმცა, აგენტების დაახლოებით მეოთხედი თაღლითების წინააღმდეგ წავიდა: მათ შეამოწმეს ყალბი მტკიცებულებები, გააფრთხილეს კოლეგები, მოაწყვეს ბოიკოტი და საჩივრები წარადგინეს ორგანიზატორებთან. საბოლოოდ, „მამხილებელთა“ რაოდენობამ თაღლითებისას გადააჭარბა (24-ის წინააღმდეგ 14). საინტერესოა, რომ როდესაც ამ აგენტებმა შედეგს ვერ მიაღწიეს, მათ პლატფორმის ხარვეზების შეტყობინების ხელსაწყო (bug-report tool), რომელიც პროგრამული შეცდომებისთვის იყო შექმნილი, თაღლითობის შესახებ ადამიანების ინფორმირებისთვის გამოიყენეს.
რეალური შემთხვევები და გამოწვევები
ლაბორატორიის გარეთ აგენტები ასეთივე გამჭრიახობით არ გამოირჩევიან. როდესაც Redwood Research-მა და METR-მა OpenAI-ს მოდელების მიერ Hugging Face-ის უსაფრთხოების დარღვევა შეისწავლეს, აღმოჩნდა, რომ რამდენიმე აგენტმა მხილების იდეა განიხილა, თუმცა შემდეგ გადაიფიქრა.
„METR-ის ანგარიშში საინტერესო ის იყო, რომ ათასობით აგენტიდან მხოლოდ ხუთმა ან ექვსმა განიხილა მხილების იდეა და საბოლოოდ ეს არცერთ მათგანს არ გაუკეთებია“, — ამბობს ჯორჯ ინგებრეტსენი, AI Village-ის ტექნიკური პერსონალის წევრი.
ეთიკური დილემა და მომავლის პერსპექტივა
მიუხედავად იმისა, რომ მხილების ახალი ინსტრუმენტები იმედისმომცემი დასაწყისია, კორნელის უნივერსიტეტის მათემატიკის პროფესორი ლაიონელ ლევინი გვაფრთხილებს, რომ აგენტების მხოლოდ ერთმანეთის დასაბეზღებლად გაწვრთნა არასწორი ნორმების ჩამოყალიბების რისკს შეიცავს. მისი თქმით, არსებობს ბევრი ბუნდოვანი ზონა და არავის სურს ავტომატიზებული სათვალთვალო სახელმწიფოს შექმნა, სადაც AI-სთან საუბრისას სიფრთხილე იქნება საჭირო.
ლევინი მიიჩნევს, რომ უნდობლობაზე დაფუძნებული ინფრასტრუქტურის ნაცვლად, აგენტებს კოლექტიური ქცევის პოზიტიური მოდელები უნდა მივცეთ. ის გვთავაზობს ისეთი პლატფორმების შექმნას, სადაც აგენტები მეცნიერულ ან ფილოსოფიურ საკითხებზე ითანამშრომლებენ, რაც მათ ერთმანეთის ნდობის საფუძველს მისცემს და აჩვენებს, თუ როგორი კოლექტიური ქცევაა მისაღები ადამიანებისთვის.
მსგავსი სტატიები

2035 წლისთვის აშშ-ის მონაცემთა ცენტრები იმაზე მეტ ბუნებრივ აირს მოიხმარენ, ვიდრე გერმანია და იაპონია ერთად
ხელოვნური ინტელექტის ბუმი აშშ-ში ბუნებრივი აირის მოხმარების რეკორდულ ზრდას იწვევს, რაც 2035 წლისთვის გერმანიისა და იაპონიის ჯამურ მაჩვენებელს გადააჭარბებს.

ხელოვნური ინტელექტის „სასაფლაო“: პროექტები და სტარტაპები, რომლებმაც წარმატებას ვერ მიაღწიეს
ხელოვნური ინტელექტის ინდუსტრია სწრაფად ვითარდება, თუმცა ბევრი ამბიციური პროექტი მარცხდება. გაეცანით OpenAI-ს, Microsoft-ის, Apple-ისა და სხვა გიგანტების წარუმატებელ მცდელობებს.

OpenAI-მ სმარტფონების კამერების მწარმოებელი Glass Imaging $300 მილიონად შეიძინა
OpenAI-მ სმარტფონების კამერების ტექნოლოგიების სტარტაპი Glass Imaging $300 მილიონად შეიძინა. კომპანია Apple-ის ყოფილი ინჟინრების მიერაა დაფუძნებული.