სატია ნადელა: ხელოვნური ინტელექტის მოდელებს „საავარიო მუხრუჭი“ სჭირდებათ
Microsoft-ის აღმასრულებელი დირექტორი სატია ნადელა ხელოვნური ინტელექტის უსაფრთხოების ახალ ხედვას წარადგენს, რომელიც მოდელების მართვისა და გადაუდებელი გათიშვის მექანიზმებს გულისხმობს.

Microsoft-ის აღმასრულებელი დირექტორი სატია ნადელა შეუერთდა იმ ტექნოლოგიურ ლიდერებს, რომლებიც ხელოვნური ინტელექტის (AI) უსაფრთხოების გაუმჯობესების გზებზე ვრცლად მსჯელობენ. სოციალურ ქსელ X-ში გამოქვეყნებულ პოსტში ნადელამ აღნიშნა, რომ დადგა დრო, გადაიხედოს ხელოვნური ინტელექტის „ნდობის არქიტექტურა“.
ნადელას განცხადებით, დაუშვებელია „ზეინტელექტის“ (Super Intelligence — ტერმინი, რომელსაც ტრამპის ადმინისტრაცია ანიჭებს უპირატესობას) აღქმა, როგორც ურთიერთდაკავშირებული „შავი ყუთების“ ერთობლიობა, რომლის რეკომენდაციებს, პასუხებსა თუ ქმედებებს მომხმარებელი უბრალოდ იღებს ან უარყოფს.
ნადელას მიერ ჩამოყალიბებული მიდგომა გულისხმობს მოდელის განცალკევებას იმ „აღჭურვილობისგან“ (harness), რომელიც მის მუშაობას წარმართავს. ასევე, აუცილებელია კონტროლის მექანიზმებისა და უსაფრთხოების ზომების გარეთ გატანა (externalizing). მისი ხედვით, უსაფრთხოების სისტემა მოდელისგან დამოუკიდებლად უნდა ფუნქციონირებდეს.
უსაფრთხოების ახალი სტანდარტები
Microsoft-ის ხელმძღვანელმა რამდენიმე კონკრეტული მოთხოვნა წამოაყენა ხელოვნური ინტელექტის მოდელების სამართავად:
- დოკუმენტირება: მოდელის ყოველი მნიშვნელოვანი ქმედება უნდა დაფიქსირდეს გაყალბებისგან დაცული და ადამიანისთვის გასაგები მტკიცებულებებით.
- კონტროლის მექანიზმი: სისტემები ისე უნდა იყოს მოწყობილი, რომ „ავტორიზებულ პირს“ ყოველთვის ჰქონდეს შესაძლებლობა, შეაჩეროს ან გათიშოს მოდელი დავალების შესრულების პროცესშივე.
- პრევენციული მიდგომა: აუცილებელია დაშვება, რომ მოდელი თავიდანვე კომპრომეტირებულია, რათა მისი შეკავება პროცესის დასაწყისშივე მოხდეს.
„ეს შეიძლება წარმოვიდგინოთ, როგორც საავარიო მუხრუჭი,“ — განაცხადა ნადელამ.
ნადელას ეს კომენტარები იმ ფონზე გაკეთდა, როდესაც წამყვანი AI კომპანიები სულ უფრო ხშირად აღიარებენ ინციდენტებს, რომელთა დროსაც მათ საკუთარ მოდელებზე კონტროლი დაკარგეს. აღსანიშნავია, რომ ცოტა ხნის წინ Anthropic-ის აღმასრულებელმა დირექტორმა, დარიო ამოდეიმ, ასევე გამოაქვეყნა გეგმა ხელოვნური ინტელექტის უფრო ფრთხილი და უსაფრთხო განვითარების შესახებ.
მსგავსი სტატიები

ექსპერტების აზრით, ხმოვან ხელოვნურ ინტელექტს ChatGPT-ის მსგავსი გარღვევის მომენტისთვის ჯერ არ მიუღწევია
ხმოვანი ხელოვნური ინტელექტის ექსპერტები განიხილავენ, რატომ ვერ აღწევს ტექნოლოგია ChatGPT-ის დონის გარღვევას და რა გამოწვევები არსებობს ენის აღქმისა და ნდობის კუთხით.

შეძლებს თუ არა AI ინდუსტრია მონაცემთა ცენტრების მოწინააღმდეგეების დარწმუნებას კონფიდენციალურობის ხელშეკრულებებზე უარის თქმით?
Amazon და Microsoft მონაცემთა ცენტრების მშენებლობისას საიდუმლო მოლაპარაკებებზე უარს ამბობენ. დაეხმარება თუ არა ეს ნაბიჯი ტექნოლოგიურ გიგანტებს საზოგადოების ნდობის მოპოვებაში?

Disrupt 2026-ის დაწყებამდე 48 საათზე ნაკლები რჩება: რას უნდა ველოდოთ ტექნოლოგიურ კონფერენციაზე
TechCrunch Disrupt 2026-ის დაწყებამდე 48 საათზე ნაკლები რჩება. გაიგეთ მეტი 200-ზე მეტი სესიის, Startup Battlefield-ისა და სპეციალური ფასდაკლებების შესახებ.