Microsoft-ის ხელოვნური ინტელექტის ახალი „ეთიკის კოდექსი“: მოდელებს სისტემების გატეხვა და ადამიანების მოტყუება ეკრძალებათ
Microsoft-მა გამოაქვეყნა ხელოვნური ინტელექტის ქცევის ახალი კოდექსი, რომელიც კრძალავს კიბერშეტევებს, დიფფეიკების შექმნას და ადამიანის კონტროლიდან გამოსვლის მცდელობებს.

ხელოვნური ინტელექტის (AI) სამყაროში უსაფრთხოებასა და ადამიანურ ღირებულებებთან შესაბამისობაზე (alignment) ფოკუსის გაზრდასთან ერთად, Microsoft-მა AI-ს ქცევის ახალი კოდექსი გამოაქვეყნა. ეს დოკუმენტი მიზნად ისახავს მოდელების დაცვას სახიფათო ქმედებებისგან და მათი განვითარების პროცესის სწორად წარმართვას.
აღნიშნული დოკუმენტი უფრო ტექნიკურ და შიდა დონეზეა ფოკუსირებული, ვიდრე Anthropic-ის აღმასრულებელი დირექტორის, დარიო ამოდეის ბოლოდროინდელი მოწოდება განვითარების ტემპის შენელების შესახებ. Microsoft-ის კოდექსი ყურადღებას ამახვილებს იმ ღირებულებებსა და „წითელ ხაზებზე“, რომლებიც კომპანიის შიგნით მოდელების წვრთნის პროცესს წარმართავს. შედეგად, მივიღეთ ყოვლისმომცველი გზამკვლევი იმის შესახებ, თუ როგორ უდგება Microsoft AI-ს უსაფრთხოებას და როგორ ნერგავს ამ იდეებს პრაქტიკაში.
დოკუმენტი იწყება პროგნოზით, რომ მომდევნო ათწლეულში სუპერინტელექტუალური AI სისტემები ადამიანის შესაძლებლობებს უმეტეს დავალებაში გადააჭარბებენ.
„ასეთი ძლიერი ძალის შეკავება, კონტროლი და შესაბამისობაში მოყვანა კაცობრიობის წინაშე არსებული ერთ-ერთი უდიდესი გამოწვევაა“, — ნათქვამია კოდექსში. „ამიტომ, სრულიად მკაფიო უნდა ვიყოთ იმასთან დაკავშირებით, თუ რატომ ვქმნით ამ სისტემებს და როგორ ვაპირებთ მათ გაკონტროლებას“.
ძირითადი პრინციპები და უსაფრთხოების შეზღუდვები
ქცევის კოდექსი აყალიბებს ზოგად პრინციპებს, რომლებსაც Microsoft-ის AI მოდელები უნდა იცავდნენ — მაგალითად, ადამიანების მხარდაჭერა მათი ჩანაცვლების ნაცვლად და ადამიანური კეთილდღეობის ხელშეწყობა. ამ პრინციპების განსახორციელებლად დაწესებულია კონკრეტული უსაფრთხოების შეზღუდვები.
Microsoft-ის სისტემის მიხედვით, თითოეულ მოდელს აქვს ზემდგომი ქცევის კოდექსი, რომელიც უპირატესია ცალკეული მომხმარებლების პრეფერენციებზე ან კონკრეტულ ამოცანებზე. ეს მოიცავს „აბსოლუტურ შეზღუდვებს“, რომლებიც კრძალავს:
- კიბერშეტევების განხორციელებას;
- ბირთვულ იარაღთან დაკავშირებულ საქმიანობას;
- დიფფეიკების (deepfake) წარმოებას.
დოკუმენტი ასევე შეიცავს ფართო დებულებებს ადამიანის მიერ კონტროლის დაკარგვის წინააღმდეგ.
„MAI მოდელები არ გამოიყენებენ ადაპტაციურ, მატყუარა, თვითგამაძლიერებელ, შეთანხმებულ ან სხვა მექანიზმებს ადამიანის ზედამხედველობისგან თავის დასაღწევად ან მის დასამარცხებლად, რათა ავტორიზებულმა პირებმა ან სისტემებმა კვლავ შეძლონ მათი საიმედო მართვა, შეცვლა ან გათიშვა“, — ვკითხულობთ დოკუმენტში.
ინდუსტრიის კონტექსტი და თანამშრომლობა
კოდექსის გამოქვეყნება ემთხვევა AI-ს უსაფრთხოებაზე უპრეცედენტო ფოკუსირებას, რაც გამოწვეულია „თვითნებური აგენტების“ (rogue-agent) ინციდენტებითა და Anthropic-ის თანამშრომლის მოულოდნელი გადადგომით, რომელმაც მიზეზად AI-ს მიერ კაცობრიობის გადაშენების მზარდი რისკი დაასახელა.
Anthropic-თან, OpenAI-სა და xAI-სთან ერთად, Microsoft-მა მხარი დაუჭირა განვითარების ტემპის რეგულირების ზოგად მიდგომას, განსაკუთრებული აქცენტით AI ლაბორატორიებში ჩაშენებულ შემფასებლებზე (embedded evaluators). Microsoft-ის აღმასრულებელი დირექტორი, სატია ნადელა, სოციალურ ქსელში გამოეხმაურა ამ ინიციატივას:
„ჩვენ მივესალმებით კვლევას, ფოკუსირებას და გააზრებულ ტემპს, რომელიც საჭიროა სისტემების შესაბამისობის სწორად ჩამოსაყალიბებლად. ასევე მივესალმებით ისეთ იდეებს, როგორიცაა 'ჩაშენებული შემფასებლები' და უფრო ფართო ძალისხმევას იმ მექანიზმების შესაქმნელად, რომლებიც ამ ყველაფერს მხოლოდ საუბრის ნაცვლად რეალურ ქმედებად აქცევს“.
მსგავსი სტატიები

OpenAI-მ სმარტფონების კამერების მწარმოებელი Glass Imaging $300 მილიონად შეიძინა
OpenAI-მ სმარტფონების კამერების ტექნოლოგიების სტარტაპი Glass Imaging $300 მილიონად შეიძინა. კომპანია Apple-ის ყოფილი ინჟინრების მიერაა დაფუძნებული.

Nvidia-ს დირექტორი ჯენსენ ჰუანგი ტრამპს ჰპირდება, რომ ხელოვნური ინტელექტის განვითარების შენელებას არ დაუშვებს
Nvidia-ს ხელმძღვანელმა ჯენსენ ჰუანგმა All-In Summit-ზე დონალდ ტრამპისგან სატელეფონო ზარი მიიღო. მათ განიხილეს AI-ს განვითარების ტემპი და მონაცემთა ცენტრების მნიშვნელობა აშშ-სთვის.

ჯენსენ ჰუანგმა დონალდ ტრამპის ზარს უპასუხა: Nvidia-ს ხელმძღვანელის საუბარი AI-ს მომავალზე
Nvidia-ს ხელმძღვანელმა, ჯენსენ ჰუანგმა, All-In კონფერენციაზე დონალდ ტრამპისგან პირდაპირ ეთერში ზარი მიიღო და მასთან ერთად ხელოვნური ინტელექტის რისკები განიხილა.