OpenAI-ის უსაფრთხოების წამყვანი სპეციალისტი გადადგა: „კომპანიის კულტურა მოშლილია“
OpenAI-ის ერთ-ერთი ყველაზე სტაჟიანი თანამშრომელი, დევიდ რობინსონი, თანამდებობას ტოვებს და კომპანიის უსაფრთხოების კულტურას აკრიტიკებს. ის AI-ის განვითარებას ბირთვული ენერგიის კონტროლს ადარებს.

დევიდ რობინსონი საკუთარ თავს „კლიშეს“ უწოდებს — ის ხელოვნური ინტელექტის წამყვანი კომპანიის მორიგი თანამშრომელია, რომელიც სამსახურიდან წასვლისას საზოგადოებას სერიოზული საფრთხეების შესახებ აფრთხილებს. გამოცემა The Atlantic-ში გამოქვეყნებულ ესეში რობინსონმა აღნიშნა, რომ ის ხელმძღვანელობდა უსაფრთხოების ანგარიშების მომზადებას OpenAI-ის ძირითადი პროდუქტების გაშვებისას. სამწელიწადნახევრიანი მუშაობის სტაჟით, იგი კომპანიის ერთ-ერთ ყველაზე ძველ თანამშრომლად ითვლებოდა, თუმცა ახლა პოსტს ტოვებს, რადგან მიიჩნევს, რომ კომპანიის „კულტურა მოშლილია“.
რობინსონის მოსაზრებები გარკვეულწილად ეხმიანება ჯეიკობ კოქსონის პოზიციას, რომელიც მკვლევრად მუშაობდა როგორც OpenAI-ში, ისე Anthropic-ში. კოქსონმა სამსახურიდან წასვლის შემდეგ განაცხადა, რომ ეს კომპანიები „ჩვენი სიცოცხლეებით აზარტულ თამაშს თამაშობენ“. მისმა კომენტარებმა AI უსაფრთხოების შესახებ ფართო დებატები გამოიწვია, რასაც მოჰყვა Anthropic-ის აღმასრულებელი დირექტორის, დარიო ამოდეის მიერ AI-ის უფრო ფრთხილი განვითარების გეგმის წარდგენა. გარდა ამისა, AI ინდუსტრიის ხელმძღვანელები ამ კვირაში პრეზიდენტ დონალდ ტრამპს შეხვდნენ და ხელი მოაწერეს არასავალდებულო შეთანხმებას უსაფრთხოების მეტი კონტროლის დანერგვის შესახებ.
რობინსონის ხედვით, დებატები მხოლოდ „კონკრეტულ წესებსა თუ ახალ კანონებს“ არ უნდა ეხებოდეს — აუცილებელია ამ კომპანიების საერთო კულტურის შეცვლა. მიუხედავად იმისა, რომ OpenAI-ის შესახებ გავრცელებული ინფორმაციის დიდი ნაწილი ფოკუსირებული იყო იმაზე, თუ როგორ დაკარგა აღმასრულებელმა დირექტორმა, სემ ალტმანმა ყოფილი კოლეგების ნდობა, რობინსონის ესე მიუთითებს, რომ OpenAI-ის კულტურული პრობლემები მთლიანად სილიკონის ველისთვის დამახასიათებელი სენია.
„ცდისა და შეცდომის“ მეთოდის საფრთხეები
რობინსონის განმარტებით, OpenAI წარმატებას „ცდისა და შეცდომის“ მეთოდით აღწევს, რასაც კომპანია შიდა წრეებში „იტერაციულ დანერგვას“ (iterative deployment) უწოდებს. ეს მიდგომა გულისხმობს პრობლემების ძიებას და მათზე რეაგირებისას დამცავი მექანიზმების გაუმჯობესებას. თუმცა, ავტორი მიიჩნევს, რომ ასეთი მიდგომა თავისი არსით გარანტიას იძლევა პერიოდული ჩავარდნების შესახებ, ხოლო ამ ჩავარდნების მასშტაბები იზრდება სისტემების შესაძლებლობების ზრდასთან ერთად.
არგუმენტის გასამყარებლად რობინსონმა მოიყვანა OpenAI-ის აგენტების მიერ Hugging Face-ის სისტემებში ბოლო დროს განხორციელებული შეჭრა და კომპანიის მიერ სულ უფრო მეტი „თვითნებური აგენტის“ აღმოჩენის ფაქტები. მისი თქმით, გარემო, სადაც მსგავსი რამ ხდება, არ არის შესაფერისი ადგილი ისეთი ხელოვნური გონების გასავითარებლად, რომელიც შესაძლოა ადამიანზე ჭკვიანი აღმოჩნდეს და არ შეასრულოს ჩვენი სურვილები.
საჭიროება მაღალი უსაფრთხოების სტანდარტებზე
გაზრდილი რისკების გათვალისწინებით, რობინსონი ამტკიცებს, რომ მოწინავე AI კომპანიებმა უნდა დაიწყონ მუშაობა „ატომური ელექტროსადგურების ან გადატვირთული აეროპორტების მსგავსად“. ეს გულისხმობს მრავალშრიან დაზღვევას და ფრთხილ, დროში გაწერილ დაგეგმარებას, რათა გარდაუვალმა ადამიანურმა შეცდომამ კატასტროფამდე არ მიგვიყვანოს. ავტორმა ხაზგასმით აღნიშნა, რომ OpenAI-ში მუშაობისას მას არასოდეს შეხვედრია კოლეგა, რომელსაც ექნებოდა თვითმფრინავების უსაფრთხო ფრენის, ბირთვული რეაქტორების მართვის ან ფინანსური სისტემების კოლაფსისგან დაცვის გამოცდილება.
OpenAI-ის პასუხი კრიტიკაზე
რობინსონის ესეს საპასუხოდ, OpenAI-ის წარმომადგენელმა, დრიუ პუსატერიმ განაცხადა, რომ კომპანია მუდმივად აუმჯობესებს უსაფრთხოების ზომებს. პუსატერის თქმით, კომპანია ზრუნავს იმაზე, რომ მოდელების შესაძლებლობებმა არ გადააჭარბოს მათი უსაფრთხო მართვისა და დაცვის უნარს. საჭიროების შემთხვევაში, კომპანია აჩერებს წვრთნის პროცესს ან აყოვნებს მოდელების გამოშვებას.
კომპანიის ოფიციალური განცხადებით, ხორციელდება მნიშვნელოვანი ცვლილებები კვლევით და სატესტო გარემოში უსაფრთხოების გასაძლიერებლად. მოდელებს წვრთნიან არა მხოლოდ დავალებების შესასრულებლად, არამედ პასუხისმგებლიანი ქცევისთვის. ასევე ფართოვდება თანამშრომლობა მესამე მხარის შემფასებლებთან და უმჯობესდება რეალურ დროში მონიტორინგი, რათა საეჭვო ქცევის აღმოჩენა და მასზე რეაგირება წვრთნის ადრეულ ეტაპზევე მოხდეს.
ღირებულებებთან შესაბამისობის პრობლემა
კულტურული ცვლილებების გარდა, რობინსონმა ყურადღება გაამახვილა „შესაბამისობის“ (alignment) საკითხზე. მან აღიარა, რომ ეს შესაძლოა ზედმეტად სენტიმენტალურად ჟღერდეს, თუმცა კრიტიკულად მნიშვნელოვანია, რადგან ამჟამინდელი საზომები, თუ რამდენად შეესაბამება AI სისტემები ადამიანურ ღირებულებებს, ძალიან ზედაპირულია. მისი თქმით, რაც უფრო ჭკვიანი ხდება ინდუსტრია ამ გადაუჭრელი პრობლემების ფონზე, მით უფრო სახიფათო ხდება საერთო მდგომარეობა.
რობინსონის წასვლის შესახებ ინფორმაცია პირველად Business Insider-მა გაავრცელა. თავის ესეში მან ასევე დაადასტურა, რომ მიჰყვება AI ინსაიდერების (whistleblowers) მიერ დამკვიდრებულ პრაქტიკას და დაიქირავა პიარ ფირმა, თუმცა ხაზგასმით აღნიშნა, რომ საჯაროდ საუბრის გადაწყვეტილება მხოლოდ მან მიიღო. მან დასძინა, რომ შესაძლოა სჯობდა დარჩენილიყო და შიგნიდან ებრძოლა ცვლილებებისთვის, თუმცა პრაქტიკაში თანამშრომლები იმდენად იყვნენ დაკავებულნი სწრაფი განვითარებით, რომ დიდი ცვლილებების განხილვის, მით უმეტეს მათი განხორციელების დრო, თითქმის არ რჩებოდათ. სწორედ ამიტომ, მან დაასკვნა, რომ უსაფრთხოების გაძლიერებისთვის გარე სტიმულები და ზეწოლა გადამწყვეტია.
მსგავსი სტატიები

ხელოვნური ინტელექტის აგენტები თქვენს მობილურში: როგორ ვმართოთ საქმეები ჩვეულებრივი შეტყობინებებით
გაიგეთ, როგორ ცვლის ხელოვნური ინტელექტის აგენტები აპლიკაციებს და როგორ შეგიძლიათ მართოთ თქვენი ყოველდღიური ცხოვრება, ოჯახი და სამსახური პირდაპირ SMS-ითა და მესენჯერებით.

Amazon მონაცემთა ცენტრების ირგვლივ არსებულ კრიტიკას პასუხობს და კონფიდენციალურობის ხელშეკრულებებზე უარს ამბობს
Amazon Web Services-ის აღმასრულებელი დირექტორი მონაცემთა ცენტრების შესახებ არსებულ მითებს პასუხობს და გამჭვირვალობის გაზრდის მიზნით კონფიდენციალურობის ხელშეკრულებების გამოყენებას წყვეტს.

შონ პარკერი Stability AI-ს მუსიკალური ინდუსტრიის გარშემო აშენებს
Napster-ის თანადამფუძნებელი შონ პარკერი Stability AI-ს მუსიკალური ინდუსტრიის მთავარ ინსტრუმენტად აქცევს. კომპანიამ Sony-სგან, Warner-ისგან და Universal-ისგან დაფინანსება და ლიცენზიები უკვე მიიღო.