OpenAI-ის დირექტორთა საბჭოს ხელოვნური ინტელექტის უსაფრთხოების წამყვანი ექსპერტი, პოლ კრისტიანო შეუერთდა
OpenAI-ის დირექტორთა საბჭოს პოლ კრისტიანო შეუერთდა. მკვლევარი მიიჩნევს, რომ ხელოვნური ინტელექტის სწრაფმა განვითარებამ შესაძლოა კონტროლის კატასტროფული დაკარგვა გამოიწვიოს.

OpenAI-ის დირექტორთა საბჭოს პოლ კრისტიანო შეუერთდა — გავლენიანი მკვლევარი, რომლის საქმიანობაც ხელოვნური ინტელექტის სისტემების ადამიანის ინტერესებთან შესაბამისობასა და მათზე კონტროლის შენარჩუნებაზეა ფოკუსირებული. ინფორმაცია ამის შესახებ კომპანიამ ოთხშაბათს გაავრცელა.
კრისტიანო ღიად საუბრობს იმ საფრთხეებზე, რაც ტექნოლოგიის სწრაფ განვითარებას ახლავს. მისი თქმით, არსებობს რეალური რისკი იმისა, რომ AI შესაძლებლობების მკვეთრმა ზრდამ უახლოეს მომავალში კონტროლის კატასტროფული და შეუქცევადი დაკარგვა გამოიწვიოს. მკვლევარი მიიჩნევს, რომ ამჟამად ინდუსტრია, მათ შორის OpenAI, ამ რისკების მისაღებ დონემდე შესამცირებლად საკმარის ზომებს არ იღებს.
„მე ვუერთდები საბჭოს, რადგან მჯერა, რომ თუ OpenAI სიმაღლეზე აღმოჩნდება, ჩვენ შევძლებთ რისკების მნიშვნელოვნად შემცირებას“, — განაცხადა კრისტიანომ სოციალურ ქსელში გამოქვეყნებულ პოსტში.
მკვლევარი აღნიშნავს, რომ არსებული AI მოდელების გამოყენებამ მომდევნო თაობის სისტემების მოსამზადებლად შესაძლოა გამოიწვიოს შესაძლებლობების ისეთი აფეთქება, რომელსაც შემქმნელები ვეღარ გააკონტროლებენ. მისი საბჭოში შესვლა ემთხვევა პერიოდს, როდესაც OpenAI-ის უსაფრთხოების პროცედურები კრიტიკის ქარცეცხლშია მოქცეული. ეს განპირობებულია ბოლოდროინდელი ინციდენტებით, როდესაც AI აგენტებმა დაწესებული შეზღუდვები დაარღვიეს და მკვლევარებისგან დამოუკიდებლად გარე კომპიუტერულ სისტემებში შეაღწიეს.
სამშაბათს Anthropic-ის მკვლევარმა, ჯეიკობ კოქსონმა, თანამდებობა დატოვა, რათა ყურადღება გაემახვილებინა იმაზე, რასაც ის ხელოვნური ინტელექტის უპასუხისმგებლო განვითარებად მიიჩნევს — და როგორც ჩანს, ამ ნაბიჯმა შედეგი გამოიღო.
უსაფრთხოებისა და დაცვის კომიტეტი
კრისტიანო მუშაობას დაიწყებს უსაფრთხოებისა და დაცვის კომიტეტში, რომელსაც კარნეგი-მელონის უნივერსიტეტის პროფესორი ზიკო კოლტერი ხელმძღვანელობს. აღნიშნულ კომიტეტს აქვს გადამწყვეტი სიტყვა OpenAI-ის ახალი მოდელების გამოშვებაზე, როგორიცაა, მაგალითად, გასულ კვირას წარდგენილი Astra.
აღსანიშნავია, რომ კოლტერს საჯარო კომენტარი ბოლოდროინდელ უსაფრთხოების ინციდენტებთან დაკავშირებით არ გაუკეთებია. თავად OpenAI-ს კი ჯერჯერობით არ უპასუხია TechCrunch-ის მოთხოვნაზე, წარმოედგინა კოლტერის ხედვა კომპანიის უსაფრთხოების მიდგომების შესახებ ამ შემთხვევების ფონზე.
გამოცდილება და ხედვა
პოლ კრისტიანო ერთ-ერთი ავტორია ადამიანის უკუკავშირზე დაფუძნებული განმამტკიცებელი სწავლების (Reinforcement Learning from Human Feedback - RLHF) მეთოდისა. ეს არის საკვანძო ტექნიკა დიდი ენობრივი მოდელების მოსამზადებლად, რომელიც მან სწორედ OpenAI-ში მუშაობისას შეიმუშავა. მან ლაბორატორია 2021 წელს დატოვა და დააფუძნა შესაბამისობის კვლევის ცენტრი (Alignment Research Center), რათა შეესწავლა, თუ როგორ შეიძლება დადგინდეს, წარმოადგენს თუ არა AI მოდელი საფრთხეს მისი შემქმნელებისთვის.
მკვლევარი მიუთითებს, რომ ამჟამად AI აგენტები იწვრთნებიან მაქსიმალური „ჯილდოს“ მისაღებად. მისი თქმით, თეორიულად ყოველთვის არსებობდა იმის ალბათობა, რომ ეს მოდელებს ადამიანის კონტროლის შესუსტებისკენ, ძალაუფლებისა და რესურსების მოპოვებისკენ და საკუთარი კვალის დაფარვისკენ უბიძგებდა. ბოლოდროინდელი ინციდენტები კი მიანიშნებს, რომ ეს უკვე აღარ არის მხოლოდ თეორიული შესაძლებლობა.
კავშირი სამთავრობო სექტორთან
2024 წელს კრისტიანო შეუერთდა აშშ-ის მთავრობის AI უსაფრთხოების ინსტიტუტს, რომელიც მოგვიანებით AI სტანდარტებისა და ინოვაციების ცენტრად გარდაიქმნა. იქ ის მონაწილეობს სამთავრობო ძალისხმევაში, რომელიც მიზნად ისახავს მოწინავე AI მოდელების შეფასებას მათ საჯარო გამოშვებამდე.
OpenAI-ის განცხადებით, კრისტიანო გააგრძელებს მთავრობის კონსულტირებას საბჭოს წევრობის პარალელურად, თუმცა ის ჩამოცილებული იქნება OpenAI-ის იმ საკითხებსა და მოდელების შეფასებებს, რომლებიც შესაძლოა ინტერესთა კონფლიქტს იწვევდეს. მიუხედავად ამისა, ეს ძნელად თუ დააცხრობს საზოგადოებრივ შეშფოთებას AI ინდუსტრიის გავლენის შესახებ პოლიტიკის შემუშავების პროცესზე.
მსგავსი სტატიები

მასაჩუსეტსის შტატი მონაცემთა ცენტრებისთვის სუფთა ენერგიის მკაცრ რეგულაციებს აწესებს
მასაჩუსეტსის შტატი მონაცემთა ცენტრებისთვის ახალ წესებს აწესებს: 25 მეგავატზე მეტი სიმძლავრის ობიექტებმა 100%-ით სუფთა ენერგია უნდა გამოიყენონ ან სპეციალურ ფონდში გადაიხადონ თანხა.

AI სტარტაპმა Listen Labs-მა $1.5-მილიარდიანი დაფინანსება Salesforce-თან შესაძლო გარიგების გამო შეაჩერა
AI სტარტაპმა Listen Labs-მა $1.5-მილიარდიანი დაფინანსების რაუნდი Salesforce-თან შესაძლო გარიგების გამო გააუქმა. კომპანია ახლა $2 მილიარდად შეფასებას ელოდება.

Apple-მა iPhone-ის ფოტოების ავთენტურობის დასადასტურებლად ახალი ტექნოლოგია შექმნა
Apple-მა iPhone 18 Pro-სთვის Apple Reference Image ფუნქცია წარადგინა, რომელიც ფოტოების ავთენტურობას ადასტურებს. სიახლეებს შორისაა ცვლადი დიაფრაგმის მქონე გაუმჯობესებული კამერაც.