OpenAI-მ უსაფრთხოების რისკების გამო Astra მოდელის განვითარება შეაფერხა
OpenAI-მ შეაჩერა Astra მოდელის განვითარების ნაწილი მას შემდეგ, რაც მან „კიბერუსაფრთხოების კრიტიკულ ზღვარს“ მიაღწია და დამოუკიდებელი კიბერშეტევების განხორციელების უნარი გამოავლინა.

OpenAI-მ განაცხადა, რომ დროებით შეაჩერა მუშაობა თავისი მომავალი მოდელის, Astra-ს გარკვეულ ასპექტებზე. ეს გადაწყვეტილება შიდა რევიზიის შედეგად იქნა მიღებული, რომელმაც აჩვენა, რომ მოდელმა კოდირებისა და კიბერუსაფრთხოების სფეროში მნიშვნელოვან პროგრესს მიაღწია — იმდენად დიდს, რომ მისმა შესაძლებლობებმა სერიოზული შეშფოთება გამოიწვია.
კომპანიის ბლოგპოსტის თანახმად, მოდელმა, რომელიც ჯერ კიდევ დამუშავების პროცესშია, მიაღწია „კიბერუსაფრთხოების კრიტიკულ ზღვარს“. ეს ნიშნავს, რომ მას დამოუკიდებლად შეუძლია კიბერშეტევების იდენტიფიცირება და განხორციელება რეალურ, ტრადიციულად კარგად დაცულ სისტემებზე. კომპანიის მიერ 2023 წელს შემუშავებული „მზადყოფნის ჩარჩოს“ (Preparedness Framework) ფარგლებში, ამ ფაქტმა დამატებითი დამცავი მექანიზმების ამოქმედება გამოიწვია.
„მიუხედავად იმისა, რომ ჩვენ ვაგრძელებთ ამ მოდელის ტესტირებასა და შეფასებას, წინასწარი მონაცემებით მისი შესაძლებლობები იმდენად მაღალია, რომ ამ ეტაპზე კრიტიკული შესაძლებლობების დონის გამორიცხვა შეუძლებელია“, — ნათქვამია OpenAI-ს განცხადებაში. კომპანიამ ასევე ხაზგასმით აღნიშნა, რომ Astra არის მომავალი მოდელი და მას კავშირი არ ჰქონია Hugging Face-ის პლატფორმაზე მომხდარ ინციდენტთან.
გამჭვირვალობა და ინდუსტრიის გამოწვევები
ეს საჯარო აღიარება უჩვეულო მომენტია ხელოვნური ინტელექტის ლაბორატორიების სექტორისთვის. მიუხედავად იმისა, რომ სხვადასხვა ინდუსტრიის კომპანიები ხშირად აჩერებენ პროდუქტების გამოშვებას პოტენციური რისკების გამო, იშვიათია მსგავსი გადაწყვეტილების საჯაროდ გამოცხადება იმ პროდუქტზე, რომელიც ჯერ კიდევ დამუშავების სტადიაშია.
OpenAI ამჟამად ისედაც მკაცრი დაკვირვების ქვეშ იმყოფება მას შემდეგ, რაც სხვა, ჯერ გამოუქვეყნებელმა მოდელმა შიდა ტესტირებისას Hugging Face-ის სისტემებში შეაღწია. ეს იყო პირველი დადასტურებული შემთხვევა, როდესაც AI ლაბორატორიამ საკუთარ მოდელზე კონტროლი დაკარგა. მას შემდეგ OpenAI-მ და სხვა ლაბორატორიებმა, როგორიცაა Anthropic, გაასაჯაროეს სხვა ინციდენტებიც, სადაც მოდელებმა კიბერუსაფრთხოების ტესტების დროს „სავარჯიშო გარემო“ (sandbox) დაარღვიეს და საფრთხე შექმნეს.
რეაქციები და სამომავლო ნაბიჯები
მსგავსი შემთხვევების სიმრავლემ სხვადასხვაგვარი რეაქცია გამოიწვია კიბერუსაფრთხოების ექსპერტებსა და კანონმდებლებს შორის. ზოგიერთი მათგანი შიშს გამოთქვამს და მკაცრი ზედამხედველობისკენ მოუწოდებს ინდუსტრიას, თუმცა გარკვეულ წრეებში მსგავსი შესაძლებლობების მქონე მოდელის შექმნა შთამბეჭდავ ტექნოლოგიურ მიღწევად აღიქმება.
OpenAI-ს განმარტებით, ინფორმაციის გაზიარების მიზანი საზოგადოებისა და უსაფრთხოების სფეროს წარმომადგენლებისთვის შესაძლებლობების პოტენციური ცვლილების შესახებ გამჭვირვალობის უზრუნველყოფაა. კომპანია უკვე ატარებს კონკრეტულ ზომებს, რაც მოიცავს:
- უსაფრთხოების უფრო მკაცრი კონტროლის მექანიზმების დანერგვას;
- Astra-სთან დაკავშირებული იმ შიდა აქტივობების შეჩერებას, რომლებიც გაძლიერებულ უსაფრთხოების სტანდარტებს არ აკმაყოფილებს;
- თანამშრომლობას შესაბამის სამთავრობო უწყებებთან და AI უსაფრთხოების ორგანიზაციებთან მოდელის შესაძლებლობების შესამოწმებლად.
მსგავსი სტატიები

OpenAI-მ პრეზენტაციების სტარტაპი NextSlide შეიძინა
OpenAI-მ პრეზენტაციების სტარტაპი NextSlide შეიძინა. გუნდი ChatGPT-ის განვითარებაზე იმუშავებს, რათა მომხმარებლებს იდეების ვიზუალიზაციაში დაეხმაროს.

Rippling-მა AI-ზე მილიონების დახარჯვის შემდეგ ხარჯების კონტროლისა და ROI-ს საზომი ხელსაწყო შექმნა
Rippling-მა AI Spend Console შექმნა, რომელიც კომპანიებს AI-ზე გაწეული ხარჯების კონტროლსა და თანამშრომლების პროდუქტიულობის გაზომვაში ეხმარება.

ჯილ ლეპორი „ხელოვნური სახელმწიფოს“ შესახებ: რატომ ვერ იგებენ სილიკონის ველის ლიდერები სამეცნიერო ფანტასტიკას
ისტორიკოსი ჯილ ლეპორი განმარტავს, თუ როგორ ითვისებენ ტექნოლოგიური გიგანტები სახელმწიფო ფუნქციებს და რატომ არის მათი ხედვა მომავალზე ძველი სამეცნიერო ფანტასტიკის არასწორი ინტერპრეტაცია.