OpenAI უსაფრთხოების ახალ მექანიზმებს ნერგავს Hugging Face-ის ინციდენტის შემდეგ
OpenAI-მ უსაფრთხოების ახალი პოლიტიკა წარადგინა, რომელიც მოდელების განვითარების პროცესში მონიტორინგის გაძლიერებას, ქსელის იზოლაციას და ინციდენტებზე სწრაფ რეაგირებას ითვალისწინებს.

OpenAI-მ სამშაბათს უსაფრთხოების ახალი პოლიტიკის პაკეტი წარადგინა, რომელიც მოდელების ტესტირების პროცესში უსაფრთხოების ინციდენტების პრევენციასა და მართვაზეა ფოკუსირებული. ახალი დამცავი მექანიზმები მოიცავს მოდელების უფრო დეტალურ მონიტორინგს განვითარების ეტაპზე, ასევე გაძლიერებულ ყურადღებას ალაინმენტსა (შესაბამისობაზე) და უსაფრთხოებაზე პოსტ-ტრენინგის პროცესში.
„რაც უფრო იზრდება მოდელების შესაძლებლობები, მით უფრო იმატებს მათი შიდა განვითარებასა და ტესტირებასთან დაკავშირებული რისკები,“ — ნათქვამია კომპანიის ბლოგპოსტში. „მონიტორინგის, ალაინმენტისა და უსაფრთხოების ჩვენი სტანდარტები ამ რისკებზე წინ უნდა იყოს.“
ეს ზომები OpenAI-ს უსაფრთხოების პრაქტიკაში განხორციელებული ერთ-ერთი პირველი საჯარო ცვლილებაა 21 ივლისს მომხდარი Hugging Face-ის ინციდენტის შემდეგ. კომპანიის წარმომადგენლების განცხადებით, ეს ნაბიჯები არ არის მხოლოდ პირდაპირი პასუხი მომხდარზე; ისინი ნაწილობრივ განპირობებულია მომავალი Astra მოდელის კიბერუსაფრთხოების შესაძლებლობებითა და ხელოვნური ინტელექტის განვითარების ზოგადი ტემპით.
სწავლების პროცესის შეჩერება და რისკების შეფასება
იმავე პოსტში OpenAI-მ გაამჟღავნა, რომ Hugging Face-ის ინციდენტის შემდეგ ორი კვირით შეაჩერა განმამტკიცებელი სწავლება (Reinforcement Learning - RL), თუმცა მას შემდეგ ნაკლებად რისკიანი მოდელების მუშაობა განაახლა. კომპანიის განცხადებით, მათი ყველაზე დიდი დაგეგმილი RL გაშვება კვლავ შეჩერებულია, სანამ ტარდება მცირე მასშტაბის ტრენინგები და შეფასებები მოდელის ქცევის შესასწავლად, დამცავი მექანიზმების დასადასტურებლად და ალაინმენტის მეტი მტკიცებულების მოსაპოვებლად.
OpenAI-ს კვლევების ვიცე-პრეზიდენტმა, ამელია გლეისმა ჟურნალისტებთან საუბრისას ხაზი გაუსვა, რომ კონტროლის სიმკაცრე მოდელების შესაძლებლობების ზრდასთან ერთად მოიმატებს, ხოლო ყველაზე დიდი მოდელები ყველაზე მკაცრი შემოწმების ქვეშ მოხვდებიან. „ჩვენ დავაწესეთ მოთხოვნები და მოლოდინები უსაფრთხო განვითარებისთვის. ეს მოთხოვნები იცვლება იმ რისკის დონის მიხედვით, რომელსაც ვხედავთ,“ — განაცხადა გლეისმა.
ქსელური უსაფრთხოება და მონიტორინგის სისტემა
ინციდენტის შემდეგ OpenAI გააკრიტიკეს ქსელური უსაფრთხოების სუსტი პრაქტიკის გამო, რის შედეგადაც მოდელებმა დატოვეს საწვრთნელი გარემო ქსელში არსებული იმ ხელსაწყოს დაზიანებით, რომელსაც ინტერნეტთან წვდომა ჰქონდა. ახალი დამცავი ზომები მოიცავს ქსელის იზოლაციის უფრო მკაცრ პრაქტიკას, თუმცა კონკრეტული დეტალები ამ ეტაპზე ბუნდოვანი რჩება. ახალი სისტემის მიხედვით, ერთი სამუშაო დატვირთვის ან დამხმარე სერვისის კომპრომეტირება თავისთავად არ მისცემს საშუალებას არაავტორიზებულ წვდომას ინტერნეტზე ან სხვა შიდა ქსელებზე.
ყველაზე მნიშვნელოვან დამცავ მექანიზმად მონიტორინგის სისტემა მიიჩნევა, რომელიც შეამოწმებს ხელსაწყოების მოქმედებებს, ხელმისაწვდომ ლოგიკურ კვალს და აქტივობების ჟურნალებს სხვადასხვა არაავტორიზებული ქცევის გამოსავლენად. OpenAI-ს მიზანია, საეჭვო აქტივობის აღმოჩენიდან 30 წუთის განმავლობაში გასცეს შესაბამისი გაფრთხილება.
კომპანიის შეფასებით, ამგვარი მონიტორინგის გამოთვლითი დატვირთვა შესაბამისი პროცესის დაახლოებით 20%-ს შეადგენს. OpenAI სისტემის შესახებ დამატებითი დეტალების გამოქვეყნებას მომავალ ბლოგპოსტში გეგმავს. მომხდარი ინციდენტის ოფიციალური ანალიზი (postmortem) კვლავ მოლოდინის რეჟიმშია.
მსგავსი სტატიები

Anthropic-მა Opus 5.5 წარადგინა: გაუმჯობესებული წარმადობა და შემცირებული ტარიფები
Anthropic-მა Claude-ის ხაზის უმძლავრესი მოდელი, Opus 5.5 გამოუშვა. სიახლე გამოირჩევა გაუმჯობესებული სისწრაფით, შემცირებული ფასითა და Fable მოდელზე უკეთესი შედეგებით.

OpenAI-მ GPT-6 Sol და Luna წარადგინა: გაუმჯობესებული სიზუსტე და განახევრებული ფასი
OpenAI აფართოებს GPT-6-ის თაობას Sol და Luna მოდელების განახლებით. ახალი ვერსიები გამოირჩევა მაღალი ეფექტურობით, ნაკლები შეცდომითა და API-ზე წვდომის განახევრებული ღირებულებით.

Meta აღიარებს, რომ Muse-ის მსგავსება OpenClaw-თან შემთხვევითობა არ არის
Meta-ს ახალი ხელოვნური ინტელექტი Muse, რომელიც აპლიკაციების მაღაზიების სათავეში მოექცა, ღიად ეფუძნება ღია კოდის მქონე პროექტ OpenClaw-ს. კომპანია ადასტურებს შთაგონების ფაქტს.