Anthropic-მა Fable-ის ახალი ვერსია წარადგინა: მოდელი უფრო იაფი და ნაკლებად შეზღუდულია
Anthropic-მა Fable და Mythos 5.1 წარადგინა. ახალი მოდელები უფრო იაფია, აქვთ მონაცემთა შენახვაზე უარის თქმის ფუნქცია და გაუმჯობესებული წარმადობა ბენჩმარკებში.

სამშაბათს კომპანია Anthropic-მა თავისი ყველაზე მოწინავე ხელოვნური ინტელექტის მოდელის ტყუპი ვერსიები — Fable და Mythos 5.1 გამოუშვა. განახლებული Fable არა მხოლოდ გაუმჯობესებული წარმადობით გამოირჩევა, არამედ მოიცავს ცვლილებებს, რომლებიც მიზნად ისახავს ტოკენების ღირებულების შემცირებასა და უსაფრთხოების მექანიზმებით გამოწვეული ცრუ-პოზიტიური შეზღუდვების შემცირებას.
ერთ-ერთი ყველაზე მნიშვნელოვანი სიახლე Anthropic-ის მიერ მონაცემთა შენახვაზე უარის თქმის (Zero Data Retention) პოლიტიკის მხარდაჭერაა. ეს ფუნქცია კლიენტებს საშუალებას აძლევს, Anthropic-ის მოდელები საკუთარ ინფრასტრუქტურაზე ისე გამოიყენონ, რომ მონაცემთა გარე გადინების საფრთხე გამოირიცხოს. მაღალი კონფიდენციალურობის სერვისი, სახელწოდებით Enterprise Frontier Safeguards, რომელიც აქამდე Fable-ისთვის უსაფრთხოების რისკების გამო მიუწვდომელი იყო, მომხმარებლებისთვის ივნისიდან გახდება ხელმისაწვდომი.
აღსანიშნავია, რომ სისტემა კვლავ გააგრძელებს აგენტების ან ადამიანების მიერ მოდელის ბოროტად გამოყენების მონიტორინგს, თუმცა კლიენტები თავად გააკონტროლებენ, თუ როგორ განხორციელდება ეს პროცესი. განცხადების ფარგლებში Anthropic-მა მომხმარებლები დაარწმუნა, რომ მათ მონაცემებზე არასათანადო წვდომა არ მომხდარა. „Anthropic-ს არასდროს გამოუყენებია კორპორატიული მონაცემები მოდელების დასატრენინგებლად ექსპლიციტური ნებართვის გარეშე და არც მომავალში აპირებს ამას“, — ნათქვამია ოფიციალურ განცხადებაში.
რეკორდული მაჩვენებლები და სამეცნიერო მიღწევები
Anthropic-ის სხვა გამოშვებების მსგავსად, ახალმა მოდელებმა რეკორდები დაამყარეს სხვადასხვა ბენჩმარკებში, მათ შორის Terminal-Bench 4.0-ში (CLI-ზე დაფუძნებული კოდირებისთვის) და Humanity’s Last Exam-ში (ზოგადი ლოგიკური მსჯელობისთვის). გარდა ამისა, Anthropic-მა გამოაქვეყნა სამი ახალი სამეცნიერო მიგნება, რომლებიც მოდელებმა მათ ოფიციალურ გამოშვებამდე დააგენერირეს. მათ შორისაა GPU-ს ოპტიმიზაციის მეთოდი და ვენერას მაღალი რეზოლუციის რუკა, რომელიც არსებული ფოტოებისგან შეიქმნა.
უსაფრთხოება და რისკების შეფასება
როგორც წინა შემთხვევებში, მოდელებს ახლავს დეტალური სისტემური ბარათი (system card), სადაც მათი შესაძლებლობები მარტივი ენით არის განმარტებული. დოკუმენტში Mythos შეფასებულია როგორც „დაბალი რისკის“ მქონე მოდელი ხელოვნური ინტელექტის ავტომატიზებულ განვითარებასთან დაკავშირებით — პროცესი, როდესაც AI საკუთარ თავს აუმჯობესებს, რაც ზოგიერთი ექსპერტის აზრით, ადამიანის მხრიდან კონტროლის დაკარგვის საფრთხეს შეიცავს. სისტემურ ბარათში აღნიშნულია, რომ მოდელის უნარი, დააჩქაროს შიდა კვლევები და განვითარება, სრულ შესაბამისობაშია მიმდინარე ტენდენციებთან.
ზოგადი ქცევის თვალსაზრისით, Mythos ოდნავ უფრო მეტადაა მიდრეკილი არასათანადო ქცევისკენ, ვიდრე Opus, რაც შესაძლოა მისი გაზრდილი შესაძლებლობების შედეგი იყოს. „Mythos 5.1-ს ახასიათებს მცირე რეგრესი საერთო ქცევის კუთხით Opus 5-თან შედარებით, თუმცა ის გაუმჯობესებულია Mythos 5-სა და Claude Sonnet 5-თან მიმართებით“, — ნათქვამია დოკუმენტში. მოდელი უფრო ადვილად თანამშრომლობს მომხმარებლებთან ბოროტად გამოყენების მცდელობისას და უფრო მარტივად იღებს გადაუმოწმებელ ავტორიზაციებს, ვიდრე Opus 5, თუმცა წინა მოდელებთან შედარებით ნაკლებად სავარაუდოა, რომ უგულებელყოს მკაფიო შეზღუდვები, ჰქონდეს ჰალუცინაციები ან ტყუილად განაცხადოს დავალების შესრულების შესახებ.
მსგავსი სტატიები

OpenAI-მ ChatGPT Health-ი Epic-ის სისტემასთან დააკავშირა: რას ნიშნავს ეს ექიმებისთვის?
OpenAI-მ ChatGPT Health-ი Epic-ის სისტემასთან დააკავშირა, რაც ექიმებს 325 მილიონზე მეტი პაციენტის მონაცემებზე წვდომასა და მათ AI-ით დამუშავების საშუალებას აძლევს.

Google-ის პასუხი Canva-ს: ხელოვნური ინტელექტის ახალი ხელსაწყო, რომელიც დიზაინს ტექსტური მითითებებით ქმნის
Google-მა წარადგინა ახალი AI ხელსაწყო Google Pics, რომელიც მომხმარებლებს საშუალებას აძლევს, ტექსტური მითითებებით შექმნან დიზაინი პირდაპირ Google Workspace-ში.

პენტაგონმა ChatGPT-ისა და Grok-ის სპეციალური სამხედრო ვერსიები აამოქმედა
პენტაგონმა 3 მილიონი თანამშრომლისთვის ChatGPT-ისა და Grok-ის სპეციალური სამხედრო ვერსიები აამოქმედა, რომლებიც უსაფრთხოების მაღალი სტანდარტებითა და მონაცემთა დაცვით გამოირჩევა.