Anthropic-მა Opus 5.5 წარადგინა: გაუმჯობესებული წარმადობა და შემცირებული ტარიფები
Anthropic-მა Claude-ის ხაზის უმძლავრესი მოდელი, Opus 5.5 გამოუშვა. სიახლე გამოირჩევა გაუმჯობესებული სისწრაფით, შემცირებული ფასითა და Fable მოდელზე უკეთესი შედეგებით.

Anthropic-მა სამშაბათს თავისი უახლესი მოდელი, Opus 5.5 გამოუშვა. კომპანიის განცხადებით, ახალი მოდელი კოდირებისა და ინტელექტუალური სამუშაოს შესრულების კუთხით ახალ სტანდარტებს ამკვიდრებს. Opus წარმოადგენს Anthropic-ის Claude-ის ხაზის ყველაზე მძლავრ და პრემიუმ კლასის მოდელს, სადაც Sonnet საშუალო რანგის, ხოლო Haiku ყველაზე სწრაფი და ბიუჯეტური ვარიანტია.
აღსანიშნავია, რომ Anthropic-ის განცხადებით, Opus 5.5 მრავალ ტესტში (benchmarks) აჯობებს უფრო დიდ Fable მოდელს და წარმატებით ართმევს თავს იმ არაფორმალურ დავალებებს, რომლებზეც Fable-მა სასურველი შედეგის ჩვენება ვერ შეძლო. ახალი ვერსია წინამორბედზე მნიშვნელოვნად იაფიცაა: გამავალი ტოკენების (output tokens) ღირებულება მილიონზე 20 დოლარს შეადგენს, ნაცვლად ძველი მოდელის 25 დოლარისა. ფასების მსგავსი კლება სხვა მეტრიკებზეც აისახა.
ახალი მოდელი უფრო სწრაფად მუშაობს, რაც მიუთითებს მისი ფუნქციონირებისთვის საჭირო გამოთვლითი რესურსების საერთო შემცირებაზე. გარდა ამისა, მნიშვნელოვანი ცვლილებები შევიდა კომუნიკაციის სტილშიც: Opus 5.5 ნაკლებად იყენებს პროფესიულ ჟარგონებს და პრიორიტეტს ანიჭებს მნიშვნელოვანი ინფორმაციის შეტყობინების დასაწყისში განთავსებას. ეს სიახლე Opus 5-ის 24 ივლისს გამოშვებიდან სულ რაღაც ორ თვეში დაინერგა.
მომავალი გეგმები და უსაფრთხოების სტანდარტები
ოფიციალური განცხადების თანახმად, უახლოეს კვირებში იგეგმება Sonnet 5.5-ისა და Haiku 5.5-ის გამოშვებაც, რომლებიც მსგავსი ტიპის გაუმჯობესებულ წარმადობას შესთავაზებენ მომხმარებლებს. Anthropic-ის განმარტებით, Opus 5.5 ბიოლოგიისა და კიბერუსაფრთხოების შესაძლებლობებით Mythos-ს უტოლდება, რის გამოც მასზე იგივე დამცავი მექანიზმები ვრცელდება, რაც კომპანიის Fable მოდელზე.
აღნიშნული უსაფრთხოების ზომები ზღუდავს მოდელის გამოყენებას ისეთი მიზნებისთვის, როგორიცაა კომპილირებულ პროგრამებში ხარვეზების (exploits) ძიება ან ბიოლოგიური იარაღის შექმნა. Opus 5.5 არის Anthropic-ის პირველი რელიზი მას შემდეგ, რაც აღმასრულებელმა დირექტორმა, დარიო ამოდეიმ, „პროგრესის ტემპის დარეგულირების“ (pacing the frontier) სტრატეგია აირჩია. ეს გულისხმობს ხელოვნური ინტელექტის შესაძლებლობების განვითარების შეგნებულ შენელებას, რათა ის შესაბამისობაში მოვიდეს უსაფრთხოების (alignment) სტანდარტებთან.
„დავრწმუნდი, რომ რისკების სრულფასოვანი მართვა კიდევ უფრო მეტ წინდახედულობას მოითხოვს. ეს არ გულისხმობს მხოლოდ ინვესტირებას რისკების პრევენციაში, არამედ შესაძლებლობების განვითარების ტემპის ისეთ დარეგულირებას, რომ უსაფრთხოების სისტემებმა მას ფეხი აუწყოს“, — აღნიშნა ამოდეიმ მიმდინარე თვის დასაწყისში გამოქვეყნებულ პოსტში.
ტესტირება და საჯარო პოლიტიკა
Opus 5.5-ის უსაფრთხოების ტესტირება მისი წინამორბედების მსგავსად წარიმართა, რაც მოიცავდა გარე ორგანიზაციების, მათ შორის METR-ისა და Frontier Design-ის მიერ ჩატარებულ შეფასებებს. თუმცა, Anthropic ხაზს უსვამს, რომ მომავალი მოდელებისთვის უკვე მზადდება უფრო დახვეწილი მომზადებისა და შეფასების სისტემები, მათ შორის გაუმჯობესებული უსაფრთხოებისა და მონიტორინგის მექანიზმები.
კომპანიის ბლოგპოსტში ნათქვამია, რომ ხელოვნური ინტელექტის შესაძლებლობების ზრდასთან ერთად, საჯარო პოლიტიკამ უფრო დიდი როლი უნდა შეასრულოს იმ სისტემების უსაფრთხოების უზრუნველყოფაში, რომლებსაც ადამიანები ენდობიან. Anthropic-მა უკვე დაიწყო შესაბამისი ინფრასტრუქტურის მომზადება და ამ მიმართულებით დამატებითი დეტალების გაზიარებას უახლოეს მომავალში გეგმავს.
მსგავსი სტატიები

OpenAI-მ GPT-6 Sol და Luna წარადგინა: გაუმჯობესებული სიზუსტე და განახევრებული ფასი
OpenAI აფართოებს GPT-6-ის თაობას Sol და Luna მოდელების განახლებით. ახალი ვერსიები გამოირჩევა მაღალი ეფექტურობით, ნაკლები შეცდომითა და API-ზე წვდომის განახევრებული ღირებულებით.

Meta აღიარებს, რომ Muse-ის მსგავსება OpenClaw-თან შემთხვევითობა არ არის
Meta-ს ახალი ხელოვნური ინტელექტი Muse, რომელიც აპლიკაციების მაღაზიების სათავეში მოექცა, ღიად ეფუძნება ღია კოდის მქონე პროექტ OpenClaw-ს. კომპანია ადასტურებს შთაგონების ფაქტს.

OpenAI მათემატიკოსთა საკონსულტაციო ჯგუფს ქმნის: AI-მ 100-ზე მეტი რთული ამოცანა ამოხსნა
OpenAI-მ მათემატიკოსთა საკონსულტაციო ჯგუფი შექმნა, რათა მეცნიერებს მეტი გავლენა ჰქონდეთ AI კვლევებზე, მას შემდეგ რაც კომპანიამ 100-ზე მეტი რთული ამოცანის ამოხსნის შესახებ განაცხადა.