AGI IS NEAR
3 სექტემბერი, 2026

Claude Fable 5.1 – Anthropic-ის ახალი მოდელი

Claude Fable 5.1

Anthropic-მა წარადგინა Claude Fable 5.1 – ახალი მოდელი, რომელსაც კომპანია კოდირებისა და ცოდნაზე დაფუძნებული სამუშაოსთვის საკუთარ ყველაზე ძლიერ მოდელად აცხადებს. მასთან ერთად გამოვიდა Claude Mythos 5.1, რომელიც იმავე მოდელს ეფუძნება, ოღონდ განსხვავებული დაცვის მექანიზმებით.

Fable 5.1 უკვე ხელმისაწვდომია ყველა პლატფორმაზე, Mythos 5.1 კი მხოლოდ სანდო წვდომის პროგრამებით ვრცელდება.

სარჩევი

რას გვთავაზობს Claude Fable 5.1

Anthropic-ის მიხედვით, ახალი მოდელი გამორჩეულია გრძელ, მრავალეტაპიან ამოცანებზე – მაგალითად, ვრცელ მათემატიკურ მტკიცებულებაზე ან ხელშეკრულებაზე, სადაც ასობით ჯვარედინი მიმართებაა.

კომპანია ხაზს უსვამს, რომ Claude Fable 5.1 გვერდით გზებს არ ეძებს და პრობლემის ფესვეულ მიზეზზე მუშაობს, ზედაპირული შესწორების ნაცვლად. ეს განსაკუთრებით ეხება პროგრამულ შეცდომებს, რომლებიც დიდხანს რჩება აღმოუჩენელი.

კონკრეტული მაგალითიც მოჰყავთ: საინვესტიციო კომპანია Millennium-ის ტესტებში მოდელმა იპოვა იშვიათი კრახის მიზეზი მათ შიდა სისტემებში, რომელსაც წლების განმავლობაში ვერც ინჟინრები და ვერც სხვა მოდელები ვერ ხსნიდნენ.

რას აჩვენებს ბენჩმარკები

Anthropic-მა გამოაქვეყნა შედეგები რამდენიმე ტესტზე. აგენტური სამეცნიერო კვლევის ბენჩმარკზე Terminal-Bench-Science 0.1 Fable 5.1-მა 52.6% დააფიქსირა, მაშინ როცა Fable 5-ს 24.7%, Opus 5-ს 29.0%, GPT-5.6 Sol-ს კი 22.4% აქვს.

დანარჩენი მაჩვენებლები ასე გამოიყურება:

  • Terminal-Bench 4.0 (აგენტური კოდირება) – 55.8%, Mythos 5.1-ის შემთხვევაში 60.9%; Fable 5-ს 42.0% ჰქონდა
  • CursorBench 3.2.0 – 73.4%, მაქსიმალურ ძალისხმევაზე
  • Humanity’s Last Exam – 60.9% ინსტრუმენტების გარეშე და 65.0% ინსტრუმენტებით
  • AutomationBench (ბიზნესპროცესები) – 31.4%, Fable 5-ის 17.1%-ის საპირისპიროდ
  • GDPval-AA v2 (ცოდნაზე დაფუძნებული სამუშაო) – 1853 ქულა

ტესტები ჩატარდა ჩართული საწარმოო დაცვის მექანიზმებით, რაც, კომპანიის თქმით, ზოგიერთ დავალებაზე შედეგს ამცირებს.

სამეცნიერო კვლევა: ცილები, ვენერა და GPU-ები

განცხადების ერთ-ერთი ყველაზე საინტერესო ნაწილი სამეცნიერო ექსპერიმენტებს ეხება. Anthropic-ის შეფასებით, ეს ადრეული ნიშანია იმისა, თუ როგორ შეიძლება მოდელებმა აღმოჩენებში წვლილი შეიტანონ.

ცილოვანი დიზაინი

Mythos 5.1-ს ღია კოდის ცილების დიზაინისა და დაკეცვის ინსტრუმენტებზე მისცეს წვდომა, შედეგები კი ორმა გარე ორგანიზაციამ ლაბორატორიულად შეამოწმა. სამ სამიზნეზე მიღებულმა შემკვრელებმა Adaptyv Bio-ს კონკურსების საუკეთესო ნამუშევრებზე 10-ჯერ მაღალი აფინურობა აჩვენეს.

12 სამიზნეზე წარმატებული დიზაინების წილი 50%-ს მიუახლოვდა. შედარებისთვის, დარგში დღეს 10-15% ჩვეულებრივ მაჩვენებლად ითვლება.

ვენერას ახალი რუკა

Fable 5.1-მა გაწვრთნა ნეირონული ქსელი და შექმნა ვენერას ზედაპირის მესამედის მაღალი გარჩევადობის სიმაღლეთა რუკა. სამუშაო ეყრდნობა NASA-ს Magellan-ის მისიის რადარულ სურათებს, რომლებიც 30 წელზე მეტის წინაა გადაღებული.

ახალი რუკა დეტალებს 2-3 კილომეტრის და არა 10-20 კილომეტრის დონეზე აჩვენებს, სიმაღლეებს კი 25%-მდე უფრო ზუსტად. Anthropic-მა ის Creative Commons ლიცენზიით გამოაქვეყნა, NASA VERITAS-ისა და ESA EnVision-ის მომავალი მისიების წინ.

გამოთვლითი ბიოლოგია

Mythos 5.1-მა დაწერა GPU-ს კერნელები და შუალედური შედეგების ქეშირება დაამატა, რითაც შვიდი ღია კოდის მოდელი 2.5-ჯერ დააჩქარა იდენტური შედეგების შენარჩუნებით. გენომის მასშტაბის ანალიზებზე ამან სავარაუდო GPU-ხარჯები 30-60%-ით შეამცირა.

კომპანიის თქმით, ასეთი ოპტიმიზაცია ჩვეულებრივ ინჟინრების გუნდს კვირებს ართმევს, Mythos 5.1-მა კი დღეებში, მხოლოდ საჯაროდ ხელმისაწვდომი კოდის საფუძველზე გააკეთა.

დაცვის მექანიზმები უფრო ზუსტი გახდა

ერთ-ერთი პრაქტიკული ცვლილება ცრუ გაფრთხილებებს ეხება. კიბერუსაფრთხოებაში Claude Code-ის მომხმარებლებმა სესიაზე დაახლოებით 60%-ით ნაკლები ჩარევა უნდა ნახონ, ვიდრე Fable 5-ის დროს.

Fable 5.1-ს უკვე შეუძლია პროგრამული დაუცველობების აღმოჩენა, თუმცა არა მათთვის ექსპლოიტების შექმნა. შეღწევადობის ტესტირება, ექსპლოიტების გენერაცია და ბინარული სკანირება კვლავ Opus მოდელებზე გადამისამართდება.

ბიოლოგიაში ახალი დაცვები 85%-ით ნაკლებად ირთვება ელემენტარულ ბიოლოგიურ და სამედიცინო კითხვებზე. სიცოცხლის შემსწავლელ მეცნიერებებში კვლევასთან დაკავშირებული მოთხოვნები კი Opus მოდელებს გადაეცემა. სრული დეტალები System Card-შია.

ცალკე იხსნება Enterprise Frontier Safeguards – სისტემა, სადაც კორპორაციული მომხმარებლის მონაცემები მის საკუთარ ღრუბლოვან ინფრასტრუქტურაში ინახება და არა Anthropic-თან. გაშვება ეტაპობრივად, ამ შემოდგომიდან დაიწყება.

ფასი და ხელმისაწვდომობა

Claude Fable 5.1 დღეიდან ხელმისაწვდომია ყველა პლატფორმაზე, მათ შორის Amazon Web Services-ზე, Google Cloud-სა და Microsoft Azure-ზე. დეველოპერებისთვის მოდელის იდენტიფიკატორია claude-fable-5-1 Claude API-ზე.

ქეშიდან წაკითხვის ფასი 75%-ით შემცირდა და მილიონ ტოკენზე $0.25 შეადგენს. ტიპური დატვირთვისთვის ეს საერთო ხარჯს დაახლოებით 25%-ით ამცირებს, ინტენსიურად აგენტური ამოცანებისთვის კი 45%-მდე.

დანარჩენი ტარიფი უცვლელია: $10 მილიონ შემავალ ტოკენზე და $50 მილიონ გამომავალზე.

ჯერჯერობით Mythos 5.1 მხოლოდ აშშ-ის ორგანიზაციათა შეზღუდულ წრეს აქვს, კიბერდაცვისა და სიცოცხლის მეცნიერებების პროგრამების ფარგლებში.

რას ნიშნავს ეს პრაქტიკაში

Claude Fable 5.1-ის მთავარი აქცენტი სიჩქარეზე ან ერთჯერად პასუხებზე არაა – საუბარია გრძელ, უზედამხედველო სამუშაოზე და პრობლემის რეალურ მიზეზამდე მისვლაზე. ბენჩმარკებში ყველაზე დიდი წინსვლა სწორედ აგენტურ და კვლევით ამოცანებზეა.

დანარჩენს პრაქტიკა აჩვენებს. მოდელის გამოცდა უკვე შესაძლებელია Claude-ში, სადაც ის ნაგულისხმევად საშუალო ძალისხმევის რეჟიმში მუშაობს, Claude Code-ში კი მაღალზე.

AI გზამკვლევი რა არის ხელოვნური ინტელექტი? სრული გზამკვლევი: როგორ მუშაობს AI, რა არის LLM და რას ნიშნავს AGI - მარტივ ქართულში.

LLM.GE - გზამკვლევი ხელოვნურ ინტელექტში

LLM.GE არის ქართულ-ენოვანი პლატფორმა, რომელზეც ყოველდღიურად ქვეყნდება AI და ტექნოლოგიების სიახლეები, ახალი მოდელების, კვლევებისა და პრაქტიკული ინსტრუმენტების შესახებ. საიტის მიზანია, მკითხველმა ერთ სივრცეში მიიღოს ზუსტი, გასაგები და დროული ინფორმაცია ტექნოლოგიური ინდუსტრიის მთავარი მოვლენების შესახებ

გამოიწერე სიახლეები

გამოწერის გაუქმება ნებისმიერ დროს შეგიძლიათ Privacy Policy

×