კომპანია ანთროფიკი (Anthropic) აქვეყნებს ანგარიშს, რომლის მიხედვითაც ხელოვნური ინტელექტი უკვე აჩქარებს თავად ხელოვნური ინტელექტის განვითარებას. ანთროპიკის შიდა მონაცემები მიუთითებს შესაძლო გზაზე, რომელსაც რეკურსიული თვითგაუმჯობესება ჰქვია – ანუ სიტუაცია, როცა AI სისტემა დამოუკიდებლად აპროექტებს და ქმნის თავის უფრო ძლიერ „მემკვიდრეს“.
ანგარიშის ავტორების თქმით, ეს იმაზე სწრაფად ხდება, ვიდრე ისინი ვარაუდობდნენ, და თემა მეტ ყურადღებას იმსახურებს. დოკუმენტი The Anthropic Institute-მა მოამზადა; ის ეფუძნება როგორც საჯარო ბენჩმარკებს, ისე ანთროფიკის შიგნიდან მოპოვებულ, აქამდე გამოუქვეყნებელ მონაცემებს.
რას აცხადებს ანთროფიკი
ანთროფიკი აღნიშნავს, რომ AI-ის ისტორიის უმეტესი ნაწილის განმავლობაში ადამიანები მართავდნენ განვითარების ყველა ეტაპს. ახლა კი კომპანია სამუშაოს მზარდ ნაწილს თავად AI სისტემებს ანდობს, რაც პროცესს აჩქარებს.
მაგალითად, კომპანიის ცნობით, დღეს ანთროპიკის ინჟინრები საშუალოდ 8-ჯერ მეტ კოდს უშვებენ კვარტალში, ვიდრე 2021-2025 წლებში უშვებდნენ. ეს მაჩვენებელი იმაზე მიუთითებს, რომ AI ხელსაწყოები მუშაობის ტემპს მნიშვნელოვნად ცვლის.
თუმცა ანთროფიკი ცალსახად აზუსტებს: რეკურსიულ თვითგაუმჯობესებამდე საბოლოოდ ჯერ არ მისულან და ეს პროცესი გარდაუვალი არ არის. ამავდროულად, კომპანიის თქმით, ეს შესაძლოა მოხდეს უფრო ადრე, ვიდრე ადამიანთა უმრავლესობა ელოდება.
რას ამბობს ანთროფიკი მტკიცებულებებზე
კომპანია ორ სახის მტკიცებულებას გამოყოფს. პირველი – გარე სამყაროდან, ანუ საჯარო ბენჩმარკები; მეორე – ანთროფიკის შიგნიდან.
გარე მონაცემებზე საუბრისას მითითებულია, რომ ამოცანების ხანგრძლივობა, რომელსაც მოდელები საიმედოდ ართმევენ თავს, ორმაგდება დაახლოებით ყოველ ოთხ თვეში – უფრო ადრინდელი ყოველ შვიდთვიანი ტემპის ნაცვლად. ეს დაკვირვება METR-ს ეკუთვნის.
კონკრეტული მაგალითიც მოჰყავთ: 2024 წლის მარტში Claude Opus 3 ასრულებდა პროგრამული ამოცანებს, რომელსაც ადამიანი დაახლოებით ოთხ წუთში გააკეთებდა. ერთი წლის შემდეგ Claude Sonnet 3.7 ართმევდა თავს დაახლოებით ერთსახევარსაათიან ამოცანებს, კიდევ ერთი წლის შემდეგ კი Claude Opus 4.6 – 12-საათიან დავალებებს.
იგივე სურათია სამუშაო ბენჩმარკებზე. SWE-bench-ზე, რომელიც რეალურ პროგრამული ინჟინერიის ამოცანებს ამოწმებს, მოდელები ორ წელიწადში დაბალი ერთნიშნა მაჩვენებლებიდან ბენჩმარკის “გაჯერებამდე” მივიდნენ.
მტკიცებულებები ანთროფიკის შიგნიდან
კომპანიის ცნობით, 2026 წლის მაისის მდგომარეობით, ანთროფიკის კოდის ბაზაში ჩამერგებული კოდის 80%-ზე მეტი კლოდის ავტორობით იწერებოდა. Claude Code-ის research preview-მდე, 2025 წლის თებერვალამდე, ეს ციფრი დაბალ ერთნიშნა მაჩვენებელში იყო.
კიდევ ერთი მაგალითი: 2026 წლის აპრილში Claude-მა 800-ზე მეტი შესწორება შეიტანა, რამაც API შეცდომების ერთი კატეგორია ათასჯერ შეამცირა. ამ სამუშაოს ზედამხედველი ინჟინრის შეფასებით, ადამიანს იგივეს გასაკეთებლად ოთხი წელი დასჭირდებოდა.
ღია, არასპეციფიცირებულ ამოცანებზე Claude-ის წარმატების მაჩვენებელმა 2026 წლის მაისში 76%-ს მიაღწია – ექვს თვეში 50 პროცენტული პუნქტით მეტი.
რას ნიშნავს ეს
ანთროფიკი ხაზს უსვამს, რომ ადამიანის როლი განვითარების ყველა ეტაპზე ვიწროვდება. კოდის წერა და ექსპერიმენტების ჩატარება სულ უფრო იაფი ხდება ადამიანის დროში, თუმცა გამოთვლით რესურსში ფასი რჩება.
ექსპერიმენტების ოპტიმიზაციაში ცვლილება განსაკუთრებით თვალსაჩინოა. 2025 წლის მაისში Claude Opus 4 საშუალოდ დაახლოებით 3-ჯერ აჩქარებდა საწყის კოდს, 2026 წლის აპრილში კი Claude Mythos Preview – დაახლოებით 52-ჯერ. შესადარებლად, გამოცდილ ადამიან მკვლევარს იმავე ამოცანაზე 4-ჯერ აჩქარებისთვის ოთხიდან რვა საათი დასჭირდებოდა.
კვლევით ნაწილშიც არის წინსვლა. 2026 წლის აპრილში ანთროფიკმა აჩვენა Claude-ის მიერ ღია კვლევითი პროექტის თავიდან ბოლომდე წარმართვის პირველი მაგალითი. ორმა ადამიანმა მკვლევარმა დაახლოებით ერთ კვირაში სხვაობის დაახლოებით 23% აღადგინა, AI აგენტებმა კი 97% – 800 კუმულაციური საათისა და დაახლოებით 18,000 დოლარის გამოთვლითი რესურსის ხარჯზე.
ამავდროულად, კომპანია ღიად საუბრობს შეზღუდვებზე. კოდის ხაზების რაოდენობა ხარისხს კი არა, რაოდენობას ზომავს, ამიტომ 8-ჯერ მეტი კოდი ნამდვილი პროდუქტიულობის ზრდას აჭარბებს. გარდა ამისა, კვლევითი “გემოვნება” – იმის გადაწყვეტა, რომელი პრობლემაა ღირებული – ჯერ კიდევ ადამიანის შედარებითი უპირატესობაა.
შესაძლო მომავალი
ანთროფიკი სამ შესაძლო სცენარს გამოყოფს: ტენდენცია შეჩერდება, მაგრამ დღევანდელი შესაძლებლობები ფართოდ გავრცელდება; AI ლაბორატორიები განაგრძობენ ეფექტიანობის მზარდ ზრდას ადამიანის ზედამხედველობით; ან AI სისტემები სრულ რეკურსიულ თვითგაუმჯობესებას მიაღწევენ და დაიწყებენ საკუთარი მემკვიდრეების შექმნას.
ცალკე მაგალითად მოხსენიებულია
Project Glasswing: კომპანიის ცნობით, პირველ კვირებში Mythos Preview-მ მსოფლიოს უმნიშვნელოვანეს სისტემებში 10,000-ზე მეტი მაღალი და კრიტიკული სიმძიმის პროგრამული დაუცველობა აღმოაჩინა.
დასკვნა
ანთროფიკის მთავარი გზავნილი ისაა, რომ ეს ტექნოლოგიური ტრენდი მნიშვნელოვან შედეგებს ჰპირდება მსოფლიოს – როგორც დადებითს მეცნიერებასა და ჯანდაცვაში, ისე რისკებს, თუ ადამიანები AI სისტემებზე კონტროლს დაკარგავენ.
კომპანია წერს, რომ თუ შესაძლებელი იქნებოდა ფრონტიერული AI-ის განვითარების შენელება მეტი დროის მოსაპოვებლად, ეს კარგი იქნებოდა – მაგრამ ცალმხრივი შენელება მხოლოდ ნაკლებად ფრთხილ მოთამაშეებს შეუწყობდა ხელს. ამიტომ The Anthropic Institute აპირებს კვლევის ჩატარებას და უახლოეს თვეებში პოლიტიკოსების, მკვლევრების, სამოქალაქო სექტორისა და სხვა კომპანიების მონაწილეობით დისკუსიების ორგანიზებას.
დასკვნა მარტივია: AI-ის მიერ საკუთარი მემკვიდრის შექმნა ჯერ რეალობა არ არის, მაგრამ ის ტენდენცია, რომ ხელოვნური ინტელექტი აჩქარებს საკუთარ განვითარებას, უკვე იკვეთება – და მისი განხილვა, ანთროფიკის თქმით, ახლა უნდა დაიწყოს.
სხვა თემები
კოლექტიური კიბერთავდაცვა: OpenAI-ის ღია წერილი
Model Hardware Standard – Anthropic-ის ახალი სტანდარტი
Claude მეცნიერებისთვის: უფასო გეგმა 10 000 მკვლევარს
