AGI IS NEAR
12 აგვისტო, 2026

Grok 4.6 – SpaceXAI-მ ახალი მოდელი წარადგინა

Grok 4.6

SpaceXAI-მ ხელოვნური ინტელექტის ახალი მოდელი Grok 4.6 წარადგინა. ახალ მოდელში განსაკუთრებული ყურადღება ეთმობა ხანგრძლივად მომუშავე AI აგენტებს, მრავალსაფეხურიან დავალებებს, პროგრამირებას და უფრო კომპლექსურ ინტერაქტიულ თუ ვიზუალურ სამუშაოებს.

SpaceXAI-ის თანახმად, Grok 4.6 რამდენიმე AI აგენტებისა და ცოდნაზე დაფუძნებული სამუშაოს ბენჩმარკზე მოწინავე შედეგებს აჩვენებს. ამასთან, ახალი მოდელის საბაზისო ფასი Grok 4.5-ის დონეზე რჩება.

სარჩევი

რა შეიცვალა Grok 4.6-ში

Grok 4.6 შექმნილია ისეთი კომპლექსური ამოცანებისთვის, რომელთა შესრულებაც მრავალი თანმიმდევრული ნაბიჯის გავლას მოითხოვს. მაგალითად, მოდელს შეუძლია თემის კვლევა, ინფორმაციის ანალიზი, კოდის დიდ ბაზასთან მუშაობა და იდეის დასრულებულ აპლიკაციად ან სამუშაო პროდუქტად გარდაქმნა.

SpaceXAI-ის შიდა ტესტირების მიხედვით, მოდელი განსაკუთრებით ეფექტიანია ფართო პროდუქტის იდეის პირველი სამუშაო ვერსიის შექმნისას. მას შეუძლია უცნობი სფეროს გამოკვლევა, აპლიკაციის სტრუქტურის დაგეგმვა, ძირითადი ფუნქციების განხორციელება და შემდეგ მიღებული შედეგის რამდენიმე ეტაპად გაუმჯობესება.

კომპანია ასევე აღნიშნავს, რომ ხანგრძლივი სამუშაო პროცესების დროს მოდელი უფრო ხშირად ამოწმებს საკუთარ შედეგებს და შემდეგ გადადის მომდევნო ეტაპზე. ეს მნიშვნელოვანი მიმართულებაა AI აგენტებისთვის, რადგან მათ ხშირად უწევთ არა ერთი პასუხის გენერირება, არამედ ერთმანეთთან დაკავშირებული მოქმედებების თანმიმდევრულად შესრულება.

Grok-4.6-ის შედეგები AI ბენჩმარკებში

SpaceXAI-ის მიერ გამოქვეყნებული შეფასებების მიხედვით, Grok 4.6-მა Artificial Analysis Intelligence Index-ზე 61 ქულა მიიღო. იგივე შედეგი აქვს OpenAI-ის GPT-5.6 Sol-ს, ხოლო Grok 4.5-ის შედეგი 56 ქულაა. აღნიშნული ინდექსი ცხრა სხვადასხვა ბენჩმარკისგან შემდგარ კომპოზიტურ შეფასებას წარმოადგენს.

გაუმჯობესება ჩანს სხვა ტესტებშიც. CursorBench v3.2-ზე Grok 4.6-ის შედეგი 69.9%-ია, Grok 4.5-ის 66.7%-თან შედარებით. DeepSWE v1.1-ზე ახალი მოდელი 65.9%-ს აღწევს, წინა მოდელის 54%-ის წინააღმდეგ.

FrontierCode v1.1 Extended შეფასებაში Grok 4.6-მა 61.3% მიიღო, Grok 4.5-მა კი 56.6%. APEX-Agents-ზე სხვაობა კიდევ უფრო დიდია – ახალი მოდელის შედეგია 57.5%, ხოლო Grok 4.5-ის – 47.1%.

grok 4 6 bench

როგორ გაწვრთნეს ახალი მოდელი

SpaceXAI-ის ინფორმაციით, ახალი მოდელის დამატებითი წვრთნის ეტაპი Grok 4.5-თან შედარებით უფრო ხანგრძლივი იყო. პროცესში გამოიყენეს მოდელების მიერ გენერირებული და შერჩეული მონაცემები მსჯელობისა და რთული ტექნიკური კონცეფციებისთვის, მაღალი ხარისხის საინჟინრო მონაცემები და გაუმჯობესებული ოპტიმიზაციისა და წვრთნის მეთოდები.

შემდეგ კომპანიამ Grok 4.5 გამოიყენა SFT ტრაექტორიების ხელახლა გენერირებისთვის. სამუშაო მოიცავდა მსჯელობის სხვადასხვა რეჟიმს, AI აგენტების გარემოებს, STEM სფეროებს, პროგრამულ ინჟინერიასა და ცოდნაზე დაფუძნებულ დავალებებს. პრობლემური შედეგების გასაფილტრად SpaceXAI-მ მოდელებზე დაფუძნებული შემოწმებებიც გამოიყენა.

Grok-4.6 ასევე გაწვრთნილია მრავალფეროვან agentic RL ამოცანებზე. მათ შორისაა ზოგადი პროგრამირება, ცოდნაზე დაფუძნებული სამუშაო, kernel optimization, ვებდეველოპმენტი და კომპიუტერული დიზაინი.

ინტერაქტიული პროექტები და პროგრამირება

SpaceXAI-ის შეფასებით, Grok 4.6, Grok 4.5-თან შედარებით უკეთეს საწყის შედეგებს ქმნის ვიზუალური და ინტერაქტიული პროექტების შემთხვევაში. კონკრეტული პროდუქტის იდეის მიღების შემდეგ მოდელს შეუძლია ერთ სამუშაო ციკლში ჩამოაყალიბოს აპლიკაციის სტრუქტურა და ვიზუალური მიმართულება.

ეს შესაძლებლობა განსაკუთრებით მნიშვნელოვანია AI პროგრამირების ინსტრუმენტებისთვის, სადაც მოდელისგან მხოლოდ კოდის ცალკეული ფრაგმენტის დაწერა აღარ არის საკმარისი. თანამედროვე AI აგენტებს სულ უფრო ხშირად სთხოვენ პროექტის დაგეგმვას, სხვადასხვა კომპონენტის შექმნას, შედეგის შემოწმებას და მომხმარებლის უკუკავშირის საფუძველზე მის გაუმჯობესებას.

უსაფრთხოება და შესაძლებლობები

Grok-4.6-ის უსაფრთხოების მექანიზმები მოდელის გაზრდილი შესაძლებლობების შესაბამისად გაუმჯობესდა და დაკალიბრდა. კომპანია აღნიშნავს ისეთ ლეგიტიმურ გამოყენებებს, როგორებიცაა უსაფრთხოების ხარვეზების გამოსწორება, საინჟინრო დიზაინის პროცესის დაჩქარება და AI კვლევების მხარდაჭერა.

კომპანიის ცნობით, Grok 4.6-ის გამოშვებამდე ჩატარდა შესაძლებლობებისა და უსაფრთხოების მექანიზმების შეფასებების ყველაზე ფართო ნაკრები, რომელიც SpaceXAI-ს ამ დრომდე გამოუყენებია. შეფასებები მოიცავს როგორც მოდელის გამოშვებამდე ჩატარებულ ტესტირებას, ასევე გამოშვების შემდგომ და მესამე მხარის ტესტებს.

სად არის ხელმისაწვდომი Grok 4.6

Grok 4.6 უკვე ხელმისაწვდომია Cursor-სა და Grok Build-ში. მოდელთან მუშაობა ასევე შესაძლებელია SpaceXAI API-ის საშუალებით.

SpaceXAI-ის მიხედვით, Grok 4.6 ასევე ხელმისაწვდომია პარტნიორების, მათ შორის OpenRouter-ის, Vercel-ისა და Cloudflare-ის პლატფორმებზე.

გადმოწერე Grok App Store-დან

API-ის სტანდარტული ვერსიის ფასი იწყება 2 დოლარიდან მილიონ input token-ზე და 6 დოლარიდან მილიონ output token-ზე. ასევე არსებობს უფრო სწრაფი ვარიანტი, რომლის ფასიც ორჯერ მეტია.

გამოშვების პირველ კვირაში SpaceXAI Cursor-სა და Grok Build-ში Grok 4.6-ისთვის ორმაგ ჩართულ გამოყენებას სთავაზობს მომხმარებლებს. მოდელის ტექნიკური დეტალები და კომპანიის სრული შეფასებები ხელმისაწვდომია SpaceXAI-ის ოფიციალურ განცხადებაში.

რას ნიშნავს Grok 4.6-ის გამოშვება

Grok 4.6-ის შემთხვევაში SpaceXAI-ის მთავარი აქცენტი მხოლოდ ერთჯერადი პასუხების ხარისხის ზრდაზე არ არის. მოდელი უფრო მეტად არის ორიენტირებული ხანგრძლივ, მრავალსაფეხურიან სამუშაო პროცესებზე, სადაც AI სისტემას ინფორმაციის მოძიება, ანალიზი, კოდის ან პროდუქტის შექმნა და საკუთარი შედეგის შემოწმება უწევს.

ბენჩმარკების მიხედვით, Grok 4.6 თითქმის ყველა გამოქვეყნებულ შეფასებაში შესამჩნევ გაუმჯობესებას აჩვენებს Grok 4.5-თან შედარებით. განსაკუთრებით საინტერესოა პროგრესი AI აგენტების, პროგრამირებისა და ცოდნაზე დაფუძნებული სამუშაოს მიმართულებით – სფეროებში, რომლებზეც SpaceXAI ახალი მოდელის პოზიციონირებისას ყველაზე დიდ აქცენტს აკეთებს.

AI დამწყებთათვის ხელოვნური ინტელექტი: სრული გზამკვლევი ისწავლე საფუძვლები - მანქანური დასწავლიდან ChatGPT-მდე, ინტერაქტიული ტესტით.

LLM.GE - გზამკვლევი ხელოვნურ ინტელექტში

LLM.GE არის ქართულ-ენოვანი ვებ-გვერდი, რომელიც სრულად ეძღვნება ხელოვნურ ინტელექტს, დიდ ენობრივ მოდელებს (LLM) და AI ტექნოლოგიების სიახლეებს. აქ ნახავთ ინფორმაციას ChatGPT-ის, Gemini-ის, Claude-ის და სხვა AI ინსტრუმენტების შესახებ ქართულ ენაზე

გამოიწერე სიახლეები
×