SpaceXAI-მ წარადგინა Grok 4.5 – კომპანიის ახალი მოდელი, რომელიც სპეციალურად კოდირების, აგენტური ამოცანებისა და საოფისე სამუშაოსთვის შეიქმნა. ეს არის პირველი მოდელი, რომელიც SpaceXAI-მ და Cursor-მა ერთობლივად გაწვრთნეს – სულ რაღაც რამდენიმე კვირით ადრე SpaceX-მა Cursor-ის შეძენაზე შეთანხმებას მოაწერა ხელი, რომელიც სტარტაპს 60 მილიარდ დოლარად აფასებს.
კომპანიის თქმით, Grok 4.5 მისი ყველაზე ძლიერი მოდელია და “ლიდერულ სიჩქარესა და ფასზე” გვთავაზობს ფრონტირულ ინტელექტს.
რით განსხვავდება Grok 4.5
Grok 4.5 არის mixture-of-experts არქიტექტურის მოდელი და მის ტრენინგში ტრილიონობით ტოკენის მოცულობის Cursor-ის მონაცემები გამოიყენეს – რეალური დეველოპერების ინტერაქციები კოდბაზებთან და პროგრამულ ინსტრუმენტებთან. ეს მოდელს საშუალებას აძლევს, ისწავლოს არა მხოლოდ არსებული კოდიდან, არამედ იმისგანაც, თუ როგორ მუშაობენ დეველოპერები და აგენტები რეალურ გარემოში.
ამავდროულად, ტრენინგის მონაცემები განზრახ ფართო დატოვეს: კოდის გარდა მოდელი STEM ამოცანებზე, სამეცნიერო ნაშრომებსა და სხვა ცოდნით სამუშაოზეც გაწვრთნეს. SpaceXAI-ის თქმით, ტრენინგი ათიათასობით NVIDIA GB300 GPU-ზე მიმდინარეობდა, ხოლო reinforcement learning ეტაპი ასიათასობით ამოცანას მოიცავდა – ძირითადად მრავალსაფეხურიან საინჟინრო დავალებებს.
Grok 4.5-ის შედეგები ბენჩმარკებზე
SpaceXAI-მ გამოაქვეყნა შედარებები კონკურენტებთან, მათ შორის Anthropic-ის Claude-სა და OpenAI-ის GPT-5.5-თან:
- Terminal Bench 2.1: Grok 4.5 – 83.3%, GPT-5.5 (xhigh) – 83.4%, Claude Fable (max) – 84.3%, Claude Opus 4.8 (max) – 78.9%
- SWE Bench Pro: Claude Fable – 80.4%, Claude Opus 4.8 – 69.2%, Grok 4.5 – 64.7%, GPT-5.5 – 58.6%
- DeepSWE 1.0: Claude Fable – 66.1%, GPT-5.5 – 64.31%, Grok 4.5 – 62.0%
- Harvey Legal Agent Benchmark: Grok 4.5 პირველ ადგილზეა
სურათი შერეულია: ტერმინალურ ამოცანებში მოდელი ლიდერებს უტოლდება, თუმცა SWE Bench Pro-ზე Anthropic-ის მოდელებს ჩამორჩება. სამაგიეროდ, იურიდიულ აგენტურ ბენჩმარკზე პირველი ადგილი აჩვენებს, რომ SpaceXAI მოდელს მხოლოდ კოდირებისთვის არ ამზადებდა.
ხელმისაწვდომობა და ფასი
Grok 4.5 დღეიდან ხელმისაწვდომია Grok Build-ში, Cursor-ის ყველა გეგმაზე და SpaceXAI-ის API კონსოლში. შეზღუდული დროით Grok Build-სა და Cursor-ში მოდელის გამოყენება უფასოა, ხოლო Cursor პირველი კვირის განმავლობაში გამოწერის ფარგლებში ჩართულ ლიმიტს აორმაგებს.
Cursor-ის მონაცემებით, საბაზო მოდელის ფასი 2 დოლარია მილიონ შემავალ ტოკენზე და 6 დოლარი – გამომავალზე. არსებობს სწრაფი ვარიანტიც: 4 დოლარი შემავალზე და 18 დოლარი გამომავალზე.
რა უნდა იცოდნენ ევროპელმა მომხმარებლებმა
Grok 4.5 ჯერ არ არის ხელმისაწვდომი ევროკავშირში – არც SpaceXAI-ის პროდუქტებში და არც API-ში. კომპანიის თქმით, ევროკავშირში მოდელი ივლისის შუა რიცხვებში გამოჩნდება.
სხვა თემები
Grok – რა არის და რა შეუძლია SpaceXAI-ის AI ასისტენტს
Cursor Origin – Cursor-მა კოდის ჰოსტინგი გაუშვა
SpaceX-მა Cursor-ის შეძენა ოფიციალურად დაასრულა
