NVIDIA-ს ახალი თაობის პლატფორმა Vera Rubin ოფიციალურად ამოქმედდა და წარმოება სრული ტემპით მიდის. კომპანიის განცხადებით, Vera Rubin NVL72 სისტემები უკვე მუშაობს CoreWeave-ის, Google Cloud-ის, Microsoft Azure-ისა და Oracle Cloud-ის მონაცემთა ცენტრებში. მთავარი დაპირება კონკრეტულია – 10-ჯერ მეტი ტოკენი ერთ მეგავატზე, ვიდრე წინა თაობის Blackwell-ს შეეძლო.
Vera Rubin-ის პირველი რეალური ბენჩმარკი: 10x მეტი ტოკენი მეგავატზე
CoreWeave გახდა პირველი AI ღრუბელი, რომელმაც Vera Rubin NVL72 რეალურ გარემოში აამუშავა და გაზომილი შედეგები გამოაქვეყნა. DeepSeek-R1 მოდელზე ჩატარებულმა ტესტმა აჩვენა 10-ჯერ მეტი ტოკენი წამში ერთ მეგავატზე, ვიდრე Grace Blackwell NVL72-ზე.
სარჩევი
ეს მეტრიკა შემთხვევით არ არის არჩეული. ტოკენები მეგავატზე განსაზღვრავს, შეუძლია თუ არა AI ინფრასტრუქტურას მომგებიანად გაფართოება, როცა ელექტროენერგია მთავარი შემზღუდველი ფაქტორია. მეტი ტოკენი იმავე ენერგიაზე ნიშნავს მეტ “ინტელექტს” იმავე ბიუჯეტით.
NVIDIA-ს მონაცემებით, GB200 NVL72-თან შედარებით ახალი სისტემა მილიონ ტოკენზე ღირებულებასაც ათჯერ ამცირებს.
Vera CPU – პროცესორი AI აგენტების ეპოქისთვის
პლატფორმის ცენტრში ახალი NVIDIA Vera CPU დგას, საკუთარი Olympus ბირთვით. NVIDIA-ს თქმით, ის კონკურენტ ჩიპლეტურ დიზაინებთან შედარებით 2-ჯერ სწრაფია ერთნაკადიან დავალებებში, 3-ჯერ მეტ ბირთვთაშორის გამტარუნარიანობას იძლევა და მეხსიერების დაყოვნებას 40%-ით ამცირებს.
დამოუკიდებელი შედეგებიც გამოჩნდა. ღრუბლოვანმა პლატფორმა DeepInfra-მ, რომელიც კვირაში თითქმის ხუთ ტრილიონ ტოკენს ამუშავებს, საკუთარ საწარმოო ინფრასტრუქტურაზე ჩაატარა ტესტები. შედეგები:
- 2.2-ჯერ სწრაფი ორკესტრაცია ალტერნატიულ CPU-ებთან შედარებით
- 1.6-ჯერ მეტი პარალელური AI აგენტი მომსახურების იმავე ხარისხით
- ინფრასტრუქტურის უკეთესი უტილიზაცია და ხარჯების ეფექტიანობა
ეს იმიტომ არის მნიშვნელოვანი, რომ AI აგენტები სულ უფრო მეტ დაგეგმვას, ინსტრუმენტების გამოყენებას და მონაცემთა გადაადგილებას საჭიროებენ – და ამ სამუშაოს დიდი ნაწილი სწორედ CPU-ზე მოდის, GPU-ს გამოძახებებს შორის.
შვიდი ჩიპი, ერთი სისტემა
Vera Rubin NVL72 შვიდი ახალი ჩიპისგან შედგება, რომლებიც თავიდანვე ერთიან სისტემად არის დაპროექტებული და არა ცალკეული კომპონენტების ნაკრებად. მეექვსე თაობის NVLink ქსელი შიდა კავშირისთვის 260 TB/s გამტარუნარიანობას იძლევა, რაც მთელ რეკს ერთ გაერთიანებულ ამაჩქარებლად აქცევს.
საინტერესოა საინჟინრო დეტალებიც. გამოთვლით ბლოკში აღარ არის კაბელები, ვენტილატორები და შლანგები, რის გამოც აწყობის დრო საათებიდან ერთ წუთამდე შემცირდა. ხოლო 45 გრადუსიანი თხევადი გაგრილების დიზაინი ჩილერების გარეშე მუშაობის საშუალებას იძლევა – ახალი მონაცემთა ცენტრებისთვის ეს ყოველწლიურად მილიონობით გალონ წყალს ზოგავს თითო მეგავატზე.
ვინ იყენებს უკვე Vera Rubin-ს
პლატფორმას 300-ზე მეტი გლობალური პარტნიორი უჭერს მხარს, ხოლო მიწოდების ჯაჭვი 30 ქვეყანაში 350-ზე მეტ საწარმოო ობიექტს მოიცავს.
Google Cloud-მა Vera Rubin NVL72-ზე დაფუძნებული პირველი A5X ინსტანსი გაუშვა, რომელსაც ლონდონური სტარტაპი Ineffable Intelligence იყენებს გაძლიერებული სწავლების მასშტაბური სისტემებისთვის. პარალელურად, Microsoft-მა და Mistral-მა მრავალმილიარდიანი შეთანხმება გააფორმეს, რომლის ფარგლებშიც ევროპაში ათასობით Vera Rubin GPU განთავსდება – მიზანი ევროპული ღია მოდელებისა და სუვერენული AI ინფრასტრუქტურის გაძლიერებაა.
ჯამში სურათი ასეთია: ინდუსტრია აგენტური AI-ს ეპოქაში გადადის, სადაც სისტემები ტრადიციულ აპლიკაციებზე 15-ჯერ მეტ ტოკენს მოიხმარენ. Vera Rubin სწორედ ამ დატვირთვისთვის არის აწყობილი და პირველი ციფრები აჩვენებს, რომ ენერგოეფექტიანობის ნახტომი რეალურია.
სხვა თემები
NVIDIA AVO-მ ARC-AGI-3-ის საჯარო ტესტზე 100% შედეგი აჩვენა
NVIDIA Nemotron 3.5 Lightning – ახალი ღია AI მოდელი
Alpamayo 2 Super: NVIDIA-ს ახალი ღია AI მოდელი
