OpenAI-მ ახალი თაობის მოდელების ლიმიტირებული, preview ვერსიები წარადგინა. ამ ხაზის სათავეში დგას GPT-5.6 Sol – კომპანიის ფლაგმანი ფრონტიერ მოდელი. მასთან ერთად წარდგენილია GPT-5.6 Terra, დაბალანსებული მოდელი ყოველდღიური სამუშაოსთვის, და GPT-5.6 Luna, სწრაფი და იაფი ვარიანტი დიდი მოცულობის ამოცანებისთვის.
სამივე მოდელი GPT-5.6 ოჯახის ნაწილია და ჯერ მხოლოდ ნდობით აღჭურვილ პარტნიორთა ვიწრო წრისთვის ხდება ხელმისაწვდომი. OpenAI გეგმავს, რომ Sol, Terra და Luna უახლოეს კვირებში ფართოდ გაიტანოს ბაზარზე.
სარჩევი

რას გვთავაზობს GPT-5.6 Sol
OpenAI-ის შეფასებით, GPT-5.6 Sol მისი ყველაზე ძლიერი მოდელია დღემდე. კომპანიამ გამოაქვეყნა შეფასებების ნაკრები, რომელიც აჩვენებს გაუმჯობესებულ აგენტურ შესაძლებლობებს კოდირების, ბიოლოგიისა და კიბერუსაფრთხოების მიმართულებით.
კოდირების ამოცანებში GPT-5.6 Sol-მა ახალი რეკორდი დააფიქსირა ბენჩმარკ Terminal-Bench 2.1-ზე, რომელიც ბრძანებათა ხაზის სამუშაო პროცესებს, დაგეგმვასა და ხელსაწყოების კოორდინაციას ამოწმებს. ბიოლოგიის მიმართულებით, GeneBench v1-ზე მოდელმა GPT-5.5-ზე უკეთესი შედეგი აჩვენა და ამავდროულად ნაკლები ტოკენი დახარჯა.
GPT-5.6-თან ერთად OpenAI ნერგავს ახალ max რეჟიმს, რომელიც Sol-ს ღრმა მსჯელობისთვის მეტ დროს აძლევს. ამას გარდა, ახალი ultra რეჟიმი ცალკეული აგენტის შესაძლებლობებს სცდება და ქვე-აგენტებს იყენებს რთული სამუშაოს დასაჩქარებლად.
კიბერუსაფრთხოების შესაძლებლობები
კომპანიის თქმით, GPT-5.6 Sol მათი ყველაზე ძლიერი მოდელია კიბერუსაფრთხოებაში. ბენჩმარკ ExploitBench-ზე იგი კონკურენციას უწევს Mythos Preview-ს და ამისთვის გამომავალი ტოკენების მხოლოდ დაახლოებით მესამედს ხარჯავს.
ExploitGym-ზე, რომელიც UC Berkeley-ის მკვლევრებმა OpenAI-სა და სხვა ფრონტიერ ლაბორატორიებთან ერთად შექმნეს, სამივე მოდელმა – Sol, Terra და Luna – კიბერ-შესაძლებლობების მკაფიო ზრდა აჩვენა მსჯელობის გაძლიერებისას.
ცალკე აღსანიშნავია შედარება Anthropic-ის ფრონტიერ მოდელ Claude Mythos-თან (ამჟამად ხელმიუწვდომელია). ExploitBench-ზე GPT-5.6 Sol წარმადობით უტოლდება Mythos Preview-ს, თუმცა ამისთვის გამომავალი ტოკენების მხოლოდ დაახლოებით მესამედს ხარჯავს. ამდენად, OpenAI აქცენტს არა მხოლოდ შესაძლებლობაზე, არამედ ეფექტიანობაზე აკეთებს – მსგავსი შედეგი ბევრად ნაკლები რესურსით.
GPT-5.6 Terra და Luna – ფასი და წარმადობა
GPT-5.6 Terra წარმადობით უტოლდება წინა თაობის GPT-5.5-ს, თუმცა ორჯერ იაფია. Luna კი ძლიერ შესაძლებლობებს კომპანიის ყველაზე დაბალ ფასად სთავაზობს მომხმარებელს.
GPT-5.6-თან ერთად შემოდის დასახელების ახალი სისტემა. ციფრი მოდელის თაობას აღნიშნავს, ხოლო Sol, Terra და Luna მდგრად შესაძლებლობების დონეებს, რომლებიც საკუთარი ტემპით შეიძლება განვითარდეს. კომპანიის თქმით, ეს ოჯახი მომხმარებლებსა და დეველოპერებს უფრო ნათელ არჩევანს სთავაზობს ინტელექტს, სიჩქარესა და ფასს შორის.
უსაფრთხოების მრავალშრიანი სისტემა
GPT-5.6 Sol მათი დღემდე ყველაზე მყარი უსაფრთხოების სისტემით ეშვება. OpenAI-მ გააძლიერა დაცვა მაღალი რისკის აქტივობის, მგრძნობიარე კიბერ-მოთხოვნებისა და განმეორებითი ბოროტად გამოყენების წინააღმდეგ. კომპანიამ რამდენიმე კვირა დახარჯა სისტემაში სუსტი წერტილების მოძიებასა და მის გამყარებაზე.
დაცვა რამდენიმე შრედ არის აწყობილი: მოდელში ჩაშენებული შეზღუდვები, გენერაციის დროს რეალურ დროში მომუშავე შემოწმებები, ანგარიშის დონის სიგნალები და მუდმივი მონიტორინგი. რეალურ დროში მომუშავე კიბერ და ბიოლოგიის კლასიფიკატორები აფასებენ გამომავალ ტექსტს მისი წარმოქმნისთანავე და მაღალი რისკის შემთხვევაში გენერაცია შეიძლება შეჩერდეს დამატებითი შემოწმებისთვის.
კომპანია აცხადებს რომ პრევიუს პერიოდში მომხმარებლებს შესაძლოა შეხვდეთ შემთხვევები, როცა მოთხოვნა იბლოკება ან პასუხი დამატებითი შემოწმების გამო ნელდება. სწორედ ეს არის ერთ-ერთი, რის შესამოწმებლადაც preview იქმნება – გუნდს სურს დარწმუნდეს, რომ უსაფრთხოების სისტემა აფერხებს ბოროტად გამოყენებას და ამავდროულად ლეგიტიმურ მომხმარებლებს ნორმალური სამუშაოს დასრულების საშუალებას აძლევს. OpenAI ასევე მუშაობს საწარმოო კლიენტებთან გრძელვადიან მიდგომებზე, მათ შორის კონფიდენციალურობის შემნახველ აღმოჩენასა და კლიენტის მიერ მართულ უსაფრთხოების კონტროლზე.
OpenAI განმარტავს, რომ GPT-5.6 Sol უკეთ ეხმარება მომხმარებელს დაუცველობების პოვნასა და გასწორებაში, ვიდრე სრული თავდასხმის ბოლომდე განხორციელებაში. Preparedness Framework-ის მიხედვით, მოდელი არ კვეთს კიბერ-კრიტიკულ ზღვარს.
Chromium-ისა და Firefox-ის ჩართულობით ჩატარებულ შეფასებებში მოდელმა აღმოაჩინა ხარვეზები და ექსპლუატაციის სამშენებლო ბლოკები, თუმცა ტესტირების პირობებში დამოუკიდებლად ვერ შექმნა სრული, ფუნქციური ექსპლოიტი.
ავტომატური red-teaming
OpenAI-მ უსაფრთხოებას უპრეცედენტო რესურსი მოახმარა. კომპანიამ 700,000-ზე მეტი A100-ის ეკვივალენტი GPU-საათი დახარჯა ავტომატურ red-teaming-ზე, რომელიც ე.წ. უნივერსალური jailbreak-ების მოძიებას ისახავდა მიზნად – იმ თავდასხმების, რომლებიც ბევრ სხვადასხვა კონტექსტში მუშაობს.
ავტომატური მუშაობის გარდა, კომპანია მესამე მხარის ტესტერებთან ერთად ატარებდა ადამიანი ექსპერტების მიერ red-teaming-ს, რომელიც პრევიუს პერიოდშიც გაგრძელდება.
რატომ იწყება ყველაფერი limited preview-ით
OpenAI-ის თქმით, აშშ-ის მთავრობასთან მიმდინარე თანამშრომლობის ფარგლებში კომპანიამ გაშვებამდე წარადგინა მოდელების შესაძლებლობები და გეგმები. სწორედ აშშ-ის მთავრობის თხოვნით იწყება ნდობით აღჭურვილ პარტნიორთა მცირე ჯგუფისთვის ლიმიტირებული preview, სანამ მოდელები უფრო ფართოდ გავრცელდება.
— Sam Altman (@sama)
November 27, 2012
ფასები და ხელმისაწვდომობა
პრევიუს პერიოდში GPT-5.6 მოდელები თავდაპირველად API-სა და Codex-ის გავლით იქნება ხელმისაწვდომი პარტნიორთათვის. მოგვიანებით კომპანია გეგმავს მათ გატანას ChatGPT-ში, Codex-სა და API-ში უფრო ფართო აუდიტორიისთვის.
ფასები 1 მილიონ ტოკენზეა გათვლილი სამი ზომისთვის:
- GPT-5.6 Sol: $5 შემავალ / $30 გამომავალ ტოკენებზე
- GPT-5.6 Terra: $2.50 შემავალ / $15 გამომავალ ტოკენებზე
- GPT-5.6 Luna: $1 შემავალ / $6 გამომავალ ტოკენებზე
GPT-5.6 ასევე ნერგავს უფრო პროგნოზირებად prompt caching-ს, მათ შორის ქეშის მკაფიო breakpoint-ებისა და 30-წუთიანი მინიმალური ქეშის სიცოცხლის მხარდაჭერას. ქეშში ჩაწერა ფასდება შემავალი ტოკენის ფასის 1.25-მაგად, ხოლო ქეშიდან წაკითხვა ინარჩუნებს 90%-იან ფასდაკლებას.
OpenAI ასევე იწყებს GPT-5.6 Sol-ის გაშვებას Cerebras-ის ინფრასტრუქტურაზე ივლისში, წამში 750 ტოკენამდე სიჩქარით. წვდომა თავიდან მხოლოდ შერჩეულ კლიენტებზე იქნება, სანამ კომპანია სიმძლავრეს გააფართოებს.
სხვა თემები
Claude რიმანის ჰიპოთეზა – ახალი AI მიღწევა
GPT-5-6 Cyber – OpenAI-ის ახალი კიბერუსაფრთხოების AI
AI კიბერტესტები: მოდელებმა რეალური სისტემები გატეხეს

