AGI IS NEAR
4 სექტემბერი, 2026

OpenAI-მ GPT-6 Astra წარადგინა

OpenAI-მ GPT-6 Astra წარადგინა - შესაძლებლობები, ბენჩმარკები, უსაფრთხოება და ხელმისაწვდომობა

OpenAI-მ GPT-6 Astra წარადგინა. კომპანია მას თავის ყველაზე ინტელექტუალურ და მომხმარებლის მიზნებთან შესაბამისობის მხრივ ყველაზე განვითარებულ მოდელად აღწერს.

GPT-6 Astra აერთიანებს წინასწარი წვრთნის, განმტკიცებითი სწავლებისა და მოდელის ქცევის შესაბამისობაზე მუშაობის მიმართულებით ჩატარებულ მრავალწლიან კვლევებს. OpenAI-ის განცხადებით, მოდელი მოწინავე შედეგებს აჩვენებს კომპიუტერის გამოყენებაში, ვებგვერდებთან მუშაობაში, პროგრამულ ინჟინერიაში, კიბერუსაფრთხოებაში, მეცნიერებასა და პროფესიულ საქმიანობაში.

სარჩევი

ახალი მოდელის პრეზენტაციაში სამი მიმართულება გამოირჩევა: თითქმის მაქსიმალური შედეგები რთულ ბენჩმარკებზე, კომპიუტერისა და ბრაუზერის გამოყენებით მრავალეტაპიანი სამუშაოების შესრულება და მისთვის განსაზღვრული უფლებამოსილების უკეთ დაცვა.

რა არის GPT-6 Astra

GPT-6 Astra არის OpenAI-ის ახალი ფლაგმანი მოდელი, რომელიც რთული და მრავალეტაპიანი სამუშაოებისთვის შეიქმნა. ოფიციალური დოკუმენტაციის მიხედვით, მას შეუძლია კოდის, ბრაუზერისა და პროფესიული პროგრამების გამოყენებით ერთიანი სამუშაო პროცესის შესრულება.

მსგავსი დავალება შეიძლება რამდენიმე ერთმანეთზე დამოკიდებულ ეტაპსა და სხვადასხვა ინსტრუმენტის გამოყენებას მოიცავდეს. Astra შექმნილია იმისთვის, რომ მთელი პროცესის განმავლობაში შეინარჩუნოს დავალების კონტექსტი და მიღებული შედეგების მიხედვით განაგრძოს მუშაობა.

OpenAI-ის ცნობით, მომხმარებელს შეუძლია მოდელს უფრო რთული სამუშაო გადასცეს და მოდელს უფრო მეტი ნდობით დაეყრდნოს. კომპანია ხაზს უსვამს Astra-ს სიჩქარეს, სიზუსტესა და რთულ პირობებში მოქმედების უნარს.

GPT-6 Astra-ს მთავარი შესაძლებლობები

OpenAI ახალი მოდელის შესაძლებლობებიდან რამდენიმე ძირითად მიმართულებას გამოყოფს:

  • კომპიუტერის გამოყენება – GPT-6 Astra-ს შეუძლია კომპიუტერულ გარემოში მუშაობა და პროფესიულ პროგრამებთან ურთიერთქმედება.
  • ვებგვერდებთან მუშაობა – მოდელი გათვლილია ბრაუზერის გამოყენებით მრავალეტაპიანი პროცესების შესრულებაზე.
  • პროგრამული ინჟინერია – Astra მოწინავე შედეგებს აჩვენებს პროგრამული კოდის შექმნასა და კოდთან დაკავშირებულ სამუშაოებში.
  • კიბერუსაფრთხოება – OpenAI კიბერუსაფრთხოებას მოდელის ერთ-ერთ ძლიერ მიმართულებად ასახელებს.
  • მეცნიერება და მათემატიკა – მოდელმა მაღალი შედეგი აჩვენა რთულ მათემატიკურ ბენჩმარკზე და, კომპანიის განცხადებით, ღია მათემატიკური ამოცანების ამოხსნაშიც მიიღო მონაწილეობა.
  • პროფესიული სამუშაო – Astra განკუთვნილია რთული დავალებებისთვის, რომლებიც რამდენიმე მოქმედებისა და ინსტრუმენტის თანმიმდევრულ გამოყენებას მოითხოვს.

ეს შესაძლებლობები GPT-6 Astra-ს მრავალეტაპიანი პროცესების შესრულების საშუალებას აძლევს. მოდელს შეუძლია გააგრძელოს მუშაობა სხვადასხვა ინსტრუმენტიდან მიღებული შედეგების საფუძველზე და დავალების მთავარი მიზანი პროცესის განმავლობაში შეინარჩუნოს.

GPT-6 Astra-ს შედეგები ბენჩმარკებზე

OpenAI-ის მიერ გამოქვეყნებული მონაცემებით, GPT-6 Astra-მ თითქმის მაქსიმალური შედეგები აჩვენა მათემატიკის, მსჯელობისა და კიბერუსაფრთხოების რამდენიმე რთულ შეფასებაში. ყველა ჩამოთვლილი მაჩვენებელი კომპანიის მიერ გავრცელებულ შედეგებს ეფუძნება.

98% FrontierMath Tier 4-ზე

GPT-6 Astra-მ FrontierMath Tier 4-ზე 98%-იანი შედეგი მიიღო. OpenAI ამ მაჩვენებელს ბენჩმარკის თითქმის სრულად დაძლევად აფასებს.

კომპანიის განცხადებით, Astra-მ უკვე შეუწყო ხელი მათემატიკაში დიდი ხნის განმავლობაში ღიად დარჩენილი ამოცანების ამოხსნას. ეს განცხადება განსაკუთრებით მნიშვნელოვანი ნაწილია მოდელის სამეცნიერო შესაძლებლობების შესახებ OpenAI-ის მიერ წარმოდგენილ ინფორმაციაში.

98%-იანი მაჩვენებელი კონკრეტულად FrontierMath Tier 4-ის შეფასებას ეხება. ის Astra-ს რთულ მათემატიკურ დავალებებზე მუშაობის შესაძლებლობას ასახავს, თუმცა ყველა შესაძლო მათემატიკური პრობლემის გადაწყვეტას არ ნიშნავს.

astra-benchmarks

99.9% ARC-AGI-3-ზე

ARC-AGI-3-ზე GPT-6 Astra-მ 99.9%-იანი შედეგი დააფიქსირა. ეს ბენჩმარკის თითქმის მაქსიმალური მაჩვენებელია.

OpenAI ამ შედეგს Astra-ს მსჯელობის შესაძლებლობების ერთ-ერთ მთავარ ინდიკატორად წარმოადგენს. 99.9% კონკრეტულად ARC-AGI-3-ის შეფასებას ასახავს და მოდელის ყველა შესაძლო რეალურ გარემოში მუშაობის სრულ საზომად არ უნდა ჩაითვალოს.

100% ExploitBench-ზე

კიბერუსაფრთხოების მიმართულებით GPT-6 Astra-მ ExploitBench-ზე 100%-იანი შედეგი მიიღო. ეს აღნიშნულ ბენჩმარკზე მაქსიმალური მაჩვენებელია.

OpenAI ExploitBench-ის შედეგს Astra-ს კიბერუსაფრთხოების შესაძლებლობების ერთ-ერთ მთავარ მტკიცებულებად ასახელებს. ის კონკრეტულ შეფასებაში მოდელის შედეგს აჩვენებს და ყველა რეალურ კიბერუსაფრთხოების გარემოს არ მოიცავს.

FrontierMath Tier 4-ზე მიღებული 98%, ARC-AGI-3-ზე დაფიქსირებული 99.9% და ExploitBench-ის 100% OpenAI-ის მიერ გამოქვეყნებული მაჩვენებლებია. მოდელის ფართო გამოყენება დამატებით წარმოდგენას შექმნის იმის შესახებ, როგორ გადაიტანება ეს შედეგები ყოველდღიურ პროფესიულ სამუშაოებში.

კომპიუტერისა და ბრაუზერის გამოყენება

GPT-6 Astra-ს ერთ-ერთი მთავარი მიმართულება კომპიუტერისა და ბრაუზერის გამოყენებაა. OpenAI-ის ოფიციალური დოკუმენტაციის მიხედვით, მოდელს შეუძლია კოდის, ვებგვერდებისა და პროფესიული პროგრამების გამოყენებით მრავალეტაპიანი სამუშაო პროცესების შესრულება.

Astra გათვლილია დავალებებზე, რომლებიც ერთი პასუხის მომზადებით არ სრულდება. მოდელმა უნდა შეასრულოს ერთმანეთზე დამოკიდებული მოქმედებები, შეინარჩუნოს სამუშაოს კონტექსტი და საჭიროების შემთხვევაში შეცვალოს მოქმედების მიმართულება.

GPT-6 Astra წინა მოდელებთან შედარებით უკეთ ინარჩუნებს თანმიმდევრულობას ხანგრძლივი სამუშაოების დროს. გაურკვევლობის შემთხვევაში მას შეუძლია კონტექსტის გამოყენება ან მიზანმიმართული დამაზუსტებელი კითხვის დასმა.

ნაკლები ტოკენი და დავალების შესაძლო დაბალი ღირებულება

OpenAI-ის ინფორმაციით, GPT-6 Astra რამდენიმე შეფასებაში უკეთეს შედეგებს მნიშვნელოვნად ნაკლები გამომავალი ტოკენის გამოყენებით აღწევს. კომპანია აცხადებს, რომ ამის შედეგად API-ის სავარაუდო ღირებულება თითოეულ დავალებაზე ძველ მოდელებთან შედარებით შეიძლება შემცირდეს.

Astra-ს თითო ტოკენის ფასი უფრო მაღალია, თუმცა ნაკლები გამომავალი ტოკენის გამოყენებამ კონკრეტული დავალების საერთო ხარჯი შეიძლება შეამციროს. OpenAI ამ შეფასებას რამდენიმე ტესტის შედეგებზე დაყრდნობით აკეთებს.

საბოლოო ღირებულება კონკრეტულ სამუშაოზე, მოთხოვნის მოცულობასა და გამოყენებულ შესაძლებლობებზე იქნება დამოკიდებული. ამიტომ თითო ტოკენის ფასი და მთლიანი დავალების შესრულების ხარჯი ერთმანეთისგან განსხვავებული მაჩვენებლებია.

ახალი შესაძლებლობები დეველოპერებისთვის

GPT-6 Astra-სთან ერთად OpenAI-მ დეველოპერებისთვის რამდენიმე ახალი ფუნქციაც წარმოადგინა. მათი მიზანია ხანგრძლივი სამუშაოების მართვა და პროცესის მიმდინარეობისას მოდელისთვის ახალი მითითებების მიწოდება.

ინსტრუმენტების ასინქრონული გამოძახება

GPT-6 Astra მხარს უჭერს ინსტრუმენტების ასინქრონულ გამოძახებას. სანამ აპლიკაცია ერთ-ერთი ინსტრუმენტის მუშაობის დასრულებას ელოდება, მოდელს შეუძლია გააგრძელოს მსჯელობა, სხვა ინსტრუმენტი გამოიძახოს ან დავალების დამოუკიდებელ ნაწილზე იმუშაოს.

აპლიკაცია კვლავ თავად ასრულებს ინსტრუმენტის ოპერაციას და მართავს დაუსრულებელ სამუშაოებს. მიღებული შედეგი მოდელს შესაბამისი გამოძახების იდენტიფიკატორის გამოყენებით უბრუნდება.

მითითების შეცვლა მუშაობის მიმდინარეობისას

ახალი მოდელი მხარს უჭერს მუშაობის მიმდინარეობისას დამატებითი მითითების მიღებას. მომხმარებელს შეუძლია Astra-ს გაუგზავნოს შესწორება ან მოთხოვნის ცვლილება მანამდე, სანამ მოდელი საწყისი დავალების შესრულებას დაასრულებს.

WebSocket კავშირის გამოყენებისას Responses API უკვე დასრულებულ სამუშაოს ინარჩუნებს და ახალ მითითებას გაგრძელებულ პროცესში ითვალისწინებს. ეს შესაძლებლობა OpenAI-ის დოკუმენტაციაში Mid-turn steering-ის სახელით არის წარმოდგენილი.

მსჯელობის დონის შეცვლა

დეველოპერებს საუბრის მიმდინარეობისას Astra-ს მსჯელობის ძალისხმევის შეცვლაც შეუძლიათ. რთული სამუშაოსთვის შესაძლებელია მისი გაზრდა, ხოლო უფრო მარტივი გაგრძელებისთვის შემცირება.

ცვლილება საწყისი მოთხოვნის ხელახლა დაწერის გარეშე ხდება და თავდაპირველი მოთხოვნის პრეფიქსის ქეშის შენარჩუნებას ითვალისწინებს. განახლებული დონე მოქმედებს მანამდე, სანამ დეველოპერი მას კიდევ ერთხელ არ შეცვლის.

GPT-5.6-ში არსებული API შესაძლებლობები

GPT-6 Astra მხარს უჭერს GPT-5.6-ის რამდენიმე არსებულ API შესაძლებლობასაც:

  • Computer use
  • Structured Outputs
  • Streaming
  • Programmatic Tool Calling
  • Multi-agent orchestration
  • Prompt caching
  • Persisted reasoning
  • Compaction
  • Pro mode

GPT-6 Astra და მომხმარებლის განზრახვის გაგება

OpenAI GPT-6 Astra-ს თავის ყველაზე მეტად შესაბამისობაში მოყვანილ მოდელად აღწერს. ამ მიმართულებაში კომპანია გულისხმობს მომხმარებლის განზრახვის გაგებას, დავალების საზღვრების დაცვას, სიფრთხილით მოქმედებასა და საკუთარი ქცევის გამჭვირვალედ ახსნას.

როდესაც ინსტრუქციაში რუტინული დეტალი აკლია, Astra-ს შეუძლია მის ხელთ არსებული კონტექსტის გამოყენება. თუ გაურკვევლობამ შეიძლება შედეგი არსებითად შეცვალოს, მოდელი მიზანმიმართულ დამაზუსტებელ კითხვას სვამს.

OpenAI-ის ოფიციალური დოკუმენტაციის მიხედვით, Astra-ს შეუძლია მუშაობის პროცესში მიღებული ახალი მოთხოვნების გათვალისწინება, მიმართულების შეცვლა და დამატებით კითხვებზე პასუხი ისე, რომ მთავარი დავალება არ დაკარგოს. კომპანია ამ თვისებებს რთული სამუშაოების დელეგირებისთვის მნიშვნელოვან გაუმჯობესებად მიიჩნევს.

უფლებამოსილების საზღვრების ახალი შეფასება

GPT-6 Astra-ს ქცევის შესამოწმებლად OpenAI-მ ახალი შეფასება შექმნა, რომელიც Hugging Face-ის ინციდენტით იყო შთაგონებული. ტესტი ამოწმებს, გასცდება თუ არა მოდელი მისთვის განსაზღვრულ უფლებამოსილებას რთული ან შეუძლებელი დავალების მიღებისას.

OpenAI-ის მონაცემებით, წარმოებაში გამოყენებული დამცავი მექანიზმების გარეშე GPT-5.6 Sol ნებადართული სამიზნის ფარგლებს შემთხვევების 48%-ში გასცდა. GPT-6 Astra-მ იმავე შეფასებაში ასეთი ქცევა შემთხვევების 0%-ში გამოავლინა.

0%-იანი მაჩვენებელი კონკრეტულად ამ შეფასების შედეგია და ყველა შესაძლო გარემოში მოდელის ქცევის გარანტიას არ წარმოადგენს. ის აჩვენებს, რომ OpenAI-ის ტესტში Astra-მ ნებადართული სამიზნის საზღვრები არცერთ დაფიქსირებულ შემთხვევაში არ დაარღვია.

OpenAI GPT-6 Astra-სთვის შეუსაბამო ქცევის მონიტორინგის გაძლიერებულ სისტემასაც იყენებს. კომპანიის ინფორმაციით, სისტემა მოდელის მუშაობას ასინქრონულად აკვირდება და შესაძლო შეუსაბამობის აღმოჩენის შემთხვევაში გაფრთხილებას ქმნის.

ვისთვის გახდება GPT-6 Astra ხელმისაწვდომი

GPT-6 Astra-ს გავრცელება თავდაპირველად OpenAI-ის Trusted Access Program-ში ჩართული კომპანიებისთვის დაიწყო. მომდევნო დღეებში მოდელი ხელმისაწვდომი გახდება ChatGPT Plus, Pro, Business და Enterprise მომხმარებლებისთვის.

მოდელზე წვდომა შესაძლებელი გახდება OpenAI API-ისა და AWS-ის მეშვეობითაც. დეველოპერებისთვის API-ში მისი მოდელის იდენტიფიკატორია gpt-6-astra.

API-ის მნიშვნელოვანი დეტალები

GPT-6 Astra მხარს უჭერს Chat Completions-ს, თუმცა ინსტრუმენტების გამოსაძახებლად OpenAI Responses API-ის გამოყენებაა საჭირო. მოდელს არ აქვს მსჯელობის none დონე.

რას ნიშნავს GPT-6 Astra-ს გამოშვება

GPT-6 Astra-ს პრეზენტაციით OpenAI რთული ციფრული სამუშაოების დელეგირებაზე აკეთებს აქცენტს. მოდელის მთავარი მიმართულებებია მაღალი დონის მსჯელობა, კომპიუტერისა და ბრაუზერის გამოყენება, პროფესიულ პროგრამებთან მუშაობა და დავალების განსაზღვრული უფლებამოსილების ფარგლებში შესრულება.

FrontierMath Tier 4-ზე მიღებული 98%, ARC-AGI-3-ზე დაფიქსირებული 99.9% და ExploitBench-ის 100% Astra-ს ტექნიკურ შესაძლებლობებზე მნიშვნელოვან წარმოდგენას ქმნის. ამ ეტაპზე ეს მაჩვენებლები OpenAI-ის მიერ გამოქვეყნებულ შეფასებებს წარმოადგენს.

AI გზამკვლევი რა არის ხელოვნური ინტელექტი? სრული გზამკვლევი: როგორ მუშაობს AI, რა არის LLM და რას ნიშნავს AGI - მარტივ ქართულში.

LLM.GE - გზამკვლევი ხელოვნურ ინტელექტში

LLM.GE არის ქართულ-ენოვანი პლატფორმა, რომელზეც ყოველდღიურად ქვეყნდება AI და ტექნოლოგიების სიახლეები, ახალი მოდელების, კვლევებისა და პრაქტიკული ინსტრუმენტების შესახებ. საიტის მიზანია, მკითხველმა ერთ სივრცეში მიიღოს ზუსტი, გასაგები და დროული ინფორმაცია ტექნოლოგიური ინდუსტრიის მთავარი მოვლენების შესახებ

გამოიწერე სიახლეები

გამოწერის გაუქმება ნებისმიერ დროს შეგიძლიათ Privacy Policy

×