Alibaba -ის Qwen გუნდმა Qwen3.8-27B-ის ღია წონები გამოაქვეყნა. ეს არის Qwen3.8-Max-ის წარდგენის გაგრძელება, როდესაც კომპანიამ Qwen3.8 ოჯახის open-weight მოდელების გამოშვება დააანონსა.
Qwen3.8-27B-თან ერთად უკვე ხელმისაწვდომია გაცილებით დიდი Qwen3.8-2.4T-A95B-ის წონებიც. შედეგად, დეველოპერებს შეუძლიათ აირჩიონ შედარებით კომპაქტური, მრავალმოდალური მოდელი ან Max კლასის მასშტაბური სისტემა რთული AI აგენტებისთვის.
სარჩევი
Qwen3.8-27B-ის open weights უკვე ხელმისაწვდომია
Qwen3.8-27B არის 27 მილიარდი პარამეტრის მქონე dense მოდელი. ის თავიდანვე მრავალმოდალურად არის შექმნილი და ტექსტთან ერთად გამოსახულებებისა და ვიდეოების დამუშავებაც შეუძლია.
Qwen-ის განცხადებით, მოდელი საერთო შესაძლებლობებით Qwen3.7-Plus-ს უსწრებს და განსაკუთრებით კარგად მუშაობს რეალურ პროგრამირებასა და საოფისე სამუშაო პროცესებში. ოფიციალურ აღწერაში ყურადღება გამახვილებულია კვლევაზე, პროფესიულ დავალებებზე, ავტონომიურ დაგეგმვასა და მრავალსაფეხურიანი ამოცანების ბოლომდე შესრულებაზეც.
Qwen3.8-27B-ის მთავარი მახასიათებლებია:
- 27 მილიარდი პარამეტრი და dense არქიტექტურა;
- ტექსტის, გამოსახულებებისა და ვიდეოების დამუშავების მხარდაჭერა;
- პროგრამირებისა და პროფესიული სამუშაო პროცესებისთვის გაუმჯობესებული შესაძლებლობები;
- AI აგენტებისთვის უფრო ძლიერი დაგეგმვა და გარემოდან მიღებულ უკუკავშირზე რეაგირება;
- აზროვნების რეჟიმისა და მსჯელობის სიღრმის მართვის შესაძლებლობა.
მოდელის ზომა მას Qwen3.8 ოჯახის 2.4-ტრილიონიან ვარიანტთან შედარებით უფრო მოქნილ არჩევანად აქცევს. Qwen მას ადგილობრივ ინფრასტრუქტურაზე გასაშვები აპლიკაციებისა და ისეთი პროექტებისთვის პოზიციონირებს, სადაც ხარისხთან ერთად ეფექტიანობაც მნიშვნელოვანია.
262K კონტექსტი და გაფართოება მილიონ ტოკენამდე
Qwen3.8-27B ნატიურად 262,144-ტოკენიან კონტექსტს უჭერს მხარს. ეს მოდელს საშუალებას აძლევს, ერთ სამუშაო პროცესში დიდი მოცულობის კოდი, დოკუმენტები და ხანგრძლივი საუბრის ისტორია დაამუშაოს.
ოფიციალური მოდელის ბარათის მიხედვით, კონტექსტის გაფართოება 1,000,000 ტოკენამდე YaRN-ის გამოყენებით არის შესაძლებელი. მნიშვნელოვანია განსხვავება – 262K მოდელის ნატიური კონტექსტია, ხოლო მილიონ ტოკენამდე გაზრდა დამატებით კონფიგურაციას მოითხოვს.
Qwen3.8-2.4T-A95B-ის წონებიც გამოქვეყნდა
Qwen-მა ცოტა ხნით ადრე Qwen3.8-2.4T-A95B-ის ღია წონებიც გამოაქვეყნა. ეს არის Mixture-of-Experts არქიტექტურის მოდელი, რომელსაც ჯამში 2.4 ტრილიონი პარამეტრი აქვს, თუმცა თითოეული მოთხოვნის დამუშავებისას 95 მილიარდი პარამეტრი აქტიურდება.
კომპანია მას Max კლასის მოდელად აღწერს და რთული პროგრამირების, კვლევის, პროფესიული მუშაობისა და ხანგრძლივი აგენტური პროცესებისთვის განიხილავს. მისი მასშტაბიდან გამომდინარე, ეს ვარიანტი პირველ რიგში უფრო ძლიერი გამოთვლითი ინფრასტრუქტურის მქონე გუნდებისთვისაა განკუთვნილი.
ღია მოდელი და Qwen3.8-Max სრულად იდენტური არ არის
Qwen3.8-2.4T-A95B და ღრუბლოვან სერვისში ხელმისაწვდომი Qwen3.8-Max ერთმანეთისგან უნდა გაიმიჯნოს. ოფიციალური მოდელის ბარათის მიხედვით, Qwen3.8-Max დაფუძნებულია 2.4T-A95B-ზე, მაგრამ დამატებით სთავაზობს ვიზუალურ შეყვანას, non-thinking რეჟიმს, ნაგულისხმევ მილიონტოკენიან კონტექსტსა და ჩაშენებულ ინსტრუმენტებს.
ღია Qwen3.8-2.4T-A95B კი მხოლოდ ტექსტზე მუშაობს და ყველა მოთხოვნისთვის აზროვნების რეჟიმს იყენებს. ამიტომ გამოქვეყნებული წონები Qwen3.8-Max-ის საფუძველს წარმოადგენს, მაგრამ ღრუბლოვანი ვერსიის ყველა ფუნქციას არ იმეორებს.
სად შეიძლება Qwen3.8-27B-ის ჩამოტვირთვა?
Qwen3.8 ოჯახის მოდელები თავმოყრილია Hugging Face-ის ოფიციალურ კოლექციაში და ModelScope-ზე. იქ ხელმისაწვდომია მოდელების წონები, კონფიგურაციის ფაილები და გაშვების ტექნიკური ინსტრუქციები.
Qwen3.8-27B თავსებადია ისეთ ინსტრუმენტებთან, როგორებიცაა Hugging Face Transformers, vLLM, SGLang და TokenSpeed. ეს დეველოპერებს საშუალებას აძლევს, მოდელი სხვადასხვა ტიპის ინფრასტრუქტურასა და სამუშაო პროცესში დანერგონ.
ამ გამოშვებით Qwen-მა წინა ანონსში მიცემული დაპირება შეასრულა. Qwen3.8-27B ხელმისაწვდომი გახდა მათთვის, ვისაც შედარებით კომპაქტური მრავალმოდალური მოდელი სჭირდება, ხოლო Qwen3.8-2.4T-A95B უფრო მასშტაბურ აგენტურ და პროფესიულ სისტემებზეა გათვლილი.
სხვა თემები
Qwen3.8-Max წარადგინეს – Alibaba-ის ახალი AI მოდელი
Qwen-image-3.0 – ახალი თაობის გამოსახულების AI
Qwen3.6-35B-A3B: Alibaba-მ AI მოდელის განახლება გამოუშვა
