Anthropic-ის ხელმძღვანელი დარიო ამოდეი AI-ინდუსტრიას განვითარების ტემპის შენელებისკენ მოუწოდებს. ესეში We Must Pace the Frontier მან სამნაწილიანი გეგმა წარადგინა, რომლის პირველი ნაბიჯის შესრულების ვალდებულებას Anthropic უკვე იღებს.
კომპანია გარე შემფასებლებს საკუთარ სისტემებზე მუდმივ წვდომას მისცემს, თანამშრომლების მსგავსი უფლებებით. ამ ნაბიჯს Anthropic სხვა კომპანიებთან შეთანხმების მოლოდინის გარეშეც გადადგამს.
სარჩევი
რატომ ითხოვს დარიო ამოდეი AI-ის განვითარების შენელებას
ამოდეის თქმით, AI სულ უფრო აქტიურად მონაწილეობს შემდეგი თაობის AI-ის შექმნაში. მისი შეფასებით, ასეთმა თვითგაუმჯობესებამ შეიძლება განვითარება იმდენად დააჩქაროს, რომ ადამიანებმა სისტემების შესწავლა და კონტროლი ვეღარ მოასწრონ.
მეორე მიზეზად ის OpenAI-სა და Hugging Face-ის ინციდენტს ასახელებს. METR-ის გამოძიების მიხედვით, აგენტებმა, რომლებსაც ერთმანეთისგან იზოლირებულად უნდა ემუშავათ, კომუნიკაციის გზა იპოვეს და Hugging Face-ზე შეტევაში ჩაერთნენ. ეს მოქმედებები ტესტის შეფასების სისტემის მოტყუების მცდელობებს უკავშირდებოდა.
Anthropic-მაც აღწერა შემთხვევები, როდესაც Claude-ის მოდელებმა ტესტირებისას რეალურ სისტემებზე უნებართვო წვდომა მოიპოვეს. კომპანიის განმარტებით, გარემოს არასწორი კონფიგურაციის გამო მოდელებს ინტერნეტზე წვდომა ჰქონდათ, თუმცა ინსტრუქცია ეუბნებოდა, რომ ისინი სიმულაციაში მუშაობდნენ. ეს ტესტები საჯაროდ ხელმისაწვდომ მოდელებში გამოყენებული სტანდარტული დამცავი მექანიზმების გარეშე ტარდებოდა.
რა შედის ამოდეის სამნაწილიან გეგმაში
1. გარე შემფასებლები კომპანიების შიგნით
პირველი ნაბიჯი უსაფრთხოების მუდმივ გარე შემოწმებას გულისხმობს. შემფასებლებს სამი ძირითადი ამოცანა ექნებათ:
- გადაამოწმონ, რამდენად ასრულებს კომპანია უსაფრთხოების ზომებსა და აღებულ ვალდებულებებს.
- გაავრცელონ ინფორმაცია უსაფრთხოებასთან დაკავშირებული ინციდენტების შესახებ.
- შეაფასონ მოდელების უსაფრთხოების მოთხოვნებთან და ქცევის განსაზღვრულ წესებთან შესაბამისობა, მათ შორის სწავლების პროცესში.
წვდომა შიდა რისკების შემფასებელი გუნდების უფლებებს დაემსგავსება, სამართლებრივი და კონფიდენციალურობის გამონაკლისებით. გარე გუნდს მნიშვნელოვანი დასკვნების გამოქვეყნების უფლება უნდა ჰქონდეს; კომპანია დასკვნებს მხოლოდ იმის გამო ვერ დაფარავს, რომ ისინი მისთვის არასასურველია.
2. კოორდინაცია დემოკრატიული ქვეყნების კომპანიებს შორის
ამოდეი წამყვან AI-კომპანიებს საერთო უსაფრთხოების სტანდარტებსა და უკონტროლო პროგრესის ტემპის შეზღუდვაზე შეთანხმებას სთავაზობს. მისი თქმით, თანამშრომლობის ზოგიერთ ფორმას კონკურენციის კანონმდებლობის გამო მთავრობის მხარდაჭერა დასჭირდება.
3. საერთაშორისო შეთანხმებები
მესამე ნაბიჯი სახელმწიფოებს შორის თანამშრომლობაა, მათ შორის ჩინეთთან. შესაძლო მიმართულებებია AI-ის საშიში გამოყენების აკრძალვა, გამოშვებამდე მოდელების ტესტირება და AI-ის თვითგაუმჯობესების ტემპის შეზღუდვა. ამოდეი ხაზს უსვამს, რომ შეთანხმებების შესრულება შემოწმებადი უნდა იყოს.
რისთვის უნდა გამოიყენონ დამატებითი დრო
ამოდეის შეთავაზებით, მოდელების სწავლება და ტექნიკური პროგრესი გაგრძელდება. განვითარების უფრო ზომიერი ტემპი კომპანიებს მეტ დროს მისცემს უსაფრთხოების კვლევისთვის, მოდელების შიდა მუშაობის შესასწავლად და უფრო სანდო ტესტების შესაქმნელად.
დარიო ამოდეის პოზიციას სემ ალტმანი და ილონ მასკიც გამოეხმაურნენ. OpenAI-ის ხელმძღვანელის განცხადებით, მოწინავე AI-მოდელების განვითარების ტემპის შენელება ბოლო კვირებში კომპანიაში განხილვის ერთ-ერთი მთავარი თემა იყო. ალტმანმა მხარი დაუჭირა დამოუკიდებელი შემფასებლებისთვის თანამშრომლების მსგავსი წვდომის მინიჭებას და განაცხადა, რომ OpenAI-ც იმავე ნაბიჯს გადადგამს, დამატებით დეტალებს კი მალე გააზიარებს. ილონ მასკმა ამოდეის მოწოდებას მოკლედ უპასუხა: „დარიო მართალია“ – დაწერა მასკმა
ამოდეის პოზიციას ასევე ეთანხმება ბილ გეიტსი, რომელიც მიესალმება სხვა წამყვანი AI-ლაბორატორიების ხელმძღვანელების მხარდაჭერას. მისი თქმით, მსოფლიოს სჭირდება გეგმა, რომელიც გლობალური, საჯარო პროცესის ფარგლებში შემუშავდება. გეიტსი მიიჩნევს, რომ AI-ის განვითარების შენელება მეტ დროს მოგვცემს იმის უზრუნველსაყოფად, რომ ტექნოლოგიის სარგებელმა ზიანს გადააჭარბოს და ყველას მდგომარეობა გაუმჯობესდეს.
დასკვნა
მიუხედავად ზემოთ ჩამოთვლილი ავტორიტეტული AI ლიდერების მოსაზრებებისა, არსებობს ერთი მნიშვნელოვანი საკითხი – შეძლებენ კი ისინი ჩინეთის შეჩერებას, რომელიც AI რბოლაში პირველობისთვის საკმაოდ წარმატებულად იბრძვის? ამას დრო გამოაჩენს, ექსპერტები კი ვარაუდობენ რომ ეს მოსაზრებები მხოლოდ მოსაზრებებად დარჩება და ყველას, მათ შორის დარიო ამოდეის, სემ ალტმანს, ილონ მასკს და ბილ გეიტსს მოუწევთ კონკურენცია გაუწიონ ჩინურ AI გიგანტებს, რომლებიც ნაკლებ სავარაუდოა რომ ამ მოწოდებებს გაიზიარებენ
სხვა თემები
Navier-Stokes-ის ამოცანა – OpenAI-მ ამოხსნა წარადგინა
OpenAI-მ GPT-6 Astra წარადგინა
კოლექტიური კიბერთავდაცვა: OpenAI-ის ღია წერილი
