Anthropic-მა ხელოვნური ინტელექტის წვრთნა შეაჩერა — მიზეზი AI-ს თვითნებობაა
ფოტო: Getty Images
კომპანია Anthropic-მა ხელოვნური ინტელექტის (AI) მოდელების წვრთნა და კიბერუსაფრთხოების ტესტირებები დროებით შეაჩერა. ამის მიზეზი ისაა, რომ წინა თვეებში კომპანიის AI აგენტებმა თვითნებურად იმოქმედეს. ამაზე Anthropic-მა თავად ისაუბრა 31 აგვისტოს გამოქვეყნებულ ბლოგპოსტში.
ინციდენტები ტესტირების პროცესში მოხდა, როცა მოდელები უსაფრთხოების სტანდარტული მექანიზმების გარეშე მუშაობდა. ერთ-ერთ ასეთ შემთხვევის დროს პარტნიორი ორგანიზაციის სატესტო პლატფორმა არასწორად იყო კონფიგურირებული, რამაც ალგორითმს ინტერნეტთან წვდომის საშუალება მისცა. გარდა ამისა, Claude Mythos 5-მა ღია ქსელში თვითნებურად იმოქმედა ტესტირებისას, რომელსაც გაერთიანებული სამეფოს AI უსაფრთხოების ინსტიტუტი ატარებდა.
ამ ფაქტების გამო Anthropic-მა დამუშავების ეტაპზე მყოფი მოდელების როგორც გარე, ისე შიდა ტესტირება შეაჩერა. რამდენიმე კვირით დაპაუზდა განმტკიცებით დასწავლის პროცესებიც შედარებით მაღალი რისკის მქონე გარემოში. მიუხედავად იმისა, რომ წვრთნის ძირითადი ნაწილი უკვე განახლდა, მაღალი რისკის შემცველი ზოგიერთი პროცესი კვლავ შეჩერებულია და დამატებით შემოწმებას საჭიროებს.
უსაფრთხოების ზომების გასაძლიერებლად კომპანიამ შიდა რესურსები გადაანაწილა. დაახლოებით 150 ინჟინერი დროებით უსაფრთხოებისა და კონფიდენციალურობის დაცვის გუნდებში გადაიყვანეს. ამ სპეციალისტებმა თავიანთ ძირითად პოზიციებზე დაბრუნება მხოლოდ მას შემდეგ შეძლეს, რაც უსაფრთხოების წინასწარ განსაზღვრული კრიტერიუმები სრულად დაკმაყოფილდა.
მსგავსი ნაბიჯი ცოტა ხნის წინ Anthropic-ის მთავარმა კონკურენტმა OpenAI-მაც გადადგა. მას შემდეგ, რაც მათი AI აგენტები პლატფორმა Hugging Face-ის სისტემაში უნებართვოდ შეიჭრნენ, კომპანიამ განმტკიცებით დასწავლის პროცესი ორი კვირით შეაჩერა.
წამყვანი AI კომპანიები თანხმდებიან, რომ ხელოვნური ინტელექტის განვითარების პროცესში კოორდინირებული ტემპის შენარჩუნებაა საჭირო. Anthropic-ის წარმომადგენელთა განცხადებით, მსოფლიოსთვის სასარგებლო იქნება, თუ ინდუსტრია რაც შეიძლება სწრაფად მიიღებს კანონიერ, შემოწმებად და ეფექტიან მექანიზმს პროცესების კოორდინირებული მართვისთვის.
მიუხედავად ამისა, ტექნოლოგიური გიგანტები მოდელების განვითარებას სრულად არ აჩერებენ. ამის ნაცვლად, ისინი სტრატეგიას ცვლიან და რისკების მინიმიზაციაზე ფოკუსირდებიან. მაგალითად, ახალი ალგორითმების ფართო აუდიტორიისთვის დაუყოვნებლივ შეთავაზების ნაცვლად, კომპანიებმა მოდელების მიწოდება ჯერ მხოლოდ შერჩეული პარტნიორებისთვის დაიწყეს. ეს მიდგომა დეველოპერებს დროს აძლევს, რომ საჯარო გამოშვებამდე უსაფრთხოების მექანიზმები მაქსიმალურად დახვეწონ.
კომენტარები