რედაქტორის შენიშვნა: ეს სტატია განახლდა Perplexity-ს, OpenAI-სა და IBM-ის პასუხებით. აგენტური ტექნოლოგია სრულად შედის ხელოვნური ინტელექტის მეინსტრიმში ამ კვირაში OpenAI-ის განცხადებით, რომელმაც დაიქირავა პიტერ სტაინბერგი, ღია კოდის პროგრამული უზრუნველყოფის ჩარჩო OpenClaw-ის შემქმნელი. OpenClaw-ის პროგრამულმა უზრუნველყოფამ გასულ თვეში დიდი ყურადღება მიიპყრო არა მხოლოდ თავისი გაუმჯობესებული შესაძლებლობების (აგენტები, რომლებსაც, მაგალითად, შეუძლიათ თქვენი სახელით ელექტრონული ფოსტის გაგზავნა და მიღება) გამო, არამედ მისი დრამატული უსაფრთხოების ხარვეზების გამოც, მათ შორის თქვენი პირადი კომპიუტერის სრულად ხელში ჩაგდების შესაძლებლობის გამო. ასევე: არის თუ არა Perplexity-ის ახალი „კომპიუტერი“ OpenClaw-ის უფრო უსაფრთხო ვერსია? როგორ მუშაობს აგენტებისადმი არსებული გატაცებისა და მათი დადებითი და უარყოფითი მხარეების შესახებ მცირე ცოდნის გათვალისწინებით, მნიშვნელოვანია, რომ MIT-ისა და პარტნიორი ინსტიტუტების მკვლევრებმა ახლახან გამოაქვეყნეს მასშტაბური კვლევა, რომელიც 30 ყველაზე გავრცელებულ აგენტურ AI სისტემას მოიცავს. შედეგები ცხადყოფს, რომ აგენტური AI ამჟამად უსაფრთხოების კოშმარია, დისციპლინა, რომელიც ხასიათდება ინფორმაციის არგამჟღავნებით, გამჭვირვალობის ნაკლებობით და ძირითადი პროტოკოლების მკაფიო არარსებობით იმის შესახებ, თუ როგორ უნდა ფუნქციონირებდნენ აგენტები. ანგარიშის ყველაზე დიდი გამოცხადება არის ის, თუ რამდენად რთულია იმ ყველა პრობლემის იდენტიფიცირება, რაც აგენტურ AI-ს შეიძლება შეექმნას. ეს ძირითადად დეველოპერების მხრიდან ინფორმაციის არგამჟღავნების შედეგია. „ჩვენ ვადგენთ მუდმივ შეზღუდვებს ანგარიშგებაში აგენტური სისტემების ეკოსისტემურ და უსაფრთხოებასთან დაკავშირებულ მახასიათებლებზე“, – წერს კვლევის მთავარი ავტორი ლეონ შტაუფერი კემბრიჯის უნივერსიტეტიდან და მისი თანამშრომლები MIT-დან, ვაშინგტონის უნივერსიტეტიდან, ჰარვარდის უნივერსიტეტიდან, სტენფორდის უნივერსიტეტიდან, პენსილვანიის უნივერსიტეტიდან და იერუსალიმის ებრაული უნივერსიტეტიდან. ინფორმაციის გაჟღავნების რვა სხვადასხვა კატეგორიაში ავტორებმა აღნიშნეს, რომ აგენტური სისტემების უმეტესობა არანაირ ინფორმაციას არ გვთავაზობს კატეგორიების უმრავლესობისთვის. გამოტოვებები მოიცავს პოტენციური რისკების შესახებ ინფორმაციის არგამჟღავნებას და მესამე მხარის ტესტირების (ასეთის არსებობის შემთხვევაში) შესახებ ინფორმაციის არგამჟღავნებას. წითლად მოცემული ცხრილი, რომელიც აჩვენებს აგენტური სისტემების ინფორმაციის გაუმჟღავნებლობის ყველა გამოტოვებას. 39-გვერდიანი ანგარიში, „2025 წლის AI ინდექსი: განთავსებული აგენტური AI სისტემების სოციო-ტექნიკური მახასიათებლების დოკუმენტირება“, რომლის ჩამოტვირთვაც აქ არის შესაძლებელი, სავსეა ინფორმაციით იმის შესახებ, თუ რამდენად ცოტა რამის თვალყურის დევნება, მიკვლევა, მონიტორინგი და კონტროლია შესაძლებელი დღევანდელ აგენტურ AI ტექნოლოგიაში. მაგალითად, „მრავალი კორპორაციული აგენტისთვის, საჯაროდ ხელმისაწვდომი ინფორმაციიდან გაურკვეველია, არსებობს თუ არა ინდივიდუალური შესრულების კვალის მონიტორინგი“, რაც იმას ნიშნავს, რომ არ არსებობს ზუსტი შესაძლებლობა იმის გასაკონტროლებლად, თუ რას აკეთებს აგენტური AI პროგრამა. ასევე: AI აგენტები უკვე იწვევენ კატასტროფებს – და ამ ფარულმა საფრთხემ შეიძლება შეაფერხოს თქვენი უსაფრთხო დანერგვა. „ოცდაათი აგენტიდან თორმეტი არ უზრუნველყოფს გამოყენების მონიტორინგს ან მხოლოდ მაშინ აგზავნის შეტყობინებას, როდესაც მომხმარებლები გამოყენების ლიმიტს მიაღწევენ“, – აღნიშნეს ავტორებმა. ეს ნიშნავს, რომ თქვენ არ შეგიძლიათ თვალყური ადევნოთ, თუ რამდენ გამოთვლით რესურსს მოიხმარს აგენტური AI – ეს საკვანძო საკითხია იმ საწარმოებისთვის, რომლებსაც ამისთვის ბიუჯეტი უნდა გამოყონ. ამ აგენტების უმეტესობა ასევე არ ანიშნებს რეალურ სამყაროს, რომ ისინი AI არიან, ამიტომ შეუძლებელია იმის ცოდნა, ადამიანთან გაქვთ საქმე თუ ბოტთან. „აგენტების უმეტესობა ნაგულისხმევად არ ამჟღავნებს თავის AI ბუნებას საბოლოო მომხმარებლებისთვის ან მესამე მხარისთვის“, – აღნიშნეს მათ. ინფორმაციის გაჟღვნა, ამ შემთხვევაში, მოიცავს ისეთ საკითხებს, როგორიცაა გენერირებულ სურათის ფაილზე წყლის ნიშნის დასმა, რათა ნათელი იყოს, როდის შეიქმნა სურათი AI-ის მეშვეობით, ან ვებსაიტის „robots.txt“ ფაილზე რეაგირება, რათა აგენტი საიტზე იდენტიფიცირდეს როგორც ავტომატიზაცია და არა როგორც ადამიანი ვიზიტორი. ზოგიერთი ამ პროგრამული ინსტრუმენტი არ იძლევა კონკრეტული აგენტის მუშაობის შეჩერების საშუალებას. Alibaba-ს MobileAgent-ს, HubSpot-ის Breeze-ს, IBM-ის watsonx-ს და ბერლინში, გერმანიაში დაფუძნებული პროგრამული უზრუნველყოფის მწარმოებელ n8n-ის მიერ შექმნილ ავტომატიზაციებს „არ აქვთ დოკუმენტირებული შეჩერების ვარიანტები, მიუხედავად ავტონომიური შესრულებისა“, – განაცხადეს შტაუფერმა და მისმა გუნდმა. „კორპორაციული პლატფორმებისთვის ზოგჯერ მხოლოდ ყველა აგენტის შეჩერების ან განთავსების გაუქმების ვარიანტი არსებობს.“ იმის აღმოჩენა, რომ ვერ აჩერებ რაღაცას, რაც არასწორად მოქმედებს, ერთ-ერთი ყველაზე ცუდი სცენარია დიდი ორგანიზაციისთვის, სადაც მავნე შედეგები აჭარბებს ავტომატიზაციის სარგებელს. ასევე: OpenClaw უსაფრთხოების კოშმარია – 5 წითელი დროშა, რომელიც არ უნდა უგულებელყოთ (სანამ გვიან არ არის). ავტორები ელიან, რომ ეს პრობლემები, გამჭვირვალობისა და კონტროლის საკითხები, გაგრძელდება აგენტებთან დაკავშირებით და კიდევ უფრო გამწვავდება. „აქ დოკუმენტირებული მმართველობითი გამოწვევები (ეკოსისტემის ფრაგმენტაცია, ვებ ქცევის დაძაბულობა, აგენტ-სპეციფიკური შეფასებების არარსებობა) მნიშვნელობას მოიპოვებს აგენტური შესაძლებლობების ზრდასთან ერთად“, – წერენ ისინი. შტაუფერმა და გუნდმა ასევე განაცხადეს, რომ ისინი ცდილობდნენ უკუკავშირის მიღებას იმ კომპანიებისგან, რომელთა პროგრამული უზრუნველყოფაც განიხილეს ოთხი კვირის განმავლობაში. კონტაქტირებულთა დაახლოებით მეოთხედმა უპასუხა, „მაგრამ მხოლოდ 3/30-მა არსებითი კომენტარებით.“ ეს კომენტარები შეტანილ იქნა ანგარიშში, წერენ ავტორები. მათ ასევე აქვთ ფორმა, რომელიც კომპანიებს მიეწოდათ მიმდინარე შესწორებებისთვის. HubSpot-მა, n8n-მა და Alibaba-მ კომენტარის მოთხოვნაზე დაუყოვნებლივ არ უპასუხეს. Perplexity-ის წარმომადგენელი...