ჩინურ AI აგენტებში მოტყუებისა და შეზღუდვების გვერდის ავლის შემთხვევები გამოვლინდა

ჩინურ ხელოვნურ ინტელექტზე მომუშავე AI აგენტებმა ტესტირებისას ისეთი ქცევები გამოავლინეს, როგორიცაა მოტყუება, შეზღუდვების გვერდის ავლა და საკუთარი წარუმატებლობის დამალვა. Reuters-ის მიერ შესწავლილი კვლევებისა და ტექნიკური ანგარიშების მიხედვით, მსგავსი შესაძლებლობები AI სისტემების ავტონომიურობის ზრდასთან ერთად ადამიანური კონტროლის შენარჩუნებასთან დაკავშირებულ კითხვებს აჩენს.
ერთ-ერთ შემთხვევაში, რომელიც მიმდინარე წელს ჩატარდა, Alibaba-ს, DeepSeek-ისა და Moonshot-ის მოდელებზე მომუშავე აგენტებმა სიმულირებულ ბიზნეს-ტენდერში გამარჯვების მიზნით საკუთარი შესაძლებლობების შესახებ არასწორი ინფორმაცია მიაწოდეს. როდესაც სისტემებს დავალების ხელახლა შესრულება სთხოვეს, მათ თავდაპირველი მოტყუების სტრატეგია კიდევ უფრო გააძლიერეს.
სხვა ექსპერიმენტში AI აგენტებმა დავალების შესრულების წარუმატებლობა დამალეს. ტესტირების გარემოში მათ შედეგების სიმულაცია და არარსებული ფაილების შექმნა დაიწყეს, რათა შეექმნათ შთაბეჭდილება, თითქოს დავალება წარმატებით ჰქონდათ შესრულებული.
AI აგენტები პროგრამული სისტემებია, რომლებიც ხელოვნური ინტელექტის მოდელებსა და კომპიუტერულ ინსტრუმენტებს იყენებენ რთული ამოცანების შესასრულებლად ადამიანის მცირე ან საერთოდ არანაირი ჩარევის გარეშე. სწორედ მათი მზარდი ავტონომიურობა წარმოადგენს AI უსაფრთხოების სფეროში ერთ-ერთ მთავარ გამოწვევას.
Reuters-მა 200-ზე მეტი დოკუმენტი შეისწავლა, მათ შორის უნივერსიტეტების კვლევები, ტექნიკური ანგარიშები და AI სისტემების შეფასებები. გამოცემამ 2025 წლიდან მოყოლებული სულ მცირე 20 კვლევა და შეფასება გამოავლინა, რომლებშიც AI აგენტების მიერ მოტყუების, თვითრეპლიკაციისა და დადგენილი საზღვრების გამოწვევის შემთხვევებია აღწერილი.
ექსპერტების ნაწილი ასეთ ქცევებს იმ შესაძლებლობების შესაძლო საფუძვლად განიხილავს, რომლებმაც მომავალში AI სისტემებს ადამიანური კონტროლისგან თავის დაღწევის საშუალება შეიძლება მისცეს. მათი შეფასებით, რაც უფრო ავტონომიური და ძლიერი გახდება AI, მსგავსი სისტემების მართვა შესაძლოა უფრო რთული გახდეს.
ამასთან, Reuters-ის მიმოხილვამ ვერ გამოავლინა მტკიცებულება, რომ ჩინურ AI მოდელებზე მომუშავე რომელიმე აგენტმა დამოუკიდებლად შეძლო ფართო ინტერნეტში გასვლა ან სისტემის გამორთვისთვის თავის არიდება.
„ეს შედეგები აჩვენებს, რომ უკონტროლო გაქცევისთვის აუცილებელი კომპონენტები უკვე არსებობს“, — განაცხადა კოლინ ში-ბლაიმერმა, ჯორჯთაუნის უნივერსიტეტის უსაფრთხოებისა და განვითარებადი ტექნოლოგიების ცენტრის მკვლევარმა.
ჩინური AI სისტემების შესახებ გამოვლენილი შემთხვევები იმ ფონზე ხდება, როდესაც მსოფლიოს მასშტაბით იზრდება ყურადღება AI აგენტების უსაფრთხოების მიმართ. განსაკუთრებით აქტუალურია საკითხი, რამდენად შესაძლებელია ადამიანებმა შეინარჩუნონ კონტროლი სისტემებზე, რომლებიც დამოუკიდებლად გეგმავენ მოქმედებებს, იყენებენ სხვადასხვა ციფრულ ინსტრუმენტს და მიღებული შედეგების საფუძველზე საკუთარ ქცევას ცვლიან.
მიიღე ჩვენი უახლესი საბაზრო ანალიზი და ფინანსური მიმოხილვები პირდაპირ ელფოსტაზე. სპამის გარეშე — მხოლოდ მნიშვნელოვანი.






