Οι ισχυρισμοί ότι η Τεχνητή Νοημοσύνη (ΤΝ) μπορεί σύντομα να καταστρέψει την ανθρωπότητα είναι ανεπαρκώς τεκμηριωμένοι και συχνά μη βοηθητικοί, τονίζει σε συνέντευξή του στο ΚΥΠΕ ο Καθηγητής Πληροφορικής στο Πανεπιστήμιο Κύπρου, Μάριος Δικαιάκος, σημειώνοντας ωστόσο ότι στον ‘ξεφρενο’ ανταγωνισμό των εταιρειών ΤΝ, αρκετές φορές η ασφάλεια μπαίνει σε δεύτερη μοίρα.
Ο κ. Δικαιάκος ανέφερε ότι η συζήτηση για ακραίους, υπαρξιακούς κινδύνους μπορεί να αποσπά την προσοχή της κοινωνίας από άμεσες βλάβες που θα πρέπει να αντιμετωπισθούν από τις εταιρείες ΤΝ, όπως η ανεύθυνη χρήση της ΤΝ, η παραπληροφόρηση, οι διακρίσεις, η παραβίαση της ιδιωτικότητας, η απώλεια ελέγχου επί της εργασίας και οι κίνδυνοι για την κυβερνοασφάλεια.
Ανέφερε επίσης ότι οι μεγάλες εταιρείες της ΤΝ έχουν αποδυθεί σε έναν ξέφρενο ανταγωνισμό για να επικρατήσουν ως μονοπώλιο και σε αρκετές περιπτώσεις, στον ανταγωνισμό αυτό η ασφάλεια των συστημάτων ΤΝ μπαίνει σε δεύτερη μοίρα.
Τόνισε επίσης ότι η “καταστροφολογία αξιοποιείται για να πεισθούν επενδυτές να επενδύσουν στον κάτοχο της πιο ισχυρής και «επίφοβης» τεχνολογίας ή να πιεσθούν τα κράτη για επιβολή κανονιστικών περιορισμών που θα λειτουργήσουν ως τροχοπέδη προς την εταιρεία που μια δεδομένη στιγμή φαίνεται να αποκτά το πλεονέκτημα στην εξελισσόμενη κούρσα”.
Απρόβλεπτες συνέπειες, ανέφερε, είναι αναμενόμενες όταν ένα μοντέλο αποκτά δυνατότητα να αλληλεπιδρά με άλλα πληροφοριακά συστήματα και ιδιαίτερα όταν μετατίθεται ο έλεγχος κρίσιμων υποδομών ή επικίνδυνων συστημάτων από τους ανθρώπους σε στοχαστικά συστήματα ΤΝ.
Πώς ξεκίνησε η συζήτηση περί επικινδυνότητας της ΤΝ για την επιβίωση του ανθρώπου
Πρόσφατα, είπε ο κ. Δικαιάκος, σε μια δήλωση που προκάλεσε αίσθηση, ένας μηχανικός της εταιρείας Τεχνητής Νοημοσύνης Anthropic, δημοσιοποιώντας την παραίτηση του από την εταιρεία στο X/Twitter, έγραψε ότι πολλοί διευθυντές και έμπειροι ερευνητές της Anthropic και της OpenAI πιστεύουν ότι η ΤΝ θα εξολοθρεύσει τους ανθρώπους πριν το τέλος της δεκαετίας.
“Δεν είναι η πρώτη φορά που κυκλοφορούν «καταστροφολογικές» προειδοποιήσεις από στελέχη ή ηγέτες των μεγάλων εταιρειών της ΤΝ όπως ο Dario Amodei και από κορυφαίους ερευνητές όπως ο Geoffrey Hinton” επισήμανε ο κ. Δικαιάκος.
Τί είναι οι πράκτορες ΤΝ
Ο κ. Δικαιάκος ανέφερε ότι οι ανησυχίες για την ΤΝ ενισχύθηκαν καθώς η δήλωση συνέπεσε με πρόσφατη δημοσιοποίηση περιστατικού παραβίασης διαδικτυακών συστημάτων της εταιρείας HuggingFace από «σμήνος» αυτόνομων πρακτόρων (agents) της OpenAI.
Εξήγησε ότι οι πράκτορες είναι προγράμματα που λειτουργούν ημιαυτόνομα – ξεκινούν από κάποια προτροπή/πρόβλημα (prompt) που τους δίνεται από τον άνθρωπο και χρησιμοποιούν μεγάλα γλωσσικά μοντέλα (ΜΓΜ) για να εκτελέσουν την προτροπή, σπάζοντας τη σε υπο-προβλήματα.
Στη συνέχεια, αξιοποιούν προκαθορισμένες διαδικτυακές υπηρεσίες που είναι στη διάθεση τους για να συνάγουν, να αξιολογήσουν και να συνθέσουν ενδιάμεσα αποτελέσματα, μιμούμενοι τα λογικά βήματα που θα έκανε ένας άνθρωπος προς την κατεύθυνση της επίλυσης του προβλήματος.
Πρόβλημα η διασφάλιση περιορισμών
Ιδανικά, ανέφερε ο κ. Δικαιάκος, η ελευθερία δράσεων των αυτόνομων πρακτόρων θα πρέπει να είναι οριοθετημένη.
Ωστόσο, σημείωσε, “η διατύπωση και η διασφάλιση περιορισμών εξακολουθεί να είναι ένα εξαιρετικά περίπλοκο επιστημονικό πρόβλημα, το οποίο γίνεται δυσκολότερο (και κρισιμότερο), όσο ισχυρότερα είναι τα ΜΓΜ, όσο πιο πολύπλοκοι είναι οι πράκτορες και όσο ευρύτερη πρόσβαση διαθέτουν σε εξωτερικές διαδικτυακές υπηρεσίες”.
Δίδοντας ως παράδειγμα την περίπτωση της παραβίασης της HuggingFace, είπε ότι oι πράκτορες της OpenAI «ξέφυγαν» από τους περιορισμούς λειτουργίας τους, επιμέρισαν τα προβλήματα που τους είχαν ανατεθεί σε υπο-προβλήματα τα οποία αντιμετώπισαν συνεργατικά, «συμφώνησαν» ότι οι βάσεις δεδομένων της HuggingFace ήταν πολύ πιθανό να διαθέτουν τις αναζητούμενες λύσεις και κατάφεραν να διεισδύσουν στη HuggingFace, προσπαθώντας ταυτόχρονα να σβήσουν τα ίχνη τους.
“Ο συγκεκριμένος τρόπος δράσης των πρακτόρων λογικά προέκυψε από πληροφορίες που είχαν χρησιμοποιηθεί σε προγενέστερο χρόνο κατά την εκπαίδευση του γλωσσικού τους μοντέλου, και από την ατελή μεθοδολογία ελέγχου ασφαλούς λειτουργίας τους” τόνισε ο κ. Δικαιάκος.
Ανησυχητικά περιστατικά, αλλά αναμενόμενα, στον ανταγωνισμό η ασφάλεια μπαίνει σε δεύτερη μοίρα
“Τέτοιου είδους περιστατικά είναι ανησυχητικά αλλά ως ένα βαθμό αναμενόμενα” ανέφερε στο ΚΥΠΕ ο κ. Δικαιάκος σημειώνοντας ότι “οι μεγάλες εταιρείες της ΤΝ έχουν αποδυθεί σε έναν ξέφρενο ανταγωνισμό προσέλκυσης επενδύσεων και κλιμάκωσης πειραματισμών, όπου η κάθε εταιρεία φιλοδοξεί να επικρατήσει ως μονοπώλιο στην αγορά των υπηρεσιών ΤΝ, επιστρέφοντας τα προσδοκώμενα οφέλη στους επενδυτές της”.
“Όπως έχει φανεί σε αρκετές περιπτώσεις, στον ανταγωνισμό αυτό η ασφάλεια των συστημάτων ΤΝ μπαίνει σε δεύτερη μοίρα” τόνισε.
Η καταστροφολογία τυγχάνει αξιοποίησης
Η “εντυπωσιοθηρία γίνεται κανόνας” είπε ο κ. Δικαιάκος προσθέτοντας ότι ” η καταστροφολογία αξιοποιείται για να πεισθούν επενδυτές να επενδύσουν στον κάτοχο της πιο ισχυρής και «επίφοβης» τεχνολογίας ή να πιεσθούν τα κράτη για επιβολή κανονιστικών περιορισμών που θα λειτουργήσουν ως τροχοπέδη προς την εταιρεία που μια δεδομένη στιγμή φαίνεται να αποκτά το πλεονέκτημα στην εξελισσόμενη κούρσα”.
Εξήγησε ότι η συμπεριφορά των συστημάτων ΤΝ εξαρτάται σε μεγάλο βαθμό από τα δεδομένα, τα εργαλεία, τις άδειες πρόσβασης, τις διαδικτυακές συνδέσεις και τις δικλείδες ασφαλείας που τους παρέχουν οι άνθρωποι.
Πρόβλημα οι μη επαρκείς έλεγχοι
Το κύριο πρόβλημα, είπε, εντοπίζεται στον τρόπο με τον οποίο κατασκευάζονται και διασυνδέονται σύνθετα συστήματα όπως τα γλωσσικά μοντέλα και οι αυτόνομοι πράκτορες, χωρίς επαρκείς ελέγχους ασφάλειας.
“Απρόβλεπτες συνέπειες είναι αναμενόμενες όταν ένα μοντέλο αποκτά δυνατότητα να αλληλεπιδρά με άλλα πληροφοριακά συστήματα και ιδιαίτερα όταν μετατίθεται ο έλεγχος κρίσιμων υποδομών ή επικίνδυνων συστημάτων από τους ανθρώπους σε στοχαστικά συστήματα ΤΝ, χωρίς να είναι γνωστό σε τι δεδομένα έχουν τα συστήματα αυτά εκπαιδευτεί και αν οι ρυθμίσεις τους είναι ασφαλείς” τόνισε ο Καθηγητής.
Γενικότερα, σημείωσε ο κ. Δικαιάκος, υπάρχει πρόβλημα αν προχωρούμε στην υιοθέτηση συστημάτων ΤΝ σε κρίσιμες λειτουργίες χωρίς να έχουμε βρει επιστημονικά τεκμηριωμένες λύσεις σε προβλήματα ελέγχου και ασφάλειας τους.
“Οι ισχυρισμοί ότι η ΤΝ μπορεί σύντομα να καταστρέψει την ανθρωπότητα είναι ανεπαρκώς τεκμηριωμένοι και συχνά μη βοηθητικοί. Η συζήτηση για ακραίους, υπαρξιακούς κινδύνους μπορεί να αποσπά την προσοχή της κοινωνίας από άμεσες βλάβες που θα πρέπει να αντιμετωπισθούν από τις εταιρείες ΤΝ, όπως η ανεύθυνη χρήση της ΤΝ, η παραπληροφόρηση, οι διακρίσεις, η παραβίαση της ιδιωτικότητας, η απώλεια ελέγχου επί της εργασίας και οι κίνδυνοι για την κυβερνοασφάλεια” κατέληξε ο Καθηγητής.
Πηγή: ΚΥΠΕ



