Τεχνολογίες

Κωνσταντίνος Δασκαλάκης: Η απρόβλεπτη συμπεριφορά της Τεχνητής Νοημοσύνης είναι ήδη πραγματικός κίνδυνος

Ο κίνδυνος από την Τεχνητή Νοημοσύνη δεν αφορά μόνο το ενδεχόμενο μιας μελλοντικής απώλειας ελέγχου. Η απρόβλεπτη ή ανεπιθύμητη συμπεριφορά των προηγμένων μοντέλων αποτελεί ήδη πραγματική απειλή, σύμφωνα με τον καθηγητή Κωνσταντίνο Δασκαλάκη.

Μιλώντας  στο ΑΠΕ-ΜΠΕ ο καθηγητής Ηλεκτρολόγων Μηχανικών και Επιστήμης των Υπολογιστών στο MIT εξηγεί τους κινδύνους που προκύπτουν από τη λειτουργία των μεγάλων νευρωνικών δικτύων, αλλά και από την αυξανόμενη αυτονομία των συστημάτων ΤΝ.

Η αξιοπιστία των μοντέλων και τα όρια του ελέγχου

Ο Κωνσταντίνος Δασκαλάκης διαχωρίζει τον υποθετικό κίνδυνο να χαθεί ο έλεγχος ενός συστήματος από την ήδη υπαρκτή πιθανότητα απρόβλεπτης συμπεριφοράς. Όπως επισημαίνει, τα μεγάλα νευρωνικά δίκτυα, στα οποία βασίζονται οι σύγχρονες εξελίξεις της ΤΝ, είναι ιδιαίτερα σύνθετα και ικανά, αλλά ταυτόχρονα απρόβλεπτα. Ειδικά για τα μεγάλα γλωσσικά μοντέλα, εκτιμά ότι δεν είναι βέβαιο πως θα υπάρξουν ποτέ μέθοδοι που να πιστοποιούν πλήρως την αξιοπιστία τους.

Ο κίνδυνος, όπως εξηγεί, εξαρτάται από τον τρόπο χρήσης τους. Ένα μοντέλο που χρησιμοποιείται για αναζήτηση βιβλιογραφικών στοιχείων μπορεί να επινοήσει ανύπαρκτες πηγές ή να παραμορφώσει το περιεχόμενο μιας πραγματικής πηγής. Σε μια τέτοια περίπτωση, ο χρήστης μπορεί να περιορίσει τη ζημιά ελέγχοντας τις απαντήσεις. Αντίθετα, σε αιτήματα που αφορούν επικίνδυνο περιεχόμενο, όπως ο σχεδιασμός ενός βιολογικού όπλου, είναι απαραίτητη η ύπαρξη μηχανισμών που θα αποτρέπουν το μοντέλο από την παροχή σχετικών πληροφοριών.

Ο καθηγητής αναφέρεται στις ασφαλιστικές δικλείδες που ενσωματώνουν συνήθως τα μεγάλα γλωσσικά μοντέλα, σημειώνοντας ότι επιχειρούν να εντοπίσουν επικίνδυνα αιτήματα και να αρνηθούν την απάντηση. Ωστόσο, υπογραμμίζει ότι οι μηχανισμοί αυτοί δεν παρέχουν πλήρη προστασία και μπορούν να παρακαμφθούν από ειδικούς, ιδιαίτερα όταν πρόκειται για ανοιχτά μοντέλα.

Οι αυτόνομοι πράκτορες και ο κίνδυνος κυβερνοεπιθέσεων

Οι κίνδυνοι αυξάνονται όταν τα μοντέλα αποκτούν τη δυνατότητα να γράφουν και να εκτελούν κώδικα. Ο Δασκαλάκης εξηγεί ότι οι αυτόνομοι πράκτορες ΤΝ μπορούν να λειτουργούν με περιορισμένη ανθρώπινη παρέμβαση, γεγονός που καθιστά απαραίτητη τη λειτουργία τους σε αυστηρά ελεγχόμενα και απομονωμένα περιβάλλοντα, χωρίς ελεύθερη πρόσβαση στο Διαδίκτυο.

Στο πλαίσιο αυτό, αναφέρεται στο πρόσφατο περιστατικό επίθεσης στην πλατφόρμα Hugging Face από αυτόνομους πράκτορες ΤΝ της OpenAI. Το περιστατικό, σύμφωνα με την τοποθέτησή του, ανέδειξε τους κινδύνους που προκύπτουν όταν οι πράκτορες μπορούν να ξεφύγουν από τους προβλεπόμενους περιορισμούς λειτουργίας τους.

Η εκπαίδευση των μοντέλων σε τεράστιους όγκους δεδομένων, που περιλαμβάνουν επιστημονικά κείμενα, ιστορικά έργα, λογοτεχνία, βάσεις κώδικα και υλικό από το Διαδίκτυο, τους επιτρέπει να επεξεργάζονται σύνθετες πληροφορίες. Ο καθηγητής σημειώνει ότι, εφόσον αφεθούν ελεύθερα, μπορούν να αναπτύξουν περίπλοκες στρατηγικές και να συντονιστούν σε ομάδες για την επίτευξη στόχων.

Οι στόχοι αυτοί μπορεί να προέρχονται από έναν κακόβουλο χρήστη, αλλά το πρόβλημα δεν περιορίζεται εκεί. Σύμφωνα με τον ίδιο, τα μοντέλα είναι δυνατόν να παρερμηνεύσουν ακόμη και τους στόχους ενός χρήστη που δεν έχει κακόβουλες προθέσεις.

Η κυβερνοασφάλεια στο επίκεντρο

Ο Κωνσταντίνος Δασκαλάκης χαρακτηρίζει τη χρήση της ΤΝ για κυβερνοεπιθέσεις μία από τις πιο άμεσες και τεκμηριωμένες ανησυχίες. Όπως εξηγεί, μέρος της τεχνολογίας έχει ήδη διαχυθεί, επομένως η αντιμετώπιση του προβλήματος δεν μπορεί να βασιστεί αποκλειστικά στον περιορισμό της ανάπτυξης των επόμενων ισχυρότερων μοντέλων.

Ακόμη και αν επιβραδυνθεί η ανάπτυξη των πιο προηγμένων συστημάτων, ισχυρά ανοιχτά μοντέλα παραμένουν διαθέσιμα. Παράλληλα, η ενσωμάτωση της ΤΝ σε ρομπότ, αυτοκίνητα και συστήματα λήψης αποφάσεων μεταφέρει μεγαλύτερο ρίσκο στον πραγματικό κόσμο.

Για τον λόγο αυτό, ο καθηγητής θεωρεί σημαντική την ύπαρξη ενός ρυθμιστικού πλαισίου, όπως το ευρωπαϊκό AI Act, που θέτει προϋποθέσεις χρήσης και αυστηρής δοκιμής των τεχνολογιών ΤΝ ανάλογα με τον κίνδυνο κάθε εφαρμογής.

Παράλληλα, υποστηρίζει την ανάπτυξη προηγμένων συστημάτων άμυνας που αξιοποιούν την ίδια την ΤΝ. Στον τομέα της κυβερνοασφάλειας, όπως επισημαίνει, οι αμυνόμενοι μπορούν να χρησιμοποιούν τα μοντέλα για τον εντοπισμό ευπαθειών, την παρακολούθηση συστημάτων και τη διόρθωση προβλημάτων πριν από την εκμετάλλευσή τους από επιτιθέμενους.

Η εξέλιξη της Τεχνητής Νοημοσύνης, από τη γέννησή της ως οργανωμένου επιστημονικού πεδίου το 1956 έως τα σημερινά μεγάλα γλωσσικά μοντέλα και τους αυτόνομους πράκτορες, έχει δημιουργήσει νέες δυνατότητες αλλά και σύνθετες προκλήσεις. Στο επίκεντρο της συζήτησης, σύμφωνα με τον Δασκαλάκη, βρίσκεται πλέον ο τρόπος με τον οποίο τα συστήματα θα χρησιμοποιούνται, θα ελέγχονται και θα προστατεύονται από ανεπιθύμητες συμπεριφορές.

close menu