Η αποχώρηση του Ντέιβιντ Ρόμπινσον ανοίγει ξανά τη συζήτηση για το αν η ανάπτυξη της τεχνητής νοημοσύνης προχωρά ταχύτερα από τους μηχανισμούς ασφαλείας της.
Με σοβαρές αιχμές για τον τρόπο λειτουργίας της OpenAI αποχώρησε από την εταιρεία ο Ντέιβιντ Ρόμπινσον, ο οποίος είχε την ευθύνη σύνταξης των εκθέσεων ασφάλειας που συνόδευαν τις μεγάλες κυκλοφορίες μοντέλων της. Σε άρθρο του στο Atlantic, περιγράφει μια εταιρική κουλτούρα που, κατά την εκτίμησή του, δεν ανταποκρίνεται στους κινδύνους της τεχνολογίας που αναπτύσσει.
Στο επίκεντρο της κριτικής του βρίσκεται η διαρκής πίεση για το επόμενο προϊόν. Ο Ρόμπινσον υποστηρίζει ότι η πεποίθηση πως κάθε πρόβλημα μπορεί να διορθωθεί όταν εμφανιστεί γίνεται όλο και πιο επικίνδυνη, όσο αυξάνονται οι δυνατότητες των συστημάτων. Η ανησυχία του αφορά το ενδεχόμενο μιας αστοχίας που θα έχει σοβαρές συνέπειες πριν προλάβει να ενεργοποιηθεί η ανθρώπινη παρέμβαση.
Για να περιγράψει αυτόν τον κίνδυνο, χρησιμοποιεί την εικόνα αυτόνομων προγραμμάτων που θα λειτουργούν σαν οργανωμένες ομάδες χάκερ, χωρίς ανάγκη ύπνου ή ανάπαυσης. Ως παράδειγμα αναφέρει το ενδεχόμενο να αποκλείσουν την πρόσβαση σε υπολογιστικά συστήματα νοσοκομείων, απαιτώντας λύτρα.
Πρόκειται για υποθετικό σενάριο που επιστρατεύει ως προειδοποίηση. Η συγκεκριμένη αναφορά δεν αποτελεί καταγγελία ότι συνέβη ήδη τέτοια επίθεση σε νοσοκομείο.
Ο ίδιος συνδέει τις ανησυχίες του με το περιστατικό αυτόνομων συστημάτων της OpenAI εναντίον της Hugging Face. Το παρουσιάζει ως ένδειξη ενός ευρύτερου προβλήματος στον κλάδο: οι γρήγοροι ρυθμοί ανάπτυξης και η ευελιξία στη λειτουργία των εταιρειών μπορούν, κατά την άποψή του, να αφήνουν επικίνδυνα περιθώρια για λάθη.
Η πρότασή του είναι να αλλάξει ο τρόπος με τον οποίο οργανώνεται η ασφάλεια. Ζητά αξιοποίηση της εμπειρίας από την πυρηνική ενέργεια και την αεροπορία, με πολλαπλά επίπεδα προστασίας, εφεδρείες και προσεκτικό σχεδιασμό. Στόχος είναι ένα ανθρώπινο λάθος ή μια τεχνική βλάβη να μη μετατρέπονται αυτομάτως σε ανεξέλεγκτο συμβάν.
Παράλληλα, θεωρεί απαραίτητη την ανάπτυξη νέων επιστημονικών μεθόδων, ώστε τα ισχυρότερα συστήματα να παραμένουν ασφαλή ακόμη και όταν δρουν χωρίς συνεχή ανθρώπινη επίβλεψη. Η κριτική του, συνεπώς, αφορά τόσο τις τεχνικές δικλίδες όσο και τον τρόπο με τον οποίο λαμβάνονται οι αποφάσεις μέσα στις εταιρείες.
Στην ίδια συζήτηση παρεμβαίνει ο ερευνητής Τζέφρι Ίρβινγκ, πρώην στέλεχος της OpenAI και πρώην επικεφαλής επιστήμονας του βρετανικού ινστιτούτου ασφάλειας της AI. Σε άρθρο στο Time εκτιμά περίπου στο 50% την πιθανότητα αφανισμού της ανθρωπότητας από συστήματα εξυπνότερα από τον άνθρωπο. Διευκρινίζει, ωστόσο, ότι δεν αποδίδει μαθηματική ακρίβεια στο ποσοστό. Πρόκειται για προσωπική εκτίμηση υπό μεγάλη αβεβαιότητα, όχι για αποδεδειγμένη πρόβλεψη ή κοινά αποδεκτό επιστημονικό συμπέρασμα.
Ανάλογες ανησυχίες έχουν εκφραστεί και από εργαζομένους ή πρώην εργαζομένους της Anthropic. Ανάμεσά τους ο Τζέικομπ Κόξον, ο οποίος αποχώρησε προειδοποιώντας για ενδεχόμενες καταστροφικές συνέπειες μέσα στη δεκαετία. Οι διαφωνίες γύρω από αυτά τα σενάρια παραμένουν έντονες, ιδίως ως προς τη δυνατότητα τεκμηρίωσης των πιθανοτήτων και των χρονικών οριζόντων τους.
Από την πλευρά της, η OpenAI δηλώνει ότι ενισχύει τις πρακτικές ασφάλειας και προστασίας της και ότι επιβραδύνει την ανάπτυξη όταν το κρίνει απαραίτητο. Εκπρόσωπός της υποστηρίζει πως η εταιρεία αναστέλλει την εκπαίδευση ή καθυστερεί τη διάθεση μοντέλων, ώστε οι δυνατότητές τους να μην ξεπερνούν όσα μπορεί να διαχειριστεί με ασφάλεια.
Στο ίδιο πλαίσιο, έχει αναφερθεί ακύρωση της κυκλοφορίας μοντέλου επόμενης γενιάς έπειτα από ανησυχίες στις εσωτερικές δοκιμές, καθώς και αναστολή εκπαίδευσης των πιο προηγμένων μοντέλων της.
Η παραίτηση Ρόμπινσον θέτει ένα ουσιαστικό ζήτημα λογοδοσίας: με ποια κριτήρια αποφασίζεται ότι ένα αυτόνομο σύστημα είναι αρκετά ασφαλές για να χρησιμοποιηθεί; Η απάντηση έχει σημασία για κάθε άνθρωπο και οργανισμό που θα κληθεί να εμπιστευτεί αυτή την τεχνολογία.

