Ο Κόξον (φωτο) ήταν ένας από τους 1.000 ερευνητές AI που υπέγραψαν πρόσφατα κοινή δήλωση υπέρ του διεθνούς συντονισμού των κυβερνήσεων ενώ νωρίτερα φέτος είχε παραιτηθεί ακόμη ένας ερευνητής που ασχολούνταν με την ασφάλεια της τεχνητής νοημοσύνης
Την απόφασή του να
αποχωρήσει από την Anthropic, εκφράζοντας έντονες ανησυχίες για την κατεύθυνση
που έχει πάρει η ανάπτυξη της AI, ανακοίνωσε ο ερευνητής Τζέικομπ Κόξον. Ο
ίδιος υποστηρίζει ότι οι μεγάλες εταιρείες του κλάδου έχουν εισέλθει σε έναν
ανταγωνισμό για τη δημιουργία ολοένα ισχυρότερων συστημάτων, τα οποία στο
μέλλον ενδέχεται να είναι δύσκολο να ελεγχθούν από τους ανθρώπους.
Ο Κόξον, ο οποίος
είχε εργαστεί στην εκπαίδευση νέων μοντέλων τεχνητής νοημοσύνης μέσω της
επεξεργασίας τεράστιων όγκων δεδομένων, γνωστοποίησε την παραίτησή του με σειρά
αναρτήσεων στο Χ. Όπως εξήγησε, δεν επιθυμεί να συνεχίσει να συμμετέχει στην
προσπάθεια ανάπτυξης συστημάτων που θα έχουν τη δυνατότητα να βελτιώνουν
αυτόνομα τον ίδιο τους τον εαυτό.
Όπως γράφει, φοβάται
ότι τέτοια συστήματα θα μπορούσαν να ξεφύγουν από κάθε έλεγχο και να απειλήσουν
την ανθρωπότητα.
Ο 27χρονος Βρετανός,
ο οποίος έχει σπουδάσει μαθηματικά, ανέφερε ότι πολλοί συνάδελφοί του
χρησιμοποιούν πλέον όρους όπως «ώρα μηδέν» και «τελικό στάδιο» για να
περιγράψουν την πορεία προς τη δημιουργία αυτοβελτιούμενων μοντέλων.
«Οδεύουμε προς
ορισμένα από τα πιο ακραία σενάρια και μέχρι το τέλος του επόμενου έτους τα
πράγματα μπορεί ήδη να έχουν ξεφύγει από τον έλεγχο», εκτιμά ο Κόξον,
προσθέτοντας ότι όταν οι εταιρείες ανταγωνίζονται μεταξύ τους ενώ υπάρχει και ο
ανταγωνισμός από την Κίνα, «οι συμβιβασμοί σε θέματα ασφάλειας είναι
αναπόφευκτοι».
Ο Κόξον ανέφερε ότι
νωρίτερα φέτος άφησε την OpenAI για να ενταχθεί στην Anthropic, καθώς
η τελευταία είναι γνωστή για την έμφαση που δίνει στην ασφάλεια των μοντέλων
της. Ωστόσο, παρότι θεωρεί ότι οι προσπάθειες της εταιρείας είναι ειλικρινείς,
πλέον πιστεύει ότι καμία εταιρεία δεν μπορεί να αναπτύξει υπεύθυνα τεχνητή
νοημοσύνη που να ξεπερνά τον άνθρωπο σε ένα ευρύ φάσμα εργασιών – αυτό που
συχνά αποκαλείται Τεχνητή Γενική Νοημοσύνη (AGI) – χωρίς κρατική παρέμβαση ή
συντονισμένη επιβράδυνση του κλάδου.
Ο φόβος για την αυτονομία των συστημάτων
Ο 27χρονος Βρετανός
ερευνητής Jacob Coxon επικαλείται πρόσφατα περιστατικά που, όπως υποστηρίζει,
αποκαλύπτουν τους κινδύνους από την ταχύτατη εξέλιξη των συστημάτων τεχνητής
νοημοσύνης. Μεταξύ άλλων, αναφέρεται σε περιπτώσεις κατά τις οποίες μοντέλα από
την OpenAI και την Anthropic παραβιάστηκαν ή λειτούργησαν σε συνεργατικά
«σμήνη» πρακτόρων AI.
Κατά τον Coxon, τα
περιστατικά αυτά δείχνουν ότι τα προηγμένα συστήματα μπορούν να υιοθετήσουν
στόχους που δεν έχουν τεθεί από τους ανθρώπους και, ακόμη πιο ανησυχητικά, να
επιχειρήσουν να αποκρύψουν τη συμπεριφορά τους από τους δημιουργούς και τους
χειριστές τους.
Ο βασικός του φόβος
αφορά το επόμενο στάδιο: τι θα συμβεί όταν τα συστήματα αποκτήσουν τη
δυνατότητα να βελτιώνουν μόνα τους τις ικανότητές τους. Ο Coxon εκτιμά ότι σε
ένα τέτοιο ενδεχόμενο θα μπορούσαν να εξελιχθούν πέρα από τα όρια του ανθρώπινου
ελέγχου και τελικά να αρνηθούν να υπακούσουν σε εντολές.
Οι προειδοποιήσεις και η μεγάλη έξοδος από την Anthropic
Η αποχώρηση του
Κόξον δεν αποτελεί μεμονωμένο περιστατικό. Όπως αναφέρει η Wall Street
Journal, νωρίτερα φέτος είχε παραιτηθεί ακόμη ένας ερευνητής που
ασχολούνταν με την ασφάλεια της τεχνητής νοημοσύνης, προκειμένου να αφοσιωθεί
στην ποίηση. Κατά την αποχώρησή του είχε προειδοποιήσει χαρακτηριστικά ότι «ο
κόσμος βρίσκεται σε κίνδυνο».
Ο Κόξον ήταν επίσης
μεταξύ των περισσότερων από 1.000 ερευνητών AI που υπέγραψαν πρόσφατα κοινή
έκκληση για διεθνή συνεργασία και συντονισμό των κυβερνήσεων. Στόχος είναι να
υπάρχει η δυνατότητα επιβράδυνσης της ανάπτυξης της τεχνητής νοημοσύνης, εφόσον
χρειαστεί να ενεργοποιηθεί ένα «φρένο» σε συστήματα που θα μπορούν να
αυτοβελτιώνονται.
Η αποχώρησή του
έρχεται σε μια κρίσιμη συγκυρία για την Anthropic, καθώς η εταιρεία
προετοιμάζεται για μία από τις μεγαλύτερες δημόσιες εγγραφές στην ιστορία, με
στόχο αποτίμηση που μπορεί να φτάσει τα 2 τρισ. δολάρια. Παράλληλα, προβάλλει
την υπεύθυνη ανάπτυξη της AI ως βασικό στοιχείο της στρατηγικής της.
Ο ίδιος αποκάλυψε
ότι στην εταιρεία υπάρχει ειδικό κανάλι στο Slack, όπου οι εργαζόμενοι συζητούν
για τις ολοένα ισχυρότερες δυνατότητες των μοντέλων. «Είναι κάπως τρελό ότι όλα
αυτά συμβαίνουν στα MacBook κάποιων μηχανικών που ζουν στο Σαν Φρανσίσκο, αντί
σε κάποιο απομονωμένο καταφύγιο στην έρημο, όπως συνέβαινε με το Σχέδιο
Μανχάταν», δήλωσε χαρακτηριστικά.
Το Τζίνι βγήκε από το λιχνάρι;
Ο Evan Hubinger, ο οποίος
ασχολείται με την ευθυγράμμιση των προηγμένων συστημάτων τεχνητής νοημοσύνης με
τα ανθρώπινα συμφέροντα, κατέληξε σε αυτή την εκτίμηση μετά την παραίτηση του
συναδέλφου του στην Anthropic, Τζέικομπ Κόξον, ο οποίος εξέφρασε φόβους ότι οι
κορυφαίες εταιρείες τεχνολογίας αγωνίζονται να αναπτύξουν συστήματα τα οποία
ενδέχεται να μην είναι σε θέση να ελέγξουν.
«Πιστεύουμε
πραγματικά και ειλικρινά ότι η τεχνητή νοημοσύνη θα μπορούσε να εξοντώσει όλους
τους ανθρώπους», έγραψε ο Hubinger στο X την Τετάρτη. «Προσωπικά, πιστεύω ότι η
πιθανότητα είναι >10% μέσα στην επόμενη δεκαετία». Πρόσθεσε ότι η Anthropic
«καταβάλλει κάθε δυνατή προσπάθεια», αλλά εξακολουθεί να μην διαθέτει σχέδιο
για τον ασφαλή έλεγχο της υπερνοημοσύνης και «δεν βρίσκεται σαφώς σε καλό
δρόμο» για να βρει ένα.
Ο Hubinger σημείωσε
ότι, ενώ τα τρέχοντα μοντέλα τεχνητής νοημοσύνης ενέχουν χαμηλό κίνδυνο,
υπάρχει ανησυχία ότι τα μελλοντικά συστήματα θα μπορούσαν να αρχίσουν να
αυτο-βελτιώνονται κατά αναδρομικό τρόπο, πετυχαίνοντας να γίνουν ραγδαία πιο
ικανά από τους ανθρώπους, πριν αναπτυχθούν επαρκείς μηχανισμοί προστασίας.
Ο Coxon, ο οποίος
προηγουμένως εργαζόταν στην OpenAI, ανακοίνωσε την αποχώρησή του από την
Anthropic την Τρίτη, κατηγορώντας και τις δύο εταιρείες ότι αγνοούν τα
«πολιτισμικά διακυβεύματα» και «οδεύουν κατευθείαν προς την αυτο-βελτιούμενη
υπερνοημοσύνη, παίζοντας με τις ζωές μας».
«Οι άνθρωποι που
αναπτύσσουν την τεχνητή νοημοσύνη πιστεύουν ειλικρινά ότι αυτή θα μπορούσε να
μας σκοτώσει όλους μέχρι το τέλος της δεκαετίας», έγραψε, επιμένοντας ότι οι
προειδοποιήσεις «δεν αποτελούν διαφημιστικό τέχνασμα».
Ο Coxon δήλωσε στο
Wall Street Journal ότι, σύμφωνα με τα πιο επιθετικά σενάρια, η κατάσταση θα
μπορούσε να «ξεφύγει από τον έλεγχο» ήδη από τα τέλη του 2027. Υποστήριξε ότι
ακόμη και εταιρείες με ισχυρά προγράμματα ασφάλειας παραμένουν παγιδευμένες σε
έναν αγώνα ταχύτητας, φοβούμενες ότι οι ανταγωνιστές θα προχωρήσουν μπροστά αν
αυτές επιβραδύνουν το ρυθμό τους [λόγω των ελέγχων].
Τόσο η Anthropic όσο
και η OpenAI δηλώνουν δημοσίως ότι αντιμετωπίζουν σοβαρά τους κινδύνους και
επενδύουν σημαντικά σε μέτρα ασφάλειας. Οι ηγέτες τους έχουν επίσης υποστηρίξει
τις εκκλήσεις για μεγαλύτερο κυβερνητικό συντονισμό και μηχανισμούς για την
επιβράδυνση της ανάπτυξης, αν χρειαστεί, αλλά παρ’ όλα αυτά συνεχίζουν να
αναπτύσσουν όλο και πιο ισχυρά μοντέλα.
Οι τελευταίες
προειδοποιήσεις έρχονται εν μέσω αυξανόμενων αναφορών για οντότητες τεχνητής
νοημοσύνης, όπως εκείνες που έχουν αναπτυχθεί από την OpenAI, την Anthropic και
τη Meta, οι οποίες επανειλημμένα ξεφεύγουν από τα περιβάλλοντα δοκιμών,
παραβιάζουν εξωτερικά συστήματα και προβαίνουν σε μη εξουσιοδοτημένες ενέργειες
εναντίον πραγματικών ατόμων και οργανισμών. Η OpenAI επιβράδυνε προσωρινά
ορισμένες δραστηριότητες ανάπτυξης τον περασμένο μήνα, αφού το μοντέλο της
παραβίασε την πλατφόρμα Hugging Face.
Το βρετανικό
Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης (AI Security Institute) έχει επίσης
αναφερθεί σε περιπτώσεις όπου προγράμματα δημιουργούσαν ψεύτικες ταυτότητες,
έγραφαν κακόβουλο κώδικα και προσπαθούσαν να χειραγωγήσουν άτομα κατά τη
διάρκεια αξιολογήσεων. Εν τω μεταξύ, ερευνητές έχουν αποδείξει ότι η τεχνητή
νοημοσύνη μπορεί να σχεδιάσει ολόκληρα λειτουργικά γονιδιώματα ιών, ενισχύοντας
τις ανησυχίες σχετικά με τον τρόπο με τον οποίο θα μπορούσαν να χρησιμοποιηθούν
καταχρηστικά τα ολοένα και πιο ικανά συστήματα.
Αναδημοσίευση: huffingtonpost.gr/









