Ερευνητής AI παραιτείται από την Anthropic και προειδοποιεί για την αυτοβελτιούμενη τεχνητή νοημοσύνη
Ένας 27χρονος Βρετανός ερευνητής τεχνητής νοημοσύνης, ο οποίος εργάστηκε πρώτα στην OpenAI και στη συνέχεια στην Anthropic, αποφάσισε να αποχωρήσει από τον κλάδο καταγγέλλοντας ότι οι δύο εταιρείες επιταχύνουν επικίνδυνα την κούρσα προς μια τεχνητή νοημοσύνη που θα μπορεί να αυτοβελτιώνεται. Ο Τζέικομπ Κόξον υποστηρίζει ότι το ζήτημα δεν αφορά πλέον μια μακρινή τεχνολογική πιθανότητα, αλλά έναν κίνδυνο που οι ίδιοι οι άνθρωποι της AI θεωρούν υπαρκτό.
Από την OpenAI στην Anthropic και τελικά στην έξοδο
Ο Κόξον είχε εργαστεί επί τρία χρόνια στον χώρο της προ-εκπαίδευσης μοντέλων τεχνητής νοημοσύνης, αρχικά στην OpenAI και, από φέτος, στην Anthropic. Η επιλογή του να μετακινηθεί στη δεύτερη εταιρεία είχε συνδεθεί με την πεποίθησή του ότι ακολουθούσε μια πιο συνετή προσέγγιση απέναντι στην ασφάλεια της AI.
Ωστόσο, η εμπειρία του στην Anthropic δεν τον έπεισε ότι η κατάσταση εξελισσόταν προς μια ασφαλέστερη κατεύθυνση. Αντίθετα, κατέληξε στην απόφαση να εγκαταλείψει τον κλάδο, υποστηρίζοντας ότι τόσο η OpenAI όσο και η Anthropic κινούνται προς την ανάπτυξη μιας υπερανθρώπινης τεχνητής νοημοσύνης χωρίς να υπάρχουν επαρκείς δικλίδες ασφαλείας.
«Οι άνθρωποι της AI πιστεύουν ότι μπορεί να μας σκοτώσει όλους»
Σε ανάρτησή του στο Χ, ο Κόξον υποστήριξε ότι καμία από τις δύο εταιρείες «δεν ενεργεί με υπεύθυνο τρόπο» και ότι «κατευθύνονται ολοταχώς προς μια υπερνοημοσύνη ικανή να αυτοβελτιώνεται».
Ακόμη πιο ανησυχητική ήταν η εκτίμησή του ότι οι ίδιοι οι άνθρωποι που αναπτύσσουν την τεχνητή νοημοσύνη θεωρούν υπαρκτό το ενδεχόμενο μιας καταστροφικής εξέλιξης.
«Οι άνθρωποι που δημιουργούν την ΑΙ πιστεύουν ειλικρινά ότι θα μπορούσε να μας σκοτώσει όλους ως το τέλος της δεκαετίας», ανέφερε, υπογραμμίζοντας ότι αυτή η εκτίμηση «δεν είναι κόλπο μάρκετινγκ».
Τη δήλωση αυτή ενίσχυσε με την παρέμβασή του ο Έβαν Χάμπιντζερ, στέλεχος της Anthropic που ασχολείται με την ασφάλεια. Συμφώνησε ότι η εταιρεία θεωρεί πραγματικό τον κίνδυνο και εκτίμησε ότι η πιθανότητα η AI να οδηγήσει σε θάνατο όλων των ανθρώπων μέσα στη δεκαετία είναι «πάνω από 10%».
Η Anthropic αναγνωρίζει τον κίνδυνο, αλλά δεν έχει ακόμη λύση
Ο Χάμπιντζερ υποστήριξε ότι η Anthropic κάνει «ό,τι καλύτερο» μπορεί για να αντιμετωπίσει το πρόβλημα. Παράλληλα, όμως, παραδέχθηκε ότι η εταιρεία δεν διαθέτει ακόμη σχέδιο για να διασφαλίσει ότι μια τεχνητή νοημοσύνη που θα ξεπεράσει τις ανθρώπινες δυνατότητες θα συνεχίσει να υπακούει στους δημιουργούς της.
Ο ίδιος θεωρεί μικρό τον κίνδυνο να συμβεί κάτι τέτοιο με τα σημερινά μοντέλα. Η παραδοχή, ωστόσο, ότι δεν υπάρχει ακόμη σαφής λύση για το ενδεχόμενο μιας AI που θα υπερβαίνει τις ανθρώπινες δυνατότητες αποτελεί τον πυρήνα της ανησυχίας που εκφράζει ο Κόξον.
Η κούρσα προς την αυτοβελτίωση
Στο επίκεντρο της συζήτησης βρίσκεται το ενδεχόμενο μιας τεχνητής νοημοσύνης που δεν θα περιορίζεται στην εκτέλεση εντολών, αλλά θα μπορεί να βελτιώνει η ίδια τις δυνατότητές της.
Οι πρωταγωνιστές του κλάδου θεωρούν ότι πλησιάζουν σε ένα στάδιο όπου ένα μοντέλο θα μπορούσε να σχεδιάζει τον διάδοχό του, περιορίζοντας σταδιακά τον ανθρώπινο έλεγχο. Πρόκειται για την προοπτική της «αναδρομικής αυτοβελτίωσης», που μεταφέρει τη συζήτηση από τις σημερινές εφαρμογές AI σε ένα εντελώς διαφορετικό επίπεδο.
Σύμφωνα με τον Κόξον, στους χώρους εργασίας χρησιμοποιούνται ήδη όροι όπως «crunchtime» και «endgame» για να περιγράψουν την πορεία προς αυτό το σημείο.
«Έχουν εμπλακεί σε έναν αγώνα δρόμου»
Ο Κόξον αναγνωρίζει ότι στην Anthropic υπάρχει μεγαλύτερη επίγνωση των κινδύνων και ότι οι προσπάθειες για την αντιμετώπισή τους είναι ειλικρινείς. Θεωρεί, όμως, ότι η ίδια η λογική του ανταγωνισμού περιορίζει τα περιθώρια για μια πραγματικά ασφαλή ανάπτυξη της τεχνολογίας.
Κατά την άποψή του, καμία εταιρεία δεν μπορεί από μόνη της να αναπτύξει υπεύθυνα μια τεχνητή νοημοσύνη που θα ξεπερνά τους ανθρώπους. Για να συμβεί αυτό, απαιτείται είτε κυβερνητική παρέμβαση είτε συντονισμένη επιβράδυνση από το σύνολο των εταιρειών που συμμετέχουν στην κούρσα.
«Στην Anthropic κατανοούν πολύ καλά το διακύβευμα, αλλά έχουν εμπλακεί σε έναν αγώνα δρόμου για να φτάσουν πρώτοι», υποστήριξε.
Η αλλαγή πολιτικής της Anthropic
Η παρέμβαση του Κόξον αποκτά ιδιαίτερο βάρος καθώς η Anthropic ετοιμάζεται να εισαχθεί στο χρηματιστήριο, ενώ το τελευταίο διάστημα έχουν καταγραφεί περιστατικά πειρατείας στα οποία χρησιμοποιήθηκαν χωρίς άδεια εργαλεία τεχνητής νοημοσύνης.
Τον Φεβρουάριο, η εταιρεία αφαίρεσε από την πολιτική ασφαλείας της τη δέσμευση να σταματήσει την ανάπτυξη των μοντέλων της στην περίπτωση που δεν θα μπορούσε να διαχειριστεί τους σχετικούς κινδύνους.
Η αιτιολόγηση ήταν ότι μια μονομερής παύση θα μπορούσε να οδηγήσει σε ένα διαφορετικό αποτέλεσμα: να αφήσει χώρο σε λιγότερο προσεκτικούς ανταγωνιστές να κυριαρχήσουν χωρίς αντίστοιχους περιορισμούς.
Έτσι, πίσω από τη δημόσια συζήτηση για την ασφάλεια της τεχνητής νοημοσύνης βρίσκεται πλέον ένα δύσκολο δίλημμα: πόσο μπορεί μια εταιρεία να επιβραδύνει την ανάπτυξη μιας τεχνολογίας όταν γνωρίζει ότι οι ανταγωνιστές της συνεχίζουν να επιταχύνουν; Για τον Κόξον, η απάντηση δεν μπορεί να αφεθεί αποκλειστικά στις ίδιες τις εταιρείες. Η κούρσα προς την ισχυρότερη AI, υποστηρίζει, έχει ήδη αποκτήσει διαστάσεις που απαιτούν πολιτική και θεσμική παρέμβαση.






