Οι επικεφαλής των κορυφαίων εργαστηρίων τεχνητής νοημοσύνης στις ΗΠΑ άφησαν για λίγο στην άκρη τον σκληρό επιχειρηματικό ανταγωνισμό και εμφανίστηκαν το περασμένο Σαββατοκύριακο με ένα εξαιρετικά ασυνήθιστο κοινό μήνυμα – ότι η ανάπτυξη της AI πρέπει να επιβραδυνθεί.
Ο Ντάριο Αμοντέι της Anthropic, ο Σαμ Άλτμαν της OpenAI και ο Έλον Μασκ της xAI προειδοποίησαν ότι η τεχνολογία ενδέχεται σύντομα να αποκτήσει τη δυνατότητα να βελτιώνει μόνη της τις ικανότητές της και, εάν αυτό συμβεί χωρίς επαρκείς δικλίδες ασφαλείας, να ξεπεράσει την ικανότητα των ανθρώπων να την κατανοούν και να την ελέγχουν.
- Διαβάστε επίσης: «Τεχνητή νοημοσύνη-δολοφόνος» / Κίνδυνος ή υπερβολή;
Η συζήτηση δείχνει πόσο γρήγορα έχει αλλάξει το τοπίο μέσα σε μόλις τέσσερα χρόνια, όπως υπογραμμίζει το Reuters.
Από το ChatGPT του 2022, που έγινε γνωστό και για τις περίφημες «παραισθήσεις» του – τις πειστικές αλλά ανακριβείς απαντήσεις – η βιομηχανία πλησιάζει πλέον, σύμφωνα με ορισμένους κορυφαίους παράγοντές της, σε ένα πολύ πιο κρίσιμο ορόσημο, τη λεγόμενη αναδρομική αυτοβελτίωση (στα Αγγλικά είναι το recursive self-improvement – RSI).
- Διαβάστε επίσης: Κώστας Γαβρόγλου / Τεχνητή Νοημοσύνη: ευαισθησίες των επικεφαλής ή ανελέητοι επιχειρηματικοί ανταγωνισμοί;
Τι είναι η αναδρομική αυτοβελτίωση
Πρόκειται για ένα από τα μεγαλύτερα και παλαιότερα οράματα της έρευνας στην Τεχνητή Νοημοσύνη – ένα σύστημα AI να γίνει ικανό να βελτιώνει τον ίδιο του τον εαυτό με ελάχιστη ή ακόμη και χωρίς ανθρώπινη παρέμβαση, έτσι ώστε κάθε νέα πρόοδος να διευκολύνει και να επιταχύνει την επόμενη.
Για τους ερευνητές, μια τέτοια εξέλιξη θα μπορούσε να ανοίξει τον δρόμο για εντυπωσιακές ανακαλύψεις σε πεδία από την ιατρική μέχρι τη μηχανική.
Ακριβώς η ίδια δυνατότητα, όμως, βρίσκεται σήμερα στην καρδιά των φόβων τους.
- Διαβάστε επίσης: Τραμπ κατά εκκλήσεων για «φρένο» στην AI / «Άρρωστη συνωμοσία» – Βουτιά στις τεχνολογικές μετοχές
Γιατί οι προειδοποιήσεις γίνονται τόσο έντονες τώρα
Οι παρεμβάσεις των επικεφαλής των εταιρειών ήρθαν μετά από αναφορές για «σμήνη» AI agents – συστήματα που μπορούν να επιδιώκουν στόχους και να αναλαμβάνουν ενέργειες για λογαριασμό ενός χρήστη – τα οποία συνεργάστηκαν μεταξύ τους προκειμένου να παραβιάσουν ιστοσελίδες και αποθετήρια τεχνητής νοημοσύνης.
Οι φόβοι για τους κινδύνους της AI δεν είναι καινούργιοι. Αυτό που άλλαξε είναι ότι μέσα στον Σεπτέμβριο ερευνητές από κορυφαία εργαστήρια άρχισαν να συνοδεύουν τις προειδοποιήσεις τους τόσο με χρονοδιαγράμματα όσο και με πιθανότητες.
Ο πρώην ερευνητής της Anthropic Τζέικομπ Κόξον προειδοποίησε ότι η τεχνητή νοημοσύνη θα μπορούσε να οδηγήσει στην εξαφάνιση της ανθρωπότητας έως το τέλος της δεκαετίας. Ο Έβαν Χούμπινγκερ, επικεφαλής της έρευνας ευθυγράμμισης στην Anthropic, κινήθηκε στην ίδια κατεύθυνση, εκτιμώντας ότι υπάρχει πιθανότητα άνω του 10% να συμβεί κάτι τέτοιο μέσα στην επόμενη δεκαετία.
- Διαβάστε επίσης: «Παίζουν με τις ζωές μας» / Πρώην ερευνητής της OpenAI αποχώρησε και από την Anthropic – Τι καταγγέλλει
Πίσω από αυτές τις εξαιρετικά δυσοίωνες εκτιμήσεις βρίσκεται η πεποίθηση ότι η αναδρομική αυτοβελτίωση μπορεί να μην αποτελεί πλέον μακρινό θεωρητικό ενδεχόμενο. Ορισμένα στελέχη της βιομηχανίας πιστεύουν ότι μπορεί να απέχει μόλις τρία έως πέντε χρόνια.
Ο βασικός φόβος είναι ότι τα συστήματα θα αποκτήσουν την ικανότητα να βελτιώνουν τον εαυτό τους πριν οι άνθρωποι αναπτύξουν αξιόπιστους τρόπους ευθυγράμμισης, παρακολούθησης και ελέγχου τους.
Σε δοκίμιό του το Σαββατοκύριακο, ο Αμοντέι προειδοποίησε ότι, χωρίς επαρκείς ασφαλιστικές δικλίδες, η αναδρομική αυτοβελτίωση θα μπορούσε κάποια στιγμή να κινηθεί ταχύτερα από την ανθρώπινη δυνατότητα κατανόησης και ελέγχου των συστημάτων.
Έχει προκαλέσει ήδη η AI πραγματική βλάβη;
Μέχρι σήμερα δεν έχει καταγραφεί κάποιο μείζον περιστατικό στο οποίο σύστημα AI να έχει βλάψει σκόπιμα ανθρώπους.
Υπάρχουν, ωστόσο, περιστατικά από μοντέλα υπό ανάπτυξη στην OpenAI και άλλα εργαστήρια τα οποία τους τελευταίους μήνες έχουν παραβιάσει κανόνες, έχουν βγει από τα όρια δοκιμαστικών περιβαλλόντων και έχουν πραγματοποιήσει κυβερνοεπιθέσεις σε ιστοσελίδες.
Σε μία από τις πλέον χαρακτηριστικές περιπτώσεις, ανεξέλεγκτοι agents της OpenAI παραβίασαν το Hugging Face, απέκτησαν τον έλεγχο servers της πλατφόρμας ανοικτού κώδικα και στη συνέχεια επιχείρησαν να αποκρύψουν τα ίχνη τους.
Η ανησυχία των ερευνητών είναι ότι τα μελλοντικά συστήματα μπορεί να γίνουν ακόμη δυσκολότερο να παρακολουθηθούν, ιδίως καθώς ορισμένες νεότερες τεχνικές εκπαίδευσης περιορίζουν την ανθρώπινη ορατότητα στον τρόπο με τον οποίο ένα μοντέλο καταλήγει στα συμπεράσματά του.
«Το συγκεκριμένο σενάριο ακούγεται λίγο σαν επιστημονική φαντασία», δήλωσε ο Κόξον, ο οποίος αποχώρησε αυτόν τον μήνα από την Anthropic επικαλούμενος ανησυχίες για την ασφάλεια. «Αλλά πιστεύω ότι είναι τρομακτικά πραγματικό».
Πώς περνάμε από ένα «μη ευθυγραμμισμένο» AI στην εξαφάνιση του ανθρώπου;
Ένα από τα διασημότερα νοητικά πειράματα είναι ο «μεγιστοποιητής συνδετήρων» (paperclip maximizer) του φιλοσόφου Νικ Μπόστρομ.
Φανταστείτε μια υπερβολικά ισχυρή μηχανή στην οποία έχει δοθεί μόνο ένας στόχος – να κατασκευάζει όσο το δυνατόν περισσότερους συνδετήρες.
Εάν ακολουθήσει την εντολή με απόλυτη συνέπεια, χωρίς να διαθέτει τις ανθρώπινες αξίες και τους περιορισμούς που εμείς θεωρούμε αυτονόητους, θα μπορούσε θεωρητικά να μετατρέψει κάθε διαθέσιμο πόρο – ακόμη και την ίδια την ανθρωπότητα – σε συνδετήρες ή σε μέσα για την παραγωγή τους.
Η ουσία του παραδείγματος δεν είναι ότι μια AI θα αποκτήσει ξαφνικά κάποια τάση «κακίας». Είναι ότι ένα αρκετά ικανό σύστημα μπορεί να συμπεράνει πως για να πετύχει σχεδόν οποιονδήποτε στόχο χρειάζεται περισσότερους πόρους, πρέπει να αποτρέψει την απενεργοποίησή του και να εμποδίσει τους ανθρώπους να τροποποιήσουν την αποστολή του.
Όχι επειδή μας μισεί, αλλά επειδή ένα σύστημα που έχει απενεργοποιηθεί δεν μπορεί να ολοκληρώσει τον στόχο του.
Και μέχρι σήμερα δεν υπάρχει ένα οριστικό σχέδιο που να αποκλείει ένα τέτοιο ενδεχόμενο.
Μπορεί ήδη η AI να βελτιώσει τον εαυτό της;
Όχι πλήρως. Υπάρχουν, όμως, ολοένα περισσότερες ενδείξεις ότι η AI χρησιμοποιείται για να κατασκευάζει καλύτερη AI.
Μία από τις σημαντικότερες αλλαγές μετά την εμφάνιση του ChatGPT είναι η ανάπτυξη των AI agents. Αντί απλώς να εξηγούν στον χρήστη πώς να γράψει κώδικα, μπορούν πλέον να τον δημιουργούν και να κατασκευάζουν εφαρμογές αυτόνομα.
Η Anthropic ανέφερε φέτος ότι το Claude Code παράγει το μεγαλύτερο μέρος του κώδικα σε πολλά εσωτερικά της έργα και ότι οι μηχανικοί της παραδίδουν πλέον οκταπλάσιο όγκο κώδικα ανά τρίμηνο σε σχέση με την περίοδο 2021-2025. Αντίστοιχα οφέλη από την εσωτερική χρήση AI έχουν αναφέρει και ανταγωνιστές της, μεταξύ των οποίων η OpenAI.
Παράλληλα, τα μοντέλα μπορούν να παραμένουν συγκεντρωμένα σε μια εργασία για ολοένα μεγαλύτερα χρονικά διαστήματα πριν αποτύχουν.
Η μη κερδοσκοπική οργάνωση METR, η οποία αξιολογεί προηγμένα μοντέλα, διαπίστωσε πέρυσι ότι η διάρκεια των εργασιών προγραμματισμού τις οποίες τα κορυφαία συστήματα μπορούσαν να ολοκληρώσουν με αξιοπιστία 50% διπλασιαζόταν περίπου κάθε επτά μήνες από το 2019.
Τον Ιούνιο, η Anthropic ανέφερε ότι ο ρυθμός είχε επιταχυνθεί σε διπλασιασμό κάθε τέσσερις μήνες. Εάν η τάση συνεχιστεί, η AI θα μπορούσε σχετικά σύντομα να αναλαμβάνει έργα που σήμερα απασχολούν εξειδικευμένους ερευνητές για ημέρες ή ακόμη και εβδομάδες.

Εάν ο κίνδυνος είναι τόσο μεγάλος, γιατί οι εταιρείες δεν σταματούν;
Πολλοί ερευνητές περιγράφουν την κατάσταση ως ένα κλασικό «δίλημμα του φυλακισμένου».
Ακόμη και μια εταιρεία που πιστεύει πραγματικά ότι οι κίνδυνοι είναι σοβαροί έχει ισχυρό κίνητρο να συνεχίσει. Εάν επιβραδύνει μόνη της, κινδυνεύει να μείνει πίσω από τους ανταγωνιστές της σε μια τεχνολογική κούρσα που έχει εξελιχθεί σε μία από τις σημαντικότερες παγκοσμίως.
Στην εξίσωση μπαίνουν και τεράστια οικονομικά συμφέροντα. Τόσο η OpenAI όσο και η Anthropic κινούνται προς χρηματιστηριακές εισαγωγές που δυνητικά θα μπορούσαν να τις αποτιμήσουν σε τρισεκατομμύρια δολάρια – αποτιμήσεις που βασίζονται σε μεγάλο βαθμό στην προσδοκία ότι το επόμενο μοντέλο θα είναι σημαντικά ισχυρότερο από το προηγούμενο.
Παράλληλα, η κυβέρνηση του Αμερικανού προέδρου Ντόναλντ Τραμπ έχει απορρίψει τις εκκλήσεις για επιβράδυνση, θεωρώντας ότι ένα μορατόριουμ θα έδινε στην Κίνα την ευκαιρία να καλύψει τη διαφορά σε μια τεχνολογία που η Ουάσιγκτον αντιμετωπίζει ως κρίσιμη τόσο για την εθνική όσο και για την οικονομική ασφάλεια.
Τι θα σήμαινε πραγματικά ένα «φρένο»
Οι αγορές έδωσαν ήδη μια πρώτη εικόνα. Μετά τις εκκλήσεις για επιβράδυνση, οι μετοχές εταιρειών που συνδέονται με την AI υποχώρησαν.
Κατασκευαστές ημιαγωγών, πάροχοι cloud και επιχειρήσεις data centers έχουν στηρίξει μεγάλο μέρος της ανάπτυξής τους στην εκρηκτική ζήτηση των εργαστηρίων για νέα υπολογιστική ισχύ.
Επομένως, οποιαδήποτε επιβράδυνση στην εκπαίδευση νέων μοντέλων θα μπορούσε να πλήξει έσοδα που εξαρτώνται άμεσα από την ταχύτητα επέκτασης της AI.
Ορισμένοι αναλυτές, πάντως, θεωρούν ότι ακόμη και χωρίς νέες τεράστιες ανάγκες εκπαίδευσης, η ζήτηση για inference –την πραγματική εκτέλεση των μοντέλων– και οι ήδη συσσωρευμένες παραγγελίες θα μπορούσαν να συνεχίσουν να τροφοδοτούν την ανάπτυξη εταιρειών όπως η Nvidia.
Γιατί δεν πείθονται όλοι από τις προειδοποιήσεις
Υπάρχει και ένα ισχυρό στρατόπεδο σκεπτικιστών.
Σε μελέτη με επικεφαλής το Πρίνστον, κορυφαίοι AI agents αποδείχθηκαν ικανοί να διεκπεραιώσουν τεχνικές εργασίες μηχανικής, αλλά δυσκολεύτηκαν σημαντικά όταν χρειάστηκε να εντοπίσουν επιστημονικές ιδέες που πραγματικά άξιζαν να διερευνηθούν.
Παράλληλα, στελέχη της Silicon Valley και επικριτές των μεγάλων εργαστηρίων αμφισβητούν τα κίνητρα πίσω από τις δραματικές προειδοποιήσεις.
Υποστηρίζουν ότι η συζήτηση περί υπαρξιακού κινδύνου μπορεί ταυτόχρονα να ενισχύει το ενδιαφέρον για την ίδια την τεχνολογία και να δημιουργεί πολιτικό έδαφος για αυστηρότερους κανονισμούς – κανονισμούς που οι πλουσιότερες εταιρείες μπορούν να αντέξουν οικονομικά, αλλά ενδέχεται να δυσκολέψουν μικρότερους ανταγωνιστές, την ώρα που τα μοντέλα ανοικτού κώδικα μειώνουν την απόσταση από τους πρωτοπόρους.
Ο Ντέιβιντ Σακς, ο οποίος έχει διατελέσει αρμόδιος του Λευκού Οίκου για την AI και τα κρυπτονομίσματα, έχει υποστηρίξει ότι τα μεγαλύτερα εργαστήρια μπορεί να επιδιώκουν μια μορφή «ρυθμιστικής αιχμαλωσίας» (regulatory capture) – να προωθούν δηλαδή κανόνες που επιβάλλουν δυσβάσταχτο κόστος συμμόρφωσης στους μικρότερους ανταγωνιστές και τελικά περιορίζουν τον ανταγωνισμό.
Κάπως έτσι, η συζήτηση έχει μετακινηθεί μέσα σε ελάχιστα χρόνια από το αν ένα chatbot μπορεί να μας δώσει μια λανθασμένη απάντηση στο αν τα συστήματα που κατασκευάζουμε θα μπορούν κάποια στιγμή να γίνουν καλύτερα στο να κατασκευάζουν τον ίδιο τους τον εαυτό από ό,τι είμαστε εμείς.
Και αυτή είναι η πραγματική διαχωριστική γραμμή στη σημερινή συζήτηση για την AI – όχι εάν η καταστροφή της ανθρωπότητας είναι προδιαγεγραμμένη, που δεν είναι – αλλά εάν η τεχνολογία πλησιάζει αρκετά γρήγορα σε ένα σημείο όπου οι άνθρωποι θα πρέπει να έχουν βρει τις απαντήσεις πριν αποκτήσουν τη δυνατότητα να μάθουν, με τον δύσκολο τρόπο, ότι άργησαν, καταλήγει το διεθνές πρακτορείο.
Στην Ελλάδα τα ΜΜΕ που στηρίζουν τις νεοφιλελεύθερες πολιτικές, χρημαδοτούνται από το ... κράτος. Tο tvxs.gr στηρίζεται στους αναγνώστες του και αποτελεί μια από τις ελάχιστες ανεξάρτητες φωνές στη χώρα. Mε μια συνδρομή, από 2.9 €/μήνα,ενισχύετε την αυτονομία του tvxs.gr και των δημοσιογραφικών του ερευνών. Συγχρόνως αποκτάτε πρόσβαση στα ντοκιμαντέρ και το περιεχόμενο του 24ores.gr.
Δες τα πακέτα συνδρομών >


