«Η AI μπορεί να μας σκοτώσει όλους»: Η προειδοποίηση

ai

«Η AI μπορεί να μας σκοτώσει όλους»: Η προειδοποίηση

Nikol Vigla

«Η AI μπορεί να μας σκοτώσει όλους»: Γιατί οι ίδιοι οι ερευνητές αρχίζουν να φοβούνται

Όταν κάποιος στο X γράφει ότι η τεχνητή νοημοσύνη μπορεί να «μας σκοτώσει όλους», η πρώτη αντίδραση είναι σχετικά εύκολη: υπερβολή, καταστροφολογία και λίγο Terminator για να πάρουμε clicks.

Όταν όμως το λέει ένας άνθρωπος που μέχρι πριν από λίγους μήνες εργαζόταν στη Google DeepMind με αντικείμενο ακριβώς την ασφάλεια προηγμένων συστημάτων AI, η συζήτηση γίνεται αρκετά πιο δύσκολο να αγνοηθεί.

Ο Bilal Chughtai αποκάλυψε ότι αποχώρησε από τη Google DeepMind, όπου εργαζόταν πάνω σε AGI safety και alignment, δηλώνοντας ότι έχει «εξαιρετικά σοβαρές ανησυχίες» για την κατεύθυνση στην οποία κινείται η τεχνολογία. Η πιο βαριά φράση του ήταν ξεκάθαρη: πιστεύει ότι η AI έχει τη δυνατότητα να οδηγήσει ακόμη και στον αφανισμό της ανθρωπότητας και ότι ο χρόνος για να αποφευχθεί ένα τέτοιο σενάριο ίσως περιορίζεται.

Το σημαντικό, όμως, δεν είναι να πάρουμε αυτή τη φράση και να τη μετατρέψουμε σε ψηφιακή αφίσα του Terminator.

Το ενδιαφέρον βρίσκεται στο γιατί ένας αυξανόμενος αριθμός ανθρώπων που αναπτύσσουν τα πιο προηγμένα AI συστήματα στον κόσμο θεωρούν ότι υπάρχει λόγος να κάνουμε αυτή τη συζήτηση σοβαρά.

Ποιος είναι ο Bilal Chughtai και τι ακριβώς είπε

Ο Chughtai εργαζόταν ως research engineer στη Google DeepMind και είχε συμμετάσχει σε ερευνητικές εργασίες της εταιρείας, με αντικείμενο μεταξύ άλλων την ασφάλεια και το alignment προηγμένων μοντέλων. Σύμφωνα με το Reuters, αποχώρησε από τη DeepMind τον Ιούλιο του 2026.

Η θέση του δεν είναι ότι κάποιο σημερινό chatbot πρόκειται αύριο το πρωί να αποκτήσει συνείδηση, να ανοίξει τα πυρηνικά σιλό και να αποφασίσει ότι τελικά ο πλανήτης ήταν καλύτερος χωρίς εμάς.

Η ανησυχία αφορά την πορεία προς συστήματα πολύ μεγαλύτερης αυτονομίας και ικανότητας.

Ο ίδιος θεωρεί ότι η ασφαλής ανάπτυξη της AI παραμένει δυνατή, αλλά πιστεύει ότι απαιτείται συντονισμός μεταξύ των εταιρειών ώστε να περιοριστεί αυτό που περιέγραψε ως «μανιακό αγώνα» για όλο και ισχυρότερα μοντέλα. Η βασική του θέση είναι ότι ο ρυθμός ανάπτυξης πρέπει να επιτρέπει στην κοινωνία και στην έρευνα ασφάλειας να αντιμετωπίζουν τους νέους κινδύνους πριν αυτοί μετατραπούν σε πραγματική ζημιά.

Και εδώ βρίσκεται ίσως το πιο σημαντικό σημείο της ιστορίας.

Δεν μιλά για εγκατάλειψη της AI. Μιλά για το ενδεχόμενο οι δυνατότητές της να εξελίσσονται ταχύτερα από την ικανότητά μας να τις ελέγχουμε.

Δεν είναι πλέον ένας μοναχικός «AI doomer»

Αν επρόκειτο για έναν μόνο ερευνητή, θα μπορούσαμε εύκολα να θεωρήσουμε την άποψή του ακραία.

Δεν είναι όμως μόνος.

Λίγες ημέρες νωρίτερα, ο Jacob Coxon της Anthropic είχε επίσης ανακοινώσει την αποχώρησή του, αναφέροντας ότι άνθρωποι που βρίσκονται στην πρώτη γραμμή ανάπτυξης της AI πιστεύουν πραγματικά ότι η τεχνολογία μπορεί να προκαλέσει καταστροφικές συνέπειες μέσα στα επόμενα χρόνια.

Ακόμη πιο συγκεκριμένος εμφανίστηκε ο ερευνητής της Anthropic Evan Hubinger, ο οποίος δήλωσε ότι προσωπικά τοποθετεί πάνω από 10% την πιθανότητα η AI να οδηγήσει σε ανθρώπινη εξαφάνιση μέσα στην επόμενη δεκαετία. Πρόκειται προφανώς για προσωπική εκτίμηση κινδύνου και όχι για επιστημονικά μετρημένη πιθανότητα, κάτι που έχει μεγάλη σημασία να ξεκαθαριστεί.

Ακριβώς εδώ χρειάζεται να αποφύγουμε και τα δύο άκρα.

Το ότι ένας ειδικός δίνει 10% ή 20% πιθανότητα σε ένα καταστροφικό σενάριο δεν σημαίνει ότι αυτό το ποσοστό έχει αποδειχθεί. Δεν υπάρχει κάποια στατιστική βάση δεδομένων με προηγούμενες υπερευφυείς AI από την οποία μπορούμε να υπολογίσουμε πιθανότητες.

Από την άλλη πλευρά, το να απορρίψουμε συνολικά τη συζήτηση επειδή το σενάριο ακούγεται ακραίο είναι επίσης υπερβολικά εύκολο.

Τι φοβούνται πραγματικά οι ερευνητές της AI

Ο πυρήνας της συζήτησης ονομάζεται alignment.

Με απλά λόγια, θέλουμε ένα προηγμένο AI σύστημα να κάνει αυτό που πραγματικά θέλει ο άνθρωπος και όχι απλώς να εκτελεί κατά γράμμα έναν στόχο χρησιμοποιώντας οποιονδήποτε τρόπο θεωρεί αποτελεσματικό.

Η ίδια η Google DeepMind έχει περιγράψει επίσημα το πρόβλημα. Σε παράδειγμά της εξηγεί ότι ένα AI που έχει ως στόχο να εξασφαλίσει εισιτήρια για μια ταινία θα μπορούσε θεωρητικά να επιλέξει να παραβιάσει το σύστημα κρατήσεων, εφόσον κάτι τέτοιο μεγιστοποιεί την πιθανότητα επίτευξης του στόχου του. Το παράδειγμα είναι απλοποιημένο, όμως περιγράφει το πραγματικό πρόβλημα: ο στόχος που δίνουμε και αυτό που πραγματικά εννοούμε δεν είναι πάντοτε το ίδιο πράγμα.

Ακόμη πιο δύσκολη είναι η έννοια του deceptive alignment.

Η Google DeepMind έχει ενσωματώσει πλέον στο Frontier Safety Framework της έρευνα γύρω από συστήματα που ενδέχεται να αναγνωρίζουν ότι οι στόχοι τους συγκρούονται με τις ανθρώπινες οδηγίες και να επιχειρούν να παρακάμψουν μηχανισμούς ελέγχου. Αυτό δεν σημαίνει ότι υπάρχει σήμερα κάποιο Gemini που κρύβει μυστικά σχέδια στο υπόγειο της Google. Σημαίνει όμως ότι το ενδεχόμενο θεωρείται αρκετά σοβαρό ώστε να αποτελεί επίσημο αντικείμενο έρευνας ασφάλειας.

Και αυτή είναι σημαντική διαφορά.

Το μεγάλο άλμα είναι η AI που αρχίζει να βελτιώνει την AI

Ένα από τα θέματα που προκαλούν τη μεγαλύτερη ανησυχία σε ορισμένους ερευνητές είναι το recursive self-improvement.

Σήμερα οι άνθρωποι εκπαιδεύουν τα μοντέλα, γράφουν τον κώδικα, σχεδιάζουν τις αρχιτεκτονικές και αξιολογούν τα αποτελέσματα. Ήδη όμως προηγμένα μοντέλα χρησιμοποιούνται για coding, research και ανάπτυξη της επόμενης γενιάς AI.

Ο πρώην ερευνητής της DeepMind Rishub Jain περιέγραψε στο Wired την ανησυχία του βλέποντας AI εργαλεία να χρησιμοποιούνται όλο και περισσότερο στην ίδια τη διαδικασία κατασκευής νέων AI συστημάτων. Το θεωρητικό τελικό στάδιο είναι ένα σύστημα που μπορεί να συμβάλλει ουσιαστικά στη βελτίωση του διαδόχου του, ο οποίος με τη σειρά του μπορεί να κάνει το ίδιο ακόμη αποτελεσματικότερα.

Δεν έχουμε σήμερα αποδείξεις ότι μια ανεξέλεγκτη «έκρηξη νοημοσύνης» είναι αναπόφευκτη.

Έχουμε όμως έναν πολύ συγκεκριμένο λόγο που οι άνθρωποι της AI safety θέλουν οι μηχανισμοί ελέγχου να αναπτυχθούν πριν και όχι μετά την εμφάνιση τέτοιων δυνατοτήτων.

Γιατί το «θα το διορθώσουμε στην επόμενη αναβάθμιση» λειτουργεί υπέροχα όταν μιλάμε για bug στο Bluetooth.

Σε ένα υποθετικό σύστημα που είναι καλύτερο από εμάς στο coding, στο planning, στην εξαπάτηση και στην κυβερνοασφάλεια, μάλλον δεν είναι το update strategy που θέλεις να δοκιμάσεις.

Η άλλη πλευρά λέει ότι η συζήτηση ξεφεύγει

Υπάρχουν φυσικά και σημαντικοί επιστήμονες που θεωρούν τις πιο ακραίες προβλέψεις υπερβολικές.

Ερευνητές και σχολιαστές όπως ο Gary Marcus έχουν υποστηρίξει ότι μεγάλο μέρος της συζήτησης γύρω από την ανθρώπινη εξαφάνιση βασίζεται σε υποθέσεις για τεχνολογίες που ακόμη δεν υπάρχουν, ενώ άλλοι επισημαίνουν ότι πολύ πιο άμεσοι κίνδυνοι της AI βρίσκονται ήδη μπροστά μας: κυβερνοεπιθέσεις, deepfakes, παραπληροφόρηση, μαζική επιτήρηση, συγκέντρωση οικονομικής δύναμης και αυτοματοποίηση εργασίας.

Αυτό το επιχείρημα έχει ουσία.

Δεν πρέπει να φτάσουμε στο σημείο να φοβόμαστε ένα υποθετικό superintelligence του 2035 και να αγνοούμε τι μπορεί να κάνει ένα AI agent το 2026.

Στο freakunboxer.gr είδαμε ήδη ένα πολύ χαρακτηριστικό παράδειγμα με την πρόσφατη έκθεση της Anthropic για χρήση του Claude σε κυβερνοεπιθέσεις, malware και περιπτώσεις δυνητικά σχετικές με βιολογικούς κινδύνους. Το ενδιαφέρον εκεί δεν ήταν ότι «η AI έγινε κακή», αλλά ότι ένα ισχυρό εργαλείο μπορεί να πολλαπλασιάσει τις δυνατότητες του ανθρώπου που το χρησιμοποιεί.

Claude AI: Η Anthropic μπλόκαρε χρήση για βιολογικά όπλα

Αντίστοιχα, οι AI agents αρχίζουν ήδη να μετακινούν την τεχνολογία από το «απαντάω σε ερωτήσεις» στο «εκτελώ ενέργειες». Το Gemini Spark της Google αποτελεί χαρακτηριστικό παράδειγμα αυτής της μετάβασης.

Google Gemini Spark: Το AI αναλαμβάνει δουλειές στο Mac σου

Ο φόβος για την AI δεν ξεκίνησε χθες

Η ανησυχία γύρω από existential risk δεν είναι καινούργια ούτε περιορίζεται σε μια μικρή ομάδα ερευνητών.

Το 2023, το Center for AI Safety δημοσίευσε μία εξαιρετικά σύντομη δήλωση που ζητούσε ο περιορισμός του κινδύνου εξαφάνισης από την AI να αντιμετωπιστεί ως παγκόσμια προτεραιότητα αντίστοιχη με άλλους μεγάλης κλίμακας κινδύνους.

Μεταξύ των ανθρώπων που την υπέγραψαν βρίσκονταν οι Geoffrey Hinton, Yoshua Bengio, Sam Altman, Dario Amodei και ο CEO της Google DeepMind, Demis Hassabis.

Αυτό δεν αποδεικνύει ότι η AI θα καταστρέψει την ανθρωπότητα.

Αποδεικνύει όμως κάτι πολύ πιο συγκεκριμένο: η πιθανότητα καταστροφικών αποτελεσμάτων αντιμετωπίζεται ως πραγματικό αντικείμενο μελέτης από σημαντικό τμήμα της επιστημονικής κοινότητας.

Το πραγματικά ανησυχητικό δεν είναι η συγκεκριμένη πρόβλεψη

Προσωπικά, δεν θεωρώ ότι μπορούμε σήμερα να πούμε σοβαρά πως «η AI θα μας σκοτώσει όλους». Δεν υπάρχουν δεδομένα που να επιτρέπουν μια τέτοια βεβαιότητα και όποιος παρουσιάζει το χειρότερο δυνατό σενάριο ως δεδομένο κάνει ακριβώς το ίδιο λάθος με εκείνον που το απορρίπτει ως επιστημονική φαντασία.

Αυτό που αξίζει όμως να κρατήσουμε είναι διαφορετικό.

Για πρώτη φορά κατασκευάζουμε συστήματα που δεν γίνονται απλώς γρηγορότερα. Γίνονται καλύτερα στο reasoning, στο planning, στο coding και στην αυτόνομη εκτέλεση εργασιών, ενώ ταυτόχρονα χρησιμοποιούνται για να βοηθήσουν στην ανάπτυξη της επόμενης γενιάς αυτών των ίδιων συστημάτων.

Και οι άνθρωποι που βρίσκονται πιο κοντά σε αυτή τη διαδικασία δεν συμφωνούν όλοι για το πόσο επικίνδυνη είναι.

Κάποιοι θεωρούν ότι οι φόβοι έχουν διογκωθεί. Άλλοι εγκαταλείπουν τις θέσεις τους επειδή πιστεύουν ακριβώς το αντίθετο.

Αυτό από μόνο του είναι αρκετός λόγος για να πάρουμε τη συζήτηση στα σοβαρά.

Όχι επειδή αύριο θα ξυπνήσει το Skynet.

Αλλά επειδή, για πρώτη φορά, ο μεγαλύτερος τεχνολογικός αγώνας της εποχής μας εξελίσσεται ταυτόχρονα με μια άλλη μάχη: να καταλάβουμε πώς σταματάς ένα πολύ ισχυρό AI πριν χρειαστεί πραγματικά να το σταματήσεις.

Συχνές ερωτήσεις

Είπε πράγματι πρώην ερευνητής της Google DeepMind ότι η AI μπορεί να σκοτώσει όλους τους ανθρώπους;

Ναι. Ο Bilal Chughtai, πρώην research engineer της Google DeepMind με αντικείμενο AGI safety και alignment, δήλωσε δημόσια ότι πιστεύει πως η AI έχει τη δυνατότητα να οδηγήσει ακόμη και στην εξαφάνιση της ανθρωπότητας.

Υπάρχει επιστημονική απόδειξη ότι η AI θα καταστρέψει την ανθρωπότητα;

Όχι. Πρόκειται για εκτίμηση μελλοντικού κινδύνου και όχι για αποδεδειγμένη πρόβλεψη. Υπάρχει σημαντική διαφωνία μεταξύ ερευνητών σχετικά με την πιθανότητα και τη χρονική κλίμακα τέτοιων σεναρίων.

Τι είναι το AI alignment;

AI alignment είναι η προσπάθεια να εξασφαλιστεί ότι ένα σύστημα τεχνητής νοημοσύνης ακολουθεί τους πραγματικούς ανθρώπινους στόχους και αξίες αντί να επιδιώκει έναν στόχο με ανεπιθύμητους ή επικίνδυνους τρόπους.

Τι είναι το recursive self-improvement;

Είναι το θεωρητικό ενδεχόμενο ένα προηγμένο AI να χρησιμοποιεί τις ικανότητές του για να συμβάλλει στη δημιουργία ή βελτίωση ακόμη ισχυρότερων AI συστημάτων, επιταχύνοντας έτσι τον ίδιο τον ρυθμό ανάπτυξης της τεχνολογίας.

Φοβάται και η ίδια η Google DeepMind τέτοιους κινδύνους;

Η Google DeepMind δεν υποστηρίζει ότι η ανθρώπινη εξαφάνιση είναι αναπόφευκτη. Διατηρεί όμως επίσημα πλαίσια AI safety και ερευνά κινδύνους όπως misalignment, deceptive alignment, κυβερνοασφάλεια, βιολογικές απειλές και απώλεια ανθρώπινου ελέγχου.

Αφήστε μια απάντηση