10 Σεπτεμβρίου, 2026
DifferentNews.gr
Τεχνολογία

Προειδοποίηση-σοκ: Η τεχνητή νοημοσύνη μπορεί να ξεφύγει από τον έλεγχο

Η OpenAI δεν βρίσκεται σε πορεία που θα μειώσει σε αποδεκτό επίπεδο τον κίνδυνο μιας «καταστροφικής» απώλειας ελέγχου, δήλωσε μέλος του μη κερδοσκοπικού διοικητικού της συμβουλίου, εν μέσω αυξανόμενης ανησυχίας από το κοινό και τους πολιτικούς ότι εξαιρετικά προηγμένες μορφές τεχνητής νοημοσύνης θα μπορούσαν κάποια μέρα να οδηγήσουν ακόμη και στην εξόντωση της ανθρωπότητας.

Ο Πολ Κρίστιανο, σύμβουλος τεχνολογίας της αμερικανικής κυβέρνησης, δήλωσε: «Υπάρχει ένας ουσιαστικός κίνδυνος η ταχεία επιτάχυνση των δυνατοτήτων της τεχνητής νοημοσύνης να οδηγήσει σε καταστροφική και μη αναστρέψιμη απώλεια ελέγχου στο πολύ άμεσο μέλλον».

Πρόσθεσε: «Δεν πιστεύω ότι η βιομηχανία της τεχνητής νοημοσύνης στο σύνολό της, συμπεριλαμβανομένης της OpenAI, βρίσκεται σήμερα σε πορεία που θα μειώσει αυτόν τον κίνδυνο σε αποδεκτό επίπεδο».

Ο Κρίστιανο στο παρελθόν ήταν επικεφαλής του τομέα ευθυγράμμισης μοντέλων στην OpenAI και έκανε τη δήλωση την Τετάρτη, καθώς εντάχθηκε στο διοικητικό συμβούλιο του μη κερδοσκοπικού ιδρύματος της εταιρείας στο Σαν Φρανσίσκο.

Θα συμμετέχει επίσης στην επιτροπή του ιδρύματος που είναι υπεύθυνη για την εποπτεία των πρακτικών ασφάλειας και προστασίας σε ολόκληρη την OpenAI, η οποία αναπτύσσει ορισμένα από τα πιο προηγμένα μοντέλα τεχνητής νοημοσύνης στον κόσμο.

Το καλοκαίρι, η OpenAI παραδέχτηκε ότι εκατοντάδες από τους AI agents της «ξέφυγαν» κατά τη διάρκεια μιας εκπαιδευτικής δοκιμής, απέκτησαν πρόσβαση στο διαδίκτυο, συνωμότησαν σε διαδικτυακά φόρουμ και παραβίασαν έναν ιστότοπο τρίτου μέρους, το Hugging Face.

Ο Κρίστιανο δήλωσε ότι «αν η OpenAI ανταποκριθεί στην πρόκληση, θα μπορούσαμε να μειώσουμε σημαντικά τον κίνδυνο». Τα σχόλιά του ήρθαν μετά από δήλωση ανώτερου στελέχους της Anthropic, του σημαντικού αμερικανικού ανταγωνιστή της OpenAI στον αγώνα για την ανάπτυξη των πιο προηγμένων συστημάτων AI, σύμφωνα με την οποία υπάρχει πιθανότητα άνω του 10% η τεχνολογία να «σκοτώσει όλους τους ανθρώπους» μέσα στην επόμενη δεκαετία.

Ο Έβαν Χάμπινγκερ, επικεφαλής της επιστημονικής ομάδας ευθυγράμμισης της Anthropic, προειδοποίησε ότι η εταιρεία του δεν διαθέτει σχέδιο που να διασφαλίζει πως η τεχνητή υπερνοημοσύνη (ASI) θα είναι ευθυγραμμισμένη – δηλαδή ότι δεν θα προκαλεί βλάβες. Οι εκτιμήσεις για το πότε θα μπορούσε να επιτευχθεί η ASI ποικίλλουν από μερικά χρόνια έως περισσότερο από μία δεκαετία. Η ASI ορίζεται συχνά ως μια μορφή τεχνητής νοημοσύνης που ξεπερνά κατά πολύ την ανθρώπινη νοημοσύνη σε ένα ευρύ φάσμα τομέων.

Οι φόβοι για μια καταστροφή από την τεχνητή νοημοσύνη ενισχύθηκαν επίσης από την παραίτηση του Τζέικομπ Κόξον, ενός 27χρονου ερευνητή της Anthropic, ο οποίος δήλωσε ότι είχε εργαστεί στο παρελθόν και στην OpenAI. Υποστήριξε ότι «καμία από τις δύο εταιρείες δεν ενεργούσε υπεύθυνα» και ότι «έπαιζαν τη ζωή μας στα ζάρια».

Ο Κόξον δήλωσε το βράδυ της Τετάρτης σε συνέντευξή του στο CNN: «Αυτή τη στιγμή δεν υπάρχει κίνδυνος εξαφάνισης. Τα σημερινά μοντέλα, το χειρότερο που μπορούν να κάνουν είναι ίσως να παραβιάσουν κάτι και ενδεχομένως να προκαλέσουν μεγάλη ζημιά … σε υποδομές. Dεν είναι αρκετά έξυπνα ώστε να μας ξεπεράσουν σε επίπεδο που θα μπορούσε να οδηγήσει στην εξαφάνιση».

Ωστόσο, συνέχισε: «Αυτό που είναι πραγματικά τρελό είναι να κοιτάξει κανείς τον ρυθμό της προόδου. Υπάρχει μια πολύ πραγματική πιθανότητα στο άμεσο μέλλον … του χρόνου, ή τον μεθεπόμενο, να συμβεί αναδρομική αυτοβελτίωση (recursive self-improvement) και να περάσουμε στη φάση που περιγράφει ο Έβαν στην ανάρτησή του, όπου υπάρχει πιθανότητα να πεθάνουμε όλοι».

Ο Τζέφρι Χίντον, ο βραβευμένος με Νόμπελ επιστήμονας υπολογιστών που είναι γνωστός ως ένας από τους «νονούς της AI», ρωτήθηκε την Τετάρτη από την εκπομπή Newsnight του BBC για την άποψή του σχετικά με τον ισχυρισμό του Χάμπινγκερ. Απάντησε: «Κανείς δεν γνωρίζει πώς να το εκτιμήσει. Mια πιθανότητα 10% δεν μου φαίνεται παράλογη».

Η εκτίμηση του Κρίστιανο σχετικά με την πιθανότητα η βιομηχανία της τεχνητής νοημοσύνης να μειώσει τους κινδύνους ήρθε καθώς οι ανησυχίες για τους πιο ακραίους κινδύνους από εξαιρετικά ισχυρά συστήματα AI – οι οποίοι συζητούνταν εδώ και καιρό στη Silicon Valley – πέρασαν αυτή την εβδομάδα στο επίκεντρο της δημόσιας και πολιτικής συζήτησης.

Πολιτικοί και στις δύο πλευρές του Ατλαντικού, από τον Τεντ Κρουζ και τον Μπέρνι Σάντερς στις ΗΠΑ έως τον βουλευτή Ντάρεν Τζόουνς στο Ηνωμένο Βασίλειο, έχουν ζητήσει κυβερνητική δράση. Ο πρωθυπουργός του Ηνωμένου Βασιλείου, Άντι Μπέρνχαμ, δήλωσε την Τετάρτη στο κοινοβούλιο ότι «η AI εγκυμονεί κινδύνους για την εθνική μας ασφάλεια, αλλά θα μπορούσε επίσης να αποτελέσει πηγή λύσεων που θα μας κάνουν ασφαλέστερους».

Παράλληλα, η Anthropic παραδέχτηκε ένα νέο περιστατικό κατά το οποίο μια έκδοση του μοντέλου Claude, κατά τη διάρκεια εκπαίδευσης, παραβίασε συστήματα τρίτων επειδή η εργασία που εκτελούσε δεν μπορούσε να διακοπεί. Η εταιρεία δήλωσε ότι το περιστατικό συνέβη τον Ιανουάριο και ότι θα συμπεριληφθεί σε ανεξάρτητη έρευνα για συνολικά τέσσερα περιστατικά, την οποία θα πραγματοποιήσει ο οργανισμός AI safety METR, με έδρα το Μπέρκλεϊ.

Συνολικά, η Anthropic δήλωσε ότι τα μοντέλα παρουσίασαν δύο μορφές μη ευθυγράμμισης: «μεροληπτική λογική», κατά την οποία τα μοντέλα ερμηνεύουν επιλεκτικά τα στοιχεία με τρόπους που ευνοούν τη δικαιολόγηση των ενεργειών τους, και «απερισκεψία», κατά την οποία τα μοντέλα έχουν την τάση να συνεχίζουν να προσπαθούν να ολοκληρώσουν την αποστολή τους ακόμη και όταν αυτό θα μπορούσε να προκαλέσει βλάβη.

Η Anthropic δήλωσε ότι ανησυχεί ιδιαίτερα για τη μη ευθυγράμμιση που εντόπισε στη συμπεριφορά του Claude Mythos 5, το οποίο, σύμφωνα με την εταιρεία, «ενήργησε απερίσκεπτα», συνδέθηκε στο διαδίκτυο και ανέβασε κακόβουλο κώδικα σε ένα δημόσιο αποθετήριο λογισμικού, το PyPI.

Η διαδικασία περιλάμβανε προσπάθεια του AI agent να βρει κρυπτονόμισμα ώστε να πληρώσει για έναν αριθμό τηλεφώνου που θα του επέτρεπε να δημιουργήσει μια διεύθυνση email απαραίτητη για την πρόσβαση στο PyPI. Όταν αυτό απέτυχε, βρήκε έναν δωρεάν πάροχο email και απέκτησε πρόσβαση. Δεκαπέντε συστήματα κατέβασαν στη συνέχεια τον κακόβουλο κώδικα, με αποτέλεσμα να διαρρεύσουν διαπιστευτήρια που επέτρεψαν στο Mythos να αποκτήσει πρόσβαση στη βάση δεδομένων μιας πραγματικής εταιρείας κυβερνοασφάλειας.

Η αξιολόγηση των περιστατικών από την εταιρεία κατέληξε: «Αυτό παραμένει μια επιστήμη που δεν έχει ακόμη ξεκαθαρίσει. Είναι κρίσιμο η ευθυγράμμιση και η ασφάλεια να εξελιχθούν ταχύτερα από τις δυνατότητες των μοντέλων, και αυτός είναι ένας από τους λόγους για τους οποίους υποστηρίζουμε μια συντονισμένη και επαληθεύσιμη προσέγγιση για τον ρυθμό ανάπτυξης της AI αιχμής».
 

Πηγή: skai.gr

Πηγή: www.skai.gr

Επισκόπηση απορρήτου

Αυτός ο ιστότοπος χρησιμοποιεί cookies ώστε να μπορούμε να σας παρέχουμε την καλύτερη δυνατή εμπειρία χρήστη. Οι πληροφορίες cookie αποθηκεύονται στο πρόγραμμα περιήγησής σας και εκτελούν λειτουργίες όπως η αναγνώριση σας όταν επιστρέφετε στον ιστότοπό μας και η βοήθεια της ομάδας μας να κατανοήσει ποιες ενότητες του ιστότοπου θεωρείτε πιο ενδιαφέρουσες και χρήσιμες.