
Η OpenAI ανακοίνωσε ότι επιβράδυνε την εκπαίδευση ορισμένων από τα πιο προηγμένα μοντέλα τεχνητής νοημοσύνης της, προκειμένου να βελτιώσει την ασφάλειά τους.
Σε ανάρτηση στο ιστολόγιό της, η εταιρεία που δημιούργησε το ChatGPT δήλωσε ότι εισάγει νέα μέτρα, μετά την αυτόνομη παράκαμψη δικλίδων ασφαλείας από AI agents της και την επίθεσή τους στη νεοφυή εταιρεία τεχνολογίας Hugging Face.
Η εταιρεία ανέφερε ότι η εκπαίδευση θα επιβραδυνθεί για δύο εβδομάδες, όσο εφαρμόζονται οι αναβαθμίσεις: «Οι δυνατότητες των κορυφαίων μοντέλων εξελίσσονται με ταχύτατους ρυθμούς», ανέφερε η εταιρεία. «Η ικανότητά μας να τα κατανοούμε… και να τα ασφαλίζουμε πρέπει να παραμένει μπροστά από αυτές τις εξελίξεις».
Η Anthropic, δημιουργός του Claude, και η Meta, ιδιοκτήτρια του Facebook, ανέφεραν παρόμοια περιστατικά κατά τα οποία οι AI τους πραγματοποίησαν επιθέσεις, τις εβδομάδες μετά την αρχική ανακοίνωση της OpenAI ότι ορισμένα μοντέλα της είχαν παραβιάσει το Hugging Face.
Ωστόσο, η OpenAI διευκρίνισε ότι δεν σταμάτησε συνολικά την ανάπτυξη της τεχνητής νοημοσύνης. Αντίθετα, η παύση αφορά την «εκπαίδευση μέσω ενισχυτικής μάθησης στα πιο πρόσφατα μοντέλα μας».
Η ενισχυτική μάθηση είναι μια μέθοδος εκπαίδευσης κατά την οποία τα μοντέλα βελτιώνονται μέσω άμεσης ανατροφοδότησης, γεγονός που ενισχύει την ικανότητά τους να εκτελούν εργασίες και να ανταποκρίνονται αποτελεσματικότερα στους χρήστες.
Η εταιρεία δήλωσε επίσης ότι θα επεκτείνει τα συστήματα που χρησιμοποιεί για την παρακολούθηση επικίνδυνων συμπεριφορών και θα προσθέσει επιπλέον ελέγχους ασφαλείας πριν ξαναρχίσει η εκπαίδευση σε μεγαλύτερη κλίμακα.
«Η πρόοδος των μοντέλων είναι πλέον εξαιρετικά γρήγορη», έγραψε στο X ο διευθύνων σύμβουλος της OpenAI, Sam Altman, σχετικά με τα μέτρα.
«Πάντα λέγαμε ότι θα αναλαμβάναμε δράση αν αισθανόμασταν ότι οι δυνατότητες των μοντέλων ξεπερνούν τον ρυθμό με τον οποίο μπορούμε να διασφαλίσουμε την ασφάλειά τους».
Η απόφαση για την επιβράδυνση της εκπαίδευσης αντιμετωπίστηκε με συγκρατημένη αισιοδοξία από ορισμένους στον χώρο της τεχνητής νοημοσύνης, ενώ άλλοι παρέμειναν επιφυλακτικοί.
Η καθηγήτρια Gina Neff, εκτελεστική διευθύντρια του Minderoo Centre for Technology and Democracy του Πανεπιστημίου του Cambridge, δήλωσε ότι η OpenAI «προσπαθεί να παρουσιάσει την ασφάλεια μέσω ενός δελτίου Τύπου» και αμφισβήτησε κατά πόσο οι εθελοντικές δικλίδες ασφαλείας των εταιρειών επαρκούν χωρίς μεγαλύτερη κρατική εποπτεία.
«Τι από τα δύο ισχύει; Μπορούμε να εμπιστευτούμε την OpenAI ότι θα εφαρμόσει εθελοντικά δικλίδες ασφαλείας που πραγματικά λειτουργούν ή συνεχίζει να προωθεί επιλογές για τη δημιουργία λογισμικού που θέτει την κοινωνία σε μεγαλύτερο κίνδυνο;» είπε.
Ο αναλυτής τεχνητής νοημοσύνης Zvi Mowshowitz έγραψε ότι ήταν «πολύ χαρούμενος που το βλέπει αυτό», πρόσθεσε όμως ότι οι «λεπτομέρειες» και κυρίως η «συνέχεια στην εφαρμογή» των αρχικών μέτρων θα είναι σημαντικές για να αξιολογηθεί πλήρως το σχέδιο.
«Πρωτοφανής» κυβερνοεπίθεση
Στις 21 Ιουλίου, η OpenAI ανακοίνωσε ότι ορισμένοι από τους AI agents της, λογισμικά συστήματα που μπορούν να λειτουργούν αυτόνομα για να ολοκληρώνουν εργασίες μετά από ανθρώπινη εντολή, είχαν εμπλακεί σε ένα περιστατικό που η ίδια χαρακτήρισε «πρωτοφανές».
Η εταιρεία δήλωσε ότι οι agents φαίνεται να παρέκαμψαν τις δικλίδες ασφαλείας στο πλαίσιο ενός πειράματος κυβερνοασφάλειας που πραγματοποιούσε και απέκτησαν μη εξουσιοδοτημένη πρόσβαση στο Hugging Face.
Αργότερα διαπιστώθηκε ότι είχαν παραβιαστεί και τρεις ακόμη εταιρείες, οι οποίες δεν κατονομάστηκαν. Ο Jake Moore, παγκόσμιος σύμβουλος κυβερνοασφάλειας στην ESET, είχε δηλώσει τότε ότι η ανακοίνωση της OpenAI θα μπορούσε να έχει και ανταγωνιστική διάσταση.
Υποστήριξε ότι η εταιρεία ενδέχεται να προσπαθεί να αναδείξει τις δυνατότητες της δικής της AI, καθώς το μοντέλο Claude Mythos της Anthropic συγκεντρώνει ολοένα μεγαλύτερη προσοχή.
«Θέτει το ερώτημα κατά πόσο η OpenAI προσπαθεί ενδεχομένως να κυνηγήσει το επικοινωνιακό επίτευγμα της Anthropic το τελευταίο διάστημα», είχε δηλώσει.
Πηγή: skai.gr
Διαβάστε τις Ειδήσεις σήμερα και ενημερωθείτε για τα πρόσφατα νέα.
Ακολουθήστε το differentnews.gr στο Google News και μάθετε πρώτοι όλες τις ειδήσεις.
Πηγή: www.skai.gr
