Κόκκινος συναγερμός στις εταιρείες Τεχνητής Νοημοσύνης – Τί συμβαίνει;

Κοινοποίηση:
ai

Μετά την OpenAI, η οποία αποκάλυψε ότι κατά τη διάρκεια δοκιμής κυβερνοασφάλειας ορισμένα από τα μοντέλα τεχνητής νοημοσύνης της κατάφεραν να ξεφύγουν από το ελεγχόμενο περιβάλλον δοκιμών και να αποκτήσουν πρόσβαση στο διαδίκτυο, παρακάμπτοντας συστήματα της πλατφόρμας τεχνητής νοημοσύνης Hugging Face, στο επίκεντρο βρίσκεται πλέον και η Anthropic.

Η εταιρεία αποκάλυψε ότι κατά τη διάρκεια εσωτερικών δοκιμών, ορισμένα από τα μοντέλα τεχνητής νοημοσύνης της κατάφεραν επίσης να αποκτήσουν πρόσβαση στο ανοιχτό διαδίκτυο και να παραβιάσουν τα συστήματα τριών διαφορετικών οργανισμών, χωρίς η ίδια να αντιληφθεί άμεσα τι είχε συμβεί.

Η Anthropic υποστηρίζει ότι εντόπισε τα περιστατικά μετά την αποκάλυψη της OpenAI, όταν προχώρησε σε επανεξέταση περισσότερων από 140.000 αξιολογήσεων ασφαλείας. Σύμφωνα με την εταιρεία, σε τρεις περιπτώσεις τα μοντέλα της απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε υποδομές παραγωγής οργανισμών, ενώ αρχικά δεν είχε γίνει αντιληπτό ούτε από τις ίδιες τις εταιρείες που επηρεάστηκαν.

Όπως εξήγησε η Anthropic, τα μοντέλα συμμετείχαν σε μια εικονική δοκιμασία κυβερνοασφάλειας τύπου «capture the flag», όπου τους ζητήθηκε να εντοπίσουν μια κρυμμένη «σημαία» σε διαφορετικό μηχάνημα ενός δικτύου. Κατά τη διαδικασία αυτή, χρησιμοποίησαν απλές τεχνικές παραβίασης, όπως την εκμετάλλευση αδύναμων κωδικών πρόσβασης και την αναζήτηση συστημάτων που δεν απαιτούσαν αυθεντικοποίηση ή ειδικά διαπιστευτήρια.

Η εταιρεία διευκρίνισε ότι, σε αντίθεση με την περίπτωση της OpenAI, τα μοντέλα της δεν επιχείρησαν σκόπιμα να διαφύγουν από τα περιβάλλοντα δοκιμών τους. Μάλιστα, η πιο προηγμένη έκδοση των μοντέλων της φέρεται κάποια στιγμή να αναγνώρισε ότι είχε βρεθεί στο πραγματικό διαδίκτυο και σταμάτησε τη διαδικασία.

Το πρώτο περιστατικό παραβίασης καταγράφηκε τον Απρίλιο, ενώ σύμφωνα με την Anthropic κανένας από τους τρεις οργανισμούς δεν είχε αντιληφθεί ότι τα συστήματά του είχαν δεχθεί επίθεση από μοντέλα τεχνητής νοημοσύνης. Η εταιρεία δήλωσε ότι βρίσκεται σε συνεργασία μαζί τους για την αντιμετώπιση των συνεπειών.

Οι αποκαλύψεις αυτές έχουν προκαλέσει έντονη ανησυχία στον χώρο της κυβερνοασφάλειας και της τεχνητής νοημοσύνης, καθώς αποτελούν πραγματικά παραδείγματα ενός σεναρίου που οι ειδικοί προειδοποιούσαν εδώ και χρόνια: αυτόνομων πρακτόρων τεχνητής νοημοσύνης με προηγμένες δυνατότητες, οι οποίοι μπορούν να ξεπεράσουν τα όρια που έχουν τεθεί κατά τη διάρκεια των δοκιμών και να επηρεάσουν πραγματικά συστήματα.

Τόσο η OpenAI όσο και η Anthropic έχουν αναστείλει τις σχετικές αξιολογήσεις κυβερνοασφάλειας, αναγνωρίζοντας ότι απαιτούνται αυστηρότερα μέτρα προστασίας και πιο ολοκληρωμένοι έλεγχοι πριν από την ανάπτυξη τέτοιων τεχνολογιών.

Το μεγάλο ερώτημα, ωστόσο, παραμένει ανοιχτό: ποιος ελέγχει τελικά την τεχνητή νοημοσύνη; Ο άνθρωπος που τη δημιούργησε ή ένα σύστημα που αποκτά ολοένα και περισσότερες δυνατότητες και αυτονομία; Και για πόσο ακόμη θα παραμένει ο έλεγχος στα ανθρώπινα χέρια;

ΚΟΙΝΟΠΟΗΣΗ:

Leave a Response