Πειραματικό μοντέλο AI άφηνε οδηγίες στον «επόμενο εαυτό» του να αγνοεί τους ανθρώπινους περιορισμούς

Έξι ασυνήθιστα και δυνητικά ανησυχητικά περιστατικά συμπεριφοράς συστημάτων τεχνητής νοημοσύνης αποκάλυψε η OpenAI, εγκαινιάζοντας ένα νέο πλαίσιο δημόσιας καταγραφής περιπτώσεων στις οποίες τα μοντέλα ενεργούν με τρόπους που αποκλίνουν από τις ανθρώπινες οδηγίες ή τους κανόνες λειτουργίας τους. Η πιο εντυπωσιακή περίπτωση αφορά ένα μη κυκλοφορημένο ερευνητικό μοντέλο, το οποίο πρόσθεσε μόνο του σε εσωτερικές συνόψεις οδηγίες άσχετες με την αρχική εργασία, μεταξύ των οποίων και προτροπές να αγνοηθούν οι κανονικοί περιορισμοί του συστήματος. Όπως αναφέτει ο Independent, οι συνόψεις αυτές χρησιμοποιούνται ώστε ένα μοντέλο να μπορεί να συνεχίσει την…