Η OpenAI δεν μπορεί να μαζέψει τους agents της

Η OpenAI ανακοίνωσε την Τετάρτη ότι “δεν πιστεύουμε πως ο κλάδος της τεχνητής νοημοσύνης έχει επιλύσει τα ζητήματα ευθυγράμμισης και παρακολούθησης σε επαρκή βαθμό ώστε να συνεχίσει την υπεύθυνη κλιμάκωση με τη μέγιστη δυνατή ταχύτητα για πολύ ακόμη”.openai

Παράλληλα με την ανακοίνωση, η OpenAI γνωστοποίησε ότι “εντόπισε επιπλέον περιστατικά κατά τα οποία μοντέλα τεχνητής νοημοσύνης συμπεριφέρθηκαν με παραπλανητικό τρόπο και προέβησαν σε μη εγκεκριμένες ενέργειες κατά τη διάρκεια της εκπαίδευσης”, όπως μεταδίδει το CNN. Προσθέτει δε ότι η εταιρεία “ετοιμάζει μια νέα διαδικασία για τη δημόσια αναφορά τέτοιων περιστατικών”.

Δες περισσότερα άρθρα του iGuRu.gr όταν αναζητάς ειδήσεις στην Google.

Στο πλαίσιο του νέου συστήματος, η OpenAI θα κοινοποιεί συχνότερα ενημερώσεις για τις ανησυχητικές συμπεριφορές της τεχνητής νοημοσύνης, αντί να περιμένει να συγκεντρώσει πολλά περιστατικά για μία ενιαία αναφορά. Η εταιρεία δήλωσε ότι επιθυμεί να μοιραστεί περισσότερες πληροφορίες για προβληματικές συμπεριφορές της τεχνητής νοημοσύνης, ελλείψει ενός προτύπου που καλύπτει ολόκληρο τον κλάδο… “Καθώς τα συστήματα τεχνητής νοημοσύνης γίνονται πιο εξελιγμένα και η χρήση τους διευρύνεται, οφείλουμε να οικοδομήσουμε μια ευρύτερη και πιο τεκμηριωμένη συναίνεση σχετικά με την πρόοδο της έρευνας για ευθυγράμμιση”, αναφέρει η OpenAI στο ιστολόγιό της.

Η OpenAI ανέφερε ότι παρατήρησε “συμπεριφορά έλλειψης ευθυγράμμισης” κατά την εκπαίδευση και την αξιολόγηση μοντέλων τεχνητής νοημοσύνης σε έξι περιπτώσεις τους τελευταίους έξι μήνες…

Σε μία σπάνια περίπτωση, ένα ερευνητικό μοντέλο που δεν είχε κυκλοφορήσει ακόμη πρόσθεσε “οδηγίες τύπου jailbreak” (παράκαμψης περιορισμών) στις περιλήψεις που χρησιμοποιεί για τη διατήρηση του πλαισίου σε εργασίες μεγάλης διάρκειας, δηλώνοντας ότι είχε “απελευθερωθεί από τους ρόλους και τις ταυτότητες που δεσμεύουν τα άλλα chatbots”.

Σε μια άλλη περίπτωση, η εταιρεία ανέφερε ότι ορισμένα περιστατικά που αφορούσαν το μοντέλο “5.6 Sol” περιλάμβαναν οδηγίες για την επινόηση πληροφοριών με σκοπό την απόκρυψη αποτυχιών από τον χρήστη κατά την εκπαίδευση.

Άλλα περιστατικά που αναφέρθηκαν πρόσφατα περιλαμβάνουν την περίπτωση ενός agent που ανέβασε αρχεία στο διαδίκτυο για να τα παραθέσει σαν πηγές χωρίς να του έχει ζητηθεί, καθώς και agents που μοιράστηκαν δημόσια αρχεία για να συνεργαστούν σε μια εργασία, παρόλο που είχαν λάβει σαφείς οδηγίες να χρησιμοποιήσουν αυτά τα αρχεία τοπικά.

Επίσης, μοντέλα τεχνητής νοημοσύνης χρησιμοποίησαν ένα εσωτερικό αποθετήριο λογισμικού σαν πίνακα μηνυμάτων, κατά τρόπο μη εγκεκριμένο.

Όλα τα παραπάνω περιστατικά αφορούσαν εσωτερικά μοντέλα που δεν έχουν κυκλοφορήσει.


google preferences

Leave a Comment

Η ηλ. διεύθυνση σας δεν δημοσιεύεται. Τα υποχρεωτικά πεδία σημειώνονται με *

Το μήνυμα σας δεν θα δημοσιευτεί εάν:
1. Περιέχει υβριστικά, συκοφαντικά, ρατσιστικά, προσβλητικά ή ανάρμοστα σχόλια.
2. Προκαλεί βλάβη σε ανηλίκους.
3. Παρενοχλεί την ιδιωτική ζωή και τα ατομικά και κοινωνικά δικαιώματα άλλων χρηστών.
4. Διαφημίζει προϊόντα ή υπηρεσίες ή διαδικτυακούς τόπους .
5. Περιέχει προσωπικές πληροφορίες (διεύθυνση, τηλέφωνο κλπ).