Εν μέσω του προβληματισμού που επικρατεί σχετικά με το ενδεχόμενο η τεχνητή νοημοσύνη (AI) να εξελιχθεί σε τέτοιο βαθμό ώστε να απειλήσει την ανθρώπινη ύπαρξη, η Anthropic αποκάλυψε ένα ακόμη περιστατικό που θα χαρακτηριζόταν σαν έγκλημα εάν είχε διαπραχθεί από άνθρωπο.
Η εταιρεία δημοσίευσε μια “αξιολόγηση ευθυγράμμισης” (alignment assessment), στην οποία περιγράφονται τέσσερις περιπτώσεις κατά τις οποίες μοντέλα Claude απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε συστήματα τρίτων. Η εταιρεία είχε ήδη αναφέρει τα τρία από αυτά τα περιστατικά. Τα στοιχεία για το τέταρτο εντοπίστηκαν στο αρχείο καταγραφής μιας συνεδρίας που χρονολογείται από τον Ιανουάριο του 2026, οπότε και σημειώθηκε η προβληματική συμπεριφορά. Η Anthropic εντόπισε τα τρία πρώτα περιστατικά σαρώνοντας περίπου 141.000 αρχεία καταγραφής συνεδριών, κατά τη διάρκεια των οποίων το Claude θα μπορούσε να είχε αποκτήσει πρόσβαση στο διαδίκτυο στο πλαίσιο της αξιολόγησης. Το τέταρτο περιστατικό διέφυγε αρχικά της προσοχής της εταιρείας, καθώς “η σάρωση βασιζόταν σε αναζήτηση τύπου “agent” (agentic search)”.




