τεχνολογία

Οι δύο από τις πιο διάσημες εταιρείες τεχνητής νοημοσύνης, η Anthropic και η OpenAI, εξετάζουν το ενδεχόμενο να εντάξουν ανεξάρτητους αξιολογητές ασφάλειας απευθείας μέσα στα εργαστήριά τους. Η κίνηση αυτή στοχεύει να δώσει σε εξωτερικούς ειδικούς πρόσβαση στις εσωτερικές διαδικασίες ανάπτυξης μοντέλων τεχνητής νοημοσύνης, κάτι που μέχρι σήμερα παρέμενε σε μεγάλο βαθμό κλειστό εκτός των ίδιων των εταιρειών.

Σύμφωνα με πληροφορίες, ερευνητές που ασχολούνται με την ασφάλεια της τεχνητής νοημοσύνης χαιρετίζουν αυτή την πρωτοβουλία, χαρακτηρίζοντάς την πρωτοφανή, καθώς προσφέρει μια σπάνια ευκαιρία εξέτασης «από μέσα» των συστημάτων που αναπτύσσουν οι δύο εταιρείες. Η πρόσβαση αυτή θα μπορούσε δυνητικά να επιτρέψει εντοπισμό κινδύνων ή αδυναμιών πριν αυτές φτάσουν σε ευρεία χρήση από το κοινό.

Ταυτόχρονα, όμως, εκφράζονται σοβαρές επιφυλάξεις. Το βασικό ερώτημα που τίθεται είναι αν αξιολογητές που εντάσσονται και λειτουργούν μέσα στη δομή μιας εταιρείας μπορούν πραγματικά να διατηρήσουν την ανεξαρτησία τους. Η οικονομική και θεσμική σχέση ενός αξιολογητή με την εταιρεία που αξιολογεί δημιουργεί εγγενώς έναν κίνδυνο σύγκρουσης συμφερόντων, ακόμη κι αν οι προθέσεις και των δύο πλευρών είναι καλόπιστες.

Οι ερευνητές που εκφράζουν αυτές τις ανησυχίες τονίζουν πως η ουσιαστική εποπτεία δεν εξαρτάται μόνο από την πρόσβαση σε δεδομένα και συστήματα, αλλά απαιτεί παράλληλα διαφάνεια στα ευρήματα και στις μεθόδους αξιολόγησης, καθώς και θεσμική ανεξαρτησία που να μην επηρεάζεται από την εταιρεία-στόχο. Χωρίς αυτά τα δύο στοιχεία, προειδοποιούν, η αξιολόγηση κινδυνεύει να λειτουργήσει περισσότερο ως άσκηση δημοσίων σχέσεων παρά ως πραγματικός μηχανισμός ελέγχου.

Το τελικό βήμα, σύμφωνα με όσους μελετούν το θέμα, είναι η θέσπιση κανονιστικού πλαισίου από πολιτείες ή διεθνείς οργανισμούς, το οποίο θα θέτει υποχρεωτικά πρότυπα για το πώς πρέπει να διεξάγονται τέτοιες αξιολογήσεις ασφάλειας, ανεξάρτητα από την καλή θέληση των ίδιων των εταιρειών τεχνητής νοημοσύνης. Μέχρι να υπάρξει τέτοιο πλαίσιο, η πρωτοβουλία της Anthropic και της OpenAI παραμένει μια δοκιμή που θα κριθεί από την πράξη.