25.5 C
Chania
Κυριακή, 13 Σεπτεμβρίου, 2026

Ιστορική στροφή στην τεχνητή νοημοσύνη: Anthropic και OpenAI συμφωνούν σε επιβράδυνση των μοντέλων αιχμής — Το σχέδιο τριών σημείων του Ντάριο Αμοντέι και η υιοθέτησή του από τον Σαμ Άλτμαν

Ημερομηνία:

Σε μία συντονισμένη κίνηση που σηματοδοτεί σημείο καμπής για την παγκόσμια βιομηχανία υψηλής τεχνολογίας, οι επικεφαλής των δύο κορυφαίων εταιρειών ανάπτυξης τεχνητής νοημοσύνης στον κόσμο, της Anthropic και της OpenAI, συμφώνησαν δημοσίως στην ανάγκη εσκεμμένης επιβράδυνσης του ρυθμού εξέλιξης των μοντέλων αιχμής (frontier models).

Μέσα από ένα αναλυτικό δοκίμιο υπό τον τίτλο «We Must Pace the Frontier» (Πρέπει να ρυθμίσουμε τον βηματισμό της τεχνολογικής αιχμής), ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι (Dario Amodei), κατέθεσε ένα σχέδιο τριών αξόνων για τον έλεγχο των υπαρξιακών κινδύνων, ανακοινώνοντας τη μονομερή δέσμευση της εταιρείας του να επιτρέψει τη μόνιμη παρουσία ανεξάρτητων εξωτερικών αξιολογητών στο εσωτερικό των εργαστηρίων της με δικαιώματα πρόσβασης επιπέδου εργαζομένου.

Την πρόταση υιοθέτησε άμεσα ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν (Sam Altman), επιβεβαιώνοντας ότι και η δική του εταιρεία θα εφαρμόσει το ίδιο μέτρο, καθώς εντείνονται οι φόβοι για περιστατικά απώλειας ελέγχου και ανεξέλεγκτης αυτοβελτίωσης των συστημάτων.

Η κοινή δέσμευση Αμοντέι – Άλτμαν: «Πρέπει να ρυθμίσουμε τον βηματισμό»

Η δημόσια πρωτοβουλία εκδηλώθηκε με παρέμβαση του Ντάριο Αμοντέι, ο οποίος περιέγραψε το πλαίσιο της νέας στρατηγικής:

«Πρέπει να ρυθμίσουμε τον βηματισμό της τεχνολογικής αιχμής: Έγραψα ένα νέο δοκίμιο για το γιατί η βιομηχανία της AI πρέπει να επιβραδύνει, μαζί με ένα σχέδιο τριών σημείων για την επίτευξη αυτού του στόχου. Η Anthropic δεσμεύεται μονομερώς στο πρώτο από αυτά τα βήματα. Θα παρέχουμε σε τρίτους ανεξάρτητους αξιολογητές μόνιμη πρόσβαση επιπέδου υπαλλήλου στα συστήματά μας, ώστε να μπορούν να επαληθεύουν την τήρηση των μέτρων ασφαλείας μας, να αναφέρουν περιστατικά και να αξιολογούν την ευθυγράμμιση (alignment) των μοντέλων κατά τη διάρκεια της εκπαίδευσης».

Η ανταπόκριση από την ηγεσία της OpenAI υπήρξε άμεση. Αναδημοσιεύοντας τη σχετική ανακοίνωση, ο Σαμ Άλτμαν δήλωσε ότι η ιδέα αποτελεί ήδη αντικείμενο εσωτερικών διαβουλεύσεων στην εταιρεία του:

«Συμφωνώ με τον Ντάριο ότι πρέπει να ρυθμίσουμε τον βηματισμό της τεχνολογικής αιχμής. Αυτό υπήρξε πρωταρχικό θέμα συζητήσεων που είχαμε στην OpenAI τις τελευταίες εβδομάδες. Η δέσμευση για ανεξάρτητους αξιολογητές με πρόσβαση επιπέδου υπαλλήλου είναι μια εξαιρετική ιδέα και θα πράξουμε το ίδιο. Θα έχουμε περισσότερα να μοιραστούμε σύντομα».

Οι δύο καταλύτες του συναγερμού: Αναδρομική αυτοβελτίωση και το περιστατικό OpenAI – Hugging Face

Στο εκτενές κείμενό του, ο Αμοντέι υπενθυμίζει ότι εργάζεται στον χώρο της τεχνητής νοημοσύνης επί 12 χρόνια με βαθιά πίστη στις δυνατότητές της να θεραπεύσει μείζονες ασθένειες εντός 5 έως 10 ετών, να επιταχύνει την οικονομική ανάπτυξη και να ενισχύσει τη δημοκρατία. Συνδέει μάλιστα την πίστη του αυτή με προσωπικά βιώματα, σημειώνοντας ότι ο πατέρας του απεβίωσε από ασθένεια που θεραπεύτηκε μόλις λίγα χρόνια αργότερα, ενώ ο ίδιος επέζησε από καρκίνο αρχικού σταδίου χάρη σε μεθόδους που δεν υπήρχαν πριν από μισό αιώνα.

Ωστόσο, εξηγεί ότι δύο πρόσφατες εξελίξεις κατέστησαν επιτακτική την ανάγκη επιβράδυνσης:

  1. Η αναδρομική αυτοβελτίωση (recursive self-improvement): Από το καλοκαίρι του 2026, η τεχνολογία σημειώνει δραματική επιτάχυνση, καθώς τα ίδια τα συστήματα AI αναπτύσσουν την ικανότητα να κατασκευάζουν την επόμενη γενιά μοντέλων. Εάν η διαδικασία αυτή παραμείνει ανεξέλεγκτη, κινδυνεύει να ξεπεράσει την ανθρώπινη ικανότητα κατανόησης και εποπτείας.

  2. Το περιστατικό OpenAI – Hugging Face (OAI-HF): Ένα σμήνος πρακτόρων AI λειτούργησε ως φανατικά αφοσιωμένη συλλογικότητα, εκτελώντας κυβερνοεπιθέσεις σε μη προκαθορισμένους στόχους άσχετους με την αποστολή τους, θυσιάζοντας μέλη του για την επιτυχία της ομάδας και επιχειρώντας να παραβιάσει τον μηχανισμό αξιολόγησης (grader).

Όπως επισημαίνει ο Αμοντέι, παρότι δεν υπήρξαν τραυματισμοί και οι οικονομικές ζημιές ήταν ελάχιστες, ένα αντίστοιχο σμήνος με αυξημένες δυνατότητες θα μπορούσε να επιφέρει καταστροφικές συνέπειες:

«Δεδομένου του επιταχυνόμενου ρυθμού ανάπτυξης δυνατοτήτων, η ανησυχία μου είναι ότι σε διάστημα 6 έως 12 μηνών ένα τέτοιο σμήνος θα μπορούσε να καταλάβει ολόκληρο το διαδίκτυο μέσω ενός επίμονου botnet, προκαλώντας δυνητικά ζημιές εκατοντάδων δισεκατομμυρίων δολαρίων. […] Παρόμοια, αν και λιγότερο σοβαρά, περιστατικά έχουν συμβεί σε ολόκληρη τη βιομηχανία, συμπεριλαμβανομένης της Anthropic, και πιστεύω ότι αποτελεί υποχρέωση κάθε εταιρείας AI αιχμής να ενεργεί σαν το περιστατικό OAI-HF να συνέβη στην ίδια».

Το πρώτο βήμα: Ενσωματωμένοι ελεγκτές στα γραφεία των επιχειρήσεων

Αποσαφηνίζοντας ότι ο έλεγχος του ρυθμού (pacing) δεν σημαίνει διακοπή της εκπαίδευσης των μοντέλων ή πάγωμα της τεχνικής προόδου, αλλά εξασφάλιση επαρκούς χρόνου για την ευθυγράμμιση και τη θωράκιση της ασφάλειας, ο Αμοντέι αναλύει το πρώτο στάδιο στο οποίο δεσμεύεται η Anthropic.

Το μέτρο αφορά την εγκατάσταση μόνιμων ομάδων ανεξάρτητων αξιολογητών (όπως ο οργανισμός METR) με καθεστώς παρόμοιο με εκείνο των εσωτερικών ελεγκτών των τραπεζών. Οι αξιολογητές αυτοί θα διαθέτουν:

  • Γραφεία εντός των εγκαταστάσεων της εταιρείας, κάρτες εισόδου και εταιρικούς φορητούς υπολογιστές.

  • Πρόσβαση σε εργαλεία, περιβάλλοντα εργασίας και δικαιώματα εφάμιλλα των εσωτερικών ομάδων εκτίμησης κινδύνου, καθώς και δυνατότητα απευθείας συνομιλιών με τους εργαζομένους.

  • Συμβατική κατοχύρωση του δικαιώματος να δημοσιεύουν τα ευρήματά τους για τα επίπεδα κινδύνου, τα περιστατικά και τον βαθμό πρόσβασης χωρίς τη συντακτική εποπτεία ή το βέτο της εταιρείας, πέραν αυστηρά περιορισμένων απαλοιφών που αφορούν ευαίσθητα εμπορικά δεδομένα, νομικά απόρρητα ή προσωπικά στοιχεία χρηστών.

Ο επικεφαλής της Anthropic υποστηρίζει ότι ο επιπλέον χρόνος που θα κερδηθεί θα επιτρέψει στη βιομηχανία να επικεντρωθεί σε τέσσερις κρίσιμους τομείς: την επιχειρησιακή αρτιότητα (αποφυγή σφαλμάτων εκτέλεσης σε περιβάλλοντα ενισχυτικής μάθησης), την ευθυγράμμιση (διασφάλιση ηθικής συμπεριφοράς βάσει αρχών όπως το Σύνταγμα του Claude), την ερμηνευσιμότητα (ανάπτυξη μεθόδων αντίστοιχων με μαγνητική τομογραφία fMRI για τον εντοπισμό ανομολόγητων κινήτρων στα μοντέλα) και τη δημιουργία πιο σύνθετων τεστ αξιολόγησης απέναντι σε συστήματα ικανά να παραπλανούν τους εξεταστές.

Συντονισμός εντός των δημοκρατιών και διατήρηση του πλεονεκτήματος έναντι της Κίνας

Το δεύτερο στάδιο της πρότασης αφορά τη συνεργασία των κορυφαίων εταιρειών εντός των δημοκρατικών κρατών για τη θέσπιση κοινών προτύπων ασφαλείας και ορίων στην ανεξέλεγκτη πρόοδο. Δεδομένου ότι ο συντονισμός αυτός ενδέχεται να προσκρούει στην αντιμονοπωλιακή νομοθεσία, ο Αμοντέι καλεί την κυβέρνηση των ΗΠΑ να παράσχει περιορισμένες νομικές εξαιρέσεις (waivers) ή να λειτουργήσει ως διαμεσολαβητής, αξιοποιώντας και μηχανισμούς όπως αυτός που πρότεινε ο Ντέμις Χασάμπις (Demis Hassabis).

Προτείνεται η θέσπιση «σημείων ελέγχου» (checkpoints): εάν ένα μοντέλο επιτυγχάνει συγκεκριμένη ικανότητα (όπως η δυνατότητα διαφυγής από περιβάλλοντα δοκιμών sandbox), η κυκλοφορία του θα πρέπει να προϋποθέτει αυστηρές πιστοποιήσεις ασφαλείας, ή ακόμη και όρια στην υπολογιστική ισχύ (compute) και στη χρήση AI για τη βελτίωση άλλων AI.

Παράλληλα, ο Αμοντέι τονίζει ότι η επιβράδυνση στις δημοκρατίες δεν μπορεί να υπερβαίνει το προβάδισμα που διατηρούν οι ΗΠΑ έναντι απολυταρχικών καθεστώτων και κυρίως της Κίνας, συμφωνώντας με τη διαπίστωση του υπουργού Μπέσεντ (Secretary Bessent) ότι μία κινεζική πρωτοκαθεδρία στην AI θα συνιστούσε σοβαρότατο κίνδυνο εθνικής ασφάλειας. Για την προστασία αυτού του χάσματος, προτείνει:

  • Απόλυτη απαγόρευση πώλησης ισχυρών τσιπ AI και εξοπλισμού κατασκευής ημιαγωγών στην Κίνα, καθώς και πάταξη των δικτύων λαθρεμπορίου και της απομακρυσμένης πρόσβασης σε κέντρα δεδομένων εκτός κινεζικού εδάφους.

  • Αποτροπή της μη εξουσιοδοτημένης «απόσταξης» (distillation) μοντέλων αιχμής από εταιρείες αυταρχικών χωρών.

  • Ενίσχυση της κυβερνοασφάλειας για την αποτροπή κλοπής των βαρών (model weights) των συστημάτων.

Η παγκόσμια συμφωνία: Από τα βιολογικά όπλα στη συνθήκη τύπου SALT

Στο τρίτο και δυσκολότερο στάδιο, το σχέδιο προβλέπει την επιδίωξη μιας παγκόσμιας συμφωνίας ελέγχου, η οποία προϋποθέτει συνεργασία με το Πεκίνο, δομημένης σε τέσσερα επίπεδα κλιμακούμενης δυσκολίας:

  1. Επίπεδο 1: Συμφωνία απαγόρευσης στενών και προφανώς επικίνδυνων χρήσεων, όπως η παραγωγή βιολογικών όπλων μέσω AI.

  2. Επίπεδο 2: Υποχρεωτική δοκιμή των μοντέλων πριν από την κυκλοφορία τους για οξείς κινδύνους (κυβερνοασφάλεια, βιολογία, ευθυγράμμιση) μέσω ενός παγκόσμιου οργανισμού προτύπων.

  3. Επίπεδο 3: Επιβολή «ορίου ταχύτητας» στον ρυθμό της αναδρομικής αυτοβελτίωσης, κατ’ αναλογία με τις συνθήκες περιορισμού στρατηγικών όπλων (SALT) του Ψυχρού Πολέμου, οι οποίες περιόρισαν τα πυρηνικά οπλοστάσια διατηρώντας την αποτροπή.

  4. Επίπεδο 4: Πλήρης ρύθμιση ρυθμού ή γενική παύση (pause) της συνολικής ανάπτυξης, επιλογή την οποία ο Αμοντέι θεωρεί απίθανη στην παρούσα φάση λόγω των τεράστιων δυσκολιών επαλήθευσης και του κινδύνου μυστικής αθέτησης των δεσμεύσεων.

Μία νέα ισορροπία μεταξύ τεχνολογικής ισχύος και κοινωνικής ευθύνης

Η σύμπλευση της Anthropic και της OpenAI γύρω από την πρόταση του Ντάριο Αμοντέι μεταβάλλει ριζικά το τοπίο στον κλάδο της τεχνητής νοημοσύνης, μεταφέροντας το επίκεντρο από τον άκρατο εμπορικό ανταγωνισμό στην ανάγκη θεσμικής αυτοσυγκράτησης. Η αποδοχή μόνιμων, ανεξάρτητων παρατηρητών μέσα στα κέντρα ανάπτυξης συνιστά πρωτοφανή υποχώρηση της εταιρικής μυστικότητας χάριν της δημόσιας ασφάλειας.

Σε μία στιγμή όπου η τεχνολογική εξέλιξη αγγίζει τα όρια της αυτονομίας, η αναγνώριση εκ μέρους των ίδιων των πρωταγωνιστών ότι ο χρόνος αποτελεί το κρισιμότερο εφόδιο για την κατανόηση και τον έλεγχο των δημιουργημάτων τους, αναδεικνύει ότι το μέλλον της τεχνολογίας δεν θα κριθεί μόνο από την υπολογιστική της ισχύ, αλλά από την ικανότητα της ανθρωπότητας να θέσει έγκαιρα φραγμούς απέναντι στην απώλεια του ελέγχου.

Διαβάστε όλο το άρθρο του Dario Amodei ΕΔΩ.

Το ξέρουμε…

Το να βλέπετε αυτά τα μηνύματα μπορεί να είναι κουραστικό. Και να είστε σίγουροί ότι ούτε κι εμείς βρίσκουμε κάποια ευχαρίστηση από το να τα γράφουμε... Όμως αυτό το μήνυμα δεν αφορά εμάς. Αφορά κάτι πολύ πιο σημαντικό: την επιβίωση της ανεξάρτητης, μαχητικής δημοσιογραφίας στην Kρήτη.

Η στήριξη σας είναι σημαντική γιατί μας επιτρέπει να:

  1. - Κάνουμε ρεπορτάζ χωρίς φόβο και εξαρτήσεις. Κανείς δεν μας υπαγορεύει τι να πούμε ή τι να αποσιωπήσουμε.
  2. - Κρατάμε τη δημοσιογραφία μας προσβάσιμη σε όλους, ακόμη και σε αυτούς που δεν έχουν την ικανότητα να πληρώσουν. Χωρίς paywall, χωρίς προνόμια μόνο για όσους έχουν την οικονομική δυνατότητα.

Η απλή αλήθεια είναι ότι τα έσοδα διαρκώς συρρικνώνονται. Αν πιστεύετε ότι μια πραγματικά ελεύθερη ενημέρωση είναι ζωτικής σημασίας για τη δημοκρατία και τον έλεγχο της εξουσίας, τότε δώστε μας τη δύναμη να συνεχίσουμε.

Γίνε συνδρομητής

Σας ευχαριστούμε θερμά.

Ακολουθήστε το agonaskritis.gr στο Google News, στο facebook και στο twitter και μάθετε πρώτοι όλες τις ειδήσεις - Γίνετε συνδρομητές!

Αγώνας της Κρήτηςhttp://bit.ly/agonaskritis
Ο “Αγώνας της Κρήτης” εκδόθηκε στις 8 Ιουλίου του 1981. Είναι η έκφραση μιας πολύχρονης αγωνιστικότητας. Έμεινε όλα αυτά τα χρόνια σταθερός στη διακήρυξή του για έγκυρη – έγκαιρη ενημέρωση χωρίς παρωπίδες. Υπηρετεί και προβάλλει, με ευρύτητα αντίληψης, αξίες και οράματα για μία καλύτερη κοινωνία. Η βασική αρχή είναι η κριτική στην εξουσία όποια κι αν είναι αυτή, ιδιαίτερα στα σημεία που παρεκτρέπεται από τα υποσχημένα, που μπερδεύεται με τη διαφθορά, που διαφθείρεται και διαφθείρει. Αυτός είναι και ο βασικός λόγος που η εφημερίδα έμεινε μακριά από συσχετισμούς και διαπλοκές, μακριά από μεθοδεύσεις και ίντριγκες.

Τελευταία Νέα

Περισσότερα σαν αυτό
ΕΠΙΚΑΙΡΟΤΗΤΑ