Στέλεχος της OpenAI: «εποχή γενικής νοημοσύνης». Η εταιρεία σιωπά.

Η διακήρυξη προηγείται ακόμη της δοκιμής στην πραγματική εργασία.
Σύνθεση εικόνας · tobriefΠαρουσιάζοντας προχθές το νέο κορυφαίο μοντέλο τεχνητής νοημοσύνης της OpenAI, ο πρόεδρος της εταιρείας Greg Brockman έκλεισε την ενημέρωση με μια φράση: «Welcome to the AGI era», καλωσορίσατε στην εποχή της γενικής τεχνητής νοημοσύνης (Axios, VentureBeat). Η επίσημη ανακοίνωση της ίδιας της OpenAI, όμως, δεν χρησιμοποιεί πουθενά τη λέξη: παρουσιάζει το GPT-6 Astra ως «το πιο ευφυές και ευθυγραμμισμένο μοντέλο» της (OpenAI).
Το Astra, που η OpenAI διαθέτει σταδιακά τις τελευταίες ημέρες (To Brief), δεν απαντά απλώς σε ερωτήσεις· χειρίζεται μόνο του τον υπολογιστή για να ολοκληρώνει εργασίες. Και η απόσταση ανάμεσα σε αυτό που δήλωσε προσωπικά ένα στέλεχος και σε αυτό που η εταιρεία είναι διατεθειμένη να γράψει επίσημα είναι η πραγματική είδηση.
Γιατί για την OpenAI η γενική τεχνητή νοημοσύνη (AGI) δεν είναι ένα εντυπωσιακό επίθετο, αλλά ορισμός με θεσμική και οικονομική βαρύτητα. Στο ιδρυτικό της κείμενο, η εταιρεία ορίζει την AGI ως «άκρως αυτόνομα συστήματα που ξεπερνούν τους ανθρώπους στις περισσότερες οικονομικά πολύτιμες εργασίες» (OpenAI Charter). Ο πήχης έχει τρία φίλτρα ταυτόχρονα: αυτονομία, σύγκριση με ανθρώπους και πλάτος σε μεγάλο μέρος της αμειβόμενης δουλειάς. Με μια αναλογία: ένα μοντέλο μπορεί να γράψει άριστα στις πανελλήνιες των μαθηματικών, χωρίς αυτό να αποδεικνύει ότι δουλεύει καλύτερα από άνθρωπο ως λογιστής, βοηθός δικηγόρου, project manager και τεχνικός υποστήριξης ταυτόχρονα. Ο ορισμός μιλά για το δεύτερο.
Το σχεδόν τέλειο 99,9% και οι αστερίσκοι του
Τα νούμερα του Astra είναι, όντως, εντυπωσιακά. Στο ARC-AGI-3, το τεστ που σχεδιάστηκε για να μετρά προσαρμογή σε άγνωστα, πρωτόγνωρα προβλήματα αντί για αποστήθιση (ARC Prize), αναφέρεται σκορ 99,9%. Στο FrontierMath, μια συλλογή μαθηματικών ερευνητικού επιπέδου, αναφέρεται 97,6%, μπροστά από το προηγούμενο μοντέλο της OpenAI και από το Claude Fable 5.1 της Anthropic, πάντα με βάση τα στοιχεία της ίδιας της εταιρείας (DataCamp, VentureBeat).
Εδώ χρειάζεται να διαβάσεις τα ψιλά γράμματα. Εκείνο το σχεδόν τέλειο 99,9% δεν το πέτυχε το «γυμνό» μοντέλο. Φαντάσου να αφήνεις τον εξεταζόμενο να λύσει το διαγώνισμα με ανοιχτό βιβλίο, όλα τα εργαλεία μπροστά του και όσες προσπάθειες θέλει, και μετά να βαθμολογείς «αυτόν». Το κορυφαίο σκορ βγήκε ακριβώς μέσα από ένα τέτοιο πλαίσιο βοηθημάτων (στα αγγλικά, harness) που κρατά μνήμη και εργαλεία και κοστίζει περίπου 19.000 δολάρια για μία πλήρη δοκιμή· στο τυπικό, προεπιλεγμένο περιβάλλον το σκορ έπεσε γύρω στο 62,7% (Simon Willison, DataCamp). Δεν ακυρώνεται το επίτευγμα. Γίνεται πιο ακριβές: το νούμερο μετράει ολόκληρο το σύστημα, όχι το μοντέλο μόνο του.
Πιο κοντά στην πραγματική δουλειά βρίσκεται η χρήση υπολογιστή. Ο Brockman ξεχώρισε ακριβώς αυτή την ικανότητα ως τη σημαντικότερη, καθώς το μοντέλο περνά μέσα από λογιστικά φύλλα, φόρμες και ιστοσελίδες συχνά πιο γρήγορα από άνθρωπο (Fortune). Στο OSWorld, ένα τεστ τέτοιων εργασιών, το Astra πιάνει 72,6% με περίπου 47% λιγότερο χρόνο ανά εργασία σε σχέση με το προηγούμενο μοντέλο (Prograsec). Αυτή είναι η πιο χειροπιαστή αλλαγή: λιγότερο «γράψε μου μια απάντηση», περισσότερο «άνοιξε τα εργαλεία και κάν' τη δουλειά».
Όταν μετράνε οι ανεξάρτητοι
Έξω από την OpenAI, η εικόνα θολώνει. Στον σύνθετο δείκτη νοημοσύνης της Artificial Analysis το Astra σκοράρει 61, σχεδόν ισόβαθμο με το προηγούμενο μοντέλο της OpenAI και πέντε μονάδες πίσω από το Claude Fable 5.1 της Anthropic. Σε ορισμένες πίστες προηγείται καθαρά, όπως στον προγραμματισμό με εργαλεία, όπου φτάνει το 67 (Artificial Analysis). Η επίδοση είναι δηλαδή οδοντωτή: κορυφαία σε συγκεκριμένους τομείς, χωρίς καθολική υπεροχή.
Και στο GDPval-AA v2, ένα τεστ φτιαγμένο από ένα σύνολο πραγματικών, οικονομικά πολύτιμων εργασιών, δηλαδή τη μόνη δημοσιευμένη μέτρηση που μιλά ευθέως τη γλώσσα του καταστατικού, το Astra υποχώρησε (Artificial Analysis). Εδώ κλείνει ο κύκλος πίσω στον ορισμό. Καμία από αυτές τις μετρήσεις δεν είναι αυτό που ζητά το ίδιο το καταστατικό της OpenAI: μια πραγματική εργασιακή δοκιμή, σε πολλά επαγγέλματα, με ανθρώπους ως μέτρο σύγκρισης, με κόστη, λάθη και ευθύνη για τις αποτυχίες. Τέτοια δοκιμή για το Astra δεν έχει δημοσιευθεί.
Τα καλύτερα διαθέσιμα στοιχεία για την τεχνητή νοημοσύνη και την εργασία δείχνουν έκθεση και μετατόπιση, όχι αντικατάσταση. Το ΔΝΤ εκτιμά ότι περίπου 40% των θέσεων εργασίας παγκοσμίως επηρεάζονται από την τεχνητή νοημοσύνη (IMF), με τη χρήση συγκεντρωμένη σε ψηφιακές, γραφειακές δουλειές (Anthropic).
Η λέξη «AGI», εξάλλου, ποτέ δεν ήταν ουδέτερη για την OpenAI. Λειτουργούσε ιστορικά ως συμβατικός διακόπτης στη σχέση της με τη Microsoft: η στιγμή που η εταιρεία θα δήλωνε πως έφτιαξε AGI θα άλλαζε τους όρους της συνεργασίας τους. Τον Απρίλιο του 2026 η OpenAI φάνηκε να αποστασιοποιείται από τον αυστηρό ορισμό του 2018 (Business Insider), και η ίδια ρήτρα περιγράφεται πλέον ως ανενεργή (Simon Willison). Γι' αυτό, όταν ένα στέλεχος λέει «εποχή AGI», το κρίσιμο ερώτημα είναι ποιος το αποφασίζει, με ποια μέτρηση και με ποια εμπορική συνέπεια.
Η απάντηση θα έρθει με έναν συγκεκριμένο τρόπο: την πρώτη φορά που ένα τέτοιο σύστημα θα αφεθεί να κάνει, μόνο του, τη δουλειά ανθρώπων σε πολλά επαγγέλματα, μετρημένο με ανθρώπινο μέτρο, πραγματικά κόστη και ευθύνη για τα λάθη του, τον πήχη δηλαδή που βάζει η OpenAI στο δικό της καταστατικό. Μέχρι τότε, το Astra κάνει τη συζήτηση για την AGI πιο σοβαρή από ποτέ.
Πώς σου φάνηκε το άρθρο;
Βοήθησέ μας να γίνουμε καλύτεροι
Βοήθησέ μας να γίνουμε καλύτεροι
Πώς γράφτηκε
- Μοντέλο:
- claude-opus-4-8
- Δημιουργήθηκε:
- 9/5/2026, 5:44:20 PM
- Εκτέλεση pipeline:
- incremental_20260905_163008
- Υδατόσημο:
- SynthID (αόρατο υδατόσημο της Google)
- Ανθρώπινη επιμέλεια:
- Καμία πριν τη δημοσίευση