Με το GPT-6 Astra, η OPENAI διεκδικεί τον τίτλο του «πιο ευφυούς» μοντέλου

31 λεπτά πριν
Με το GPT-6 Astra, η OPENAI διεκδικεί τον τίτλο του «πιο ευφυούς» μοντέλου

Η OPENAI χαρακτηρίζει το GPT-6 Astra «το πιο ευφυές μοντέλο στον κόσμο» και ίσως είναι το τελευταίο μεγάλο μοντέλο που θα κυκλοφορήσει για αρκετό καιρό.

Το GPT-6 Astra διαπρέπει στη χρήση του υπολογιστή και στην περιήγηση στο διαδίκτυο, αλλά και σε εργασίες ανάπτυξης λογισμικού, κυβερνοασφάλειας, επιστήμης και ευρύτερων επαγγελματικών εφαρμογών. Σε ένα εντυπωσιακό βίντεο επίδειξης που κυκλοφόρησε μαζί με την ανακοίνωση, το Astra εμφανίζεται να χειρίζεται τα πάντα, από 3D modelling μέχρι δημιουργία παρουσιάσεων, αναλαμβάνοντας συχνά πολλαπλές εργασίες ταυτόχρονα σε διαφορετικούς τομείς, όπως η παραγγελία φαγητού την ώρα που γράφει κώδικα για ένα παιχνίδι. Κεντρικό του προτέρημα είναι η ικανότητα να διαχειρίζεται αυτές τις ροές εργασίας που απαιτούν πολλαπλά βήματα τόσο στον υπολογιστή όσο και στον browser, εκτελώντας σύνθετες εργασίες με ισχυρή οπτική κρίση και χωρίς να αποκλίνει από τις αρχικές οδηγίες ή το prompt που λαμβάνει.

Όπως και σε προηγούμενες κυκλοφορίες, η OPENAI συνοδεύει την ανακοίνωση με μια σειρά benchmarks που τεκμηριώνουν τις βελτιωμένες δυνατότητες του Astra. Ξεχωρίζει η βαθμολογία 98,6% στο ARC-AGI-3, ένα από τα πιο διαδεδομένα benchmarks του κλάδου για τη μέτρηση της ικανότητας ενός AI να επιλύει άγνωστα προβλήματα. Πάντως το αποτέλεσμα πρέπει να αντιμετωπίζεται με ορισμένες επιφυλάξεις, καθώς τα συστήματα που περνούν από το benchmark δεν έχουν όλα την ίδια διαμόρφωση και η αρχιτεκτονική τους (για παράδειγμα, η ύπαρξη ή μη μόνιμης μνήμης) μπορεί να επηρεάσει τα αποτελέσματα. Άλλες βελτιώσεις είναι πιο ξεκάθαρες. Στο Terminal Bench 4.0, ένα benchmark για την κωδικοποίηση, το Astra σημείωσε 57,7%, ενώ στο Agent's Last Exam, που μετρά τις agentic ικανότητες, έφτασε το 59,3%, αρκετά υψηλότερα και στα δύο σε σχέση με το GPT-5.6 Sol. Συνολικά, το Astra βρίσκεται πλέον στην κορυφή των περισσότερων leaderboards ως προς τις επιδόσεις.

Το πόσο υπεύθυνα μπορεί να χρησιμοποιηθεί ένα τόσο ισχυρό μοντέλο είναι το ερώτημα που ανακύπτει, ιδίως καθώς το Astra επιδεικνύει ιδιαίτερες ικανότητες στην κυβερνοασφάλεια. Στο ExploitBench, ένα benchmark που μετρά την ικανότητα εκμετάλλευσης ευπαθειών λογισμικού, πέτυχε τέλεια βαθμολογία, έναντι 78,5% του GPT-5.6 Sol. Στο SRE-Bench, που αφορά την αντίστροφη ανάλυση εκτελέσιμων αρχείων χωρίς πρόσβαση στον πηγαίο κώδικα, επέλυσε το 88,0% των εργασιών με την πρώτη προσπάθεια και το 99,2% μέσα σε τέσσερις, τη στιγμή που το GPT-5.6 Sol έμενε στο 55,9% και στο 68,7% αντίστοιχα.

Το βελτιωμένο alignment του Astra, που αφορά τόσο την πιστότερη τήρηση των εντολών όσο και τη μεγαλύτερη διαφάνεια στην επικοινωνία, αναμένεται να ενισχύσει την ασφάλειά του. Παράλληλα, το μοντέλο έχει σχεδιαστεί ώστε να μην ανταποκρίνεται σε αιτήματα για προηγμένες επιθέσεις κυβερνοασφάλειας, ενώ οι ισχυρότερες δικλείδες προστασίας υπόσχονται μεγαλύτερη αντοχή στα αιτήματα jailbreak και καλύτερο εντοπισμό περιπτώσεων κατάχρησης.

Το GPT-6 Astra διατίθεται ήδη σε περιορισμένο αριθμό οργανισμών και τις επόμενες ημέρες θα γίνει διαθέσιμο σε όλους τους συνδρομητές ChatGPT Plus, Pro, Business και Enterprise, καθώς και μέσω του OPENAI API και της AWS. Για όσους προγραμματιστές το αξιοποιούν μέσω του API, το κόστος διαμορφώνεται στα 10 δολάρια ανά εκατομμύριο tokens εισόδου και στα 50 δολάρια ανά εκατομμύριο tokens εξόδου.