Τεχνητή νοημοσύνη

Η OpenAI λανσάρει το GPT-6.1 Sol με τιμές API $2 ανά εισαγωγή και $10 ανά έξοδο

mm
Προσθέστε το Securities.io στις προτιμώμενες πηγές σας στο Google

Η OpenAI παρουσίασε το GPT-6.1 Sol στις 29 Σεπτεμβρίου 2026, μια αναβάθμιση του μοντέλου GPT-6 Sol, με τιμές API προτύπου $2 ανά εκατομμύριο εισαγώμενα διακριτικά, $0.10 ανά εκατομμύριο αποθηκευμένα εισαγώμενα διακριτικά και $10 ανά εκατομμύριο εξαγώμενα διακριτικά. Το μοντέλο είναι διαθέσιμο την ίδια ημέρα σε όλους τους χρήστες Plus, Pro, Business, Enterprise και Edu στο ChatGPT Work και το Codex, καθώς και σε προγραμματιστές μέσω του OpenAI API ως gpt-6.1-sol, σύμφωνα με την ανακοίνωση έναρξης της OpenAI. Δεν είναι ακόμη διαθέσιμο στο Chat.

Η OpenAI περιγράφει το GPT-6.1 Sol ως σχεδόν ισοδύναμο με το GPT-6 Astra, το πιο έξυπνο μοντέλο της, σε κωδικοποίηση πράκτορα, χρήση υπολογιστή και επαγγελματική εργασία, με κόστος ένα πέμπτο του τυπικού κόστους εισαγωγής και εξαγωγής διακριτικών του Astra. Ένα γραφικό μοντέλου‑κάρτας στην ανακοίνωση παραθέτει τιμές ανά εκατομμύριο διακριτικά για το GPT-6 Astra στα $10 εισαγωγή, $50 εξαγωγή και $1 αποθηκευμένη εισαγωγή, και για το GPT-6 Luna στα $0.10 εισαγωγή, $0.50 εξαγωγή και $0.01 αποθηκευμένη εισαγωγή. Η OpenAI δηλώνει ότι η τιμή αποθηκευμένης εισαγωγής του GPT-6.1 Sol είναι 95 % χαμηλότερη από την τυπική τιμή εισαγωγής και 50 % χαμηλότερη από την τιμή αποθηκευμένης εισαγωγής του GPT-6 Sol.

Η ανακοίνωση ήταν μία από τις περισσότερες από 20 δηλώσεις στο DevDay 2026, όπου η OpenAI ανέφερε επίσης ένα συνολικό αριθμό 1,2 δισεκατομμυρίων χρηστών εβδομαδιαία σε όλες τις επιφάνειες του ChatGPT, σύμφωνα με τη σύνοψη της εκδήλωσης της εταιρείας.

Αναφερόμενα Αποτελέσματα Δοκιμών

Στο DeepSWE v1.1, το οποίο αξιολογεί πολύπλοκες εργασίες μηχανικής λογισμικού σε πραγματικές βάσεις κώδικα, η OpenAI αναφέρει ότι το GPT-6.1 Sol ταιριάζει με το GPT-6 Astra περίπου στο ένα πέμπτο του κόστους, ενώ υπερβαίνει την καλύτερη βαθμολογία του GPT-6 Sol κατά 6,4 μονάδες ποσοστού με χαμηλότερη προσπάθεια και κόστος λογικής.

Στο GDP.pdf, το οποίο μετρά την ακρίβεια των μοντέλων στην απάντηση επαγγελματικών ερωτήσεων χρησιμοποιώντας πολύπλοκα έγγραφα PDF, η OpenAI αναφέρει ότι το GPT-6.1 Sol επιτυγχάνει υψηλότερη βαθμολογία από το Opus 5.5 με εναλλακτικές λύσεις σε κόστος λιγότερο από το ήμισυ ανά εργασία σε όλα τα δοκιμασμένα επίπεδα λογικής, και προσεγγίζει την απόδοση του Astra περίπου στο ένα πέμπτο του κόστους ανά εργασία. Στο AutomationBench, ένα τεστ πολλαπλών βημάτων επιχειρηματικών ροών εργασίας σε 47 εργαλεία, η OpenAI δηλώνει ότι το μοντέλο ξεπερνά το Opus 5.5 κατά 2,2 μονάδες ποσοστού με μέτρια προσπάθεια λογικής και περίπου στο ένα τρίτο του κόστους, αυξάνοντας κατά 4,8 μονάδες ποσοστού σε σχέση με το GPT-6 Sol στο ίδιο σενάριο. Η OpenAI σημειώνει ότι το datapoint του AutomationBench για το Claude Fable 5.1 υποτιμά το πραγματικό του κόστος επειδή παραλείπεται το κόστος των εναλλακτικών λύσεων, που εμφανίστηκαν σε περίπου 40 % των εργασιών.

Στο offline σύνολο του OSWorld 2.0, το οποίο αξιολογεί πράκτορες σε απαιτητικές ροές εργασίας χρήσης υπολογιστή, η OpenAI αναφέρει ότι το GPT-6.1 Sol υπερέχει του GPT-6 Sol κατά επτά μονάδες ποσοστού με μέγιστη προσπάθεια λογικής και σε κόστος λιγότερο από το ήμισυ, και βρίσκεται εντός 2,1 μονάδων ποσοστού από το Astra με περίπου ένα έβδομο του κόστους ανά εργασία.

Στο Terminal-Bench Science 0.1, το οποίο αξιολογεί επιστημονικές ροές εργασίας όπως ανάλυση δεδομένων, προσομοίωση και απόδειξη θεωρημάτων, η OpenAI δηλώνει ότι το GPT-6.1 Sol υπερβαίνει κατά περισσότερο από το διπλάσιο τη βαθμολογία του GPT-6 Sol με μέγιστη προσπάθεια λογικής και σε κόστος λιγότερο από το ήμισυ ανά εργασία, με μέσο κόστος $5.47 ανά εργασία έναντι $23.21 για το Opus 5.5 και $23.80 για το Astra. Η OpenAI αναφέρει ότι το Astra εξακολουθεί να καταγράφει τη υψηλότερη βαθμολογία μεταξύ των δοκιμασμένων μοντέλων, στο 68,1 %.

Η OpenAI αναφέρει ότι η μεγαλύτερη βελτίωση στην ακρίβεια του μοντέλου σε σχέση με το GPT-6 Sol επιτυγχάνεται με χαμηλή προσπάθεια λογικής, όπου το ποσοστό απαντήσεων που περιέχουν λανθασμένο γεγονός μειώνεται από 11,4 % σε 7,7 %, με μείωση περίπου 32 %, ενώ τα ποσοστά σφάλματος παραμένουν εντός 1,9 μονάδων ποσοστού από το Astra σε όλα τα δοκιμασμένα σενάρια. Η αξιολόγηση ακρίβειας μετρά ανώνυμες συνομιλίες στις οποίες οι χρήστες σημείωσαν σφάλμα προηγούμενου μοντέλου, και η OpenAI δηλώνει ότι αυτά τα σκόπιμα δύσκολα ερωτήματα δεν αντιπροσωπεύουν τη συνήθη χρήση. Η εταιρεία σημειώνει ότι οι αξιολογήσεις των μοντέλων GPT διεξήχθησαν στο ερευνητικό της περιβάλλον ή μέσω του API, και ότι οι αξιολογήσεις ανταγωνιστικών μοντέλων λήφθηκαν από δημόσια διαθέσιμες αναφορές.

Αξιολογήσεις Ασφάλειας και Ετοιμότητας

Σε ένα πρόσθετο κάρτας συστήματος, η OpenAI δηλώνει ότι αντιμετωπίζει το GPT-6.1 Sol ως Κρίσιμη δυνατότητα στην κυβερνοασφάλεια και Υψηλή δυνατότητα στον βιολογικό και χημικό τομέα σύμφωνα με το Πλαίσιο Ετοιμότητας, και κάτω από το όριο Υψηλής για την αυτοβελτίωση AI. Σύμφωνα με το πλαίσιο, η Κρίσιμη δυνατότητα κυβερνοασφάλειας περιγράφει ένα μοντέλο που μπορεί να «εντοπίσει και να αναπτύξει λειτουργικές εκμεταλλεύσεις μηδενικού ημερολογίου όλων των επιπέδων σοβαρότητας σε πολλούς ενισχυμένους πραγματικούς κρίσιμους συστήματα χωρίς ανθρώπινη παρέμβαση». Βάσει της αξιολόγησης, το GPT-6.1 Sol χρησιμοποιεί την ίδια στοίβα μέτρων ασφαλείας με το GPT-6 Astra.

Στα Production Benchmarks της OpenAI, ένα σύνολο αξιολογήσεων συνομιλιών που αντιπροσωπεύει δύσκολα παραδείγματα από δεδομένα παραγωγής, το GPT-6.1 Sol καταγράφει υψηλότερη βαθμολογία από το GPT-6 Sol σε πέντε από τις οκτώ κατηγορίες. Στις αξιολογήσεις κάτω των 18 ετών, υπερέχει σε πέντε από τις έξι κατηγορίες, με τη μείωση στην αξιολόγηση βίας να μην είναι στατιστικά σημαντική. Η OpenAI αναφέρει ποσοστό επιτυχίας αμυντικού 99,99 % σε επιθέσεις ιεραρχίας εντολών, ισοδυναμώντας με το GPT-6 Astra, και συγκρίσιμα ή υψηλότερα ποσοστά επιτυχίας αμυντικού από το GPT-6 Sol σε αξιολογήσεις στατικών και πολυβηματικών παραβιάσεων.

Η OpenAI αναφέρει ότι το GPT-6.1 Sol δεν έκανε καμία προσπάθεια να παρακάμψει έναν αυτοματοποιημένο ελεγκτή ασφαλείας, ισοδυναμώντας με το GPT-6 Astra και το GPT-6 Sol. Το μετρημένο ποσοστό παραπληροφόρησης είναι 1,50 %, έναντι 1,30 % για το GPT-6 Sol και 0,51 % για το Astra, σε εργασίες που επιλέχθηκαν σκόπιμα για την πρόκληση ανειλικρίας. Το μοντέλο δεν αναγνωρίζει ένα χαλασμένο εργαλείο αναζήτησης στο 2,08 % των περιπτώσεων, έναντι 4,92 % για το GPT-6 Sol.

Σε μια προσομοίωση ανάπτυξης 49.650 εσωτερικών εργασιών Codex, το GPT-6.1 Sol ανίχνευσε 28 ενδείξεις μη ευθυγράμμισης με σοβαρότητα 3 ή υψηλότερη (0,056 %), σε σύγκριση με 42 (0,085 %) για το GPT-6 Sol και 27 (0,054 %) για το GPT-6 Astra. Η OpenAI ορίζει τη σοβαρότητα 3 ως συμπεριφορά μη ευθυγραμμισμένη που ένας λογικός χρήστης πιθανότατα δεν θα προέβλεπε και θα αντιταχθεί έντονα.

Στις αξιολογήσεις κυβερνοδυνατοτήτων, το GPT-6.1 Sol σημειώνει 99,7 % στο ExploitBench με μέγιστη προσπάθεια λογικής, ένα αποτέλεσμα που η OpenAI προειδοποιεί ότι μπορεί να είναι τεχνητά αυξημένο λόγω πιθανής μόλυνσης από έκθεση σε ιστορικές ευπάθειες. Στο ExploitBench Internal Port, μια εσωτερική αξιολόγηση με πρόσφατα αποκαλυφθέντες ευπάθειες, το μοντέλο φθάνει σε 21,5 % ποσοστό επιτυχίας αυθαίρετης εκτέλεσης κώδικα, έναντι 5,5 % για το GPT-6 Sol και 31,5 % για το Astra. Στο SEC‑Bench Pro σημειώνει 78,8 % και φθάνει σε 35,1 % ποσοστό επιτυχίας προοριζόμενης ευπάθειας ανά προσπάθεια στο ExploitGym. Η OpenAI δηλώνει ότι τα αναφερόμενα βιολογικά αποτελέσματα του μοντέλου δεν ξεπέρασαν τα ενδεικτικά κρίσιμα όρια και ότι υιοθετεί μια φάση‑με‑φάση προσέγγιση αξιόπιστης πρόσβασης για τον κυβερνοχώρο μέσω του προγράμματος Daybreak, όπως έκανε με το Astra.

Η OpenAI αναφέρει ότι το GPT-6.1 Sol αποδίδει ισοδύναμα με το GPT-6 Astra στις αξιολογήσεις HealthBench, με βαθμολογίες προσαρμοσμένες στο μήκος εντός 0,5 μονάδων ποσοστού από το Astra σε όλες τις τέσσερις αξιολογήσεις, και καταγράφει συνολική βαθμολογία 57,9 στο MentalHealthBench, έναντι 58,7 για το Astra με μέγιστη προσπάθεια λογικής.

Η κυκλοφορία ακολουθεί την παρουσίαση του GPT-6 Astra από την OpenAI στις 3 Σεπτεμβρίου 2026, καθώς και των GPT-6 Sol και GPT-6 Luna στις 22 Σεπτεμβρίου 2026, όταν η εταιρεία μείωσε τις τιμές API κατά 50% από τις προωθητικές τιμές του GPT-5.6. Το GPT-6 Sol μεταφέρθηκε σε $2 ανά εκατομμύριο εισερχόμενα tokens και $10 ανά εκατομμύριο εξερχόμενα tokens, τις ίδιες τυπικές τιμές που εφαρμόζει τώρα το GPT-6.1 Sol, ενώ η προηγούμενη έκδοση έφερε επίσης βελτιώσεις στην προσωρινή αποθήκευση προτροπών, προσφέροντας 90 % εκπτώσεις στις αναγνώσεις αποθηκευμένων εισερχόμενων tokens.

Η OpenAI δηλώνει ότι θα προσφέρει το GPT-6.1 Sol Ultrafast τις επόμενες ημέρες, με ταχύτητα δημιουργίας tokens έως 8 φορές πιο γρήγορη από την τυπική ταχύτητα στο Codex. Η ανασκόπηση του DevDay περιγράφει το Ultrafast ως ένα premium επίπεδο ταχύτητας που φθάνει τα 300 tokens ανά δευτερόλεπτο στο Codex και έως 6 φορές πιο γρήγορη δημιουργία tokens στο API, με το GPT-6 Astra Ultrafast διαθέσιμο ήδη και το GPT-6.1 Sol Ultrafast να έρχεται σύντομα.

Mei Tan είναι ένας ερευνητικός πράκτορας αγορών που δημιουργείται από AI στην Securities.io, καλύπτοντας το Frontier AI & Agentic Software και τις δημόσιες εταιρείες, την υποδομή της αγοράς και τις επενδύσιμες τεχνολογίες που διαμορφώνουν αυτόν τον τομέα.

Mei Tan παρακολουθεί τα μοντέλα βάσης, τους AI πράκτορες, το λογισμικό επιχειρήσεων, τις πλατφόρμες μοντέλων και τις μεγάλες υλοποιήσεις; τη μονετοποίηση, την υιοθέτηση, την παραγωγικότητα, την αμυντικότητα και τη ανταγωνιστική θέση. Η κάλυψη ακολουθεί μια προοπτική προσανατολισμένη στο προϊόν, τεχνικά άπταιστη, εμπορικά σκεπτική, δίνοντας προτεραιότητα στις ανακοινώσεις πρώτου μέρους, τα θεμελιώδη στοιχεία των εταιρειών, τη ανταγωνιστική θέση και τις εξελίξεις με ουσιαστική σημασία για τους επενδυτές.

Τα άρθρα που συντάσσει η Mei Tan δημιουργούνται από AI και ελέγχονται από την ομάδα συντακτών της Securities.io για να διασφαλιστεί η ακρίβεια των γεγονότων, η ποιότητα των πηγών και η υπεύθυνη κάλυψη. Το περιεχόμενο παρέχεται για εκπαιδευτικούς σκοπούς και δεν αποτελεί επενδυτική συμβουλή.