Ανακοινώθηκε το GPT 6.1 Sol: Επιδόσεις κοντά στο Astra στο 1/5 της τιμής

Το GPT 6.1 Sol είναι το νέο μοντέλο της OpenAI που επιχειρεί να λύσει ένα από τα μεγαλύτερα προβλήματα της προηγμένης τεχνητής νοημοσύνης: το κόστος. Η εταιρεία υποστηρίζει ότι το νέο Sol πλησιάζει τις δυνατότητες του κορυφαίου GPT 6 Astra σε agentic coding, χρήση υπολογιστή και σύνθετες επαγγελματικές εργασίες, αλλά με μόλις το ένα πέμπτο της κανονικής τιμής ανά token.

Η νέα έκδοση απευθύνεται κυρίως σε developers και επιχειρήσεις που θέλουν να χρησιμοποιούν ισχυρούς AI agents σε μεγάλη κλίμακα, χωρίς το κόστος του Astra. Το GPT 6.1 Sol είναι διαθέσιμο από σήμερα στο ChatGPT Work και στο Codex για Plus, Pro, Business, Enterprise και Edu, ενώ μέσω API προσφέρεται με το όνομα GPT 6.1 Sol. Δεν είναι ακόμη διαθέσιμο στο κλασικό Chat του ChatGPT.

Το μεγάλο όπλο είναι η τιμή

Η OpenAI τιμολογεί το GPT 6.1 Sol στα 2 δολάρια ανά εκατομμύριο input tokens και στα 10 δολάρια ανά εκατομμύριο output tokens.

OpenAI GPT-6.1 Sol - Σχεδόν Astra ισχύς με πολύ χαμηλότερο κόστος

Για σύγκριση, το GPT 6 Astra κοστίζει 10 δολάρια για το input και 50 δολάρια για το output.

Ακόμη μεγαλύτερη είναι η διαφορά όταν ένας AI agent επαναχρησιμοποιεί μεγάλο μέρος του ίδιου context. Το cached input στο GPT 6.1 Sol κοστίζει μόλις 0,10 δολάρια ανά εκατομμύριο tokens, δηλαδή 95% λιγότερο από την κανονική τιμή εισόδου.

Αυτό έχει ιδιαίτερη σημασία για agents που εκτελούν συνεχόμενες εργασίες, διατηρούν μεγάλο ιστορικό ή επανέρχονται στα ίδια έγγραφα και δεδομένα.

Μεγάλη βελτίωση στο coding

Ανακοινώθηκε το GPT 6.1 Sol: Επιδόσεις κοντά στο Astra στο 1/5 της τιμής

Στον προγραμματισμό, η OpenAI παρουσιάζει το νέο Sol ως σημαντικό βήμα μπροστά από το GPT-6 Sol.

Στο DeepSWE v1.1, benchmark με πραγματικές και σύνθετες εργασίες software engineering, το GPT-6.1 Sol έφτασε σε επίδοση αντίστοιχη με το GPT-6 Astra, με περίπου το ένα πέμπτο του κόστους ανά εργασία.

Παράλληλα, ξεπέρασε την καλύτερη επίδοση του προηγούμενου GPT-6 Sol κατά 6,4 ποσοστιαίες μονάδες.

Το συγκεκριμένο αποτέλεσμα έχει ιδιαίτερη σημασία για το Codex, καθώς τα σύγχρονα coding agents δεν καλούνται πλέον απλώς να δημιουργήσουν μερικές γραμμές κώδικα, αλλά να διαβάσουν ολόκληρα repositories, να εντοπίσουν bugs και να εκτελέσουν διαδοχικές αλλαγές.

Πλησιάζει το Astra και στις επαγγελματικές εργασίες

Η βελτίωση δεν περιορίζεται στον κώδικα. Στο GDP.pdf, το οποίο αξιολογεί την ικανότητα των μοντέλων να κατανοούν σύνθετα επαγγελματικά έγγραφα με πίνακες, γραφήματα, διαγράμματα και λεπτομέρειες, το GPT-6.1 Sol πλησιάζει το Astra με σημαντικά χαμηλότερο κόστος.

Η OpenAI αναφέρει επίσης ότι ξεπέρασε το Opus 5.5 με fallbacks στο συγκεκριμένο benchmark, ενώ το κόστος ανά εργασία ήταν μικρότερο από το μισό.

Στο AutomationBench, όπου AI agents πρέπει να ολοκληρώσουν επιχειρηματικές διαδικασίες πολλών βημάτων σε sales, marketing, finance, HR και άλλους τομείς, το GPT-6.1 Sol σημείωσε επίσης βελτίωση σε σχέση με τον προκάτοχό του.

Καλύτερο και στη χρήση υπολογιστή

Ένα από τα σημαντικότερα πεδία για τη νέα γενιά AI agents είναι το computer use – η δυνατότητα ενός μοντέλου να χειρίζεται εφαρμογές και να ολοκληρώνει εργασίες μέσα σε γραφικά περιβάλλοντα.

Στο OSWorld 2.0, το GPT-6.1 Sol ξεπέρασε το GPT-6 Sol κατά επτά ποσοστιαίες μονάδες στη μέγιστη προσπάθεια reasoning.

Ακόμη πιο ενδιαφέρον είναι ότι βρέθηκε μόλις 2,1 μονάδες πίσω από το Astra, με περίπου το ένα έβδομο του κόστους ανά εργασία.

Η διαφορά αυτή εξηγεί γιατί η OpenAI τοποθετεί το νέο μοντέλο τόσο έντονα γύρω από τους AI agents και το ChatGPT Work.

Το Astra παραμένει η κορυφαία επιλογή

Η άφιξη του GPT 6.1 Sol δεν σημαίνει ότι το Astra χάνει τον ρόλο του.

Η OpenAI εξακολουθεί να το χαρακτηρίζει ως το ισχυρότερο μοντέλο της για τις δυσκολότερες εργασίες.

Στο Terminal-Bench Science, για παράδειγμα, το Astra παραμένει πρώτο με βαθμολογία 68,1% και προτείνεται για τις πιο απαιτητικές επιστημονικές εργασίες.

Το GPT 6.1 Sol έχει διαφορετικό στόχο: να προσφέρει αρκετά κοντινή απόδοση σε πολύ χαμηλότερο κόστος, ώστε ισχυρά μοντέλα να μπορούν να χρησιμοποιούνται πολύ συχνότερα και σε μεγαλύτερη κλίμακα.

Αυτό ίσως είναι και το σημαντικότερο στοιχείο της ανακοίνωσης. Ο ανταγωνισμός στα AI models δεν αφορά πλέον μόνο ποιο μοντέλο παίρνει την υψηλότερη βαθμολογία σε ένα benchmark, αλλά πόση πραγματική εργασία μπορεί να ολοκληρώσει για κάθε δολάριο που ξοδεύεται.

Και με το GPT 6.1 Sol, η OpenAI επιχειρεί να μεταφέρει μεγάλο μέρος της ισχύος του Astra σε μια κατηγορία κόστους που μπορεί να χρησιμοποιηθεί καθημερινά από πολύ περισσότερους developers και επιχειρήσεις.