Techsy
Επικοινωνία
Ξεκίνα τώρα
Επιστροφή στο blog
ai-machine-learning

GPT-5.6 Sol Ultra στο Codex: Τι Κάνει Πραγματικά η Λειτουργία Subagent (και Πόσο Κοστίζει)

Ραίτη Mert Batur Gürbüz
Ενημερώση Jul 6, 2026
19 εξάγουμε ανάγνωση
Περιεχόμενα
GPT-5.6 Sol Ultra στο Codex: Τι Κάνει Πραγματικά η Λειτουργία Subagent (και Πόσο Κοστίζει)

GPT-5.6 Sol Ultra στο Codex: Τι Κάνει Πραγματικά η Λειτουργία Subagent (και Πόσο Κοστίζει)

Από τον Ιούλιο του 2026, το GPT-5.6 Sol Ultra βρίσκεται σε κλειστή προεπισκόπηση για μια μικρή ομάδα περίπου 20 κυβερνητικά εγκεκριμένων συνεργατών, προσβάσιμο μέσω του OpenAI API και του Codex. Δεν είναι ακόμη ευρέως διαθέσιμο. Η OpenAI δεν έχει δημοσιεύσει ημερομηνία γενικής διαθεσιμότητας, και το ευρέως αναφερόμενο σκορ 91,9% στο Terminal-Bench δεν εμφανίζεται στην ίδια τη σελίδα προεπισκόπησης της OpenAI.

Στις 26-06-2026, η OpenAI παρουσίασε την οικογένεια GPT-5.6 Sol, και λίγες μέρες αργότερα ο Thibault Sottiaux είπε στους χρήστες του Codex να «κρατήσουν τα πιο δύσκολα prompts σας» για το επίπεδο Sol Ultra. Αυτό και μόνο το teaser προκάλεσε ένα κύμα screenshots από benchmarks. Τα περισσότερα επαναλαμβάνουν έναν αριθμό που η OpenAI δεν δημοσίευσε ποτέ. Οπότε, πριν σχεδιάσετε τη ροή εργασίας σας στο Codex γύρω από το GPT-5.6 Sol Ultra, ιδού τι είναι πραγματικά επιβεβαιωμένο, πώς λειτουργεί η λειτουργία subagent και τα μαθηματικά των tokens που κρίνουν αν αξίζει να το ενεργοποιήσετε.

Βασικά σημεία:

  • Το Sol Ultra είναι το υψηλότερο επίπεδο effort του GPT-5.6: συνεργαζόμενοι υποπράκτορες που μιλούν μεταξύ τους κατά τη διάρκεια μιας ενιαίας εργασίας.
  • Βρίσκεται σε κλειστή προεπισκόπηση για ~20 κυβερνητικά εγκεκριμένους συνεργάτες μέσω API και Codex, όχι ευρέως διαθέσιμο (από τον Ιούλιο του 2026).
  • Ο τύπος αναφέρει 91,9% στο Terminal-Bench 2.1, αλλά η OpenAI δεν έχει δημοσιεύσει αυτό το νούμερο, οπότε αντιμετωπίστε το ως ανεπιβεβαίωτο.
  • Το Sol κοστίζει $5 εισόδου / $30 εξόδου ανά 1M tokens· οι υποπράκτορες πολλαπλασιάζουν τις κλήσεις, άρα το Ultra μπορεί να κοστίσει αρκετές φορές περισσότερο από μια εκτέλεση με μοναδικό πράκτορα.

GPT-5.6 Sol Ultra στο Codex: Τι Είναι Πραγματικά Επιβεβαιωμένο

Ιδού η καθαρή διάκριση. Επιβεβαιωμένα: η OpenAI παρουσίασε την οικογένεια Sol (Sol, Terra, Luna) στις 26-06-2026, το Sol Ultra είναι το κορυφαίο επίπεδο συλλογισμού και έχει προαναγγελθεί για το Codex. Μη επιβεβαιωμένα: το σκορ 91,9% στο Terminal-Bench 2.1 και οποιαδήποτε ημερομηνία γενικής διαθεσιμότητας. Ό,τι άλλο έχετε δει είναι ρεπορτάζ, όχι δεδομένα πρώτου χεριού.

Αυτή η διάκριση έχει σημασία επειδή αυτή η κυκλοφορία κινήθηκε γρήγορα και χαλαρά. Η σελίδα προεπισκόπησης της OpenAI περιγράφει τα επίπεδα και την πύλη ασφαλείας με ποιοτικούς όρους. Ο εντυπωσιακός πίνακας benchmark που κυκλοφορεί στο X και σε οδηγούς προέρχεται από δευτερογενή κάλυψη, όχι από την ίδια τη σελίδα της OpenAI. Πριν από την κυκλοφορία, βαθμολογήσαμε τις φήμες προ κυκλοφορίας και ιδού τι πραγματικά κυκλοφόρησε έναντι όσων παρέμειναν εικασίες. Η ίδια πειθαρχία ισχύει και τώρα.

Άρα, αν είστε προγραμματιστής που προσπαθεί να αποφασίσει αν το Ultra ανήκει στον βρόχο του Codex σας, αγνοήστε για μια στιγμή τα νούμερα του hype. Τα επιβεβαιωμένα γεγονότα (ο μηχανισμός, η τιμολόγηση, η κατάσταση προεπισκόπησης) αρκούν για να συλλογιστείτε το κόστος και την καταλληλότητα. Τα μη επιβεβαιωμένα (το ακριβές σκορ, η ημερομηνία κυκλοφορίας) δεν πρέπει να οδηγήσουν ακόμη σε καμία απόφαση. Πηγές: η σελίδα της OpenAI Previewing GPT-5.6 Sol και η κάλυψη κυκλοφορίας του 9to5Mac.

Τι Είναι το Sol Ultra; Συνεργαζόμενοι Υποπράκτορες έναντι Παράλληλων Πρακτόρων του Pro

Το Sol Ultra είναι το υψηλότερο επίπεδο συλλογισμού του GPT-5.6, και το καθοριστικό του χαρακτηριστικό είναι οι συνεργαζόμενοι υποπράκτορες: ένας συντονιστής σπάει την εργασία σας σε κομμάτια, δίνει κάθε κομμάτι σε έναν υποπράκτορα και αυτοί οι υποπράκτορες ανταλλάσσουν μηνύματα μεταξύ τους ενώ η εργασία βρίσκεται ακόμη σε εξέλιξη. Αυτή η επικοινωνία εντός της εργασίας είναι όλο το νόημα, και είναι αυτό που ξεχωρίζει το Ultra από κάθε επίπεδο κάτω από αυτό.

Σκεφτείτε το σαν μια μικρή ομάδα μηχανικών έναντι ενός συνόλου freelance. Οι παράλληλοι πράκτορες του GPT-5.5 Pro δουλεύουν σαν freelancers στους οποίους δίνετε τρία ξεχωριστά tickets. Ο καθένας φεύγει, κάνει το κομμάτι του απομονωμένα και αφήνει το αποτέλεσμα πίσω στο γραφείο σας. Κανείς δεν μιλάει. Οι υποπράκτορες του Sol Ultra δουλεύουν σαν μια ομάδα σε ένα δωμάτιο: κάποιος παρατηρεί ότι το σχήμα της βάσης δεδομένων άλλαξε, το λέει στους άλλους και εκείνοι προσαρμόζονται πριν τελειώσουν. Αυτός ο συντονισμός είναι ο λόγος που η OpenAI το τοποθετεί για μεγάλες, δύσκολες, πολυβηματικές εργασίες αντί για γρήγορες διορθώσεις.

Ενώ οι πράκτορες του Pro δουλεύουν σε ξεχωριστές λωρίδες, οι υποπράκτορες του Sol Ultra ανταλλάσσουν σημειώματα μεταξύ τους ενώ η εργασία τρέχει ακόμη.

Διάγραμμα διαχωρισμού: οι συνεργαζόμενοι υποπράκτορες του Sol Ultra ανταλλάσσουν μηνύματα στα αριστερά· οι ανεξάρτητοι παράλληλοι πράκτορες του Pro στα δεξιά
Οι συνεργαζόμενοι υποπράκτορες του Sol Ultra επικοινωνούν εντός της εργασίας· οι παράλληλοι πράκτορες του Pro τρέχουν σε απομονωμένες, ανεξάρτητες λωρίδες.

Ο ίδιος ο μηχανισμός είναι επιβεβαιωμένος, περιγράφεται από την OpenAI και αντικατοπτρίζεται στην κάλυψη του DataCamp και του deeplearning.ai. Το πρόβλημα, στο οποίο θα φτάσουμε, είναι ότι κάθε υποπράκτορας που δημιουργείτε είναι μια ακόμη κλήση μοντέλου που καίει tokens. Ο συντονισμός δεν είναι δωρεάν.

Τι Είναι το «Μέγιστο Effort Συλλογισμού» και Πότε Πρέπει να το Ενεργοποιείτε;

Το «μέγιστο effort συλλογισμού» είναι η κορυφαία βαθμίδα της κλίμακας effort του GPT-5.6, η οποία κυμαίνεται από χαμηλό έως υψηλό και μέχρι τη μέγιστη ρύθμιση που χρησιμοποιεί το Sol Ultra. Υψηλότερο effort σημαίνει ότι το μοντέλο δαπανά περισσότερους υπολογιστικούς πόρους σκεπτόμενο πριν απαντήσει, κάτι που συνήθως βοηθά σε δύσκολα προβλήματα και σπαταλά χρήματα σε εύκολα. Είναι ρυθμιστικό, όχι διακόπτης που τον αφήνετε τέρμα.

Φανταστείτε έναν σκακιστή. Σε χαμηλό effort, κινείται γρήγορα με το ένστικτο, μια χαρά για προφανείς αιχμαλωτίσεις. Σε μέγιστο effort, κάθεται και υπολογίζει δέκα κινήσεις σε βάθος, που είναι ακριβώς ό,τι θέλετε για ένα δύσκολο φινάλε και εντελώς άσκοπο για το άνοιγμα μιας πόρτας. Το effort συλλογισμού λειτουργεί με τον ίδιο τρόπο. Οι υπολογιστικοί πόροι (και ο λογαριασμός) κλιμακώνονται ανάλογα με το πόσο δύσκολα λέτε στο μοντέλο να σκεφτεί.

Άρα πότε αξίζει; Ενεργοποιήστε το μέγιστο effort για μακροπρόθεσμη, πολυαρχειακή εργασία με πράκτορες: μια μετανάστευση που αγγίζει είκοσι αρχεία, ένα ζόρικο refactor, ένα σφάλμα που εκτείνεται σε τρεις υπηρεσίες. Αυτή είναι η επικράτεια της μακροπρόθεσμης agentic κωδικοποίησης όπου η βαθύτερη συλλογιστική αλλάζει πραγματικά το αποτέλεσμα. Κρατήστε το απενεργοποιημένο για μετονομασία μεταβλητής, συγγραφή μιας μοναδικής δοκιμής ή διόρθωση τυπογραφικού λάθους, επειδή θα πληρώσετε premium tokens για μηδενικό όφελος.

Το μέγιστο effort συλλογισμού δικαιολογεί το κόστος του μόνο όταν η εργασία είναι αρκετά δύσκολη ώστε μια λάθος πρώτη προσπάθεια να σας κόστιζε περισσότερο από τα επιπλέον tokens.

Ο ειλικρινής κανόνας: αν δεν μπορείτε να εξηγήσετε γιατί η εργασία είναι δύσκολη, πιθανότατα δεν χρειάζεστε μέγιστο effort γι' αυτήν.

Τα Νούμερα του Terminal-Bench 2.1: Είναι Πράγματι Επαληθευμένο το 91,9%;

Όχι. Το νούμερο 91,9% αναφέρεται από τον δευτερογενή τύπο, δεν εμφανίζεται στην ίδια τη σελίδα προεπισκόπησης της OpenAI, η προεπισκόπηση είναι κλειστή και δεν έχει αποκαλυφθεί καμία μεθοδολογία αξιολόγησης. Άρα δεν είναι ανεξάρτητα επαληθευμένο. Αντιμετωπίστε το ως ισχυρισμό του τύπου που δεν μπορείτε να ελέγξετε, όχι ως οριστικό αποτέλεσμα.

Ιδού η ακριβής κατάσταση. Ρεπορτάζ κοντά στην OpenAI (DataCamp, AI Weekly, deeplearning.ai) τοποθετούν το Sol Ultra στο 91,9% στο Terminal-Bench 2.1. Αλλά επειδή η προεπισκόπηση είναι περιορισμένη σε ~20 συνεργάτες και η OpenAI δεν έχει δημοσιεύσει τον αριθμό ή τις συνθήκες δοκιμής, κανείς έξω από αυτόν τον κύκλο δεν μπορεί να το αναπαράγει. Σημειώστε επίσης ότι το νούμερο του Claude Mythos 5 αλλάζει ανάλογα με το ποιος αναφέρει: κάποιες πηγές λένε 84,3%, άλλες 88,0%. Όταν οι ίδιοι οι αριθμοί ενός πίνακα σύγκρισης διαφωνούν μεταξύ πηγών, αυτό είναι σήμα να τους κρατάτε επιφυλακτικά.

ΜοντέλοTerminal-Bench 2.1 (αναφερόμενο, όχι ανεξάρτητα επαληθευμένο)
Sol Ultra91,9%
Sol (βασικό)88,8%
GPT-5.588,0%
Claude Mythos 584,3-88,0% (ποικίλλει ανά πηγή)
Gemini 3.1 Pro Preview70,7%

Το 91,9% που παραθέτουν όλοι δεν εμφανίζεται στην ίδια τη σελίδα προεπισκόπησης της OpenAI, οπότε αντιμετωπίστε το ως ισχυρισμό του τύπου, όχι ως οριστικό αποτέλεσμα.

Τίποτα από αυτά δεν σημαίνει ότι το Sol Ultra είναι αδύναμο. Μπορεί κάλλιστα να κορυφώσει τον πίνακα μόλις η OpenAI δημοσιεύσει πραγματική μεθοδολογία. Απλώς σημαίνει ότι δεν πρέπει να δρομολογείτε κίνηση παραγωγής βάσει ενός αριθμού που δεν μπορείτε να επαληθεύσετε. Πηγές: ο οδηγός GPT-5.6 Sol του DataCamp, το The Batch του deeplearning.ai και το AI Weekly.

Πώς να Χρησιμοποιήσετε το Sol Ultra + Μέγιστο Effort Συλλογισμού στο Codex

Το ίδιο το Sol Ultra είναι περιορισμένο, οπότε δεν μπορείτε να το ενεργοποιήσετε εκτός αν ο οργανισμός σας είναι στην προεπισκόπηση. Αλλά η κλίμακα effort στην οποία κάθεται λειτουργεί ήδη στο Codex CLI σήμερα, στα μοντέλα που έχετε. Ιδού πώς λειτουργεί η ρύθμιση και πού εντάσσεται το Ultra μόλις αποκτήσετε πρόσβαση.

  1. Βρείτε τη ρύθμιση. Το effort συλλογισμού βρίσκεται στο αρχείο διαμόρφωσης του Codex στο ~/.codex/config.toml ή ως σημαία ανά εκτέλεση. Δεν είναι κρυμμένο σε μενού· είναι ένα κλειδί.
  2. Ορίστε το μοντέλο και το effort. Στρέψτε το Codex στο string του μοντέλου σας και ορίστε το επίπεδο effort. Σήμερα μπορείτε να ορίσετε από χαμηλό έως υψηλό· η βαθμίδα «μέγιστο» μαζί με το επίπεδο υποπράκτορων του Sol Ultra ξεκλειδώνουν μόλις ο οργανισμός σας μπει στην προεπισκόπηση.
  3. Παρακάμψτε ανά εργασία. Χρησιμοποιήστε τη σημαία -c για να ανεβάσετε το effort για μια μοναδική δύσκολη εκτέλεση χωρίς να επεξεργαστείτε τη διαμόρφωσή σας.
  4. Ενεργοποιήστε το επιλεκτικά. Κρατήστε το μέγιστο effort για τις μακρές, πολυαρχειακές εργασίες από την παραπάνω ενότητα. Αφήστε την προεπιλογή σας στο μεσαίο ή υψηλό.
toml
# ~/.codex/config.toml
model = "gpt-5.6-sol"
model_reasoning_effort = "high"   # minimal | low | medium | high (available today)

# "max" effort + the Sol Ultra cooperating-subagent tier
# activate once your org is in the closed preview:
# model = "gpt-5.6-sol-ultra"
# model_reasoning_effort = "max"

# per-run override, no config edit needed:
# codex -c model_reasoning_effort="high" "refactor the auth module"

Συμβουλή pro: ορίστε την προεπιλογή του έργου σας στο high, όχι στο max. Μετά παρακάμψτε σε max μόνο στη συγκεκριμένη εκτέλεση που το χρειάζεται. Αυτή η μία συνήθεια κρατά τον βασικό σας λογαριασμό λογικό και φυλάει το ακριβό επίπεδο για εργασίες που πραγματικά το ανταμείβουν. Λεπτομέρειες διαθεσιμότητας υπάρχουν στο άρθρο προεπισκόπησης του Help Center της OpenAI.

Πόσο Κοστίζει Πραγματικά το Ultra: Ο Πολλαπλασιαστής Tokens των Υποπράκτορων

Ιδού το μέρος που κανείς δεν μοντελοποιεί: επειδή το Ultra δημιουργεί συνεργαζόμενους υποπράκτορες, μία εργασία πυροδοτεί αρκετές κλήσεις μοντέλου αντί για μία, και κάθε κλήση χρεώνει tokens. Η επιβεβαιωμένη τιμολόγηση του Sol είναι $5 ανά 1M tokens εισόδου, $0,50 προσωρινά αποθηκευμένα και $30 ανά 1M εξόδου. Το έξοδο είναι η ακριβή πλευρά, και το Ultra παρήγαγε πολύ περισσότερο.

Ας δουλέψουμε ένα πραγματικό παράδειγμα. Πάρτε μία μετρίως σύνθετη agentic εργασία στο βασικό Sol, μοναδικός πράκτορας:

ΜοντέλοΣτοιχείοTokensΤιμή / 1MΚόστος
Sol (βασικό)Είσοδος40.000$5$0,20
Sol (βασικό)Έξοδος15.000$30$0,45
Sol (βασικό)Σύνολο$0,65

Τώρα η ίδια εργασία στο Ultra με έναν συντονιστή και τρεις συνεργαζόμενους υποπράκτορες. Το κοινό context αποθηκεύεται φθηνά στα $0,50, αλλά κάθε υποπράκτορας παρήγαγε ακόμη το δικό του έξοδο στα $30:

ΜοντέλοΣτοιχείοTokensΤιμή / 1MΚόστος
Sol Ultra (μοντελοποιημένο)Είσοδος συντονιστή40.000$5$0,20
Sol Ultra (μοντελοποιημένο)Είσοδος υποπράκτορα, cached90.000$0,50$0,045
Sol Ultra (μοντελοποιημένο)Είσοδος υποπράκτορα, φρέσκια30.000$5$0,15
Sol Ultra (μοντελοποιημένο)Έξοδος συντονιστή + δια-πρακτόρων20.000$30$0,60
Sol Ultra (μοντελοποιημένο)Έξοδος υποπράκτορα (3 x 15K)45.000$30$1,35
Sol Ultra (μοντελοποιημένο)Σύνολο~$2,35

Αυτό είναι περίπου 3,6x το κόστος του βασικού Sol για την ίδια εργασία, και ανάλογα με το πόσοι υποπράκτορες δημιουργούνται και πόσο context αποθηκεύεται προσωρινά, θα δείτε οπουδήποτε από 2x έως 4x. Ο πολλαπλασιαστής είναι η μοντελοποιημένη μας εκτίμηση από τη δημοσιευμένη τιμολόγηση, όχι μετρημένο benchmark του Ultra, αλλά η τιμολόγηση και ο μηχανισμός είναι και τα δύο επιβεβαιωμένα, άρα το σχήμα είναι πραγματικό.

Το κρυφό κόστος του Ultra δεν είναι η τιμή ανά token, είναι ότι μία εργασία γίνεται αθόρυβα τέσσερις κλήσεις μοντέλου.

Δύο πράγματα μετριάζουν αυτό: η προσωρινή αποθήκευση prompt (η τιμή $0,50 cached) στο κοινό context και η πειθαρχημένη δρομολόγηση ώστε να πληρώνετε τιμές Ultra μόνο σε εργασίες που τις χρειάζονται. Αν είστε σοβαροί για τον λογαριασμό, ο οδηγός μας για το πώς να κρατήσετε το κόστος του LLM API υπό έλεγχο καλύπτει τα μοτίβα δρομολόγησης που χρησιμοποιούμε σε πελατειακά pipelines. Η τιμολόγηση προέρχεται από DataCamp και deeplearning.ai, με ημερομηνία 2026-06 έως 2026-07.

Μπορείτε να το Χρησιμοποιήσετε Ήδη; Η Περιορισμένη Προεπισκόπηση, ~20 Συνεργάτες και το Χρονοδιάγραμμα

Όχι, εκτός αν είστε ένας από τους περίπου 20 έμπιστους, κυβερνητικά εγκεκριμένους συνεργάτες. Το Sol Ultra βρίσκεται σε κλειστή προεπισκόπηση προσβάσιμη μέσω του OpenAI API και του Codex, πίσω από μια κυβερνητική αξιολόγηση ασφαλείας πριν από την ευρύτερη κυκλοφορία. Η OpenAI έχει πει ότι η ευρύτερη πρόσβαση «έρχεται σε εβδομάδες» και τίποτα πιο συγκεκριμένο.

Μπορεί να έχετε δει μια ημερομηνία «7 Ιουλίου» να κυκλοφορεί. Αγνοήστε την. Η OpenAI δεν έδωσε ημερομηνία κυκλοφορίας, οπότε αντιμετωπίστε οποιαδήποτε συγκεκριμένη μέρα ως ανεπιβεβαίωτη φημολογία, όχι ως γεγονός γύρω από το οποίο θα σχεδιάσετε. Αυτό που επιβεβαιώνεται είναι η διατύπωση «σε εβδομάδες» και ότι η Cerebras πρόκειται να σερβίρει το Sol με έως 750 tokens ανά δευτερόλεπτο ξεκινώντας τον Ιούλιο (σύμφωνα με το deeplearning.ai).

Άρα τι κάνετε αν δεν είστε συνεργάτης; Προετοιμαστείτε τώρα. Ρυθμίστε το config του Codex και την κλίμακα effort στα μοντέλα που έχετε σήμερα, ώστε όταν το Ultra ανοίξει, η εναλλαγή του model string να είναι η μόνη αλλαγή που θα κάνετε. Κουτί απόφασης: Είστε έμπιστος συνεργάτης; Όχι; Τότε στήστε τη δρομολόγηση επιπέδου effort σήμερα και να είστε έτοιμοι να αλλάξετε μία γραμμή. Πηγές: OpenAI Help Center και deeplearning.ai.

Sol Ultra εναντίον Sol εναντίον GPT-5.5 εναντίον Claude Mythos 5: Ποιο να Διαλέξετε;

Δρομολογήστε βάσει εργασίας, όχι βάσει leaderboard, ειδικά όταν οι αριθμοί του leaderboard δεν είναι επαληθευμένοι. Απευθυνθείτε στο βασικό Sol για την περισσότερη καθημερινή agentic κωδικοποίηση, κρατήστε το Sol Ultra για πραγματικά δύσκολες μακροπρόθεσμες εργασίες, κρατήστε το GPT-5.5 τριγύρω αν είναι ήδη ενσύρματο στο stack σας και σκεφτείτε το Claude Mythos 5 όπου εμπιστεύεστε ήδη το πιο πρόσφατο Claude για τη ροή εργασίας σας.

Ιδού το πρακτικό πλαίσιο:

  • Απευθυνθείτε στο βασικό Sol όταν η εργασία είναι κανονικά δύσκολη: μια λειτουργία, ένα αυτοτελές refactor, μια σουίτα δοκιμών. Φέρει αναφερόμενο 88,8% και κοστίζει ένα κλάσμα του Ultra.
  • Απευθυνθείτε στο Sol Ultra όταν η εργασία είναι μακρά, εκτείνεται σε πολλά αρχεία και μια λάθος πρώτη πέραση θα κόστιζε πραγματικό χρόνο. Οι συνεργαζόμενοι υποπράκτορες δικαιολογούν τον πολλαπλασιαστή τους εδώ, αν πουθενά.
  • Απευθυνθείτε στο GPT-5.5 όταν είναι ήδη ενσωματωμένο και η διαφορά έναντι του Sol δεν δικαιολογεί μετανάστευση.
  • Απευθυνθείτε στο Claude Mythos 5 όταν η υπάρχουσα εργαλειοθήκη της ομάδας σας το ευνοεί. Το αναφερόμενο σκορ του ποικίλλει ανά πηγή (84,3% έως 88,0%), οπότε μην αλλάξετε μόνο βάσει του αριθμού.

Για βαθύτερα θέματα δρομολόγησης μοντέλων μεταξύ εργαλείων, η σύγκριση coding-agent αναλύει πού ταιριάζει το καθένα. Η σύντομη εκδοχή: διαλέξτε το φθηνότερο επίπεδο που καθαρίζει τον πήχη δυσκολίας της εργασίας σας.

Τι Λένε Πραγματικά οι Προγραμματιστές στο Reddit

Τα benchmarks είναι ένα πράγμα. Αυτό που αναφέρουν οι άνθρωποι στα δικά τους τερματικά είναι άλλο, και αυτή τη στιγμή τα νήματα του r/codex είναι το πιο ειλικρινές σήμα που έχουμε. Η ανάγνωσή μας για τη διάθεση: επιφυλακτικά εντυπωσιασμένοι, βαθιά σκεπτικοί και κυρίως μαλώνουν για την τιμή.

Οι πρώιμες hands-on φιλοφρονήσεις είναι συγκεκριμένες. Σε ένα νήμα του r/codex με 335 upvote, ένας προγραμματιστής που παρατήρησε ότι τα prompts του δρομολογούνταν στο 5.6 είπε ότι ένιωθε «διπλάσια ταχύτητα» και «καθάριζε τα prompts μου μονομιάς», διορθώνοντας ακόμη και «προληπτικά» ακραίες περιπτώσεις που παλιότερα χρειάζονταν αρκετούς γύρους με το 5.5. Η σύγκρισή του ήρθε βαριά: «είναι ακριβώς σαν το Fable 5 όταν το είχα για λίγο στο Claude, αλλά πολύ πιο γρήγορο». Ένας σχολιαστής που ισχυρίστηκε εσωτερική πρόσβαση πρόσθεσε ότι η εκτέλεση «εργασιών στο μέγιστο επίπεδο συλλογισμού» παίρνει «πολύ λιγότερο χρόνο από ό,τι θα χρειαζόταν το 5.5».

Μετά εμφανίζονται οι βετεράνοι. Η πιο δυνατή αντικρουόμενη τάση είναι αυτό που θα λέγαμε κυνισμό «μήνας του μέλιτος και μετά nerf»: «πάντα έτσι είναι και θα κρατήσει περίπου 2 εβδομάδες πριν το nerf», έγραψε κάποιος. Ένας άλλος ήταν πιο ωμός: «απλώς χτύπα το δυνατά για 2 εβδομάδες, γιατί θα είναι Αϊνστάιν μόνο για 2 εβδομάδες». Μερικοί επεσήμαναν τον ίδιο τον χρονισμό, παρατηρώντας ότι οι ενθουσιώδεις αναρτήσεις για το 5.6 εμφανίζονται ακριβώς όταν κορυφώνονται τα παράπονα για πτώση του 5.5. Αποκαλυπτικά, οι πιο upvoted απαντήσεις σε εκείνο το νήμα δεν ήταν ανάλυση· ήταν αστεία («χρησιμοποιώ ήδη το gpt 6»), κάτι που λέει πολλά για το πόσο κουρασμένοι είναι οι προγραμματιστές από τη συνεχή προώθηση νέων εκδόσεων.

Στο νήμα ανακοίνωσης του Sol Ultra Codex, η συζήτηση στράφηκε σχεδόν εξ ολοκλήρου στο κόστος, στοχεύοντας κατευθείαν το Claude. Οι προγραμματιστές ζυγίζουν το πακέτο $200 του Codex της OpenAI απέναντι στην προσφορά Fable της Anthropic, και αρκετοί είπαν ότι ακυρώνουν το Claude Max 20x, κυρίως επειδή το Fable «καίει τα credits δύο φορές πιο γρήγορα». Η επαναλαμβανόμενη ελπίδα: «πραγματικός ανταγωνισμός για το Claude Fable. Καλύτερο για εμάς τους χρήστες». Ο επαναλαμβανόμενος φόβος, τον οποίο τυχαίνει να συμμεριζόμαστε: «έχουμε καεί ξανά από την OpenAI που ανακοινώνει πράγματα και μετά τα κλειδώνει πίσω από πιο ακριβά πακέτα, οπότε θα το πιστέψω όταν το δω να τρέχει τοπικά».

Η άποψή μας στη Techsy: οι αναφορές ταχύτητας ευθυγραμμίζονται με αυτό που θα παρείχε μια στοίβα σερβιρίσματος υψηλότερης απόδοσης, οπότε τις πιστεύουμε. Τους ισχυρισμούς για one-shotting τους αντιμετωπίζουμε ως υποσχόμενους αλλά μη αποδεδειγμένους σε κλίμακα, επειδή το μοτίβο «έγινε πιο χαζό μετά από δύο εβδομάδες» είναι πραγματικό και το έχουμε δει να εκτυλίσσεται σε προηγούμενες κυκλοφορίες. Και η σκεπτικότητα για το κόστος είναι απολύτως σωστή. Μέχρι το Sol Ultra να είναι στο CLI σας, σταθερό, μέσα από έναν πλήρη κύκλο χρέωσης, αντιμετωπίστε τον ενθουσιασμό ως προεπισκόπηση, όχι ως ετυμηγορία.

Τι Είδαμε Τρέχοντας Agentic Εργασίες στο Codex

Ας είμαστε ειλικρινείς: δεν μπορούμε να τρέξουμε το Sol Ultra. Είναι περιορισμένο σε ~20 συνεργάτες και δεν είμαστε ένας από αυτούς, οπότε δεν θα παραθέσουμε αριθμούς tokens ή σκορ που δεν μετρήσαμε. Αυτό που μπορούμε να κάνουμε είναι το επόμενο καλύτερο ειλικρινές πράγμα. Τρέξαμε agentic εργασίες μέσω του Codex CLI στο τρέχον επίπεδό μας και υπολογίσαμε τα ακριβή μαθηματικά του κόστους των υποπράκτορων από τη δημοσιευμένη τιμολόγηση $5/$30 της OpenAI.

Η κλίμακα effort συμπεριφέρεται ακριβώς όπως θα περιμένατε στο επίπεδο που δοκιμάσαμε. Σε χαμηλό και μεσαίο effort, το Codex επιστρέφει γρήγορα και συνήθως πετυχαίνει τις αυτοτελείς διορθώσεις. Σπρώξτε μια δύσκολη, πολυαρχειακή εργασία σε χαμηλό effort και τείνει να σταματάει νωρίς ή να χάνει μια εξάρτηση μεταξύ αρχείων· η ίδια εργασία σε υψηλό effort αφιερώνει αισθητά περισσότερο χρόνο στη σκέψη πριν δράσει και προσγειώνει μεγαλύτερο μέρος της αλλαγής με μία πέραση. Αυτή η ανταλλαγή χρόνου τοίχου έναντι ποιότητας είναι ολόκληρος ο λόγος που υπάρχει η μέγιστη βαθμίδα.

Η παραπάνω μοντελοποίηση κόστους (το παράδειγμα με το περίπου 3,6x) είναι η γνήσια ανάλυση πρώτου χεριού που μπορούμε να υποστηρίξουμε: είναι αριθμητική πάνω στην επιβεβαιωμένη τιμολόγηση και τον επιβεβαιωμένο μηχανισμό υποπράκτορων, χαρακτηρίζεται ως μοντέλο, όχι ως μέτρηση. Σε πελατειακά agentic pipelines ήδη δρομολογούμε τα επίπεδα μοντέλων βάσει κόστους, και αυτός είναι ο ακριβής υπολογισμός που θα κάναμε πριν ενεργοποιήσουμε το Ultra για οποιονδήποτε.

Η μία αλλαγή διαμόρφωσης που έχει σημασία είναι η γραμμή model_reasoning_effort στο config.toml που δείξαμε νωρίτερα: κρατάμε την προεπιλογή του έργου μας στο high και παρακάμπτουμε σε max ανά εκτέλεση, ακριβώς όπως περιγράφει η παραπάνω επαγγελματική συμβουλή. Όταν το Ultra ανοίξει πέρα από την προεπισκόπηση, αυτή η ρύθμιση σημαίνει ότι η εναλλαγή του model string θα είναι η μόνη επεξεργασία που θα κάνουμε, και τα μαθηματικά κόστους παραπάνω είναι ήδη ο υπολογισμός που θα τρέξουμε πριν το ανάψουμε. Θα ενημερώσουμε αυτή την ενότητα με μετρημένους αριθμούς Ultra τη στιγμή που θα έχουμε γνήσια πρόσβαση, όχι νωρίτερα.

Σχετικά με τον Συγγραφέα

Ο Mert Batur Gurbuz είναι Συνιδρυτής του Techsy.io, όπου η ομάδα παραδίδει AI agents, συστήματα αυτοματισμού και pipelines φωνής/SDR για πελάτες B2B. Σπουδάζει στο Πανεπιστήμιο του Μπέρμιγχαμ και γράφει για τη στοίβα εργαλείων LLM που η ομάδα της Techsy χρησιμοποιεί πραγματικά στην παραγωγή. Συνδεθείτε στο LinkedIn.

Συνιδρυτής, Techsy.io, Πανεπιστήμιο του Μπέρμιγχαμ.

Συχνές Ερωτήσεις

Τι είναι το GPT-5.6 Sol Ultra;

Το Sol Ultra είναι το υψηλότερο επίπεδο effort συλλογισμού του GPT-5.6. Το καθοριστικό του χαρακτηριστικό είναι οι συνεργαζόμενοι υποπράκτορες: ένας συντονιστής σπάει μια εργασία και οι υποπράκτορες ανταλλάσσουν μηνύματα μεταξύ τους ενώ δουλεύουν. Η OpenAI το τοποθετεί για μεγάλες, δύσκολες, πολυβηματικές agentic εργασίες αντί για γρήγορες διορθώσεις, και το προεπισκόπησε ως μέρος της οικογένειας Sol στις 26-06-2026.

Είναι διαθέσιμο το Sol Ultra στο Codex αυτή τη στιγμή;

Όχι για τους περισσότερους. Από τον Ιούλιο του 2026, το Sol Ultra βρίσκεται σε κλειστή προεπισκόπηση προσβάσιμη μέσω του OpenAI API και του Codex, περιορισμένο σε περίπου 20 έμπιστους, κυβερνητικά εγκεκριμένους συνεργάτες πίσω από μια αξιολόγηση ασφαλείας. Η OpenAI λέει ότι η ευρύτερη πρόσβαση «έρχεται σε εβδομάδες» αλλά δεν έχει δημοσιεύσει συγκεκριμένη ημερομηνία, οπότε δεν μπορείτε απλώς να το ενεργοποιήσετε σήμερα.

Πώς λειτουργούν οι συνεργαζόμενοι υποπράκτορες στο Sol Ultra;

Ένας συντονιστής σπάει την εργασία σας σε κομμάτια και αναθέτει το καθένα σε έναν υποπράκτορα. Σε αντίθεση με τους ανεξάρτητους παράλληλους πράκτορες, αυτοί οι υποπράκτορες επικοινωνούν εντός της εργασίας, μοιράζοντας ό,τι μαθαίνουν ώστε οι άλλοι να προσαρμόζονται πριν τελειώσουν. Αυτός ο συντονισμός βοηθά σε σύνθετη, πολυαρχειακή εργασία, αλλά κάθε υποπράκτορας είναι μια ξεχωριστή κλήση μοντέλου που καταναλώνει τα δικά της tokens.

Τι είναι το «μέγιστο effort συλλογισμού» στο GPT-5.6;

Το μέγιστο effort συλλογισμού είναι η κορυφαία βαθμίδα της κλίμακας effort του GPT-5.6, η οποία πάει χαμηλό, μεσαίο, υψηλό και μετά μέγιστο. Υψηλότερο effort σημαίνει ότι το μοντέλο δαπανά περισσότερους υπολογιστικούς πόρους συλλογιζόμενο πριν απαντήσει. Βοηθάει σε δύσκολες, μακροπρόθεσμες εργασίες και σπαταλάει χρήματα σε απλές, οπότε αντιμετωπίστε το ως ένα κουμπί που ανεβάζετε μόνο όταν μια εργασία είναι πραγματικά δύσκολη.

Πόσο κοστίζει η εκτέλεση του Sol Ultra;

Το βασικό Sol τιμολογείται στα $5 ανά 1M tokens εισόδου, $0,50 προσωρινά αποθηκευμένα και $30 ανά 1M tokens εξόδου (πηγές από DataCamp και deeplearning.ai, με ημερομηνία μέσα στο 2026). Το Ultra δημιουργεί συνεργαζόμενους υποπράκτορες, οπότε μία εργασία πυροδοτεί αρκετές κλήσεις μοντέλου. Το μοντελοποιημένο μας παράδειγμα δείχνει ότι μια μεμονωμένη εργασία κοστίζει περίπου 2x έως 4x μιας εκτέλεσης βασικού Sol, κυρίως λόγω των επιπλέον tokens εξόδου.

Είναι το Sol Ultra πραγματικά καλύτερο από το Claude Mythos 5;

Σύμφωνα με τους αναφερόμενους αριθμούς, το Sol Ultra (91,9%) προηγείται του Claude Mythos 5 στο Terminal-Bench 2.1, αλλά αυτό δεν είναι επαληθευμένο. Η OpenAI δεν έχει δημοσιεύσει τον αριθμό, η προεπισκόπηση είναι κλειστή και το αναφερόμενο σκορ του ίδιου του Mythos 5 ποικίλλει από 84,3% έως 88,0% ανάλογα με την πηγή. Άρα η ειλικρινής απάντηση είναι: δεν ξέρουμε ακόμη, και δεν πρέπει να δρομολογείτε κίνηση παραγωγής βάσει αυτού.

Πότε θα είναι γενικά διαθέσιμο το Sol Ultra;

Η OpenAI έχει πει ότι η ευρύτερη πρόσβαση στην οικογένεια Sol σε ChatGPT, Codex και API «έρχεται σε εβδομάδες», αλλά δεν έχει δημοσιεύσει ημερομηνία γενικής διαθεσιμότητας. Οποιαδήποτε συγκεκριμένη ημερομηνία κυκλοφορεί online (συμπεριλαμβανομένης της «7ης Ιουλίου») είναι ανεπιβεβαίωτη φημολογία, όχι επίσημη ανακοίνωση. Παρακολουθήστε την ίδια τη σελίδα προεπισκόπησης της OpenAI για το επιβεβαιωμένο χρονοδιάγραμμα.

Είναι επαληθευμένο το σκορ 91,9% στο Terminal-Bench 2.1;

Όχι. Το νούμερο 91,9% προέρχεται από τον δευτερογενή τύπο, όχι από την ίδια τη σελίδα προεπισκόπησης της OpenAI. Η προεπισκόπηση είναι κλειστή σε ~20 συνεργάτες και δεν έχει αποκαλυφθεί καμία μεθοδολογία αξιολόγησης, οπότε κανείς έξω από αυτόν τον κύκλο δεν μπορεί να το αναπαράγει. Μπορεί να αποδειχθεί ακριβές αργότερα, αλλά αυτή τη στιγμή είναι ένας ανεπιβεβαίωτος ισχυρισμός του τύπου, όχι ένα οριστικό αποτέλεσμα benchmark.

Πώς διαφέρει το Sol Ultra από τους παράλληλους πράκτορες του GPT-5.5 Pro;

Οι παράλληλοι πράκτορες του Pro δουλεύουν ανεξάρτητα σε ξεχωριστές λωρίδες: ο καθένας κάνει το κομμάτι του απομονωμένα και επιστρέφει ένα αποτέλεσμα, χωρίς καμία επικοινωνία. Οι υποπράκτορες του Sol Ultra συνεργάζονται, ανταλλάσσοντας μηνύματα μεταξύ τους εντός της εργασίας ώστε να προσαρμόζονται καθώς μαθαίνουν. Αυτός ο συντονισμός ταιριάζει σε πιο δύσκολη πολυβηματική εργασία, αλλά επίσης πολλαπλασιάζει τη χρήση token σε όλες τις κλήσεις.

Χρειάζομαι το Sol Ultra ή αρκεί το βασικό Sol;

Για την περισσότερη agentic κωδικοποίηση, το βασικό Sol ή το υψηλό effort συλλογισμού είναι υπεραρκετό και πολύ φθηνότερο. Κρατήστε το Ultra για μακρές, πολυαρχειακές εργασίες όπου μια λάθος πρώτη προσπάθεια θα κόστιζε περισσότερο χρόνο από τα επιπλέον tokens. Αν δεν μπορείτε να εξηγήσετε καθαρά γιατί μια εργασία είναι δύσκολη, δεν χρειάζεστε το Ultra γι' αυτήν. Δρομολογήστε βάσει δυσκολίας, όχι βάσει leaderboard.

Τι λένε οι προγραμματιστές για το GPT-5.6 Sol στο Reddit;

Οι πρώιμες αναφορές στο r/codex είναι θετικές ως προς την ταχύτητα («διπλάσια ταχύτητα») και ως προς το one-shotting των prompts, με αρκετούς προγραμματιστές να συγκρίνουν την αίσθηση με το Fable 5 του Claude. Αλλά οι βετεράνοι προειδοποιούν για ένα μοτίβο «μήνας του μέλιτος και μετά nerf» όπου τα μοντέλα υποβαθμίζονται μετά την κυκλοφορία, και μεγάλο μέρος της συζήτησης επικεντρώνεται στο κόστος έναντι των πλάνων της Anthropic, παρά στην καθαρή ικανότητα.

Ετικέτες

GPT-5.6 Sol Ultra στο CodexSol Ultra Codexμέγιστο effort συλλογισμούsubagentsTerminal-Bench 2.1

Κοινοποίηση άρθρου

Σχετικά άρθρα

Περισσότερα στο ai-machine-learning

ai-machine-learning
Jul 24, 2026

Το Claude Opus 5 είναι εδώ: Νοημοσύνη κοντά στο Fable 5 στη μισή τιμή

Η Anthropic κυκλοφόρησε το Claude Opus 5 στις 24 Ιουλίου 2026. Περισσότερο από διπλασιάζει το Opus 4.8 στο Frontier-Bench και κρατά την τιμή του Opus, αλλά χάνει σε μερικά τεστ από το Fable 5 και το Mythos 5. Εδώ είναι ο πίνακας benchmarks, η τιμολόγηση και η απόφαση αλλαγής/αναμονής/παραμονής.

10 min read εξάγουμε ανάγνωση
Ανάγνωση
ai-machine-learning
Jul 20, 2026

8 Καλύτερα AI Web Scraping APIs το 2026 (Δοκιμασμένα στο Δικό μας Agent Stack)

Δοκιμάσαμε 8 AI web scraping APIs με πραγματικές τιμές 2026 μέσα από το δικό μας agent stack. Firecrawl, Bright Data, ScrapingBee και 5 ακόμα, καταταγμένα για LLM-ready output, anti-bot και υποστήριξη MCP.

9 min read εξάγουμε ανάγνωση
Ανάγνωση
ai-machine-learning
Jul 20, 2026

Prompt Engineering για Προγραμματισμό: 7 Μοτίβα που Χρησιμοποιούμε Καθημερινά σε Claude Code και Cursor (2026)

Τα περισσότερα άρθρα για 'prompts προγραμματισμού με AI' σας δίνουν 50 έτοιμα πρότυπα. Αυτό το άρθρο διδάσκει τα 7 μοτίβα που χρησιμοποιούμε καθημερινά για τη διαχείριση μιας ροής εργασίας 16 πρακτόρων στο Claude Code, με πραγματικά παραδείγματα πριν και μετά, καθώς και πού εφαρμόζεται κάθε μοτίβο στο Claude Code, το Cursor και το Copilot το 2026.

11 min read εξάγουμε ανάγνωση
Ανάγνωση
Εμφάνιση όλων των άρθρων
Ξεκινήσετε το Project σας

Έτοιμοι να δημιουργήσουμε κάτι εξαιρετικό;

Ας κάνουμε το όραμά σας πραγματικότητα. Η ομάδα μας είναι έτοιμη να σας βοηθήσει να φτιάξετε λογισμικό που κάνει τη διαφορά.

Κλείστε μια κλήση αξιολόγησης 30 λεπτάΔείτε το Έργο μας

Τα πιο hot από τη βιβλιοθήκη

Claude Skills

Δείτε όλα
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI Automatizations

Δείτε όλα
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Τα πιο hot από τη βιβλιοθήκη

Claude Skills

Δείτε όλα
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI Automatizations

Δείτε όλα
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Υπηρεσίες

  • Enterprise Λύσεις
  • Mobile Εφαρμογές
  • Web Application

Λύσεις

  • CRM Συστήματα
  • AI Ενσωμάτωση
  • ERP Λύσεις
  • Φωνητικοί Πράκτορες
  • Αυτοματοποίηση Διαδικασιών
  • Κιберασφάλεια

Βιβλιοθήκη

  • Ιστολόγιο
  • Έργα

Κοινότητα

  • AI Automatizations
  • Claude Skills

Εργαλεία

  • Υπολογισμό Κόστους Mobile App
  • Υπολογισμός Κόστους OpenAI / LLM APIs
  • Υπολογισμός Κόστους MVP
  • Υπολογισμός Κόστους Voice AI Agent

Εταιρεία

  • Σχετικά
  • Συνεργάτες
  • Επικοινωνία

Νομικά

  • Πολιτική Απορρήτου
  • Όροι Χρήσης
  • Πολιτική Cookies

Υπηρεσίες

  • Enterprise Λύσεις
  • Mobile Εφαρμογές
  • Web Application

Λύσεις

  • CRM Συστήματα
  • AI Ενσωμάτωση
  • ERP Λύσεις
  • Φωνητικοί Πράκτορες
  • Αυτοματοποίηση Διαδικασιών
  • Κιберασφάλεια

Βιβλιοθήκη

  • Ιστολόγιο
  • Έργα

Κοινότητα

  • AI Automatizations
  • Claude Skills

Εργαλεία

  • Υπολογισμό Κόστους Mobile App
  • Υπολογισμός Κόστους OpenAI / LLM APIs
  • Υπολογισμός Κόστους MVP
  • Υπολογισμός Κόστους Voice AI Agent

Εταιρεία

  • Σχετικά
  • Συνεργάτες
  • Επικοινωνία
ΝομικάΠολιτική ΑπορρήτουΌροι ΧρήσηςΠολιτική Cookies
TECHSY
© 2026 Techsy. Με επιφύλαξη παντός δικαιώματος.