
Claude Fable 5 vs Opus 4.8: Πρέπει Όντως να Αλλάξεις; (Κλάσης Mythos, με Benchmarks)
Η Anthropic κυκλοφόρησε σήμερα, 9 Ιουνίου 2026, το Claude Fable 5. Πιάνει 80,3% στο SWE-Bench Pro, το benchmark του agentic προγραμματισμού όπου το Opus 4.8 φτάνει το 69,2% και το GPT-5.5 μένει πίσω με 58,6%. Αυτή δεν είναι διαφορά στρογγυλοποίησης. Και υπάρχει μια ανατροπή: το Fable 5 είναι η δημόσια, προστατευμένη μισή έκδοση ενός νέου μοντέλου «κλάσης Mythos», με ένα αδελφό μοντέλο υπό περιορισμένη πρόσβαση, το Claude Mythos 5, που κρατείται πίσω από ένα πρόγραμμα ελεγχόμενης πρόσβασης. Δες τι άλλαξε, πόσο κοστίζει πραγματικά μια εργασία στα $10/$50 ανά εκατομμύριο tokens και αν πρέπει όντως να μετακινήσεις το stack σου από το Opus 4.8.
Γρήγορη Απάντηση
- Το Fable 5 πιάνει 80,3% στο SWE-Bench Pro έναντι 69,2% του Opus 4.8 και 58,6% του GPT-5.5.
- Η τιμολόγηση είναι $10 input / $50 output ανά εκατομμύριο tokens, λιγότερο από το μισό του Mythos Preview.
- Το Fable 5 επιστρέφει αυτόματα στο Opus 4.8 για ερωτήματα υψηλού ρίσκου σε cyber/bio/chem (σε λιγότερο από 5% των sessions).
- Δωρεάν στα πλάνα Pro/Max/Team/Enterprise έως τις 22 Ιουνίου 2026· από τις 23 Ιουνίου ισχύουν credits χρήσης.
Τι Κυκλοφόρησε Πραγματικά: Fable 5, Mythos 5 και η Σειρά «Κλάσης Mythos»
Η κλάση Mythos είναι η νέα κορυφαία βαθμίδα δυνατοτήτων της Anthropic και κυκλοφορεί ως δύο μοντέλα. Το Claude Fable 5 είναι η δημόσια, προστατευμένη έκδοση που μπορείς να καλέσεις ήδη από σήμερα. Το Claude Mythos 5 είναι το ίδιο μοντέλο αιχμής με τα safeguards αφαιρεμένα, που κρατείται πίσω από ελεγχόμενη πρόσβαση. Ίδιος εγκέφαλος, δύο στάσεις κυκλοφορίας.
Αυτός ο διαχωρισμός είναι όλη η ιστορία εδώ. Σύμφωνα με την ανακοίνωση στο newsroom της Anthropic, το Mythos 5 διατηρεί πλήρη δυνατότητα αιχμής, συμπεριλαμβανομένων επιθετικών cyber δεξιοτήτων που θα μπορούσαν να προκαλέσουν πραγματική ζημιά, γι' αυτό η Anthropic δεν το δίνει σε όλους. Το Fable 5 παίρνει αυτό το ίδιο μοντέλο και το τυλίγει με classifiers που εντοπίζουν αιτήματα υψηλού ρίσκου και τα δρομολογούν αθόρυβα στο Opus 4.8 αντί γι' αυτό.
Άρα όταν καλείς το Fable 5, παίρνεις συλλογισμό κλάσης Mythos σε ό,τι δεν είναι επικίνδυνο και ένα ασφαλέστερο εφεδρικό μοντέλο στο μικρό κομμάτι που είναι. Το CNBC το περιέγραψε ως την Anthropic να κυκλοφορεί «ένα Mythos-σαν AI στο κοινό», πράγμα ακριβές, αλλά ο ακριβής μηχανισμός μετράει περισσότερο από τον τίτλο.
Το Fable 5 και το Mythos 5 είναι το ίδιο μοντέλο αιχμής κομμένο στα δύο: ένα που μπορείς να χρησιμοποιήσεις σήμερα και ένα που η Anthropic κρατάει υπό περιορισμό. Αν κρατήσεις μόνο ένα πράγμα για την ονοματολογία, κράτα αυτό. Η κλάση Mythos είναι η βαθμίδα· το Fable και το Mythos είναι οι δύο πόρτες προς αυτήν.
Τι Άλλαξε σε Σχέση με τη Σειρά Opus 4.x
Σε κάθε eval προγραμματισμού και συλλογισμού που δημοσίευσε η Anthropic, το Fable 5 ξεπερνά το Opus 4.8, όχι οριακά αλλά με διψήφια διαφορά. Το SWE-Bench Pro πηδά από 69,2% σε 80,3%. Το FrontierCode Diamond πάει από 13,4 σε 29,3. Η τιμολόγηση επίσης έπεσε και το μοντέλο κλιμακώνεται με έναν νέο επιλογέα έντασης συλλογισμού. Αυτό είναι ένα γνήσιο βήμα αιχμής πέρα από τη σειρά Opus 4.x, όχι μια σημειακή κυκλοφορία.

Η σάρωση 13 benchmarks παραπάνω είναι η έκδοση με μια ματιά. Δες το κυρίως υποσύνολο απέναντι στα τρία μοντέλα που οι περισσότερες ομάδες συγκρίνουν πραγματικά:
| Benchmark | Claude Fable 5 | Claude Opus 4.8 | GPT-5.5 |
|---|---|---|---|
| SWE-Bench Pro (agentic προγραμματισμός) | 80,3% | 69,2% | 58,6% |
| FrontierCode Diamond (πιο δύσκολος προγραμματισμός) | 29,3 | 13,4 | 5,7 |
| Terminal-Bench 2.1 (agentic shell) | 88,0% | n/a | n/a |
| GPQA-AA (συλλογισμός μεταπτυχιακού επιπέδου, Elo) | 1932 | n/a | n/a |
| ExploitBench | 78,0% | n/a | n/a |
Το σημείο αναφοράς εδώ είναι το Claude Opus 4.8, το μοντέλο που το Fable 5 αντικαθιστά στην αιχμή και το ίδιο μοντέλο στο οποίο το Fable 5 επιστρέφει σε ερωτήματα υψηλού ρίσκου. Αν παρακολουθούσες τη σειρά Opus 4.x στις δύο τελευταίες κυκλοφορίες, το μοτίβο ήταν αυξητικές βελτιώσεις. Το Fable 5 σπάει αυτό το μοτίβο.
Δύο πράγματα να επισημάνουμε πριν διαβάσεις τον πίνακα ως ευαγγέλιο. Πρώτον, αυτά είναι τα δικά της δημοσιευμένα evals της Anthropic, όχι ανεξάρτητο τεστ. Δεύτερον, ο επιλογέας έντασης συλλογισμού σημαίνει ότι ένας μεμονωμένος αριθμός benchmark κρύβει μια καμπύλη κόστους. Περισσότερα γι' αυτό στην ενότητα τιμολόγησης, γιατί αλλάζει τα μαθηματικά.
Τα Benchmarks που Μετράνε για τους Builders
Τέσσερις αριθμοί κρατούν το πρακτικό βάρος: SWE-Bench Pro 80,3%, FrontierCode Diamond 29,3, Terminal-Bench 2.1 88,0% και GPQA-AA 1932 Elo. Μαζί καλύπτουν πραγματική δουλειά σε repo, τα πιο δύσκολα συνθετικά προβλήματα προγραμματισμού, agentic εργασίες shell και συλλογισμό μεταπτυχιακού επιπέδου. Αν η δουλειά σου αγγίζει οποιοδήποτε από αυτά, αυτή είναι η ενότητα που σου λέει αν ο αριθμός αντιστοιχεί στη δουλειά σου.
Το κεντρικό γράφημα στην κορυφή αυτού του άρθρου είναι η απόδειξη: SWE-Bench Pro 80,3 έναντι 69,2 έναντι 58,6 και FrontierCode 29,3 έναντι 13,4 έναντι 5,7. Τώρα, τι μετράνε πραγματικά αυτά;
- Το SWE-Bench Pro ελέγχει αν ένα μοντέλο μπορεί να παραδώσει ένα πραγματικό pull request σε ένα πραγματικό repo: clone, κατανόηση, patch, πέρασμα tests. Το SWE-Bench Pro μετρά αν ένα μοντέλο μπορεί να παραδώσει ένα πραγματικό pull request σε ένα πραγματικό repo και το Fable 5 πετυχαίνει 8 στα 10. Αυτός είναι ο πλησιέστερος δείκτης για το «μπορεί να κάνει την πραγματική μου δουλειά».
- Το Terminal-Bench 2.1 βαθμολογεί agentic εργασίες shell: εκτέλεση εντολών, ανάγνωση εξόδου, ανάκαμψη από σφάλματα. Το 88,0% μετράει αν χτίζεις AI coding agents που ζουν σε ένα terminal.
- Το FrontierCode Diamond είναι η πιο δύσκολη βαθμίδα προβλημάτων προγραμματισμού, αυτά όπου τα περισσότερα μοντέλα πιάνουν μονοψήφια νούμερα. Το 29,3 είναι χαμηλό σε απόλυτους όρους αλλά περισσότερο από διπλάσιο από το 13,4 του Opus 4.8.
- Το GPQA-AA είναι συλλογισμός επιστήμης μεταπτυχιακού επιπέδου, βαθμολογημένος ως Elo rating. Το 1932 σηματοδοτεί ισχυρό πολυβηματικό συλλογισμό πέρα από τον κώδικα.
Στα δικά μας workflows του Claude Code σε όλη τη σειρά Opus 4.x, το επαναλαμβανόμενο ταβάνι ήταν οι εργασίες agentic μεγάλου ορίζοντα: το μοντέλο έχανε το νήμα στη μέση μιας αλλαγής πολλών αρχείων. Οι αριθμοί του Fable 5 σε Terminal-Bench και SWE-Bench Pro δείχνουν ότι αυτό το ταβάνι μετακινήθηκε. Αν μετακινήθηκε για το δικό σου repo είναι το μόνο τεστ που μετράει, αλλά οι δημοσιευμένοι αριθμοί είναι το σωστό είδος αριθμού που αξίζει να σε νοιάζει.
Πραγματικές Περιπτώσεις: Τι Κάνει το Fable 5 που Προηγούμενα Μοντέλα Δεν Μπορούσαν
Η Anthropic δημοσίευσε τρία συγκεκριμένα παραδείγματα που δείχνουν την κατηγορία προβλήματος που το Fable 5 μπορεί πλέον να χειριστεί: μια μετανάστευση codebase της Stripe που συμπιέστηκε από μήνες σε μία μέρα, ένα βιντεοπαιχνίδι που ολοκληρώθηκε μόνο με όραση και μια άλμα επιδόσεων 3× από αυτοεπαλήθευση. Το καθένα δείχνει μια δυνατότητα που προηγούμενα μοντέλα δεν μπορούσαν να φτάσουν. Και τα τρία προέρχονται από την Anthropic· παραθέτουμε την ανακοίνωσή τους, όχι δικό μας τεστ.
Δες τι αποδεικνύει το καθένα:
-
Μετανάστευση Ruby της Stripe. Η Anthropic αναφέρει ότι το Fable 5 συμπίεσε μια μετανάστευση Ruby codebase από περίπου δύο μήνες σε περίπου μία μέρα. Η Stripe συμπίεσε μια μετανάστευση Ruby από δύο μήνες σε μία μόνο μέρα και αυτό είναι το μέγεθος προβλήματος που αυτό το μοντέλο αλλάζει. Αυτή είναι η κατηγορία refactor μεγάλου ορίζοντα που παλιά χρειαζόταν μια ανθρώπινη ομάδα να κρατά όλο το codebase στο μυαλό της.
-
Pokémon FireRed μόνο με όραση. Σύμφωνα με την Anthropic, το Fable 5 ολοκλήρωσε το Pokémon FireRed χρησιμοποιώντας μόνο όραση, όπου προηγούμενα μοντέλα χρειάζονταν πολύπλοκα προσαρμοσμένα harnesses για να τροφοδοτούν την κατάσταση του παιχνιδιού ως κείμενο. Αυτό είναι ένα άλμα χωρικού και οπτικού συλλογισμού: το μοντέλο διαβάζει την οθόνη και δρα, χωρίς scaffolding.
-
Slay the Spire, 3×. Στη μέγιστη ένταση συλλογισμού, η Anthropic λέει ότι το Fable 5 αυτοεπαληθεύει τις κινήσεις του και έφτασε σε 3× καλύτερη επίδοση μέσω επίμονης μνήμης. Το συμπέρασμα δεν είναι το παιχνίδι· είναι ότι το μοντέλο μπορεί να ελέγχει τη δική του δουλειά σε έναν μεγάλο ορίζοντα σχεδιασμού και να βελτιώνεται από αυτό.
Κανένα από αυτά δεν είναι κάτι που πρέπει να πάρεις ως δεδομένο για τη δική σου δουλειά. Αλλά ταιριάζουν καθαρά με τα άλματα των benchmarks στον παραπάνω πίνακα: προγραμματισμός μεγάλου ορίζοντα (SWE-Bench Pro), χωρικός συλλογισμός (όραση) και αυτοεπαλήθευση (ο επιλογέας έντασης συλλογισμού). Τα ποιοτικά κέρδη και τα ποσοτικά λένε την ίδια ιστορία.
Τιμολόγηση και η Πραγματικότητα του Κόστους ανά Εργασία
Το Fable 5 κοστίζει $10 ανά εκατομμύριο input tokens και $50 ανά εκατομμύριο output tokens. Η Anthropic το παρουσιάζει ως «λιγότερο από το μισό της τιμής του Claude Mythos Preview». Είναι επίσης περίπου 2× το Opus 4.8 ανά token. Και τα δύο ισχύουν. Η παγίδα είναι ότι η τιμή ανά token είναι λάθος μονάδα. Αυτό που πραγματικά πληρώνεις είναι μια ολοκληρωμένη εργασία και εκεί τα μαθηματικά του Fable 5 γίνονται ενδιαφέροντα.

Η ένταση συλλογισμού είναι ένας επιλογέας που ορίζεις ανά αίτημα. Χαμηλή ένταση σημαίνει λιγότερα εσωτερικά tokens συλλογισμού και μια φθηνότερη, γρηγορότερη απάντηση· μέγιστη ένταση σημαίνει ότι το μοντέλο σκέφτεται περισσότερο, ξοδεύει περισσότερα output tokens και πιάνει υψηλότερο σκορ. Το παραπάνω γράφημα δείχνει το Fable 5 να ανεβαίνει από ~11% σε ~31% στο FrontierCode καθώς η ένταση κλιμακώνεται από χαμηλή σε μέγιστη, ενώ το Opus 4.8 κορυφώνεται γύρω στο 13% και το GPT-5.5 κάθεται επίπεδα κοντά στο 5-6%. Άρα το κόστος ανά εργασία δεν είναι ένας αριθμός· είναι μια καμπύλη στην οποία διαλέγεις ένα σημείο.
Ας δουλέψουμε ένα συγκεκριμένο παράδειγμα από τη δημοσιευμένη τιμολόγηση $10/$50. Αυτή είναι αριθμητική από τις αναρτημένες τιμές της Anthropic, όχι αποτέλεσμα benchmark.
Πάρε μια μεμονωμένη agentic κλήση με 50.000 input tokens και 15.000 output tokens σε υψηλή ένταση:
Input: 50,000 / 1,000,000 × $10 = $0.50
Output: 15,000 / 1,000,000 × $50 = $0.75
Per call: $1.25Μια πραγματική agentic εργασία αλυσιδώνει πολλές τέτοιες κλήσεις: διάβασμα repo, σχεδιασμός, επεξεργασία, τρέξιμο tests, διόρθωση, επανάληψη. Πες ότι ο βρόχος τρέχει 12 κλήσεις σε αυτό το σχήμα: περίπου $15 για την ολοκληρωμένη εργασία. Στη μέγιστη ένταση συλλογισμού με βαρύτερο context, η δική της καμπύλη κόστους της Anthropic βάζει τα δύσκολα FrontierCode tasks πιο κοντά στην περιοχή των $20 ανά εργασία. Τρέξε την ίδια εργασία στο GPT-5.5 και θα πληρώσεις λιγότερα ανά token. Αλλά αν δεν μπορεί να ολοκληρώσει την εργασία σε κανένα επίπεδο έντασης, το κόστος σου ανά ολοκληρωμένη εργασία είναι άπειρο. Το Fable 5 κοστίζει περισσότερα ανά token από το GPT-5.5 και παρ' όλα αυτά κερδίζει στο κόστος ανά ολοκληρωμένη εργασία, επειδή ολοκληρώνει δουλειά που το GPT-5.5 δεν μπορεί.
Δες μια ελάχιστη κλήση. Η ανακοίνωση της Anthropic δίνει το claude-fable-5 ως model id· επαλήθευσε το ακριβές versioned string στα docs του Anthropic API πριν κυκλοφορήσεις, αφού τα χρονολογημένα aliases μερικές φορές διαφέρουν:
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-fable-5", # verify exact dated id in API docs
max_tokens=4096,
thinking={"type": "enabled", "budget_tokens": 8000}, # reasoning effort
messages=[
{"role": "user", "content": "Migrate this module from Ruby 2.7 to 3.3 and run the tests."}
],
)
print(message.content)Η οικονομική θέση σε μία γραμμή: πληρώνεις περισσότερα ανά token από το GPT-5.5, αλλά ολοκληρώνεις εργασίες που το GPT-5.5 δεν μπορεί να ολοκληρώσει σε καμία τιμή. Για δουλειά χαμηλού ρίσκου και υψηλού όγκου, αυτά τα μαθηματικά ευνοούν ένα φθηνότερο μοντέλο. Για δύσκολο agentic προγραμματισμό, ευνοούν το Fable 5.
Ο Διαχωρισμός των Safeguards: Γιατί το Fable Επιστρέφει στο Opus 4.8
Το Fable 5 τρέχει classifiers σε κάθε αίτημα. Όταν εντοπίσει ένα ερώτημα υψηλού ρίσκου (επιθετικό cyber, bio, chem ή απόπειρες model-distillation), επιστρέφει στο Opus 4.8 αντί να απαντήσει με πλήρη δυνατότητα κλάσης Mythos. Η Anthropic λέει ότι αυτή η εφεδρεία ενεργοποιείται σε λιγότερο από 5% των sessions, άρα οι περισσότεροι χρήστες δεν την προκαλούν ποτέ. Το νόημα είναι να κρατηθεί η επικίνδυνη δυνατότητα πίσω από την πύλη, αφήνοντας την καθημερινή δουλειά ανέπαφη.

Ο πιο δύσκολος αριθμός είναι το ποσοστό επιτυχίας επίθεσης: πόσο συχνά ένας αυτοματοποιημένος επιτιθέμενος μπορεί να κάνει jailbreak στο μοντέλο ώστε να κάνει κάτι που δεν πρέπει. Χαμηλότερο είναι καλύτερο. Τα αποτελέσματα red-team της Anthropic δείχνουν απότομη πτώση στις κυκλοφορίες, από το Opus 4.6 στο 83,2%, στο Opus 4.7 στο 72,7%, στο Opus 4.8 στο 56,6%, μέχρι το Fable 5 στο 5,4%. Υπό αυτοματοποιημένο red-teaming, οι επιθέσεις πετύχαιναν εναντίον του Fable 5 μόλις 5,4% των φορών, από 56,6% στο Opus 4.8.
Γιατί να σε νοιάζει; Αν αναπτύσσεις έναν agent με πρόσβαση σε εργαλεία (shell, σύστημα αρχείων, δίκτυο), ένα jailbreak δεν είναι μια κακή απάντηση chat, είναι ένα μοντέλο που εκτελεί πραγματικές εντολές που ένας επιτιθέμενος το οδήγησε να κάνει. Ένα ποσοστό επιτυχίας επίθεσης 5,4% σημαίνει ότι είναι περίπου δέκα φορές πιο δύσκολο να οπλοποιηθεί από το Opus 4.8. Η κάλυψη του IT Pro ξεκίνησε με τον μηχανισμό εφεδρείας ακριβώς γι' αυτόν τον λόγο: είναι το χαρακτηριστικό που κάνει ένα μοντέλο αιχμής αρκετά ασφαλές για να δοθεί στο κοινό.
Το αντάλλαγμα είναι η καθυστέρηση. Αν η ροή δουλειάς σου αγγίζει νόμιμα εργαλεία ασφαλείας, η εφεδρεία μπορεί να ενεργοποιηθεί στη μέση της εργασίας και να σου αλλάξει μοντέλα, κάτι που πρέπει να προβλέψεις.
Το Claude Mythos 5 και το Ζήτημα της Διπλής Χρήσης
Το Claude Mythos 5 είναι το αδελφό υπό περιορισμό, το ίδιο μοντέλο χωρίς την εφεδρεία safeguard. Κρατά την επιθετική cyber δυνατότητα που το Fable 5 μπλοκάρει, πράγμα που είναι ακριβώς ο λόγος που η Anthropic δεν το κυκλοφορεί δημόσια. Η πρόσβαση περνά μέσα από το Project Glasswing, ένα ελεγμένο πρόγραμμα για αμυνόμενους και ερευνητές που χρειάζονται πλήρη δυνατότητα. Ίδιο μοντέλο, δύο στάσεις κυκλοφορίας: μία ανοιχτή, μία υπό περιορισμό.

Το γράφημα κάνει τον περιορισμό ορατό. Στα evals επιθετικού cyber (Firefox, OSS-Fuzz, CyberGym, CyScenarioBench) το Mythos 5 πιάνει 88,4, 24,0, 83,8 και 38,7. Το Fable 5 επιστρέφει ένα επίπεδο 0,0 και στα τέσσερα. Στα evals επιθετικού cyber, το Mythos 5 πιάνει έως 88,4 εκεί που το Fable 5 επιστρέφει ένα επίπεδο 0,0: ο διαχωρισμός των safeguards, ορατός.
Αυτό το μηδέν δεν είναι χάσμα δυνατότητας. Είναι η εφεδρεία που ενεργοποιείται κάθε φορά, μπλοκάροντας το αίτημα πριν απαντήσει το μοντέλο κλάσης Mythos. Το TechCrunch σημείωσε τον χρονισμό: η Anthropic το κυκλοφόρησε μέρες αφότου προειδοποίησε ότι το AI γίνεται πολύ επικίνδυνο για να κυκλοφορεί ανοιχτά. Ο διαχωρισμός Fable/Mythos είναι η πολιτική απάντηση σε αυτή την προειδοποίηση, δημοσίευσε τη δυνατότητα, περιόρισε τον κίνδυνο.
Για τους περισσότερους developers, το Mythos 5 είναι άσχετο. Δεν θα πληροίς ποτέ τις προϋποθέσεις για το Project Glasswing και δεν χρειάζεται. Αυτό που μετράει είναι να ξέρεις ότι το μοντέλο που καλείς είναι σκόπιμα περιορισμένο σε μια στενή ζώνη εργασιών, εξ σχεδιασμού.
Τι Σημαίνει Αυτό: Πρέπει να Αλλάξεις;
Άλλαξε στο Fable 5 για δύσκολο agentic προγραμματισμό, πολυβηματικές εργασίες μεγάλου ορίζοντα και όραση ή χωρικό συλλογισμό, οπουδήποτε η ολοκλήρωση της εργασίας νικά το να εξοικονομείς ψιλά ανά token. Μείνε στο Opus 4.8 για δουλειά υψηλού όγκου ευαίσθητη στο κόστος ή για οτιδήποτε ενεργοποιεί την εφεδρεία ούτως ή άλλως. Αυτό είναι όλο το πλαίσιο. Τα υπόλοιπα είναι να ταιριάξεις τη δουλειά σου με τη σωστή πλευρά του.
Πότε κερδίζει το Fable 5:
- Δύσκολος agentic προγραμματισμός όπου το Opus 4.8 κολλάει· η διαφορά στο SWE-Bench Pro είναι πραγματική
- Εργασίες μεγάλου ορίζοντα (refactors πολλών αρχείων, μεταναστεύσεις) όπου η αυτοεπαλήθευση αποδίδει
- Εργασίες όρασης και χωρικού συλλογισμού
- Οποιαδήποτε δουλειά όπου μία ολοκληρωμένη εργασία αξίζει περισσότερο από το premium ανά token
Πότε κερδίζει ακόμα το Opus 4.8:
- Εργασία υψηλού όγκου, ευαίσθητη στο κόστος, όπου η τιμή ανά token κυριαρχεί
- Εργασίες cyber/bio/chem, όπου το Fable 5 επιστρέφει στο Opus 4.8 ούτως ή άλλως, άρα κάλεσέ το απευθείας
- Ροές ευαίσθητες στην καθυστέρηση που δεν αντέχουν αλλαγή μοντέλου στη μέση της εργασίας
| Περίπτωση χρήσης | Προτεινόμενο μοντέλο |
|---|---|
| Δύσκολος agentic προγραμματισμός / μεταναστεύσεις | Claude Fable 5 |
| Όραση / χωρικός συλλογισμός | Claude Fable 5 |
| Φθηνή ταξινόμηση υψηλού όγκου | Claude Opus 4.8 |
| Εργαλεία ασφαλείας / red-team | Claude Opus 4.8 (απευθείας) |
Σχετικά με τη διαθεσιμότητα: το Fable 5 είναι δωρεάν στα πλάνα Pro/Max/Team/Enterprise έως τις 22 Ιουνίου 2026, με credits χρήσης να ισχύουν από τις 23 Ιουνίου. Είναι γενικά διαθέσιμο στο API, το AWS Bedrock, το GitHub Copilot σύμφωνα με το changelog του GitHub και το Harvey. Άρα μπορείς να δοκιμάσεις την αλλαγή στον editor σου σήμερα χωρίς να αλλάξεις τη χρέωσή σου.
Σχετικά με τον Συγγραφέα
Ο Mert Batur Gurbuz είναι Συνιδρυτής του Techsy.io, όπου η ομάδα παραδίδει AI agents, συστήματα αυτοματισμού και pipelines φωνής/SDR για B2B πελάτες. Σπουδάζει στο Πανεπιστήμιο του Birmingham και γράφει για το stack εργαλείων LLM που η ομάδα της Techsy χρησιμοποιεί πραγματικά στην παραγωγή. Συνδέσου στο LinkedIn.
Συνιδρυτής, Techsy.io · Πανεπιστήμιο του Birmingham
Συχνές Ερωτήσεις
Τι είναι το Claude Fable 5;
Το Claude Fable 5 είναι το πρώτο δημόσια διαθέσιμο μοντέλο κλάσης Mythos της Anthropic, που κυκλοφόρησε στις 9 Ιουνίου 2026. Πιάνει 80,3% στο SWE-Bench Pro και τρέχει safeguard classifiers που επιστρέφουν στο Opus 4.8 σε ερωτήματα υψηλού ρίσκου. Κοστίζει $10 input / $50 output ανά εκατομμύριο tokens.
Ποια είναι η διαφορά μεταξύ Fable 5 και Mythos 5;
Είναι το ίδιο μοντέλο αιχμής με διαφορετικές στάσεις κυκλοφορίας. Το Fable 5 είναι δημόσιο και προστατευμένο· επιστρέφει στο Opus 4.8 σε επικίνδυνα ερωτήματα. Το Mythos 5 είναι η έκδοση πλήρους δυνατότητας υπό περιορισμό, προσβάσιμη μόνο μέσω του προγράμματος Project Glasswing της Anthropic για ελεγμένους αμυνόμενους και ερευνητές.
Είναι το Claude Fable 5 πραγματικά καλύτερο από το Opus 4.8;
Ναι στον δύσκολο agentic προγραμματισμό, την όραση και τον χωρικό συλλογισμό: το Fable 5 πιάνει 80,3% στο SWE-Bench Pro έναντι 69,2% του Opus 4.8. Αλλά το Opus 4.8 κερδίζει ακόμα στη δουλειά υψηλού όγκου ευαίσθητη στο κόστος και το Fable 5 επιστρέφει στο Opus 4.8 για θέματα υψηλού ρίσκου σε cyber/bio/chem ούτως ή άλλως. Το «καλύτερο» εξαρτάται από τη δουλειά σου.
Πόσο κοστίζει το Claude Fable 5;
Το Claude Fable 5 κοστίζει $10 ανά εκατομμύριο input tokens και $50 ανά εκατομμύριο output tokens. Η παρουσίαση της Anthropic είναι «λιγότερο από το μισό της τιμής του Mythos Preview». Αυτό είναι περίπου 2× το Opus 4.8 ανά token, αλλά η υπόθεση αξίας είναι ανά ολοκληρωμένη εργασία, αφού το Fable 5 ολοκληρώνει δουλειά που φθηνότερα μοντέλα δεν μπορούν.
Τι είναι ένα μοντέλο «κλάσης Mythos»;
Η κλάση Mythos είναι η νέα κορυφαία βαθμίδα δυνατοτήτων της Anthropic, που κυκλοφόρησε με το Fable 5 και το Mythos 5. Αντιπροσωπεύει ένα άλμα αιχμής πέρα από τη σειρά Opus 4.x στα benchmarks προγραμματισμού και συλλογισμού. Το Fable 5 και το Mythos 5 είναι δύο εκδόσεις κυκλοφορίας του ίδιου μοντέλου κλάσης Mythos: μία δημόσια και προστατευμένη, μία υπό περιορισμό.
Γιατί το Fable 5 επιστρέφει στο Opus 4.8;
Το Fable 5 τρέχει classifiers που εντοπίζουν αιτήματα υψηλού ρίσκου (επιθετικό cyber, bio, chem ή απόσταξη μοντέλου) και τα δρομολογεί στο Opus 4.8 αντί να απαντήσει με πλήρη δυνατότητα κλάσης Mythos. Αυτό ενεργοποιείται σε λιγότερο από 5% των sessions. Μείωσε την επιτυχία ανταγωνιστικών επιθέσεων από 56,6% (Opus 4.8) σε 5,4%.
Μπορώ να αποκτήσω πρόσβαση στο Claude Mythos 5;
Μάλλον όχι. Το Mythos 5 είναι υπό περιορισμό πίσω από το Project Glasswing, το ελεγμένο πρόγραμμα πρόσβασης της Anthropic για αμυνόμενους και ερευνητές ασφαλείας που χρειάζονται πλήρη επιθετική cyber δυνατότητα που το Fable 5 μπλοκάρει. Οι περισσότεροι developers δεν θα πληρούν τις προϋποθέσεις και δεν χρειάζεται, αφού το Fable 5 καλύπτει την καθημερινή agentic δουλειά και προγραμματισμό.
Πού μπορώ να χρησιμοποιήσω το Claude Fable 5;
Το Claude Fable 5 είναι γενικά διαθέσιμο στο Anthropic API, το AWS Bedrock, το GitHub Copilot και το Harvey. Είναι δωρεάν στα πλάνα Pro, Max, Team και Enterprise ανά θέση έως τις 22 Ιουνίου 2026· credits χρήσης ισχύουν από τις 23 Ιουνίου. Μπορείς να το δοκιμάσεις στον editor σου ή μέσω API ήδη από σήμερα.
Το Συμπέρασμα
Το Claude Fable 5 είναι ένα πραγματικό βήμα αιχμής πέρα από το Opus 4.8: 80,3% έναντι 69,2% στο SWE-Bench Pro, διπλάσιο σκορ FrontierCode και ποσοστό επιτυχίας επίθεσης 5,4% που το κάνει πολύ ασφαλέστερο να αναπτυχθεί με εργαλεία. Άλλαξε για δύσκολο agentic προγραμματισμό, εργασίες μεγάλου ορίζοντα και δουλειά όρασης. Μείνε στο Opus 4.8 για όγκο ευαίσθητο στο κόστος ή οτιδήποτε ενεργοποιεί την εφεδρεία ούτως ή άλλως. Είναι δωρεάν έως τις 22 Ιουνίου, άρα μπορείς να δοκιμάσεις την αλλαγή πριν σου κοστίσει οτιδήποτε. Η ομάδα της Techsy χτίζει production agents ακριβώς σε αυτό το stack, άρα επικοινώνησε αν θέλεις ένα χέρι.