Το Claude Opus 5.5 της Anthropic κυκλοφόρησε σήμερα 22 Σεπτεμβρίου και κοστίζει 40% λιγότερο από το Opus 5 σε τυπική χρήση.
Το Claude Opus 5.5, που η Anthropic παρουσίασε σήμερα 22 Σεπτεμβρίου, κοστίζει στην πράξη 40% λιγότερο από το Opus 5 και τα πηγαίνει καλύτερα σχεδόν σε κάθε τεστ. Είναι το πρώτο μοντέλο της οικογένειας Claude 5.5 και, κατά την εταιρεία, στις περισσότερες δουλειές φτάνει το επίπεδο του Claude Fable 5.1. Τα Sonnet 5.5 και Haiku 5.5 ακολουθούν τις επόμενες εβδομάδες.
Πόσο κοστίζει και πού είναι διαθέσιμο
Το Claude Opus 5.5 βγαίνει φθηνότερο επειδή χρειάζεται λιγότερη υπολογιστική ισχύ και ξοδεύει λιγότερα tokens για την ίδια δουλειά. Οι τιμές στο API, ανά εκατομμύριο tokens:
- Input: 4 δολάρια (περίπου 3,50 ευρώ), από 5 στο Opus 5
- Output: 20 δολάρια (περίπου 17,50 ευρώ), από 25
- Cache reads: 0,20 δολάρια (περίπου 0,18 ευρώ), από 0,50
- Cache writes: 5 δολάρια (περίπου 4,40 ευρώ), από 6,25
- Fast mode, έως 2,5x ταχύτερο: 8 δολάρια input / 40 δολάρια output (περίπου 7 και 35 ευρώ)
Η μεγαλύτερη πτώση, 60%, είναι στα cache reads, όπου πάει το μεγαλύτερο κομμάτι του λογαριασμού όταν το μοντέλο γράφει κώδικα ή δουλεύει ως agent. Η παραγωγή κειμένου είναι πάνω από 30% πιο γρήγορη.
Όσοι πληρώνουν Pro ή Max παίρνουν αυξημένα πεντάωρα όρια χρήσης, το ίδιο και οι ομάδες στο Team, μαζί με ένα reset ορίων που μπορούν να φυλάξουν για όποτε το χρειαστούν. Το μοντέλο είναι ήδη διαθέσιμο σε όλες τις πλατφόρμες, μαζί με AWS, Google Cloud και Microsoft Azure. Στην Ευρώπη τα κείμενά του φέρουν υδατογράφημα, όπως και του Fable 5.1, για να καλύπτεται ο AI Act.
Τι δείχνουν τα benchmarks και πού χάνει
- Terminal-Bench 4.0 (κώδικας): 66,4%, με το Fable 5.1 στο 55,8% και το Opus 5 στο 52,3%
- CursorBench 4.0: 57,8%, έναντι 46,6% του Opus 5
- GDPval-AA v2.1 (εργασίες 44 επαγγελμάτων): 1846 Elo, έναντι 1735 του Fable 5.1
- OSWorld 2.0 (χρήση υπολογιστή): 81,8%
Δεν κερδίζει παντού. Στο AutomationBench της Zapier το GPT-6 Astra της OpenAI έχει 41,4% έναντι 40%, και στο Terminal-Bench-Science η απόσταση μεγαλώνει σε 64,6% έναντι 58,7%. Η ίδια η Anthropic λέει ότι στην καθημερινή χρήση οι επιδώσεις του Opus 5.5 και του Fable 5.1 είναι πιο κοντά απ’ όσο δείχνουν τα νούμερα.
Η διαφορά φαίνεται καθαρά στο κόστος ανά εργασία. Στη μεσαία ρύθμιση προσπάθειας, το Opus 5.5 περνάει το GPT-6 Astra στο FrontierCode με περίπου το ένα πέμπτο του κόστους.
Newsletter Techblog
Κάθε Παρασκευή στις 19:00 —
smartphones, προσφορές, επιλογές. Χωρίς spam.
Με την εγγραφή σας αποδέχεστε την Πολιτική Απορρήτου.
Μεγάλα έργα κώδικα σε ώρες
Ένας tester ολοκλήρωσε μετάβαση κώδικα 680.000 γραμμών σε λιγότερο από μία μέρα. Άλλος διόρθωσε codebase 200.000 γραμμών σε κάτω από τρεις ώρες, εκεί που το Opus 5 ήθελε πάνω από 20.
Σε εσωτερικό τεστ, το Opus 5.5 και το Fable 5.1 ξαναέγραψαν το HAProxy από C σε Rust. Και τα δύο πέρασαν σχεδόν όλα τα regression tests, αλλά το Opus 5.5 τελείωσε σε 9,5 ώρες αντί για 12 και κόστισε 51% λιγότερο.
Γράφει πιο καθαρά από το Opus 5;
Ναι, και ήταν από τα πιο συχνά παράπονα για τον προκάτοχό του. Το Opus 5.5 βάζει την ουσία στην αρχή, κόβει την ορολογία και ακολουθεί τους κανόνες γραφής που του δίνεις.
Σε τεστ όπου έγραφε αναφορά για τα τριμηνιαία μιας εταιρείας, 16 από τις 18 αναφορές του πέρασαν έλεγχο που απέρριπτε κάθε επινοημένο αριθμό. Fable 5.1 και Opus 5 δεν πέρασαν σε καμία προσπάθεια.
Ποιες εργασίες θα «κόβονται» για λόγους ασφαλείας
Το Opus 5.5 είναι το πρώτο Opus με δικλίδες ασφαλείας ίδιας κατηγορίας με το Fable 5.1, επειδή στη βιολογία και την κυβερνοασφάλεια φτάνει τις ικανότητες του Claude Mythos 5.1. Τα bugs στον δικό σου κώδικα τα διορθώνει κανονικά, όμως οι περισσότερες εργασίες κυβερνοασφάλειας περνούν αυτόματα στο παλιότερο Opus 4.8. Οι επαγγελματίες του χώρου θα αποκτήσουν πρόσβαση μέσω του Cyber Verification Program τις επόμενες εβδομάδες, ενώ για έρευνα βιολογίας οι αιτήσεις στο Life Sciences Verification Program ανοίγουν από σήμερα.
Είναι η πρώτη κυκλοφορία μετά την έκκληση του CEO Dario Amodei να «πάρει ανάσα» η εξέλιξη της AI. Στον έλεγχο συμπεριφοράς της Anthropic, με σχεδόν 2.000 σενάρια, πήρε την καλύτερη βαθμολογία μέχρι σήμερα και προσπάθησε να παρακάμψει τα όριά του περίπου 85% λιγότερο συχνά από το Opus 5. Η εταιρεία παραδέχεται πάντως ότι συχνά καταλαβαίνει πότε το τεστάρουν.
Για developers: το thinking δεν απενεργοποιείται πια, και το preserved thinking κατά του distillation ισχύει για λογαριασμούς API από τις 31 Αυγούστου 2026.
Η άποψή μας στο Techblog
Η ουσία της είδησης είναι το 40% χαμηλότερο κόστος, περισσότερο από τα benchmarks, γιατί από αυτό εξαρτάται πόσο θα πληρώνουμε για τις εφαρμογές που τρέχουν πάνω στο Claude. Για όσους έχουν συνδρομή, τα μεγαλύτερα όρια και οι πιο σύντομες απαντήσεις θα φανούν από την πρώτη μέρα. Το αγκάθι είναι η αυτόματη μεταφορά εργασιών κυβερνοασφάλειας στο Opus 4.8, που θα εκνευρίσει όσους δουλεύουν στον χώρο μέχρι να ανοίξει το πρόγραμμα πιστοποίησης.
Σχόλια