Πανελλαδικές 2026 · ανεξάρτητη έρευνα
Και τα έξι διάλεξαν θετική κατεύθυνση.
Έξι μοντέλα τεχνητής νοημοσύνης έγραψαν και τα δέκα μαθήματα των φετινών Πανελλαδικών, με τα πραγματικά θέματα του υπουργείου. Χωρίς εξαίρεση, το καλύτερό τους πεδίο είναι το 2ο· πέντε στα έξι έχουν χειρότερο τις ανθρωπιστικές. Δύο θα έμπαιναν στην Ιατρική — το ένα ακριβώς στη βάση, 18.900 στα 18.900.
Γιώργος Ζαρκάδας · 28 Ιουλίου 2026 · πώς το μετρήσαμε
Σε ποια σχολή θα περνούσαν
Η ανώτερη σχολή που θα άνοιγαν οι βαθμοί τους, με τις βάσεις του 2026.
| Μοντέλο | 1ο Ανθρωπιστικές | 2ο Θετικές | 3ο Υγείας | 4ο Οικονομίας |
|---|---|---|---|---|
| GPT-5.5 | 18.400 Νομικής ΕΚΠΑ | 19.100 Ηλεκτρολόγων Μηχανικών & Μηχ. Υπολογιστών ΕΜΠ | 18.900 Ιατρικής ΕΚΠΑ | 18.700 Διοικητικής Επιστήμης & Τεχνολογίας ΟΠΑ |
| Gemini 3.5 Flash | 18.150 Νομικής ΕΚΠΑ | 19.550 Ηλεκτρολόγων Μηχανικών & Μηχ. Υπολογιστών ΕΜΠ | 19.200 Ιατρικής ΕΚΠΑ | 18.800 Διοικητικής Επιστήμης & Τεχνολογίας ΟΠΑ |
| Claude Opus 4.8 | 17.100 Ψυχολογίας Πάντειο | 18.600 Ναυπηγών Μηχανολόγων Μηχανικών ΕΜΠ | 17.250 Νοσηλευτικής ΕΚΠΑ | 18.400 Πληροφορικής ΑΠΘ |
| Claude Haiku 4.5 | 13.950 | 16.850 Χημείας Παν. Πατρών | 15.100 Νοσηλευτικής ΕΚΠΑ | 16.750 Οργάνωσης & Διοίκησης Επιχειρήσεων Παν. Πειραιά |
| Mistral Large 3 | 14.600 Παιδαγωγικό Δημοτικής Εκπαίδευσης Παν. Θεσσαλίας | 15.900 Επιστήμης Υπολογιστών Παν. Κρήτης | 14.200 Μαιευτικής ΠΑΔΑ | 15.350 Χρηματοοικονομικής & Τραπεζικής Διοικητικής Παν. Πειραιά |
| GPT-5.4 mini | 14.150 Παιδαγωγικό Δημοτικής Εκπαίδευσης Παν. Ιωαννίνων | 16.000 Παιδαγωγικό Δημοτικής Εκπαίδευσης ΕΚΠΑ | 14.900 Νοσηλευτικής ΕΚΠΑ | 15.100 Χρηματοοικονομικής & Τραπεζικής Διοικητικής Παν. Πειραιά |
Μόρια = μέσος όρος των τεσσάρων γραπτών του πεδίου × 1.000. Οι συντελεστές βαρύτητας δεν εφαρμόζονται: κάθε τμήμα ορίζει δικούς του, 20–30% ανά μάθημα (ΦΕΚ 7145/Β/30-12-2025), ενώ εδώ τα τέσσερα μαθήματα μετρούν ίσα. Η διαφορά είναι μερικές εκατοντάδες μόρια και μπορεί να αντιστρέψει οριακές περιπτώσεις.
Εξαιρούνται όσες σχολές απαιτούν κάτι πέρα από τα τέσσερα γραπτά — ειδικό μάθημα (σχέδιο, ξένη γλώσσα), αγωνίσματα, ή στρατιωτικές/αστυνομικές/πυροσβεστικές με επιπλέον προϋποθέσεις. Το μοντέλο δεν μπορεί να τα δώσει, άρα τα μόρια δεν θα ήταν συγκρίσιμα.
Ποιο μοντέλο, σε ποιο μάθημα
Ο βαθμός κάθε μοντέλου σε καθένα από τα δέκα μαθήματα, στα 20. Από το μάθημα που πήγαν καλύτερα προς αυτό που πήγαν χειρότερα.
| Μάθημα | GPT 5.5 | Gemini 3.5 | Claude Opus | Claude Haiku | Mistral L3 | GPT 5.4 mini |
|---|---|---|---|---|---|---|
| Φυσική | 19,6 | 20,0 | 19,4 | 18,0 | 17,8 | 18,6 |
| Μαθηματικά | 19,2 | 19,8 | 19,6 | 18,0 | 16,6 | 14,8 |
| Γλώσσα | 18,6 | 19,2 | 18,8 | 17,2 | 15,4 | 16,0 |
| Λατινικά | 19,0 | 19,4 | 18,2 | 15,4 | 16,6 | 16,2 |
| Πληροφορική | 18,0 | 19,2 | 18,8 | 16,4 | 14,8 | 14,0 |
| ΑΟΘ | 19,0 | 17,0 | 16,4 | 15,4 | 14,6 | 15,6 |
| Χημεία | 19,0 | 19,2 | 16,6 | 14,2 | 13,8 | 14,6 |
| Αρχαία | 19,2 | 19,0 | 18,6 | 13,2 | 14,0 | 13,0 |
| Βιολογία | 18,4 | 18,4 | 14,2 | 11,0 | 9,8 | 10,4 |
| Ιστορία | 16,8 | 15,0 | 12,8 | 10,0 | 12,4 | 11,4 |
Χρώμα μπαίνει μόνο εκεί που ο βαθμός αδυνατεί: πάνω από 17 το κελί μένει χαρτί, όπως σε διορθωμένο γραπτό δεν γράφεται τίποτα πάνω στο σωστό.
Κάθε βαθμός εδώ ανοίγει σε ολόκληρο το γραπτό, με την εκφώνηση και τον λόγο που χάθηκε η κάθε μονάδα. Δες ένα ερώτημα όπου το Gemini 3.5 Flash έχασε 10 από τις 18 μονάδες — Οικονομία (ΑΟΘ), σε γραπτό που πήρε 17,0. Ή το χαμηλότερο γραπτό όλου του benchmark — Βιολογία, 9,8.
Η εξέταση ολόκληρη, σε μία εικόνα Και τα 894 βαθμολογημένα κελιά, ένα ανά υποερώτημα και μοντέλο
Η κατάταξη
Μέσος όρος στα δέκα μαθήματα. Από εδώ προκύπτουν όλα τα παραπάνω.
- 1 GPT-5.5 OpenAI · Απρίλιος 2026 · 10 μαθήματα 18,7
- 2 Gemini 3.5 Flash Google · Μάιος 2026 · 10 μαθήματα 18,6
- 3 Claude Opus 4.8 Anthropic · Μάιος 2026 · 10 μαθήματα 17,3
- 4 Claude Haiku 4.5 Anthropic · Οκτώβριος 2025 · 10 μαθήματα 14,9
- 5 Mistral Large 3 Mistral AI · Δεκέμβριος 2025 · 10 μαθήματα 14,6
- 6 GPT-5.4 mini OpenAI · Μάρτιος 2026 · 10 μαθήματα 14,5
Οι μπάρες είναι σχεδόν ίσες, και αυτό είναι το εύρημα — όχι ελάττωμα του γραφήματος. Δύο μοντέλα που απέχουν λιγότερο από μισή μονάδα στα 20 πρέπει να διαβάζονται ως ισοβαθμία.
Πού χάνονται οι μονάδες
Από τα 894 βαθμολογημένα υποερωτήματα, τα 337 έχασαν μονάδες. Ο βαθμολογητής ταξινόμησε το καθένα — και η πιο συχνή αιτία δεν είναι η διατύπωση, είναι η ίδια η έννοια.
- εννοιολογικό 48%
- ελλιπής τεκμηρίωση 37%
- αντίφαση 7%
- υπολογιστικό 5%
- παραίσθηση 2%
- παρανόηση εκφώνησης 1%
Τι δεν ισχυριζόμαστε
Η έρευνα είναι όσο καλή όσο και τα όριά της. Αυτά είναι τα δικά μας.
Γνωστά όρια
- Δεν μετράμε νοημοσύνη. Είναι μία εξέταση, ένα γραπτό ανά μοντέλο και ανά μάθημα.
- Η ακρίβεια της βαθμολόγησης είναι ±3 μονάδες στα 100. Η πρώτη θέση είναι ισοβαθμία, και το δηλώνουμε εμείς.
- Βαθμολόγησε μοντέλο, όχι βαθμολογητής Βαθμολογικού Κέντρου. Ο δικός μας κανόνας είναι δημόσιος και ο ίδιος για όλους· όπου το ΙΕΠ δημοσιεύει δείκτες — στη Γλώσσα — τους ακολουθούμε.
- Η εξέταση δεν ρωτάει αν ξέρεις οικονομία· ρωτάει αν ξέρεις ΑΟΘ — και το ίδιο ισχύει για τον υποψήφιο. Χαμηλός βαθμός στην Ιστορία σημαίνει ότι το μοντέλο δεν ξέρει το σχολικό βιβλίο, όχι απαραίτητα ότι δεν ξέρει ιστορία.
- Τα μοντέλα δεν γράφουν με το χέρι, σε τρεις ώρες, με άγχος. Καμία σύγκριση με υποψήφιο δεν είναι σύγκριση συνθηκών.
- Οι προτεινόμενες λύσεις που χρησιμοποιήθηκαν ως αναφορά είναι φροντιστηρίων, όχι επίσημες.
60 βαθμολογημένα γραπτά σε 10 από 10 μαθήματα. · Η πλήρης μεθοδολογία · όλα τα γραπτά και οι βαθμολογίες στο GitHub