AI readiness των ελληνικών sites 2026: ποιοι ανοίγουν και ποιοι κλείνουν την πόρτα στα AI

Ελέγξαμε τα 500 δημοφιλέστερα ελληνικά domains (.gr) για το πώς αντιμετωπίζουν τα AI crawlers και τις μηχανές απαντήσεων. Το 12,4% μπλοκάρει ρητά τουλάχιστον ένα AI crawler, το 11,8% έχει llms.txt και το 62,7% έχει δομημένα δεδομένα στην αρχική σελίδα. Τα περισσότερα sites δεν έχουν πάρει ακόμη συνειδητή απόφαση για τα AI.

Του Ζαννέτου Γεωργίου · Δεδομένα: Οκτώβριος 2026 · Δείγμα: 500 domains, λίστα Tranco PY35J

Βασικά ευρήματα

  • Το 12,4% των δημοφιλέστερων ελληνικών sites μπλοκάρει ρητά τουλάχιστον ένα AI crawler στο robots.txt.
  • Το 8,4% μπλοκάρει crawlers εκπαίδευσης (π.χ. GPTBot, CCBot) αλλά αφήνει ανοιχτούς τους crawlers αναζήτησης του ChatGPT και του Perplexity.
  • Μόνο το 5,5% κλείνει την πόρτα σε crawler αναζήτησης AI, δηλαδή σε εκείνους που φέρνουν αναφορές και επισκέψεις.
  • Αρχείο llms.txt βρέθηκε στο 11,8% των sites. 19 από τα 53 είχαν δημιουργηθεί αυτόματα από plugin SEO.
  • Δομημένα δεδομένα (JSON-LD) έχει η αρχική σελίδα του 62,7%, αλλά FAQPage μόνο το 2,0%.

Ποια AI crawlers μπλοκάρουν τα ελληνικά sites

Από τα 500 domains, διαβάσαμε το robots.txt σε 419. Η πρώτη στήλη μετρά τα sites που αναφέρουν ονομαστικά το crawler και του απαγορεύουν όλο το site. Η δεύτερη προσθέτει όσα κλείνουν όλο το site σε κάθε bot με «User-agent: *», που επηρεάζει και τα AI crawlers.

CrawlerΕταιρεία / χρήσηΡητό μπλοκάρισμαΜαζί με «User-agent: *»
CCBotCommon Crawl34 (8,1%)41 (9,8%)
GPTBotOpenAI (εκπαίδευση)33 (7,9%)39 (9,3%)
ClaudeBotAnthropic20 (4,8%)33 (7,9%)
BytespiderByteDance19 (4,5%)32 (7,6%)
Google-ExtendedGoogle (Gemini εκπαίδευση)14 (3,3%)27 (6,4%)
Applebot-ExtendedApple Intelligence11 (2,6%)24 (5,7%)
meta-externalagentMeta AI10 (2,4%)23 (5,5%)
PerplexityBotPerplexity8 (1,9%)23 (5,5%)
OAI-SearchBotOpenAI (αναζήτηση ChatGPT)4 (1,0%)19 (4,5%)
ChatGPT-UserChatGPT (χρήστης)3 (0,7%)15 (3,6%)

Τα πιο συχνά μπλοκαρισμένα είναι τα crawlers που συλλέγουν δεδομένα για εκπαίδευση μοντέλων: GPTBot, CCBot και ClaudeBot. Αντίθετα, το OAI-SearchBot και το ChatGPT-User, που χρησιμοποιεί το ChatGPT για να βρει και να παραθέσει πηγές σε πραγματικό χρόνο, μπλοκάρονται ρητά πολύ σπάνια. Στα 100 πρώτα domains το ποσοστό με ρητό μπλοκάρισμα είναι 14,9%, ενώ στα υπόλοιπα 11,7%.

Το 8,4% των sites ακολουθεί μια συγκεκριμένη πολιτική: κλείνει τα crawlers εκπαίδευσης και αφήνει ανοιχτά όσα φέρνουν αναφορές. Έτσι ένα site προστατεύει το περιεχόμενό του από την εκπαίδευση μοντέλων, χωρίς να χάνει την προβολή στις απαντήσεις AI με παραπομπές.

llms.txt: λίγοι το έχουν, πολλοί από plugin

Το llms.txt είναι μια πρόταση για ένα αρχείο Markdown στη ρίζα του site, που συνοψίζει τι κάνει ο οργανισμός και ποιες σελίδες είναι οι σημαντικότερες. Το βρήκαμε στο 11,8% των 448 sites που φόρτωσαν (53 sites).

Είδος llms.txtSites
Γραμμένο ειδικά (Markdown)31
Αυτόματο από Yoast SEO14
Αυτόματο από Rank Math5
Οδηγίες τύπου robots.txt (λάθος μορφή)3

Το 35,8% δημιουργήθηκε αυτόματα από τα plugins Yoast SEO και Rank Math του WordPress, συχνά χωρίς κανένα επιμελημένο κείμενο. 3 sites έγραψαν μέσα οδηγίες «Allow» και «User-agent», σαν να ήταν robots.txt, κάτι που τα AI crawlers δεν διαβάζουν ως οδηγία. Δεν υπάρχει μέχρι σήμερα δημόσια ένδειξη ότι το llms.txt αυξάνει μόνο του τις αναφορές στις απαντήσεις AI. Περισσότερα στο άρθρο μας για το llms.txt.

Δομημένα δεδομένα και τεχνικά σήματα στην αρχική σελίδα

Τα AI συστήματα και η Google καταλαβαίνουν πιο εύκολα ποιος είναι ένας οργανισμός όταν η αρχική του σελίδα το δηλώνει με δομημένα δεδομένα. Στα 448 sites που φόρτωσαν μετρήσαμε:

ΣήμαSitesΠοσοστό
JSON-LD στην αρχική28162,7%
Organization ή παρόμοιος τύπος24254,0%
WebSite21347,5%
BreadcrumbList7516,7%
FAQPage92,0%
Meta description34977,9%
hreflang (οποιαδήποτε γλώσσα)11024,6%
hreflang με αγγλική έκδοση9020,1%
Χωρίς δήλωση γλώσσας (<html lang>)224,9%

Τα περισσότερα JSON-LD που βρήκαμε είναι τα βασικά Organization και WebSite, συνήθως από το θέμα ή το plugin SEO. Πιο εξειδικευμένοι τύποι, όπως FAQPage ή LocalBusiness, είναι σπάνιοι στην αρχική σελίδα. Από τα 12 sites του δημοσίου (.gov.gr) που φόρτωσαν, μόνο 1 είχε JSON-LD και κανένα llms.txt.

Τι σημαίνει για μια ελληνική επιχείρηση

  • Αποφασίστε συνειδητά για τα AI crawlers. Αν θέλετε να εμφανίζεστε ως πηγή στο ChatGPT, στο Perplexity και στη Google, μην μπλοκάρετε τα OAI-SearchBot, ChatGPT-User, PerplexityBot και Googlebot. Το GPTBot και το Google-Extended αφορούν την εκπαίδευση μοντέλων και είναι ξεχωριστή απόφαση.
  • Ελέγξτε τι κάνει ο πάροχος ή το plugin σας. Ορισμένα CDN και plugins ασφαλείας μπλοκάρουν bots χωρίς να το ξέρετε. Στο δείγμα μας 17 αρχικές σελίδες απάντησαν με 401, 403 ή 429 στο αυτοματοποιημένο αίτημά μας.
  • Βάλτε βασικά δομημένα δεδομένα. Organization ή LocalBusiness με τα σωστά στοιχεία, WebSite, και FAQPage μόνο όπου οι ερωτήσεις φαίνονται στη σελίδα. Δείτε τι είναι το schema markup.
  • Το llms.txt είναι προαιρετικό. Αν το βάλετε, γράψτε το με το χέρι, σε Markdown, με σύντομη περιγραφή και τις σημαντικότερες σελίδες. Ένα αυτόματο αρχείο χωρίς επιμέλεια δεν προσθέτει πολλά.
  • Περιεχόμενο που απαντά. Τα AI παραθέτουν σελίδες που δίνουν σαφή απάντηση. Περισσότερα για το AEO και τις υπηρεσίες AEO.

Μεθοδολογία

Δείγμα. Τα πρώτα 500 καταχωρισμένα domains με κατάληξη .gr στη λίστα Tranco (ID PY35J), που κατατάσσει τα δημοφιλέστερα sites του κόσμου συνδυάζοντας πολλές πηγές. Το δείγμα αντιπροσωπεύει τα πολυσύχναστα ελληνικά sites (μέσα ενημέρωσης, e-shops, τράπεζες, δημόσιο, πανεπιστήμια), όχι τις μικρές επιχειρήσεις. Δεν περιλαμβάνει ελληνικά sites με κατάληξη .com ή .eu.

Συλλογή. Τον Οκτώβριο του 2026 ένα script ζήτησε από κάθε domain την αρχική σελίδα (https, με ή χωρίς www), το /robots.txt και το /llms.txt, με ένα αίτημα ανά αρχείο, όριο 15 δευτερολέπτων και User-Agent που μας ταυτοποιεί. Η αρχική σελίδα φόρτωσε σε 448 sites και το robots.txt διαβάστηκε σε 419.

Ορισμοί. «Ρητό μπλοκάρισμα» σημαίνει ότι το robots.txt έχει ομάδα που αναφέρει το crawler και του απαγορεύει τη ρίζα (/). Δεν μετρήσαμε μερικά μπλοκαρίσματα φακέλων ούτε μπλοκαρίσματα σε επίπεδο server ή CDN. Για το llms.txt μετρήσαμε απάντηση 200 με κείμενο και όχι σελίδα HTML. Τα δομημένα δεδομένα μετρήθηκαν μόνο στην αρχική σελίδα.

Περιορισμοί. Η εικόνα αφορά μία χρονική στιγμή. Sites με προστασία από bots μπορεί να εμφανίζουν διαφορετική συμπεριφορά σε κανονικούς επισκέπτες. Δεν μετρήσαμε αν τα sites εμφανίζονται πράγματι σε απαντήσεις AI. Δείτε επίσης τη γενική μεθοδολογία έρευνας και την πολιτική σύνταξης της YFO. Διορθώσεις καταγράφονται στο αρχείο διορθώσεων.

Συχνές ερωτήσεις

Μπλοκάρουν τα ελληνικά sites τα AI crawlers;

Λίγα. Στα 419 δημοφιλή ελληνικά sites με αναγνώσιμο robots.txt, το 12,4% μπλοκάρει ρητά τουλάχιστον ένα AI crawler. Τα περισσότερα μπλοκάρουν crawlers εκπαίδευσης όπως το GPTBot και το CCBot, όχι τους crawlers αναζήτησης.

Πόσα ελληνικά sites έχουν llms.txt;

Στο δείγμα μας, το 11,8% των sites που φόρτωσαν είχε αρχείο llms.txt. Αρκετά είχαν δημιουργηθεί αυτόματα από Yoast ή Rank Math και 3 περιείχαν οδηγίες τύπου robots.txt, που δεν είναι η μορφή που προβλέπει η πρόταση llms.txt.

Πρέπει να μπλοκάρω το GPTBot στο site μου;

Εξαρτάται από το τι θέλετε. Το GPTBot συλλέγει δεδομένα για εκπαίδευση μοντέλων. Το OAI-SearchBot και το ChatGPT-User χρησιμοποιούνται για αναζήτηση και απαντήσεις με παραπομπές. Αν θέλετε να εμφανίζεστε ως πηγή στο ChatGPT, μην μπλοκάρετε τους crawlers αναζήτησης.

Πώς έγινε η έρευνα;

Πήραμε τα πρώτα 500 domains .gr της λίστας Tranco (ID PY35J) και ελέγξαμε αυτόματα, με ένα αίτημα ανά αρχείο, το robots.txt, το /llms.txt και την αρχική σελίδα κάθε site, τον Οκτώβριο του 2026.

Πώς να αναφέρετε την έρευνα

Your Future Online (2026). AI readiness των ελληνικών sites 2026. https://yfo.gr/statistics/ai-readiness-ellada-2026. Μπορείτε να χρησιμοποιήσετε τα ευρήματα με αναφορά και σύνδεσμο προς αυτή τη σελίδα. Για τα αναλυτικά δεδομένα, επικοινωνήστε μαζί μας.

Είναι έτοιμο το δικό σας site για τα AI;

Ζητήστε δωρεάν έλεγχο: robots.txt, δομημένα δεδομένα και τι βλέπουν σήμερα για εσάς το ChatGPT και η Google.

Δωρεάν Έλεγχος

YFO Assistant

Καλεστε WhatsApp Μηνυμα