Μετάβαση στο περιεχόμενο
AI crawlers · μηνιαία Ζωντανό

Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ

Πώς οι δημοφιλείς εθνικοί ιστότοποι κάθε χώρας της ΕΕ αντιμετωπίζουν στο robots.txt τα AI crawlers αναζήτησης και εκπαίδευσης, και πόσοι δημοσιεύουν llms.txt.

Ενημερώθηκε · Μήνας δείγματος 08/2026 · 4.645 από 5.400 ιστοτόπους μετρήθηκαν σε 27 χώρες · Φάκελος Τύπου

Βασικά ευρήματα

  • Το 10% των ιστοτόπων που μετρήθηκαν αποκλείει στο robots.txt τουλάχιστον ένα AI crawler αναζήτησης ή απαντήσεων.
  • Το 17% αποκλείει τουλάχιστον ένα AI crawler εκπαίδευσης.
  • Το 82% δεν αποκλείει κανένα AI crawler.
  • Το 9% των ιστοτόπων που μπορέσαμε να ελέγξουμε δημοσιεύει έγκυρο αρχείο llms.txt.
  • Ο AI crawler που αποκλείεται συχνότερα είναι ο CCBot: τον αποκλείει το 14% των ιστοτόπων που μετρήθηκαν.

10%

Αποκλείουν AI crawler αναζήτησης ή απαντήσεων

17%

Αποκλείουν AI crawler εκπαίδευσης

82%

Δεν αποκλείουν κανένα AI crawler

9%

Δημοσιεύουν έγκυρο llms.txt

Ανά χώρα

Πρώτα εμφανίζεται το σύνολο της ΕΕ και μετά οι χώρες, από το μεγαλύτερο ποσοστό στο μικρότερο.

Χώρα Μετρήθηκαν Αποκλ. AI αναζήτησης Αποκλ. AI εκπαίδευσης Κανένας αποκλ. llms.txt
ΕΕ (27 χώρες) 4.645 10% 17% 82% 9%
Ελλάδα 169 5% 11% 88% 8%
Γερμανία 184 27% 43% 55% 5%
Ιταλία 165 22% 30% 68% 5%
Γαλλία 166 20% 25% 72% 5%
Σουηδία 189 17% 24% 75% 6%
Φινλανδία 188 16% 22% 78% 8%
Κάτω Χώρες 176 16% 22% 76% 10%
Ιρλανδία 178 16% 20% 79% 9%
Ισπανία 160 16% 24% 75% 6%
Δανία 178 13% 19% 80% 17%
Βέλγιο 174 11% 16% 80% 9%
Τσεχία 186 11% 20% 78% 11%
Αυστρία 175 10% 19% 79% 5%
Ρουμανία 171 8% 13% 84% 18%
Πορτογαλία 170 8% 14% 84% 8%
Εσθονία 167 7% 10% 88% 10%
Λουξεμβούργο 174 7% 11% 88% 8%
Λετονία 165 7% 8% 90% 7%
Πολωνία 181 7% 24% 71% 11%
Κύπρος 163 6% 9% 91% 9%
Σλοβακία 174 4% 10% 88% 9%
Μάλτα 154 4% 8% 92% 18%
Βουλγαρία 157 4% 11% 87% 9%
Κροατία 170 4% 9% 88% 10%
Ουγγαρία 175 2% 7% 91% 10%
Σλοβενία 178 2% 4% 93% 11%
Λιθουανία 158 1% 6% 92% 13%
Αποκλεισμός ανά AI crawler
Crawler Χρήση Ιστότοποι που το αποκλείουν
GPTBot · OpenAI Εκπαίδευση μοντέλων 14%
OAI-SearchBot · OpenAI Αναζήτηση και απαντήσεις AI 7%
ChatGPT-User · OpenAI Αναζήτηση και απαντήσεις AI 8%
ClaudeBot · Anthropic Εκπαίδευση μοντέλων 12%
Claude-SearchBot · Anthropic Αναζήτηση και απαντήσεις AI 5%
Claude-User · Anthropic Αναζήτηση και απαντήσεις AI 5%
PerplexityBot · Perplexity Αναζήτηση και απαντήσεις AI 8%
Perplexity-User · Perplexity Αναζήτηση και απαντήσεις AI 5%
Google-Extended · Google Άλλες χρήσεις AI 11%
Applebot-Extended · Apple Άλλες χρήσεις AI 9%
meta-externalagent · Meta Άλλες χρήσεις AI 10%
Amazonbot · Amazon Άλλες χρήσεις AI 12%
CCBot Εκπαίδευση μοντέλων 14%

Περιλαμβάνονται οι ιστότοποι που αποκλείουν εξ ορισμού κάθε crawler (User-agent: *): το 3% όσων μετρήθηκαν.

Μεθοδολογία

Δείγμα: για καθεμία από τις 27 χώρες της ΕΕ, οι πρώτοι 200 ιστότοποι με το εθνικό domain της χώρας (π.χ. .de ή .gr) ανάμεσα στους 10.000 ιστοτόπους που επισκέφθηκαν περισσότερο οι χρήστες του Chrome στη χώρα αυτή τον μήνα 08/2026. Ένας ιστότοπος ανά καταχωρημένο domain, μόνο ασφαλείς (https) ιστότοποι. Πηγή: Chrome UX Report (Google, CC BY 4.0).

Ο crawler μας δηλώνεται ως RankProofBot και ακολουθεί το robots.txt κάθε ιστοτόπου. Μία φορά τον μήνα διαβάζει το robots.txt, το /llms.txt και την αρχική σελίδα, με ένα αίτημα τη φορά ανά ιστότοπο.

Ένας ιστότοπος αποκλείει ένα crawler όταν το robots.txt του απαγορεύει την αρχική σελίδα σε αυτό το crawler σύμφωνα με τους τυπικούς κανόνες (RFC 9309), μαζί με τους κανόνες για όλα τα crawlers. 755 από τους 5.400 ιστοτόπους δεν μετρούν στα ποσοστά: το robots.txt απάντησε με έλεγχο bot, όριο αιτημάτων ή σφάλμα διακομιστή, ή ο ιστότοπος δεν ήταν προσβάσιμος.

Ένα αρχείο llms.txt θεωρείται έγκυρο όταν είναι αρχείο κειμένου που ξεκινά με επικεφαλίδα Markdown, όπως ορίζει η πρόταση llms.txt. Ελέγχθηκαν 4.260 ιστότοποι.

Κανένας ιστότοπος δεν κατονομάζεται: αποθηκεύονται και δημοσιεύονται μόνο σύνολα ανά χώρα.

Φάκελος Τύπου: παράθεση, αναφορά και αναδημοσίευση

Στοιχεία έτοιμα για παράθεση από τον πιο πρόσφατο μήνα της μελέτης, το καθένα με την πηγή του.

Στοιχεία έτοιμα για παράθεση (5)
  • «Το 10% των ιστοτόπων που μετρήθηκαν αποκλείει στο robots.txt τουλάχιστον ένα AI crawler αναζήτησης ή απαντήσεων.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)

  • «Το 17% αποκλείει τουλάχιστον ένα AI crawler εκπαίδευσης.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)

  • «Το 82% δεν αποκλείει κανένα AI crawler.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)

  • «Το 9% των ιστοτόπων που μπορέσαμε να ελέγξουμε δημοσιεύει έγκυρο αρχείο llms.txt.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)

  • «Ο AI crawler που αποκλείεται συχνότερα είναι ο CCBot: τον αποκλείει το 14% των ιστοτόπων που μετρήθηκαν.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)

Λήψη δεδομένων

Ελεύθερη επαναχρησιμοποίηση με αναφορά στο RankProof και σύνδεσμο σε αυτή τη σελίδα. CC BY 4.0

Πώς να αναφέρετε αυτό το dataset

RankProof Research, «Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ», 2026. https://rankproof.eu/el/research/ai-crawler-access-eu

Γραμμή πηγής με σύνδεσμο (HTML)

<a href="https://rankproof.eu/el/research/ai-crawler-access-eu">Πηγή: RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ (08/2026)</a> (<a href="https://creativecommons.org/licenses/by/4.0/">CC BY 4.0</a>)

Μετράται κάθε μήνα, μόλις δημοσιευτεί η νέα μηνιαία λίστα.