Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ
Πώς οι δημοφιλείς εθνικοί ιστότοποι κάθε χώρας της ΕΕ αντιμετωπίζουν στο robots.txt τα AI crawlers αναζήτησης και εκπαίδευσης, και πόσοι δημοσιεύουν llms.txt.
Ενημερώθηκε · Μήνας δείγματος 08/2026 · 4.645 από 5.400 ιστοτόπους μετρήθηκαν σε 27 χώρες · Φάκελος Τύπου
Βασικά ευρήματα
- Το 10% των ιστοτόπων που μετρήθηκαν αποκλείει στο robots.txt τουλάχιστον ένα AI crawler αναζήτησης ή απαντήσεων.
- Το 17% αποκλείει τουλάχιστον ένα AI crawler εκπαίδευσης.
- Το 82% δεν αποκλείει κανένα AI crawler.
- Το 9% των ιστοτόπων που μπορέσαμε να ελέγξουμε δημοσιεύει έγκυρο αρχείο llms.txt.
- Ο AI crawler που αποκλείεται συχνότερα είναι ο CCBot: τον αποκλείει το 14% των ιστοτόπων που μετρήθηκαν.
10%
Αποκλείουν AI crawler αναζήτησης ή απαντήσεων
17%
Αποκλείουν AI crawler εκπαίδευσης
82%
Δεν αποκλείουν κανένα AI crawler
9%
Δημοσιεύουν έγκυρο llms.txt
Ανά χώρα
Πρώτα εμφανίζεται το σύνολο της ΕΕ και μετά οι χώρες, από το μεγαλύτερο ποσοστό στο μικρότερο.
| Χώρα | Μετρήθηκαν | Αποκλ. AI αναζήτησης | Αποκλ. AI εκπαίδευσης | Κανένας αποκλ. | llms.txt |
|---|---|---|---|---|---|
| ΕΕ (27 χώρες) | 4.645 | 10% | 17% | 82% | 9% |
| Ελλάδα | 169 | 5% | 11% | 88% | 8% |
| Γερμανία | 184 | 27% | 43% | 55% | 5% |
| Ιταλία | 165 | 22% | 30% | 68% | 5% |
| Γαλλία | 166 | 20% | 25% | 72% | 5% |
| Σουηδία | 189 | 17% | 24% | 75% | 6% |
| Φινλανδία | 188 | 16% | 22% | 78% | 8% |
| Κάτω Χώρες | 176 | 16% | 22% | 76% | 10% |
| Ιρλανδία | 178 | 16% | 20% | 79% | 9% |
| Ισπανία | 160 | 16% | 24% | 75% | 6% |
| Δανία | 178 | 13% | 19% | 80% | 17% |
| Βέλγιο | 174 | 11% | 16% | 80% | 9% |
| Τσεχία | 186 | 11% | 20% | 78% | 11% |
| Αυστρία | 175 | 10% | 19% | 79% | 5% |
| Ρουμανία | 171 | 8% | 13% | 84% | 18% |
| Πορτογαλία | 170 | 8% | 14% | 84% | 8% |
| Εσθονία | 167 | 7% | 10% | 88% | 10% |
| Λουξεμβούργο | 174 | 7% | 11% | 88% | 8% |
| Λετονία | 165 | 7% | 8% | 90% | 7% |
| Πολωνία | 181 | 7% | 24% | 71% | 11% |
| Κύπρος | 163 | 6% | 9% | 91% | 9% |
| Σλοβακία | 174 | 4% | 10% | 88% | 9% |
| Μάλτα | 154 | 4% | 8% | 92% | 18% |
| Βουλγαρία | 157 | 4% | 11% | 87% | 9% |
| Κροατία | 170 | 4% | 9% | 88% | 10% |
| Ουγγαρία | 175 | 2% | 7% | 91% | 10% |
| Σλοβενία | 178 | 2% | 4% | 93% | 11% |
| Λιθουανία | 158 | 1% | 6% | 92% | 13% |
Αποκλεισμός ανά AI crawler
| Crawler | Χρήση | Ιστότοποι που το αποκλείουν |
|---|---|---|
GPTBot · OpenAI | Εκπαίδευση μοντέλων | 14% |
OAI-SearchBot · OpenAI | Αναζήτηση και απαντήσεις AI | 7% |
ChatGPT-User · OpenAI | Αναζήτηση και απαντήσεις AI | 8% |
ClaudeBot · Anthropic | Εκπαίδευση μοντέλων | 12% |
Claude-SearchBot · Anthropic | Αναζήτηση και απαντήσεις AI | 5% |
Claude-User · Anthropic | Αναζήτηση και απαντήσεις AI | 5% |
PerplexityBot · Perplexity | Αναζήτηση και απαντήσεις AI | 8% |
Perplexity-User · Perplexity | Αναζήτηση και απαντήσεις AI | 5% |
Google-Extended · Google | Άλλες χρήσεις AI | 11% |
Applebot-Extended · Apple | Άλλες χρήσεις AI | 9% |
meta-externalagent · Meta | Άλλες χρήσεις AI | 10% |
Amazonbot · Amazon | Άλλες χρήσεις AI | 12% |
CCBot | Εκπαίδευση μοντέλων | 14% |
Περιλαμβάνονται οι ιστότοποι που αποκλείουν εξ ορισμού κάθε crawler (User-agent: *): το 3% όσων μετρήθηκαν.
Μεθοδολογία
Δείγμα: για καθεμία από τις 27 χώρες της ΕΕ, οι πρώτοι 200 ιστότοποι με το εθνικό domain της χώρας (π.χ. .de ή .gr) ανάμεσα στους 10.000 ιστοτόπους που επισκέφθηκαν περισσότερο οι χρήστες του Chrome στη χώρα αυτή τον μήνα 08/2026. Ένας ιστότοπος ανά καταχωρημένο domain, μόνο ασφαλείς (https) ιστότοποι. Πηγή: Chrome UX Report (Google, CC BY 4.0).
Ο crawler μας δηλώνεται ως RankProofBot και ακολουθεί το robots.txt κάθε ιστοτόπου. Μία φορά τον μήνα διαβάζει το robots.txt, το /llms.txt και την αρχική σελίδα, με ένα αίτημα τη φορά ανά ιστότοπο.
Ένας ιστότοπος αποκλείει ένα crawler όταν το robots.txt του απαγορεύει την αρχική σελίδα σε αυτό το crawler σύμφωνα με τους τυπικούς κανόνες (RFC 9309), μαζί με τους κανόνες για όλα τα crawlers. 755 από τους 5.400 ιστοτόπους δεν μετρούν στα ποσοστά: το robots.txt απάντησε με έλεγχο bot, όριο αιτημάτων ή σφάλμα διακομιστή, ή ο ιστότοπος δεν ήταν προσβάσιμος.
Ένα αρχείο llms.txt θεωρείται έγκυρο όταν είναι αρχείο κειμένου που ξεκινά με επικεφαλίδα Markdown, όπως ορίζει η πρόταση llms.txt. Ελέγχθηκαν 4.260 ιστότοποι.
Κανένας ιστότοπος δεν κατονομάζεται: αποθηκεύονται και δημοσιεύονται μόνο σύνολα ανά χώρα.
Φάκελος Τύπου: παράθεση, αναφορά και αναδημοσίευση
Στοιχεία έτοιμα για παράθεση από τον πιο πρόσφατο μήνα της μελέτης, το καθένα με την πηγή του.
Στοιχεία έτοιμα για παράθεση (5)
-
«Το 10% των ιστοτόπων που μετρήθηκαν αποκλείει στο robots.txt τουλάχιστον ένα AI crawler αναζήτησης ή απαντήσεων.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)
-
«Το 17% αποκλείει τουλάχιστον ένα AI crawler εκπαίδευσης.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)
-
«Το 82% δεν αποκλείει κανένα AI crawler.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)
-
«Το 9% των ιστοτόπων που μπορέσαμε να ελέγξουμε δημοσιεύει έγκυρο αρχείο llms.txt.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)
-
«Ο AI crawler που αποκλείεται συχνότερα είναι ο CCBot: τον αποκλείει το 14% των ιστοτόπων που μετρήθηκαν.» — RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ, 08/2026 (4.645 ιστότοποι σε 27 χώρες της ΕΕ)
Λήψη δεδομένων
Ελεύθερη επαναχρησιμοποίηση με αναφορά στο RankProof και σύνδεσμο σε αυτή τη σελίδα. CC BY 4.0
Πώς να αναφέρετε αυτό το dataset
RankProof Research, «Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ», 2026. https://rankproof.eu/el/research/ai-crawler-access-eu
Γραμμή πηγής με σύνδεσμο (HTML)
<a href="https://rankproof.eu/el/research/ai-crawler-access-eu">Πηγή: RankProof, Αποκλεισμός AI crawlers στους ιστοτόπους της ΕΕ (08/2026)</a> (<a href="https://creativecommons.org/licenses/by/4.0/">CC BY 4.0</a>) Δωρεάν εργαλεία για το θέμα
Οδηγοί για το θέμα
Μετράται κάθε μήνα, μόλις δημοσιευτεί η νέα μηνιαία λίστα.