PluginProbe ʕ •ᴥ•ʔ
Independent Analytics – WordPress Analytics Plugin / 2.15.3
Independent Analytics – WordPress Analytics Plugin v2.15.3
2.15.5 2.15.4 2.15.3 2.15.2 2.15.1 2.15.0 2.14.10 trunk 1.1 1.10 1.10.1 1.11 1.12 1.13 1.14 1.15 1.16 1.17 1.17.1 1.17.2 1.17.3 1.17.4 1.18 1.18.1 1.19.0 1.19.1 1.2 1.20.0 1.21.0 1.22.0 1.22.1 1.23.0 1.23.1 1.24.0 1.24.1 1.25.0 1.25.1 1.26.0 1.27.0 1.28.0 1.28.1 1.28.2 1.28.3 1.29.0 1.3 1.30.0 1.30.1 1.4 1.5 1.6 1.7 1.8 1.9 2.0.0 2.0.1 2.1.4 2.1.5 2.1.6 2.10.0 2.10.1 2.10.2 2.10.3 2.10.4 2.11.0 2.11.1 2.11.10 2.11.2 2.11.3 2.11.4 2.11.5 2.11.6 2.11.7 2.11.8 2.11.9 2.12.0 2.12.1 2.12.2 2.13.1 2.13.2 2.13.5 2.13.6 2.14.0 2.14.1 2.14.2 2.14.4 2.14.6 2.14.7 2.14.8 2.14.9 2.2.0 2.2.1 2.3.1 2.3.2 2.4.2 2.4.3 2.5.0 2.5.1 2.6.0 2.6.1 2.6.2 2.6.3 2.6.4 2.7.0 2.7.1 2.7.2 2.7.3 2.8.2 2.8.3 2.8.4 2.8.5 2.8.6 2.8.7 2.8.8 2.8.9 2.9.2 2.9.3 2.9.4 2.9.5 2.9.6 2.9.7
independent-analytics / vendor / matomo / device-detector / regexes / bots.yml
independent-analytics / vendor / matomo / device-detector / regexes Last commit date
client 1 month ago device 1 month ago bots.yml 1 month ago oss.yml 1 month ago vendorfragments.yml 2 years ago
bots.yml
5872 lines
1 ###############
2 # Device Detector - The Universal Device Detection library for parsing User Agents
3 #
4 # @link https://matomo.org
5 # @license http://www.gnu.org/licenses/lgpl.html LGPL v3 or later
6 ###############
7
8 - regex: 'WireReaderBot'
9 name: 'WireReaderBot'
10 category: 'Feed Fetcher'
11 url: 'https://wirereader.app/'
12
13 - regex: 'monitoring360bot'
14 name: '360 Monitoring'
15 category: 'Site Monitor'
16 url: 'https://www.360monitoring.io'
17 producer:
18 name: 'Plesk International GmbH'
19 url: 'https://www.plesk.com'
20
21 - regex: 'Cloudflare-Healthchecks'
22 name: 'Cloudflare Health Checks'
23 category: 'Service Agent'
24 url: 'https://developers.cloudflare.com/health-checks/'
25 producer:
26 name: 'CloudFlare'
27 url: 'https://www.cloudflare.com/'
28
29 - regex: '(360Spider(?:-Image|-Video)?)'
30 name: '$1'
31 category: 'Search bot'
32 url: 'https://www.so.com/help/help_3_2.html'
33 producer:
34 name: 'Online Media Group, Inc.'
35 url: ''
36
37 - regex: 'Aboundex'
38 name: 'Aboundexbot'
39 category: 'Search bot'
40 url: 'http://www.aboundex.com/crawler/'
41 producer:
42 name: 'Aboundex.com'
43 url: 'http://www.aboundex.com'
44
45 - regex: 'AcoonBot'
46 name: 'Acoon'
47 category: 'Search bot'
48 url: 'http://www.acoon.de/robot.asp'
49 producer:
50 name: 'Acoon GmbH'
51 url: 'http://www.acoon.de'
52
53 - regex: 'AddThis\.com'
54 name: 'AddThis.com'
55 category: 'Social Media Agent'
56 url: ''
57 producer:
58 name: 'Clearspring Technologies, Inc.'
59 url: 'http://www.clearspring.com'
60
61 - regex: 'AhrefsBot'
62 name: 'aHrefs Bot'
63 category: 'Crawler'
64 url: 'https://ahrefs.com/robot'
65 producer:
66 name: 'Ahrefs Pte Ltd'
67 url: 'https://ahrefs.com/robot'
68
69 - regex: 'AhrefsSiteAudit'
70 name: 'AhrefsSiteAudit'
71 category: 'Site Monitor'
72 url: 'https://ahrefs.com/robot/site-audit'
73 producer:
74 name: 'Ahrefs Pte Ltd'
75 url: 'https://ahrefs.com/'
76
77 - regex: 'ia_archiver|alexabot|verifybot'
78 name: 'Alexa Crawler'
79 category: 'Search bot'
80 url: 'https://support.alexa.com/hc/en-us/sections/200100794-Crawlers'
81 producer:
82 name: 'Alexa Internet'
83 url: 'https://www.alexa.com'
84
85 - regex: 'alexa site audit'
86 name: 'Alexa Site Audit'
87 category: 'Site Monitor'
88 url: 'https://support.alexa.com/hc/en-us/articles/200450194'
89 producer:
90 name: 'Alexa Internet'
91 url: 'https://www.alexa.com'
92
93 - regex: 'Amazonbot-Video'
94 name: 'Amazonbot-Video'
95 category: 'Crawler'
96 url: 'https://developer.amazon.com/support/amazonbot'
97 producer:
98 name: 'Amazon.com, Inc.'
99 url: 'https://www.amazon.com/'
100
101 - regex: 'Amazonbot'
102 name: 'Amazonbot'
103 category: 'AI Search Crawler'
104 url: 'https://developer.amazon.com/amazonbot'
105 producer:
106 name: 'Amazon.com, Inc.'
107 url: 'https://www.amazon.com/'
108
109 - regex: 'Amzn-SearchBot'
110 name: 'Amzn-SearchBot'
111 category: 'AI Search Crawler'
112 url: 'https://developer.amazon.com/amazonbot'
113 producer:
114 name: 'Amazon.com, Inc.'
115 url: 'https://www.amazon.com/'
116
117 - regex: 'Amzn-User'
118 name: 'Amzn-User'
119 category: 'AI Assistant'
120 url: 'https://developer.amazon.com/amazonbot'
121 producer:
122 name: 'Amazon.com, Inc.'
123 url: 'https://www.amazon.com/'
124
125 - regex: 'AmazonAdBot'
126 name: 'Amazon AdBot'
127 category: 'Crawler'
128 url: 'https://adbot.amazon.com/'
129 producer:
130 name: 'Amazon.com, Inc.'
131 url: 'https://www.amazon.com/'
132
133 - regex: 'NovaAct'
134 name: 'NovaAct'
135 category: 'AI Agent'
136 url: 'https://nova.amazon.com/act'
137 producer:
138 name: 'Amazon.com, Inc.'
139 url: 'https://www.amazon.com/'
140
141 - regex: 'AmazonBuyForMe'
142 name: 'AmazonBuyForMe'
143 category: 'AI Agent'
144 url: 'https://buyforme.amazon/'
145 producer:
146 name: 'Amazon.com, Inc.'
147 url: 'https://www.amazon.com/'
148
149 - regex: 'amazon-kendra'
150 name: 'Amazon Kendra'
151 category: 'Crawler'
152 url: 'https://docs.aws.amazon.com/kendra/latest/dg/stop-web-crawler.html'
153 producer:
154 name: 'Amazon.com, Inc.'
155 url: 'https://www.amazon.com/'
156
157 - regex: 'Amazon[ -]Route ?53[ -]Health[ -]Check[ -]Service'
158 name: 'Amazon Route53 Health Check'
159 category: 'Service Agent'
160 producer:
161 name: 'Amazon Web Services'
162 url: 'https://aws.amazon.com/'
163
164 - regex: 'AmorankSpider'
165 name: 'Amorank Spider'
166 category: 'Crawler'
167 url: 'http://amorank.com/webcrawler.html'
168 producer:
169 name: 'Amorank'
170 url: 'http://www.amorank.com'
171
172 - regex: 'ApacheBench'
173 name: 'ApacheBench'
174 category: 'Benchmark'
175 url: 'https://httpd.apache.org/docs/2.4/programs/ab.html'
176 producer:
177 name: 'The Apache Software Foundation'
178 url: 'https://www.apache.org/foundation/'
179
180 - regex: 'Apache/'
181 name: 'Apache'
182 category: 'Service Agent'
183 url: 'https://www.apache.org/'
184 producer:
185 name: 'The Apache Software Foundation'
186 url: 'https://www.apache.org/foundation/'
187
188 - regex: 'Applebot-Extended'
189 name: 'Applebot-Extended'
190 category: 'AI Data Scraper'
191 url: 'https://support.apple.com/en-us/119829'
192 producer:
193 name: 'Apple Inc'
194 url: 'https://www.apple.com/'
195
196 - regex: 'Applebot'
197 name: 'Applebot'
198 category: 'AI Search Crawler'
199 url: 'https://support.apple.com/en-us/119829'
200 producer:
201 name: 'Apple Inc'
202 url: 'https://www.apple.com/'
203
204 - regex: 'iTMS'
205 name: 'iTMS'
206 category: 'Crawler'
207 url: 'https://support.apple.com/en-us/119829'
208 producer:
209 name: 'Apple Inc'
210 url: 'https://www.apple.com/'
211
212 - regex: 'AppSignalBot'
213 name: 'AppSignalBot'
214 category: 'Site Monitor'
215 url: 'https://docs.appsignal.com/uptime-monitoring/'
216 producer:
217 name: 'AppSignal'
218 url: 'https://appsignal.com/'
219
220 - regex: 'Arachni'
221 name: 'Arachni'
222 category: 'Security Checker'
223 url: 'https://www.arachni-scanner.com/'
224 producer:
225 name: 'Sarosys LLC'
226 url: 'https://www.sarosys.com/'
227
228 - regex: 'AspiegelBot'
229 name: 'AspiegelBot'
230 category: 'Crawler'
231 url: 'https://aspiegel.com/'
232 producer:
233 name: 'Huawei'
234 url: 'https://www.huawei.com/'
235
236 - regex: 'Castro 2, Episode Duration Lookup'
237 name: 'Castro 2'
238 category: 'Service Agent'
239 url: 'http://supertop.co/castro/'
240 producer:
241 name: 'Supertop'
242 url: 'http://supertop.co'
243
244 - regex: 'Curious George'
245 name: 'Analytics SEO Crawler'
246 category: 'Crawler'
247 url: 'http://www.analyticsseo.com/crawler'
248 producer:
249 name: 'Analytics SEO'
250 url: 'http://www.analyticsseo.com'
251
252 - regex: 'archive\.org_bot|special_archiver'
253 name: 'archive.org bot'
254 category: 'Crawler'
255 url: 'https://archive.org/details/archive.org_bot'
256 producer:
257 name: 'The Internet Archive'
258 url: 'https://archive.org'
259
260 - regex: 'Ask Jeeves/Teoma'
261 name: 'Ask Jeeves'
262 category: 'Search bot'
263 url: ''
264 producer:
265 name: 'Ask Jeeves Inc.'
266 url: 'http://www.ask.com'
267
268 - regex: 'Backlink-Check\.de'
269 name: 'Backlink-Check.de'
270 category: 'Crawler'
271 url: 'http://www.backlink-check.de/bot.html'
272 producer:
273 name: 'Mediagreen Medienservice'
274 url: 'http://www.backlink-check.de'
275
276 - regex: 'BacklinkCrawler'
277 name: 'BacklinkCrawler'
278 category: 'Crawler'
279 url: 'http://www.backlinktest.com/crawler.html'
280 producer:
281 name: '2.0Promotion GbR'
282 url: 'http://www.backlinktest.com'
283
284 - regex: 'Baidu.*spider|baidu Transcoder'
285 name: 'Baidu Spider'
286 category: 'Search bot'
287 url: 'http://www.baidu.com/search/spider.htm'
288 producer:
289 name: 'Baidu'
290 url: 'http://www.baidu.com'
291
292 - regex: 'BazQux'
293 name: 'BazQux Reader'
294 url: 'https://bazqux.com/fetcher'
295 category: 'Feed Fetcher'
296 producer:
297 name: ''
298 url: ''
299
300 - regex: 'Better Uptime Bot'
301 name: 'Better Uptime Bot'
302 category: 'Site Monitor'
303 url: 'https://betteruptime.com/faq'
304 producer:
305 name: 'Better Uptime'
306 url: 'https://betteruptime.com/'
307
308 - regex: 'MSNBot|msrbot|bingbot|bingadsbot|BingPreview|msnbot-(UDiscovery|NewsBlogs)|adidxbot'
309 name: 'BingBot'
310 category: 'Search bot'
311 url: 'http://search.msn.com/msnbot.htmn'
312 producer:
313 name: 'Microsoft Corporation'
314 url: 'http://www.microsoft.com'
315
316 - regex: 'Blackbox Exporter'
317 name: 'Blackbox Exporter'
318 category: 'Site Monitor'
319 url: 'https://github.com/prometheus/blackbox_exporter'
320 producer:
321 name: 'Prometheus'
322 url: 'https://prometheus.io/'
323
324 - regex: 'Blekkobot'
325 name: 'Blekkobot'
326 category: 'Search bot'
327 url: 'http://blekko.com/about/blekkobot'
328 producer:
329 name: 'Blekko'
330 url: 'http://blekko.com'
331
332 - regex: 'BLEXBot'
333 name: 'BLEXBot Crawler'
334 category: 'Crawler'
335 url: 'http://webmeup-crawler.com'
336 producer:
337 name: 'WebMeUp'
338 url: 'http://webmeup.com'
339
340 - regex: 'Bloglovin'
341 name: 'Bloglovin'
342 url: 'http://www.bloglovin.com'
343 category: 'Feed Fetcher'
344 producer:
345 name: ''
346 url: ''
347
348 - regex: 'Blogtrottr'
349 name: 'Blogtrottr'
350 url: ''
351 category: 'Feed Fetcher'
352 producer:
353 name: 'Blogtrottr Ltd'
354 url: 'https://blogtrottr.com/'
355
356 - regex: 'BoardReader Blog Indexer'
357 name: 'BoardReader Blog Indexer'
358 category: 'Crawler'
359 producer:
360 name: 'BoardReader'
361 url: 'https://boardreader.com/'
362
363 - regex: 'BountiiBot'
364 name: 'Bountii Bot'
365 category: 'Search bot'
366 url: 'http://bountii.com/contact.php'
367 producer:
368 name: 'Bountii Inc.'
369 url: 'http://bountii.com'
370
371 - regex: 'Browsershots'
372 name: 'Browsershots'
373 category: 'Service Agent'
374 url: 'http://browsershots.org/faq'
375 producer:
376 name: 'Browsershots.org'
377 url: 'http://browsershots.org'
378
379 - regex: 'BUbiNG'
380 name: 'BUbiNG'
381 category: 'Crawler'
382 url: 'http://law.di.unimi.it/BUbiNG.html'
383 producer:
384 name: 'The Laboratory for Web Algorithmics (LAW)'
385 url: 'http://law.di.unimi.it/software.php#buging'
386
387 - regex: '(?<!HTC)[ _]Butterfly/'
388 name: 'Butterfly Robot'
389 category: 'Search bot'
390 url: 'http://labs.topsy.com/butterfly'
391 producer:
392 name: 'Topsy Labs'
393 url: 'http://labs.topsy.com'
394
395 - regex: 'CareerBot'
396 name: 'CareerBot'
397 category: 'Crawler'
398 url: 'http://www.career-x.de/bot.html'
399 producer:
400 name: 'career-x GmbH'
401 url: 'http://www.career-x.de'
402
403 - regex: 'CCBot'
404 name: 'ccBot crawler'
405 category: 'Crawler'
406 url: 'http://commoncrawl.org/faq/'
407 producer:
408 name: 'reddit inc.'
409 url: 'http://www.reddit.com'
410
411 - regex: 'Cliqzbot'
412 name: 'Cliqzbot'
413 category: 'Crawler'
414 url: 'http://cliqz.com/company/cliqzbot'
415 producer:
416 name: '10betterpages GmbH'
417 url: 'http://cliqz.com'
418
419 - regex: 'Cloudflare-AMP'
420 name: 'CloudFlare AMP Fetcher'
421 category: 'Crawler'
422 url: 'https://amp.cloudflare.com/doc/fetcher.html'
423 producer:
424 name: 'CloudFlare'
425 url: 'http://www.cloudflare.com'
426
427 - regex: 'Cloudflare-?Diagnostics'
428 name: 'Cloudflare Diagnostics'
429 category: 'Site Monitor'
430 url: 'https://www.cloudflare.com/'
431 producer:
432 name: 'Cloudflare'
433 url: 'https://www.cloudflare.com/'
434
435 - regex: 'CloudFlare-AlwaysOnline'
436 name: 'CloudFlare Always Online'
437 category: 'Site Monitor'
438 url: 'https://www.cloudflare.com/always-online'
439 producer:
440 name: 'CloudFlare'
441 url: 'https://www.cloudflare.com/'
442
443 - regex: 'Cloudflare-SSLDetector'
444 name: 'Cloudflare SSL Detector'
445 category: 'Site Monitor'
446 url: 'https://developers.cloudflare.com/fundamentals/reference/cloudflare-site-crawling/'
447 producer:
448 name: 'CloudFlare'
449 url: 'https://www.cloudflare.com/'
450
451 - regex: 'Cloudflare Custom Hostname Verification'
452 name: 'Cloudflare Custom Hostname Verification'
453 category: 'Service Agent'
454 url: 'https://developers.cloudflare.com/fundamentals/reference/cloudflare-site-crawling/'
455 producer:
456 name: 'CloudFlare'
457 url: 'https://www.cloudflare.com/'
458
459 - regex: 'Cloudflare-Traffic-Manager'
460 name: 'Cloudflare Traffic Manager'
461 category: 'Site Monitor'
462 url: 'https://developers.cloudflare.com/fundamentals/reference/cloudflare-site-crawling/'
463 producer:
464 name: 'CloudFlare'
465 url: 'https://www.cloudflare.com/'
466
467 - regex: 'Cloudflare-Smart-Transit'
468 name: 'Cloudflare Smart Transit'
469 category: 'Site Monitor'
470 url: 'https://developers.cloudflare.com/fundamentals/reference/cloudflare-site-crawling/'
471 producer:
472 name: 'CloudFlare'
473 url: 'https://www.cloudflare.com/'
474
475 - regex: 'CloudflareObservatory'
476 name: 'Cloudflare Observatory'
477 category: 'Site Monitor'
478 url: 'https://developers.cloudflare.com/speed/speed-test/run-speed-test'
479 producer:
480 name: 'CloudFlare'
481 url: 'https://www.cloudflare.com/'
482
483 - regex: 'https://developers\.cloudflare\.com/security-center/'
484 name: 'Cloudflare Security Insights'
485 category: 'Site Monitor'
486 url: 'https://developers.cloudflare.com/fundamentals/reference/cloudflare-site-crawling/'
487 producer:
488 name: 'CloudFlare'
489 url: 'https://www.cloudflare.com/'
490
491 - regex: 'coccoc\.com'
492 name: 'Cốc Cốc Bot'
493 url: 'https://help.coccoc.com/en/search-engine/coccoc-robots'
494 category: 'Search bot'
495 producer:
496 name: 'Cốc Cốc'
497 url: 'https://coccoc.com/'
498
499 - regex: 'collectd'
500 name: 'Collectd'
501 url: 'https://collectd.org/'
502 category: 'Site Monitor'
503 producer:
504 name: 'Collectd'
505 url: 'https://collectd.org/'
506
507 - regex: 'CommaFeed'
508 name: 'CommaFeed'
509 url: 'http://www.commafeed.com'
510 category: 'Feed Fetcher'
511 producer:
512 name: ''
513 url: ''
514
515 - regex: 'CSS Certificate Spider'
516 name: 'CSS Certificate Spider'
517 category: 'Crawler'
518 url: 'http://www.css-security.com/certificatespider/'
519 producer:
520 name: 'Certified Security Solutions'
521 url: 'https://www.css-security.com/company/about-us/'
522
523 - regex: 'Datadog Agent|Datadog/?Synthetics'
524 name: 'Datadog Agent'
525 url: 'https://github.com/DataDog/dd-agent'
526 category: 'Site Monitor'
527 producer:
528 name: 'Datadog'
529 url: 'https://www.datadoghq.com/'
530
531 - regex: 'Datanyze'
532 name: 'Datanyze'
533 url: ''
534 category: 'Crawler'
535 producer:
536 name: 'Datanyze'
537 url: 'https://www.datanyze.com'
538
539 - regex: 'Dataprovider'
540 name: 'Dataprovider'
541 category: 'Crawler'
542 url: ''
543 producer:
544 name: 'Dataprovider B.V.'
545 url: 'https://www.dataprovider.com/'
546
547 - regex: 'Daum(?!(?:Apps|Device))'
548 name: 'Daum'
549 category: 'Search bot'
550 url: 'http://tab.search.daum.net/aboutWebSearch_en.html'
551 producer:
552 name: 'Daum Communications Corp.'
553 url: 'http://www.kakaocorp.com/main'
554
555 - regex: 'Dazoobot'
556 name: 'Dazoobot'
557 category: 'Search bot'
558 url: ''
559 producer:
560 name: 'DAZOO.FR'
561 url: 'http://dazoo.fr'
562
563 - regex: 'discobot'
564 name: 'Discobot'
565 category: 'Search bot'
566 url: 'http://discoveryengine.com/discobot.html'
567 producer:
568 name: 'Discovery Engine'
569 url: 'http://discoveryengine.com'
570
571 - regex: 'Domain Re-Animator Bot|support@domainreanimator\.com'
572 name: 'Domain Re-Animator Bot'
573 category: 'Crawler'
574 url: ''
575 producer:
576 name: 'Domain Re-Animator, LLC'
577 url: 'http://domainreanimator.com'
578
579 - regex: 'DotBot'
580 name: 'DotBot'
581 category: 'Crawler'
582 url: 'http://www.opensiteexplorer.org/dotbot'
583 producer:
584 name: 'SEOmoz, Inc.'
585 url: 'http://moz.com/'
586
587 - regex: 'DuckDuck(?:Go-Favicons-)?Bot'
588 name: 'DuckDuckBot'
589 category: 'Search bot'
590 url: 'https://duckduckgo.com/duckduckgo-help-pages/results/duckduckbot/'
591 producer:
592 name: 'DuckDuckGo'
593 url: 'https://duckduckgo.com/'
594
595 - regex: 'DuckAssistBot'
596 name: 'DuckAssistBot'
597 category: 'AI Assistant'
598 url: 'https://duckduckgo.com/duckduckgo-help-pages/results/duckassistbot/'
599 producer:
600 name: 'DuckDuckGo'
601 url: 'https://duckduckgo.com/'
602
603 - regex: 'EasouSpider'
604 name: 'Easou Spider'
605 category: 'Search bot'
606 url: 'http://www.easou.com/search/spider.html'
607 producer:
608 name: 'easou ICP'
609 url: 'http://www.easou.com'
610
611 - regex: 'eCairn-Grabber'
612 name: 'eCairn-Grabber'
613 category: 'Crawler'
614 producer:
615 name: 'eCairn'
616 url: 'https://ecairn.com'
617
618 - regex: 'EMail Exractor'
619 name: 'EMail Exractor'
620 category: 'Crawler'
621 url: ''
622 producer:
623 name: ''
624 url: ''
625
626 - regex: 'evc-batch'
627 name: 'evc-batch'
628 category: 'Crawler'
629 url: ''
630 producer:
631 name: 'eVenture Capital Partners II, LLC'
632 url: 'http://www.eventures.vc/'
633
634 - regex: 'Exabot|ExaleadCloudview'
635 name: 'ExaBot'
636 category: 'Crawler'
637 url: 'http://www.exabot.com/go/robot'
638 producer:
639 name: 'Dassault Systèmes'
640 url: 'http://www.3ds.com'
641
642 - regex: 'ExactSeek Crawler'
643 name: 'ExactSeek Crawler'
644 category: 'Search bot'
645 url: 'http://www.exactseek.com'
646 producer:
647 name: 'Jayde Online, Inc.'
648 url: 'http://www.jaydeonlineinc.com'
649
650 - regex: 'Ezooms'
651 name: 'Ezooms'
652 category: 'Crawler'
653 url: ''
654 producer:
655 name: 'SEOmoz, Inc.'
656 url: 'http://moz.com/'
657
658 - regex: 'facebook(?:catalog|externalhit|externalua|platform|scraper)'
659 name: 'Facebook Crawler'
660 category: 'Social Media Agent'
661 url: 'https://developers.facebook.com/docs/sharing/webmasters/web-crawlers'
662 producer:
663 name: 'Meta Platforms, Inc.'
664 url: 'https://www.meta.com/'
665
666 - regex: 'meta-externalagent'
667 name: 'Meta-ExternalAgent'
668 category: 'AI Assistant'
669 url: 'https://developers.facebook.com/docs/sharing/webmasters/web-crawlers'
670 producer:
671 name: 'Meta Platforms, Inc.'
672 url: 'https://www.meta.com/'
673
674 - regex: 'meta-externalfetcher'
675 name: 'Meta-ExternalFetcher'
676 category: 'Social Media Agent'
677 url: 'https://developers.facebook.com/docs/sharing/webmasters/web-crawlers'
678 producer:
679 name: 'Meta Platforms, Inc.'
680 url: 'https://www.meta.com/'
681
682 - regex: 'meta-webindexer'
683 name: 'Meta-WebIndexer'
684 category: 'Social Media Agent'
685 url: 'https://developers.facebook.com/docs/sharing/webmasters/web-crawlers'
686 producer:
687 name: 'Meta Platforms, Inc.'
688 url: 'https://www.meta.com/'
689
690 - regex: 'meta-externalads'
691 name: 'Meta-ExternalAds'
692 category: 'Social Media Agent'
693 url: 'https://developers.facebook.com/docs/sharing/webmasters/web-crawlers'
694 producer:
695 name: 'Meta Platforms, Inc.'
696 url: 'https://www.meta.com/'
697
698 - regex: 'FacebookBot'
699 name: 'FacebookBot'
700 category: 'Crawler'
701 url: 'https://developers.facebook.com/docs/sharing/bot'
702 producer:
703 name: 'Meta Platforms, Inc.'
704 url: 'https://www.meta.com/'
705
706 - regex: 'Feedbin'
707 name: 'Feedbin'
708 url: 'http://feedbin.com/'
709 category: 'Feed Fetcher'
710 producer:
711 name: ''
712 url: ''
713
714 - regex: 'FeedBurner'
715 name: 'FeedBurner'
716 url: 'http://www.feedburner.com'
717 category: 'Feed Fetcher'
718 producer:
719 name: ''
720 url: ''
721
722 - regex: 'Feed Wrangler'
723 name: 'Feed Wrangler'
724 url: 'https://feedwrangler.net/'
725 category: 'Feed Fetcher'
726 producer:
727 name: 'David Smith & Developing Perspective, LLC'
728 url: 'https://david-smith.org'
729
730 - regex: 'Feedly'
731 name: 'Feedly'
732 url: 'http://www.feedly.com'
733 category: 'Feed Fetcher'
734 producer:
735 name: ''
736 url: ''
737
738 - regex: 'Feedspot'
739 name: 'Feedspot'
740 url: 'http://www.feedspot.com'
741 category: 'Feed Fetcher'
742 producer:
743 name: ''
744 url: ''
745
746 - regex: 'Fever/'
747 name: 'Fever'
748 url: 'http://feedafever.com/'
749 category: 'Feed Fetcher'
750 producer:
751 name: ''
752 url: ''
753
754 - regex: 'FlipboardProxy|FlipboardRSS'
755 name: 'Flipboard'
756 url: 'http://flipboard.com/browserproxy'
757 category: 'Feed Fetcher'
758 producer:
759 name: 'Flipboard'
760 url: 'http://flipboard.com/'
761
762 - regex: 'Findxbot'
763 name: 'Findxbot'
764 category: 'Crawler'
765 url: 'http://www.findxbot.com'
766
767 - regex: 'FreshRSS'
768 name: 'FreshRSS'
769 category: 'Feed Fetcher'
770 url: 'https://freshrss.org/'
771
772 - regex: 'Genieo'
773 name: 'Genieo Web filter'
774 category: ''
775 url: 'http://www.genieo.com/webfilter.html'
776 producer:
777 name: 'Genieo'
778 url: 'http://www.genieo.com'
779
780 - regex: 'GigablastOpenSource'
781 name: 'Gigablast'
782 category: 'Search bot'
783 url: 'https://github.com/gigablast/open-source-search-engine'
784 producer:
785 name: 'Matt Wells'
786 url: 'http://www.gigablast.com/faq.html'
787
788 - regex: 'Gluten Free Crawler'
789 name: 'Gluten Free Crawler'
790 category: 'Crawler'
791 url: 'http://glutenfreepleasure.com/'
792 producer:
793 name: ''
794 url: ''
795
796 - regex: 'gobuster'
797 name: 'Gobuster'
798 url: 'https://github.com/OJ/gobuster'
799
800 - regex: 'ichiro'
801 name: 'Goo'
802 category: 'Search bot'
803 url: 'http://search.goo.ne.jp/option/use/sub4/sub4-1'
804 producer:
805 name: 'NTT Resonant'
806 url: 'http://goo.ne.jp'
807
808 - regex: 'Storebot-Google'
809 name: 'Google StoreBot'
810 category: 'Crawler'
811
812 - regex: 'Google Favicon'
813 name: 'Google Favicon'
814 category: 'Crawler'
815
816 - regex: 'Google Search Console'
817 name: 'Google Search Console'
818 category: 'Crawler'
819 url: 'https://search.google.com/search-console/about'
820 producer:
821 name: 'Google Inc.'
822 url: 'https://www.google.com/'
823
824 - regex: 'Google Page Speed Insights'
825 name: 'Google PageSpeed Insights'
826 category: 'Site Monitor'
827 url: 'http://developers.google.com/speed/pagespeed/insights/'
828 producer:
829 name: 'Google Inc.'
830 url: 'https://www.google.com/'
831
832 - regex: 'google_partner_monitoring'
833 name: 'Google Partner Monitoring'
834 category: 'Site Monitor'
835 url: ''
836 producer:
837 name: 'Google Inc.'
838 url: 'https://www.google.com/'
839
840 - regex: 'Google-Cloud-Scheduler'
841 name: 'Google Cloud Scheduler'
842 category: 'Crawler'
843 url: 'https://cloud.google.com/scheduler'
844 producer:
845 name: 'Google Inc.'
846 url: 'https://www.google.com/'
847
848 - regex: 'Google-Structured-Data-Testing-Tool'
849 name: 'Google Structured Data Testing Tool'
850 category: 'Validator'
851 url: 'https://search.google.com/structured-data/testing-tool'
852 producer:
853 name: 'Google Inc.'
854 url: 'https://www.google.com/'
855
856 - regex: 'GoogleStackdriverMonitoring'
857 name: 'Google Stackdriver Monitoring'
858 category: 'Site Monitor'
859 url: 'https://docs.cloud.google.com/monitoring/uptime-checks/using-uptime-checks'
860 producer:
861 name: 'Google Inc.'
862 url: 'https://www.google.com/'
863
864 - regex: 'Google-Transparency-Report'
865 name: 'Google Transparency Report'
866 category: 'Site Monitor'
867 url: 'https://transparencyreport.google.com/'
868 producer:
869 name: 'Google Inc.'
870 url: 'https://www.google.com/'
871
872 - regex: 'Google-CloudVertexBot'
873 name: 'Google-CloudVertexBot'
874 category: 'AI Data Scraper'
875 url: 'https://developers.google.com/crawling/docs/crawlers-fetchers/google-common-crawlers#google-cloudvertexbot'
876 producer:
877 name: 'Google Inc.'
878 url: 'https://www.google.com/'
879
880 - regex: 'Google-Firebase'
881 name: 'Google-Firebase'
882 category: 'Service Agent'
883 url: 'https://developers.google.com/crawling/docs/crawlers-fetchers/verify-google-requests'
884 producer:
885 name: 'Google Inc.'
886 url: 'https://www.google.com/'
887
888 - regex: 'Google-ilp'
889 name: 'Google-ilp'
890 category: 'Crawler'
891 url: 'https://www.google.com/'
892 producer:
893 name: 'Google Inc.'
894 url: 'https://www.google.com/'
895
896 - regex: 'via ggpht\.com GoogleImageProxy'
897 name: 'Gmail Image Proxy'
898 category: 'Crawler'
899 url: ''
900 producer:
901 name: 'Google Inc.'
902 url: 'https://www.google.com/'
903
904 - regex: 'Google-Document-Conversion'
905 name: 'Google-Document-Conversion'
906 category: 'Service Agent'
907 url: 'https://support.google.com/drive/answer/176692?hl=en'
908 producer:
909 name: 'Google Inc.'
910 url: 'https://www.google.com/'
911
912 - regex: 'GoogleDocs; apps-spreadsheets'
913 name: 'Google Sheets'
914 category: 'Service Agent'
915 url: 'https://workspace.google.com/products/sheets/'
916 producer:
917 name: 'Google Inc.'
918 url: 'https://www.google.com/'
919
920 - regex: 'GoogleDocs; apps-presentations'
921 name: 'Google Slides'
922 category: 'Service Agent'
923 url: 'https://workspace.google.com/products/slides/'
924 producer:
925 name: 'Google Inc.'
926 url: 'https://www.google.com/'
927
928 - regex: 'GoogleDocs;'
929 name: 'Google Docs'
930 category: 'Service Agent'
931 url: 'https://docs.google.com/'
932 producer:
933 name: 'Google Inc.'
934 url: 'https://www.google.com/'
935
936 - regex: 'SeznamEmailProxy'
937 name: 'Seznam Email Proxy'
938 category: 'Crawler'
939 url: ''
940 producer:
941 name: 'Seznam.cz, a.s.'
942 url: 'http://www.seznam.cz/'
943
944 - regex: 'Seznam-Zbozi-robot'
945 name: 'Seznam Zbozi.cz'
946 category: 'Crawler'
947 url: ''
948 producer:
949 name: 'Seznam.cz, a.s.'
950 url: 'https://www.zbozi.cz/'
951
952 - regex: 'Heurekabot-Feed'
953 name: 'Heureka Feed'
954 category: 'Crawler'
955 url: 'https://sluzby.heureka.cz/napoveda/heurekabot/'
956 producer:
957 name: 'Heureka.cz, a.s.'
958 url: 'https://www.heureka.cz/'
959
960 - regex: 'ShopAlike'
961 name: 'ShopAlike'
962 category: 'Crawler'
963 url: ''
964 producer:
965 name: 'Visual Meta'
966 url: 'https://www.shopalike.cz/'
967
968 - regex: 'deepcrawl\.com'
969 name: 'Lumar'
970 category: 'Crawler'
971 url: 'https://www.lumar.io/spdr/'
972 producer:
973 name: 'Lumar'
974 url: 'https://www.lumar.io/'
975
976 - regex: 'Googlebot-News'
977 name: 'Googlebot News'
978 category: 'Search bot'
979 url: 'https://developers.google.com/search/docs/crawling-indexing/overview-google-crawlers'
980 producer:
981 name: 'Google Inc.'
982 url: 'https://www.google.com/'
983
984 - regex: 'Google-Site-Verification'
985 name: 'Google-Site-Verification'
986 category: 'Validator'
987 url: 'https://developers.google.com/crawling/docs/crawlers-fetchers/google-user-triggered-fetchers#google_site_verifier'
988 producer:
989 name: 'Google Inc.'
990 url: 'https://www.google.com/'
991
992 - regex: 'Google-Read-Aloud'
993 name: 'Google-Read-Aloud'
994 category: 'Crawler'
995 url: 'https://developers.google.com/crawling/docs/crawlers-fetchers/read-aloud-user-agent'
996 producer:
997 name: 'Google Inc.'
998 url: 'https://www.google.com/'
999
1000 - regex: 'Adwords-(?:DisplayAds|Express|Instant)|Google Web Preview|Google[ -]Publisher[ -]Plugin|Google-(?:adstxt|Ads-Conversions|Ads-Qualify|Adwords|AMPHTML|Assess|BusinessLinkVerification|HotelAdsVerifier|InspectionTool|Lens|PageRenderer|Shopping-Quality|Sites-Thumbnails|speakr|Stale-Content-Probe|Test|Youtube-Links)|(?:AdsBot|APIs|Feedfetcher|Mediapartners)-Google(?:-Mobile)?|Google(?:AdSenseInfeed|AssociationService|bot|Other|Prober|Producer|Sites)|Google.*/\+/web/snippet'
1001 name: 'Googlebot'
1002 category: 'Search bot'
1003 url: 'https://developers.google.com/search/docs/crawling-indexing/overview-google-crawlers'
1004 producer:
1005 name: 'Google Inc.'
1006 url: 'https://www.google.com/'
1007
1008 - regex: 'Google-NotebookLM'
1009 name: 'Google-NotebookLM'
1010 category: 'AI Assistant'
1011 url: 'https://developers.google.com/crawling/docs/crawlers-fetchers/google-user-triggered-fetchers'
1012 producer:
1013 name: 'Google Inc.'
1014 url: 'https://www.google.com/'
1015
1016 - regex: 'Google-Extended'
1017 name: 'Google-Extended'
1018 category: 'AI Data Scraper'
1019 url: 'https://developers.google.com/crawling/docs/crawlers-fetchers/google-common-crawlers'
1020 producer:
1021 name: 'Google Inc.'
1022 url: 'https://www.google.com/'
1023
1024 - regex: 'Gemini-Deep-Research'
1025 name: 'Gemini-Deep-Research'
1026 category: 'AI Assistant'
1027 url: 'https://gemini.google/overview/deep-research/'
1028 producer:
1029 name: 'Google Inc.'
1030 url: 'https://www.google.com/'
1031
1032 - regex: 'GoogleAgent-Mariner'
1033 name: 'GoogleAgent-Mariner'
1034 category: 'AI Agent'
1035 url: 'https://developers.google.com/search/docs/crawling-indexing/google-agent-mariner'
1036 producer:
1037 name: 'Google Inc.'
1038 url: 'https://www.google.com/'
1039
1040 - regex: 'GoogleAgent-Search'
1041 name: 'GoogleAgent-Search'
1042 category: 'AI Assistant'
1043 url: 'https://developers.google.com/search/docs/crawling-indexing/google-agent-search'
1044 producer:
1045 name: 'Google Inc.'
1046 url: 'https://www.google.com/'
1047
1048 - regex: 'Bard-AI'
1049 name: 'Bard-AI'
1050 category: 'AI Search Crawler'
1051 url: 'https://developers.google.com/search/docs/crawling-indexing/google-common-crawlers'
1052 producer:
1053 name: 'Google Inc.'
1054 url: 'https://www.google.com/'
1055
1056 - regex: 'Gemini-AI'
1057 name: 'Gemini-AI'
1058 category: 'AI Search Crawler'
1059 url: 'https://developers.google.com/search/docs/crawling-indexing/google-common-crawlers'
1060 producer:
1061 name: 'Google Inc.'
1062 url: 'https://www.google.com/'
1063
1064 - regex: 'Google-Pinpoint'
1065 name: 'Google-Pinpoint'
1066 category: 'AI Assistant'
1067 url: 'https://developers.google.com/crawling/docs/crawlers-fetchers/google-user-triggered-fetchers#google-pinpoint'
1068 producer:
1069 name: 'Google Inc.'
1070 url: 'https://www.google.com/'
1071
1072 - regex: '^Google$'
1073 name: 'Googlebot'
1074 category: 'Search bot'
1075 url: 'https://developers.google.com/search/docs/crawling-indexing/overview-google-crawlers'
1076 producer:
1077 name: 'Google Inc.'
1078 url: 'https://www.google.com/'
1079
1080 - regex: 'Google-Safety'
1081 name: 'Google-Safety'
1082 category: 'Crawler'
1083 url: 'https://developers.google.com/search/docs/crawling-indexing/google-special-case-crawlers'
1084 producer:
1085 name: 'Google Inc.'
1086 url: 'https://www.google.com/'
1087
1088 - regex: 'DuplexWeb-Google'
1089 name: 'DuplexWeb-Google'
1090 category: 'Crawler'
1091 url: 'https://developers.google.com/search/docs/crawling-indexing/google-special-case-crawlers'
1092 producer:
1093 name: 'Google Inc.'
1094 url: 'https://www.google.com/'
1095
1096 - regex: 'Google-Area120-PrivacyPolicyFetcher'
1097 name: 'Google Area 120 Privacy Policy Fetcher'
1098 category: 'Crawler'
1099 url: 'https://area120.google.com/'
1100 producer:
1101 name: 'Google Inc.'
1102 url: 'https://www.google.com/'
1103
1104 - regex: 'HubSpot '
1105 name: 'HubSpot'
1106 category: 'Crawler'
1107 producer:
1108 name: 'HubSpot Inc.'
1109 url: 'https://www.hubspot.com'
1110
1111 - regex: 'vuhuv(?:Bot|RBT)'
1112 name: 'vuhuvBot'
1113 category: 'Search bot'
1114 url: 'https://vuhuv.com/bot.html'
1115
1116 - regex: 'HTTPMon'
1117 name: 'HTTPMon'
1118 category: 'Site Monitor'
1119 url: 'http://www.httpmon.com'
1120 producer:
1121 name: 'towards GmbH'
1122 url: 'http://www.towards.ch/'
1123
1124 - regex: 'ICC-Crawler'
1125 name: 'ICC-Crawler'
1126 category: 'Crawler'
1127 url: 'http://www.nict.go.jp/en/univ-com/plan/crawl.html'
1128 producer:
1129 name: ''
1130 url: ''
1131
1132 - regex: 'inoreader\.com'
1133 name: 'inoreader'
1134 category: 'Feed Reader'
1135 url: 'https://www.inoreader.com'
1136
1137 - regex: 'iisbot'
1138 name: 'IIS Site Analysis'
1139 category: 'Crawler'
1140 url: 'http://www.iis.net/iisbot.html'
1141 producer:
1142 name: 'Microsoft Corporation'
1143 url: 'http://www.microsoft.com'
1144
1145 - regex: 'ips-agent'
1146 name: 'IPS Agent'
1147 category: 'Crawler'
1148 producer:
1149 name: 'VeriSign, Inc'
1150 url: 'http://www.verisign.com/'
1151
1152 - regex: 'IP-Guide\.com'
1153 name: 'IP-Guide Crawler'
1154 category: 'Crawler'
1155 url: ''
1156 producer:
1157 name: ''
1158 url: 'https://ip-guide.com'
1159
1160 - regex: 'k6/'
1161 name: 'K6'
1162 url: 'https://k6.io/'
1163
1164 - regex: 'kouio'
1165 name: 'Kouio'
1166 url: 'http://kouio.com/'
1167 category: 'Feed Fetcher'
1168 producer:
1169 name: ''
1170 url: ''
1171
1172 - regex: 'larbin'
1173 name: 'Larbin web crawler'
1174 category: 'Crawler'
1175 url: 'http://larbin.sourceforge.net'
1176 producer:
1177 name: ''
1178 url: ''
1179
1180 - regex: '[A-z0-9]*-Lighthouse'
1181 name: 'Lighthouse'
1182 category: 'Site Monitor'
1183 url: 'https://developers.google.com/web/tools/lighthouse'
1184 producer:
1185 name: 'Lighthouse'
1186 url: 'https://developers.google.com/web/tools/lighthouse'
1187
1188 - regex: 'last-modified\.com'
1189 name: 'LastMod Bot'
1190 category: 'Site Monitor'
1191 url: 'https://last-modified.com/en/about'
1192 producer:
1193 name: ''
1194 url: 'https://last-modified.com/en'
1195
1196 - regex: 'linkdexbot|linkdex\.com'
1197 name: 'Linkdex Bot'
1198 category: 'Search bot'
1199 url: 'http://www.linkdex.com/bots'
1200 producer:
1201 name: 'Mojeek Ltd.'
1202 url: 'http://www.mojeek.com'
1203
1204 - regex: 'LinkedInBot'
1205 name: 'LinkedIn Bot'
1206 category: 'Social Media Agent'
1207 url: 'http://www.linkedin.com'
1208 producer:
1209 name: 'LinkedIn'
1210 url: 'http://www.linkedin.com'
1211
1212 - regex: 'ltx71'
1213 name: 'LTX71'
1214 category: 'Security Checker'
1215 url: 'https://ltx71.com/'
1216 producer:
1217 name: ''
1218 url: ''
1219
1220 - regex: 'Mail\.RU'
1221 name: 'Mail.Ru Bot'
1222 category: 'Search bot'
1223 url: 'http://help.mail.ru/webmaster/indexing/robots/types_robots'
1224 producer:
1225 name: 'Mail.Ru Group'
1226 url: 'http://corp.mail.ru'
1227
1228 - regex: 'magpie-crawler'
1229 name: 'Magpie-Crawler'
1230 category: 'Social Media Agent'
1231 url: 'http://www.brandwatch.com/magpie-crawler/'
1232 producer:
1233 name: 'Brandwatch'
1234 url: 'http://www.brandwatch.com'
1235
1236 - regex: 'MagpieRSS'
1237 name: 'MagpieRSS'
1238 url: 'http://magpierss.sourceforge.net/'
1239 category: 'Feed Parser'
1240 producer:
1241 name: ''
1242 url: ''
1243
1244 - regex: 'masscan-ng'
1245 name: 'masscan-ng'
1246 url: 'https://github.com/bi-zone/masscan-ng'
1247 category: 'Crawler'
1248 producer:
1249 name: 'BIZON, OOO'
1250 url: 'https://bi.zone/'
1251
1252 - regex: '.*masscan'
1253 name: 'masscan'
1254 url: 'https://github.com/robertdavidgraham/masscan'
1255 category: 'Crawler'
1256 producer:
1257 name: 'Robert Graham'
1258 url: 'https://github.com/robertdavidgraham'
1259
1260 - regex: 'Mastodon/'
1261 name: 'Mastodon Bot'
1262 category: 'Social Media Agent'
1263
1264 - regex: 'meanpathbot'
1265 name: 'Meanpath Bot'
1266 category: 'Search bot'
1267 url: 'http://www.meanpath.com/meanpathbot.html'
1268 producer:
1269 name: 'Meanpath'
1270 url: 'http://www.meanpath.com'
1271
1272 - regex: 'MetaJobBot'
1273 name: 'MetaJobBot'
1274 category: 'Crawler'
1275 url: 'http://www.metajob.at/the/crawler'
1276 producer:
1277 name: 'MetaJob'
1278 url: 'http://www.metajob.at'
1279
1280 - regex: 'MetaInspector'
1281 name: 'MetaInspector'
1282 category: 'Crawler'
1283 url: 'https://github.com/jaimeiniesta/metainspector'
1284
1285 - regex: 'MixrankBot'
1286 name: 'MixRank Bot'
1287 category: 'Crawler'
1288 url: 'http://mixrank.com'
1289 producer:
1290 name: 'Online Media Group, Inc.'
1291 url: ''
1292
1293 - regex: 'MJ12bot'
1294 name: 'MJ12 Bot'
1295 category: 'Search bot'
1296 url: 'http://majestic12.co.uk/bot.php'
1297 producer:
1298 name: 'Majestic-12'
1299 url: 'http://majestic12.co.uk'
1300
1301 - regex: 'Mnogosearch'
1302 name: 'Mnogosearch'
1303 category: 'Search bot'
1304 url: 'http://www.mnogosearch.org/'
1305 producer:
1306 name: 'Lavtech.Com Corp.'
1307 url: ''
1308 - regex: 'MojeekBot'
1309 name: 'MojeekBot'
1310 category: 'Search bot'
1311 url: 'http://www.mojeek.com/bot.html'
1312 producer:
1313 name: 'Mojeek Ltd.'
1314 url: 'http://www.mojeek.com'
1315
1316 - regex: 'munin'
1317 name: 'Munin'
1318 category: 'Site Monitor'
1319 url: 'http://munin-monitoring.org/'
1320 producer:
1321 name: 'Munin'
1322 url: 'http://munin-monitoring.org/'
1323
1324 - regex: 'NalezenCzBot'
1325 name: 'NalezenCzBot'
1326 category: 'Crawler'
1327 url: 'http://www.nalezen.cz/about-crawler'
1328 producer:
1329 name: 'Jaroslav Kuboš'
1330 url: ''
1331
1332 - regex: 'check_http/v'
1333 name: 'Nagios check_http'
1334 category: 'Site Monitor'
1335 url: 'https://nagios.org'
1336 producer:
1337 name: 'Nagios Plugins Development Team'
1338 url: 'https://nagios.org'
1339
1340 - regex: 'nbertaupete95\(at\)gmail\.com'
1341 name: 'nbertaupete95'
1342 category: 'Crawler'
1343
1344 - regex: 'Netcraft(?: Web Server Survey| SSL Server Survey|SurveyAgent)'
1345 name: 'Netcraft Survey Bot'
1346 category: 'Search bot'
1347 url: ''
1348 producer:
1349 name: 'Netcraft'
1350 url: 'http://www.netcraft.com'
1351
1352 - regex: 'netEstate NE Crawler'
1353 name: 'netEstate'
1354 category: 'Crawler'
1355 url: 'http://www.website-datenbank.de/Impressum'
1356 producer:
1357 name: 'netEstate GmbH'
1358 url: 'https://www.netestate.de/en/'
1359
1360 - regex: 'Netvibes'
1361 name: 'Netvibes'
1362 url: 'http://www.netvibes.com/'
1363 category: 'Feed Fetcher'
1364 producer:
1365 name: ''
1366 url: ''
1367
1368 - regex: 'NewsBlur .*(?:Fetcher|Finder)'
1369 name: 'NewsBlur'
1370 url: 'http://www.newsblur.com'
1371 category: 'Feed Fetcher'
1372 producer:
1373 name: ''
1374 url: ''
1375
1376 - regex: 'NewsGatorOnline'
1377 name: 'NewsGator'
1378 url: 'http://www.newsgator.com'
1379 category: 'Feed Fetcher'
1380 producer:
1381 name: ''
1382 url: ''
1383
1384 - regex: 'nlcrawler'
1385 name: 'NLCrawler'
1386 category: 'Crawler'
1387 url: ''
1388 producer:
1389 name: 'Northern Light'
1390 url: 'http://northernlight.com'
1391
1392 - regex: 'Nmap Scripting Engine'
1393 name: 'Nmap'
1394 category: 'Security Checker'
1395 url: 'https://nmap.org/book/nse.html'
1396 producer:
1397 name: 'Nmap'
1398 url: 'https://nmap.org/'
1399
1400 - regex: 'Nuzzel'
1401 name: 'Nuzzel'
1402 category: 'Crawler'
1403 producer:
1404 name: 'Nuzzel'
1405 url: 'https://www.nuzzel.com/'
1406
1407 - regex: 'NodePing'
1408 name: 'NodePing'
1409 category: 'Site Monitor'
1410 url: 'https://nodeping.com'
1411 producer:
1412 name: 'NodePing'
1413 url: 'https://nodeping.com'
1414
1415 - regex: 'Octopus [\d.]+'
1416 name: 'Octopus'
1417
1418 - regex: 'OnlineOrNot\.com_bot'
1419 name: 'OnlineOrNot Bot'
1420 category: 'Site Monitor'
1421 url: 'https://onlineornot.com/website-monitoring'
1422 producer:
1423 name: 'OnlineOrNot'
1424 url: 'https://onlineornot.com'
1425
1426 - regex: 'webzio-extended'
1427 name: 'webzio-extended'
1428 category: 'AI Data Scraper'
1429 url: 'https://docs.webz.io/reference/how-it-works-video'
1430 producer:
1431 name: 'Webz.io Ltd'
1432 url: 'https://webz.io/'
1433
1434 - regex: 'webzio'
1435 name: 'webzio'
1436 category: 'AI Search Crawler'
1437 url: 'https://docs.webz.io/reference/how-it-works-video'
1438 producer:
1439 name: 'Webz.io Ltd'
1440 url: 'https://webz.io/'
1441
1442 - regex: 'omgili'
1443 name: 'Omgilibot'
1444 category: 'Search bot'
1445 url: 'https://webz.io/blog/api/what-is-the-omgili-bot-and-why-is-it-crawling-your-website/'
1446 producer:
1447 name: 'Webz.io Ltd'
1448 url: 'https://webz.io/'
1449
1450 - regex: 'OpenindexSpider'
1451 name: 'Openindex Spider'
1452 category: 'Search bot'
1453 url: 'http://www.openindex.io/en/webmasters/spider.html'
1454 producer:
1455 name: 'Openindex B.V.'
1456 url: 'http://www.openindex.io'
1457
1458 - regex: 'spbot'
1459 name: 'OpenLinkProfiler'
1460 category: 'Crawler'
1461 url: 'http://openlinkprofiler.org/bot'
1462 producer:
1463 name: 'Axandra GmbH'
1464 url: 'http://www.axandra.com'
1465
1466 - regex: 'OpenWebSpider'
1467 name: 'OpenWebSpider'
1468 category: 'Crawler'
1469 url: 'http://www.openwebspider.org'
1470 producer:
1471 name: 'OpenWebSpider Lab'
1472 url: 'http://lab.openwebspider.org'
1473
1474 - regex: 'OrangeBot|VoilaBot'
1475 name: 'Orange Bot'
1476 category: 'Search bot'
1477 url: 'http://lemoteur.orange.fr'
1478 producer:
1479 name: 'Orange'
1480 url: 'http://www.orange.fr'
1481
1482 - regex: 'PaperLiBot'
1483 name: 'PaperLiBot'
1484 category: 'Search bot'
1485 url: 'http://support.paper.li/entries/20023257-what-is-paper-li'
1486 producer:
1487 name: 'Smallrivers SA'
1488 url: 'http://www.paper.li'
1489
1490 - regex: 'phantomas/'
1491 name: 'Phantomas'
1492 category: 'Site Monitor'
1493 url: 'https://github.com/macbre/phantomas'
1494
1495 - regex: 'phpservermon'
1496 name: 'PHP Server Monitor'
1497 category: 'Site Monitor'
1498 url: 'https://github.com/phpservermon/phpservermon'
1499 producer:
1500 name: 'PHP Server Monitor'
1501 url: 'http://www.phpservermonitor.org/'
1502
1503 - regex: 'Pocket(?:ImageCache|Parser)'
1504 name: 'Pocket'
1505 category: 'Read-it-later Service'
1506 url: 'https://getpocket.com/pocketparser_ua'
1507 producer:
1508 name: 'Read It Later, Inc.'
1509 url: 'https://getpocket.com/'
1510
1511 - regex: 'PritTorrent'
1512 name: 'PritTorrent'
1513 category: 'Crawler'
1514 url: 'https://github.com/astro/prittorrent'
1515 producer:
1516 name: 'Bitlove'
1517 url: 'http://bitlove.org/'
1518
1519 - regex: 'PRTG Network Monitor'
1520 name: 'PRTG Network Monitor'
1521 category: 'Network Monitor'
1522 url: 'https://www.paessler.com/prtg'
1523 producer:
1524 name: 'Paessler AG'
1525 url: 'https://www.paessler.com'
1526
1527 - regex: 'psbot'
1528 name: 'Picsearch bot'
1529 category: 'Search bot'
1530 url: 'http://www.picsearch.com/bot.html'
1531 producer:
1532 name: 'Picsearch'
1533 url: 'http://www.picsearch.com'
1534
1535 - regex: 'Pingdom(?:\.com|TMS)'
1536 name: 'Pingdom Bot'
1537 category: 'Site Monitor'
1538 url: ''
1539 producer:
1540 name: 'Pingdom AB'
1541 url: 'https://www.pingdom.com'
1542
1543 - regex: 'Quora Link Preview'
1544 name: 'Quora Link Preview'
1545 category: 'Crawler'
1546 url: ''
1547 producer:
1548 name: 'Quora'
1549 url: 'http://www.quora.com'
1550
1551 - regex: 'Quora-Bot'
1552 name: 'Quora Bot'
1553 category: 'Crawler'
1554 url: ''
1555 producer:
1556 name: 'Quora'
1557 url: 'https://www.quora.com/'
1558
1559 - regex: 'RamblerMail'
1560 name: 'RamblerMail Image Proxy'
1561 category: 'Crawler'
1562 url: ''
1563 producer:
1564 name: 'Rambler&Co'
1565 url: 'https://rambler-co.ru/'
1566
1567 - regex: 'QuerySeekerSpider'
1568 name: 'QuerySeekerSpider'
1569 category: 'Crawler'
1570 url: 'http://queryseeker.com/bot.html'
1571 producer:
1572 name: 'QueryEye Inc.'
1573 url: 'http://queryeye.com'
1574
1575 - regex: 'Qwantify|Qwantbot'
1576 name: 'Qwantbot'
1577 category: 'Crawler'
1578 url: 'https://help.qwant.com/bot/'
1579 producer:
1580 name: 'Qwant Corporation'
1581 url: 'https://www.qwant.com/'
1582
1583 - regex: 'Rainmeter'
1584 name: 'Rainmeter'
1585 category: 'Crawler'
1586 url: 'https://www.rainmeter.net'
1587
1588 - regex: 'redditbot'
1589 name: 'Reddit Bot'
1590 category: 'Social Media Agent'
1591 url: 'http://www.reddit.com/feedback'
1592 producer:
1593 name: 'reddit inc.'
1594 url: 'http://www.reddit.com'
1595
1596 - regex: 'Riddler'
1597 name: 'Riddler'
1598 category: 'Security search bot'
1599 url: 'https://riddler.io/about'
1600 producer:
1601 name: 'F-Secure'
1602 url: 'https://www.f-secure.com'
1603
1604 - regex: 'rogerbot'
1605 name: 'Rogerbot'
1606 category: 'Crawler'
1607 url: 'http://moz.com/help/pro/what-is-rogerbot-'
1608 producer:
1609 name: 'SEOmoz, Inc.'
1610 url: 'http://moz.com/'
1611
1612 - regex: 'ROI Hunter'
1613 name: 'ROI Hunter'
1614 category: 'Crawler'
1615 url: ''
1616 producer:
1617 name: 'Roihunter a.s.'
1618 url: 'http://roihunter.com/'
1619
1620 - regex: 'SafeDNSBot'
1621 name: 'SafeDNSBot'
1622 category: 'Crawler'
1623 url: 'https://www.safedns.com/searchbot'
1624 producer:
1625 name: 'SafeDNS, Inc.'
1626 url: 'https://www.safedns.com/'
1627
1628 - regex: 'Scrapy'
1629 name: 'Scrapy'
1630 category: 'Crawler'
1631 url: 'http://scrapy.org'
1632
1633 - regex: 'Screaming Frog SEO Spider'
1634 name: 'Screaming Frog SEO Spider'
1635 category: 'Crawler'
1636 url: 'http://www.screamingfrog.co.uk/seo-spider'
1637 producer:
1638 name: 'Screaming Frog Ltd'
1639 url: 'http://www.screamingfrog.co.uk'
1640
1641 - regex: 'ScreenerBot'
1642 name: 'ScreenerBot'
1643 category: 'Crawler'
1644 url: 'http://www.screenerbot.com'
1645 producer:
1646 name: ''
1647 url: ''
1648
1649 - regex: 'SemrushBot'
1650 name: 'SemrushBot'
1651 category: 'Crawler'
1652 url: 'https://www.semrush.com/bot/'
1653 producer:
1654 name: 'Semrush Inc.'
1655 url: 'https://www.semrush.com/'
1656
1657 - regex: 'BacklinksExtendedBot'
1658 name: 'BacklinksExtendedBot'
1659 category: 'Crawler'
1660 url: 'https://www.semrush.com/bot/'
1661 producer:
1662 name: 'Semrush Inc.'
1663 url: 'https://www.semrush.com/'
1664
1665 - regex: 'SerpReputationManagementAgent'
1666 name: 'Semrush Reputation Management'
1667 category: 'Service Agent'
1668 url: 'https://www.semrush.com/bot/'
1669 producer:
1670 name: 'Semrush Inc.'
1671 url: 'https://www.semrush.com/'
1672
1673 - regex: 'SplitSignalBot'
1674 name: 'SplitSignalBot'
1675 category: 'Crawler'
1676 url: 'https://www.semrush.com/bot/'
1677 producer:
1678 name: 'Semrush Inc.'
1679 url: 'https://www.semrush.com/'
1680
1681 - regex: 'SiteAuditBot'
1682 name: 'SiteAuditBot'
1683 category: 'Crawler'
1684 url: 'https://www.semrush.com/bot/'
1685 producer:
1686 name: 'Semrush Inc.'
1687 url: 'https://www.semrush.com/'
1688
1689 - regex: 'SensikaBot'
1690 name: 'Sensika Bot'
1691 category: ''
1692 url: ''
1693 producer:
1694 name: 'Sensika'
1695 url: 'http://sensika.com'
1696
1697 - regex: 'SEOENG(?:World)?Bot'
1698 name: 'SEOENGBot'
1699 category: 'Crawler'
1700 url: 'http://www.seoengine.com/seoengbot.htm'
1701 producer:
1702 name: 'SEO Engine'
1703 url: 'http://www.seoengine.com'
1704
1705 - regex: 'seoscanners\.net'
1706 name: 'Seoscanners.net'
1707 category: 'Crawler'
1708 url: ''
1709
1710 - regex: 'SkypeUriPreview'
1711 name: 'Skype URI Preview'
1712 category: 'Service Agent'
1713 url: ''
1714 producer:
1715 name: 'Skype Communications S.à.r.l.'
1716 url: 'https://www.skype.com'
1717
1718 - regex: 'SeznamBot|SklikBot|Seznam screenshot-generator'
1719 name: 'Seznam Bot'
1720 category: 'Search bot'
1721 url: 'http://www.mapy.cz/cz/seznambot.html'
1722 producer:
1723 name: 'Seznam.cz, a.s.'
1724 url: 'http://www.seznam.cz/'
1725
1726 - regex: 'shopify-partner-homepage-scraper'
1727 name: 'Shopify Partner'
1728 category: 'Crawler'
1729 url: 'https://www.shopify.com/partners'
1730 producer:
1731 name: 'Shopify'
1732 url: 'https://www.shopify.com/'
1733
1734 - regex: 'ShopWiki'
1735 name: 'ShopWiki'
1736 category: 'Search tools'
1737 url: 'http://www.shopwiki.com/wiki/Help:Bot'
1738 producer:
1739 name: 'ShopWiki Corp.'
1740 url: 'http://www.shopwiki.com'
1741
1742 - regex: 'SilverReader'
1743 name: 'SilverReader'
1744 url: 'http://silverreader.com'
1745 category: 'Feed Fetcher'
1746 producer:
1747 name: ''
1748 url: ''
1749
1750 - regex: 'SimplePie'
1751 name: 'SimplePie'
1752 url: 'http://www.simplepie.org'
1753 category: 'Feed Parser'
1754 producer:
1755 name: ''
1756 url: ''
1757
1758 - regex: 'SISTRIX Crawler'
1759 name: 'SISTRIX Crawler'
1760 category: 'Crawler'
1761 url: 'http://crawler.sistrix.net'
1762 producer:
1763 name: 'SISTRIX GmbH'
1764 url: 'http://www.sistrix.de'
1765
1766 - regex: 'compatible; (?:SISTRIX )?Optimizer'
1767 name: 'SISTRIX Optimizer'
1768 category: 'Crawler'
1769 url: 'https://optimizer.sistrix.com'
1770 producer:
1771 name: 'SISTRIX GmbH'
1772 url: 'http://www.sistrix.de'
1773
1774 - regex: 'SiteSucker'
1775 name: 'SiteSucker'
1776 category: 'Crawler'
1777 url: 'http://ricks-apps.com/osx/sitesucker/'
1778
1779 - regex: 'sixy\.ch'
1780 name: 'Sixy.ch'
1781 category: 'Site Monitor'
1782 url: 'http://sixy.ch'
1783 producer:
1784 name: 'Manuel Kasper'
1785 url: 'https://neon1.net/'
1786
1787 - regex: 'Slackbot|Slack-ImgProxy'
1788 name: 'Slackbot'
1789 category: 'Crawler'
1790 url: 'https://api.slack.com/robots'
1791 producer:
1792 name: 'Slack Technologies'
1793 url: 'http://slack.com'
1794
1795 - regex: 'Sogou[ -](?:head|inst|Orion|Pic|Test|web)[ -]spider|New-Sogou-Spider'
1796 name: 'Sogou Spider'
1797 category: 'Search bot'
1798 url: 'http://www.sogou.com/docs/help/webmasters.htm'
1799 producer:
1800 name: 'Sohu, Inc.'
1801 url: 'http://www.sogou.com'
1802
1803 - regex: 'Sosospider|Sosoimagespider'
1804 name: 'Soso Spider'
1805 category: 'Search bot'
1806 url: 'http://help.soso.com/webspider.htm'
1807 producer:
1808 name: 'Tencent Holdings'
1809 url: 'http://www.soso.com'
1810
1811 - regex: 'Sprinklr'
1812 name: 'Sprinklr'
1813 category: 'Crawler'
1814 url: ''
1815 producer:
1816 name: 'Sprinklr, Inc.'
1817 url: 'https://www.sprinklr.com/'
1818
1819 - regex: 'SSL Labs'
1820 name: 'SSL Labs'
1821 category: 'Validator'
1822 url: 'https://www.ssllabs.com/about/assessment.html'
1823 producer:
1824 name: 'SSL Labs'
1825 url: 'https://www.ssllabs.com/about/assessment.html'
1826
1827 - regex: 'StatusCake'
1828 name: 'StatusCake'
1829 category: 'Site Monitor'
1830 url: 'https://www.statuscake.com'
1831 producer:
1832 name: 'StatusCake'
1833 url: 'https://www.statuscake.com'
1834
1835 - regex: 'Superfeedr bot'
1836 name: 'Superfeedr Bot'
1837 category: 'Feed Fetcher'
1838 url: ''
1839 producer:
1840 name: 'Superfeedr'
1841 url: 'https://superfeedr.com/'
1842
1843 - regex: 'Sparkler'
1844 name: 'Sparkler'
1845 category: 'Crawler'
1846 url: 'https://github.com/USCDataScience/sparkler'
1847
1848 - regex: 'Spinn3r'
1849 name: 'Spinn3r'
1850 category: 'Crawler'
1851 url: 'http://spinn3r.com/robot'
1852 producer:
1853 name: 'Tailrank Inc'
1854 url: 'http://spinn3r.com'
1855
1856 - regex: 'SputnikBot'
1857 name: 'Sputnik Bot'
1858 category: 'Crawler'
1859 url: ''
1860
1861 - regex: 'SputnikFaviconBot'
1862 name: 'Sputnik Favicon Bot'
1863 category: 'Crawler'
1864 url: ''
1865
1866 - regex: 'SputnikImageBot'
1867 name: 'Sputnik Image Bot'
1868 category: 'Crawler'
1869 url: ''
1870
1871 - regex: 'SurveyBot'
1872 name: 'Survey Bot'
1873 category: 'Search bot'
1874 url: 'http://www.domaintools.com/webmasters/surveybot.php'
1875 producer:
1876 name: 'Domain Tools'
1877 url: 'http://www.domaintools.com'
1878
1879 - regex: 'TarmotGezgin'
1880 name: 'Tarmot Gezgin'
1881 url: 'http://www.tarmot.com/gezgin/'
1882 category: 'Search bot'
1883
1884 - regex: 'TelegramBot'
1885 name: 'TelegramBot'
1886 url: 'https://telegram.org/blog/bot-revolution'
1887
1888 - regex: 'TLSProbe'
1889 name: 'TLSProbe'
1890 url: 'https://scan.trustnet.venafi.com/'
1891 category: 'Security search bot'
1892 producer:
1893 name: 'Venafi TrustNet'
1894 url: 'https://www.venafi.com'
1895
1896 - regex: 'TinEye-bot'
1897 name: 'TinEye Crawler'
1898 category: 'Search bot'
1899 url: 'http://www.tineye.com/crawler.html'
1900 producer:
1901 name: 'Idée Inc.'
1902 url: 'http://ideeinc.com'
1903
1904 - regex: 'Tiny Tiny RSS'
1905 name: 'Tiny Tiny RSS'
1906 url: 'http://tt-rss.org'
1907 category: 'Feed Fetcher'
1908 producer:
1909 name: ''
1910 url: ''
1911
1912 - regex: 'theoldreader\.com'
1913 name: 'theoldreader'
1914 category: 'Feed Reader'
1915 url: 'https://theoldreader.com'
1916
1917 - regex: 'Trackable/0\.1'
1918 name: 'Chartable'
1919 category: 'Site Monitor'
1920 url: 'https://help.chartable.com/article/34-what-is-the-trackable-analytics-prefix'
1921 producer:
1922 name: 'Chartable'
1923 url: 'https://chartable.com'
1924
1925 - regex: 'trendictionbot'
1926 name: 'Trendiction Bot'
1927 category: 'Crawler'
1928 url: 'http://www.trendiction.de/bot'
1929 producer:
1930 name: 'Talkwalker Inc.'
1931 url: 'http://www.talkwalker.com'
1932
1933 - regex: '^Turnitin(?:Bot)?'
1934 name: 'TurnitinBot'
1935 category: 'Crawler'
1936 url: 'https://www.turnitin.com/robot/crawlerinfo.html'
1937 producer:
1938 name: 'iParadigms, LLC.'
1939 url: 'https://www.turnitin.com/'
1940
1941 - regex: 'TweetedTimes'
1942 name: 'TweetedTimes Bot'
1943 category: 'Crawler'
1944 url: 'https://tweetedtimes.com/'
1945 producer:
1946 name: 'TweetedTimes'
1947 url: 'https://tweetedtimes.com/'
1948
1949 - regex: 'TweetmemeBot'
1950 name: 'Tweetmeme Bot'
1951 category: 'Crawler'
1952 url: 'http://tweetmeme.com/'
1953 producer:
1954 name: 'Mediasift'
1955 url: ''
1956
1957 - regex: 'Twingly Recon'
1958 name: 'Twingly Recon'
1959 category: 'Crawler'
1960 url: 'https://app.twingly.com/public-docs/crawler'
1961 producer:
1962 name: 'Twingly'
1963 url: 'https://www.twingly.com'
1964
1965 - regex: 'Twitterbot'
1966 name: 'Twitterbot'
1967 category: 'Social Media Agent'
1968 url: 'https://dev.twitter.com/docs/cards/getting-started'
1969 producer:
1970 name: 'Twitter'
1971 url: 'http://www.twitter.com'
1972
1973 - regex: 'UniversalFeedParser'
1974 name: 'UniversalFeedParser'
1975 category: 'Feed Fetcher'
1976 url: 'https://github.com/kurtmckee/feedparser'
1977 producer:
1978 name: 'Kurt McKee'
1979 url: 'https://github.com/kurtmckee'
1980
1981 - regex: 'via secureurl\.fwdcdn\.com'
1982 name: 'UkrNet Mail Proxy'
1983 category: 'Crawler'
1984 url: ''
1985 producer:
1986 name: 'UkrNet Ltd'
1987 url: 'https://www.ukr.net/'
1988
1989 - regex: 'Uptime(?:bot)?/'
1990 name: 'Uptimebot'
1991 category: 'Site Monitor'
1992 url: 'https://uptime.com/uptime-bot'
1993 producer:
1994 name: 'Uptime'
1995 url: 'https://uptime.com/'
1996
1997 - regex: 'UptimeRobot'
1998 name: 'UptimeRobot'
1999 category: 'Site Monitor'
2000 url: 'https://uptimerobot.com/'
2001 producer:
2002 name: 'Uptime Robot'
2003 url: 'https://uptimerobot.com/'
2004
2005 - regex: 'URLAppendBot'
2006 name: 'URLAppendBot'
2007 category: 'Crawler'
2008 url: 'http://www.profound.net/urlappendbot.html'
2009 producer:
2010 name: 'Profound Networks'
2011 url: 'http://www.profound.net'
2012
2013 - regex: 'Vagabondo'
2014 name: 'Vagabondo'
2015 category: 'Crawler'
2016 url: ''
2017 producer:
2018 name: 'WiseGuys'
2019 url: 'http://www.wise-guys.nl/'
2020
2021 - regex: 'vkShare; '
2022 name: 'VK Share Button'
2023 category: 'Crawler'
2024 url: 'https://dev.vk.com/en/widgets/share'
2025 producer:
2026 name: 'VK'
2027 url: 'https://vk.com/'
2028
2029 - regex: 'VKRobot'
2030 name: 'VK Robot'
2031 category: 'Crawler'
2032 url: 'https://dev.vk.com/en/'
2033 producer:
2034 name: 'VK'
2035 url: 'https://vk.com/'
2036
2037 - regex: 'VSMCrawler'
2038 name: 'Visual Site Mapper Crawler'
2039 category: 'Crawler'
2040 url: 'http://www.visualsitemapper.com/crawler'
2041 producer:
2042 name: 'Alentum Software Ltd.'
2043 url: 'http://www.alentum.com'
2044
2045 - regex: 'Jigsaw'
2046 name: 'W3C CSS Validator'
2047 category: 'Validator'
2048 url: 'http://jigsaw.w3.org/css-validator'
2049 producer:
2050 name: 'W3C'
2051 url: 'http://www.w3.org'
2052
2053 - regex: 'W3C_I18n-Checker'
2054 name: 'W3C I18N Checker'
2055 category: 'Validator'
2056 url: 'http://validator.w3.org/i18n-checker'
2057 producer:
2058 name: 'W3C'
2059 url: 'http://www.w3.org'
2060
2061 - regex: 'W3C-checklink'
2062 name: 'W3C Link Checker'
2063 category: 'Validator'
2064 url: 'http://validator.w3.org/checklink'
2065 producer:
2066 name: 'W3C'
2067 url: 'http://www.w3.org'
2068
2069 - regex: 'W3C_Validator|Validator\.nu'
2070 name: 'W3C Markup Validation Service'
2071 category: 'Validator'
2072 url: 'http://validator.w3.org/services'
2073 producer:
2074 name: 'W3C'
2075 url: 'http://www.w3.org'
2076
2077 - regex: 'W3C-mobileOK'
2078 name: 'W3C MobileOK Checker'
2079 category: 'Validator'
2080 url: 'http://validator.w3.org/mobile'
2081 producer:
2082 name: 'W3C'
2083 url: 'http://www.w3.org'
2084
2085 - regex: 'W3C_Unicorn'
2086 name: 'W3C Unified Validator'
2087 category: 'Validator'
2088 url: 'http://validator.w3.org/unicorn'
2089 producer:
2090 name: 'W3C'
2091 url: 'http://www.w3.org'
2092
2093 - regex: 'P3P Validator'
2094 name: 'W3C P3P Validator'
2095 category: 'Validator'
2096 url: 'https://www.w3.org/P3P/validator.html'
2097 producer:
2098 name: 'W3C'
2099 url: 'https://www.w3.org'
2100
2101 - regex: 'Wappalyzer'
2102 name: 'Wappalyzer'
2103 url: 'https://github.com/AliasIO/Wappalyzer'
2104 producer:
2105 name: 'AliasIO'
2106 url: 'https://github.com/AliasIO'
2107
2108 - regex: 'PTST/'
2109 name: 'WebPageTest'
2110 category: 'Site Monitor'
2111 url: 'https://www.webpagetest.org'
2112
2113 - regex: 'WeSEE'
2114 name: 'WeSEE:Search'
2115 category: 'Search bot'
2116 url: 'http://www.wesee.com/bot'
2117 producer:
2118 name: 'WeSEE Ltd'
2119 url: 'http://www.wesee.com'
2120
2121 - regex: 'WebbCrawler'
2122 name: 'WebbCrawler'
2123 category: 'Crawler'
2124 url: 'http://badcheese.com/crawler.html'
2125 producer:
2126 name: 'Steve Webb'
2127 url: 'http://badcheese.com'
2128
2129 - regex: 'websitepulse[+ ]checker'
2130 name: 'WebSitePulse'
2131 category: 'Site Monitor'
2132 url: 'http://badcheese.com/crawler.html'
2133 producer:
2134 name: 'WebSitePulse'
2135 url: 'http://www.websitepulse.com/'
2136
2137 - regex: 'WordPress.+isitwp\.com'
2138 name: 'IsItWP'
2139 category: 'Crawler'
2140 url: 'https://www.isitwp.com/'
2141 producer:
2142 name: 'WPBeginner, LLC'
2143 url: 'https://www.wpbeginner.com/'
2144
2145 - regex: 'Automattic Analytics Crawler'
2146 name: 'Automattic Analytics'
2147 category: 'Crawler'
2148 url: 'https://wordpress.com/crawler/'
2149 producer:
2150 name: 'Wordpress.org'
2151 url: 'https://wordpress.org/'
2152
2153 - regex: 'WordPress\.com mShots'
2154 name: 'WordPress.com mShots'
2155 category: 'Service Agent'
2156 url: 'https://wordpress.org/'
2157 producer:
2158 name: 'Wordpress.org'
2159 url: 'https://wordpress.org/'
2160
2161 - regex: 'wp\.com feedbot'
2162 name: 'wp.com feedbot'
2163 category: 'Feed Fetcher'
2164 url: 'https://wordpress.com/'
2165 producer:
2166 name: 'Automattic, Inc.'
2167 url: 'https://automattic.com/'
2168
2169 - regex: 'WordPress'
2170 name: 'WordPress'
2171 category: 'Service Agent'
2172 url: 'https://wordpress.org/'
2173 producer:
2174 name: 'Wordpress.org'
2175 url: 'https://wordpress.org/'
2176
2177 - regex: 'Wotbox'
2178 name: 'Wotbox'
2179 category: 'Search bot'
2180 url: 'http://www.wotbox.com/bot/'
2181 producer:
2182 name: 'Wotbox'
2183 url: 'http://www.wotbox.com'
2184
2185 - regex: 'XenForo'
2186 name: 'XenForo'
2187 category: 'Service Agent'
2188 url: 'https://xenforo.com/'
2189 producer:
2190 name: 'XenForo Ltd.'
2191 url: 'https://xenforo.com/'
2192
2193 - regex: 'yacybot'
2194 name: 'YaCy'
2195 category: 'Search bot'
2196 url: 'http://yacy.net/bot.html'
2197 producer:
2198 name: 'YaCy'
2199 url: 'http://yacy.net'
2200
2201 - regex: 'Yahoo! Slurp|Yahoo!-AdCrawler'
2202 name: 'Yahoo! Slurp'
2203 category: 'Search bot'
2204 url: 'http://help.yahoo.com/ysearch/slurp'
2205 producer:
2206 name: 'Yahoo! Inc.'
2207 url: 'http://www.yahoo.com'
2208
2209 - regex: 'Yahoo Link Preview|Yahoo:LinkExpander:Slingstone'
2210 name: 'Yahoo! Link Preview'
2211 category: 'Crawler'
2212 url: 'https://help.yahoo.com/kb/mail/yahoo-link-preview-SLN23615.html'
2213 producer:
2214 name: 'Yahoo! Inc.'
2215 url: 'http://www.yahoo.com'
2216
2217 - regex: 'YahooMailProxy'
2218 name: 'Yahoo! Mail Proxy'
2219 category: 'Service Agent'
2220 url: 'https://help.yahoo.com/kb/yahoo-mail-proxy-SLN28749.html'
2221 producer:
2222 name: 'Yahoo! Inc.'
2223 url: 'http://www.yahoo.com'
2224
2225 - regex: 'YahooCacheSystem'
2226 name: 'Yahoo! Cache System'
2227 category: 'Crawler'
2228 url: ''
2229 producer:
2230 name: 'Yahoo! Inc.'
2231 url: 'http://www.yahoo.com'
2232
2233 - regex: 'Y!J-(ASR|BR[IJOWY]|[BPW]SC)'
2234 name: 'Yahoo! Japan $1'
2235 category: 'Crawler'
2236 url: 'https://support.yahoo-net.jp/PccSearch/s/article/H000007955'
2237 producer:
2238 name: 'Yahoo! Japan Corp.'
2239 url: 'https://www.yahoo.co.jp/'
2240
2241 - regex: 'Y!J'
2242 name: 'Yahoo! Japan'
2243 category: 'Crawler'
2244 url: 'https://support.yahoo-net.jp/PccSearch/s/article/H000007955'
2245 producer:
2246 name: 'Yahoo! Japan Corp.'
2247 url: 'https://www.yahoo.co.jp/'
2248
2249 - regex: 'YandexBot.+MirrorDetector'
2250 name: 'YandexBot-MirrorDetector'
2251 category: 'Crawler'
2252 url: 'https://yandex.com/support/webmaster/robot-workings/check-yandex-robots.html'
2253 producer:
2254 name: 'Yandex LLC'
2255 url: 'https://yandex.com/company/'
2256
2257 - regex: '(Yandex(?:(?:\.Gazeta |Accessibility|Com|Mobile|MobileScreenShot|RenderResources|Screenshot|Sprav)?Bot|(?:AdNet|Antivirus|Blogs|Calendar|Catalog|Dialogs|Direct(?:Dyn)?|Favicons|ForDomain|ImageResizer|Images|Market|Media(?:naBot)?|Metrika|News(?:links)?|OntoDB(?:API)?|Pagechecker|Partner|RCA|SearchShop|(?:News|Site)links|Tracker|Turbo|Userproxy|Verticals|Vertis|Video(?:Parser)?|Webmaster))|YaDirectFetcher)'
2258 name: '$1'
2259 category: 'Search bot'
2260 url: 'https://yandex.com/support/webmaster/robot-workings/check-yandex-robots.html'
2261 producer:
2262 name: 'Yandex LLC'
2263 url: 'https://yandex.com/company/'
2264
2265 - regex: 'YandexAdditional'
2266 name: 'YandexAdditionalBot'
2267 category: 'AI Search Crawler'
2268 url: 'https://yandex.com/support/webmaster/robot-workings/check-yandex-robots.html'
2269 producer:
2270 name: 'Yandex LLC'
2271 url: 'https://yandex.com/company/'
2272
2273 - regex: 'Yeti|NaverJapan|AdsBot-Naver'
2274 name: 'Yeti/Naverbot'
2275 category: 'Search bot'
2276 url: 'http://help.naver.com/robots/'
2277 producer:
2278 name: 'Naver'
2279 url: 'http://www.naver.com'
2280
2281 - regex: 'YoudaoBot'
2282 name: 'Youdao Bot'
2283 category: 'Search bot'
2284 url: 'http://www.youdao.com/help/webmaster/spider'
2285 producer:
2286 name: 'NetEase, Inc.'
2287 url: 'http://corp.163.com'
2288
2289 - regex: 'YOURLS'
2290 name: 'Yourls'
2291 category: 'Crawler'
2292 url: 'http://yourls.org'
2293
2294 - regex: 'YRSpider|YYSpider'
2295 name: 'Yunyun Bot'
2296 category: 'Search bot'
2297 url: 'http://www.yunyun.com/SiteInfo.php?r=about'
2298 producer:
2299 name: 'YunYun'
2300 url: 'http://www.yunyun.com'
2301
2302 - regex: 'zgrab'
2303 name: 'zgrab'
2304 category: 'Security Checker'
2305 url: 'https://github.com/zmap/zgrab'
2306
2307 - regex: 'Zookabot'
2308 name: 'Zookabot'
2309 category: 'Crawler'
2310 url: 'http://zookabot.com'
2311 producer:
2312 name: 'Hwacha ApS'
2313 url: 'http://hwacha.dk'
2314
2315 - regex: 'ZumBot'
2316 name: 'ZumBot'
2317 category: 'Search bot'
2318 url: 'http://help.zum.com/inquiry'
2319 producer:
2320 name: 'ZUM internet'
2321 url: 'http://www.zuminternet.com/'
2322
2323 - regex: 'YottaaMonitor'
2324 name: 'Yottaa Site Monitor'
2325 category: 'Site Monitor'
2326 url: 'http://www.yottaa.com/products/site-monitor'
2327 producer:
2328 name: 'Yottaa'
2329 url: 'http://www.yottaa.com/'
2330
2331 - regex: 'Yahoo Ad monitoring.*yahoo-ad-monitoring-SLN24857'
2332 name: 'Yahoo Gemini'
2333 category: 'Crawler'
2334 url: 'https://help.yahoo.com/kb/yahoo-ad-monitoring-SLN24857.html'
2335 producer:
2336 name: 'Yahoo! Inc.'
2337 url: 'http://www.yahoo.com'
2338
2339 - regex: '.*Java.*outbrain'
2340 name: 'Outbrain'
2341 category: 'Crawler'
2342 url: ''
2343 producer:
2344 name: 'Outbrain'
2345 url: 'http://www.outbrain.com/'
2346
2347 - regex: 'HubPages.*crawlingpolicy'
2348 name: 'HubPages'
2349 category: 'Crawler'
2350 url: 'https://hubpages.com/help/crawlingpolicy'
2351 producer:
2352 name: 'HubPages, Inc.'
2353 url: 'https://discover.hubpages.com/'
2354
2355 - regex: 'Pinterest(?:bot)?/.*www\.pinterest\.com'
2356 name: 'Pinterest'
2357 url: 'https://help.pinterest.com/en/business/article/pinterest-crawler'
2358 category: 'Crawler'
2359 producer:
2360 name: 'Pinterest'
2361 url: 'https://www.pinterest.com/'
2362
2363 - regex: '.*Site24x7'
2364 name: 'Site24x7 Website Monitoring'
2365 category: 'Site Monitor'
2366 url: 'https://www.site24x7.com/site24x7-faq.html'
2367 producer:
2368 name: 'Site24x7'
2369 url: 'https://www.site24x7.com'
2370
2371 - regex: '.* HLB'
2372 name: 'Site24x7 Defacement Monitor'
2373 category: 'Site Monitor'
2374 url: 'https://support.site24x7.com/portal/en/kb/articles/default-user-agent-used-in-website-defacement-monitor'
2375 producer:
2376 name: 'Site24x7'
2377 url: 'https://www.site24x7.com/'
2378
2379 - regex: 's~snapchat-proxy'
2380 name: 'Snapchat Proxy'
2381 category: 'Crawler'
2382 url: 'https://www.snapchat.com'
2383 producer:
2384 name: 'Snapchat Inc.'
2385 url: 'https://www.snapchat.com'
2386
2387 - regex: 'Snap URL Preview Service'
2388 name: 'Snap URL Preview Service'
2389 category: 'Service Agent'
2390 url: 'https://developers.snap.com/robots'
2391 producer:
2392 name: 'Snapchat Inc.'
2393 url: 'https://www.snapchat.com/'
2394
2395 - regex: 'SnapchatAds'
2396 name: 'Snapchat Ads'
2397 category: 'Crawler'
2398 url: 'https://businesshelp.snapchat.com/s/article/adsbot-crawler?language=en_US'
2399 producer:
2400 name: 'Snapchat Inc.'
2401 url: 'https://www.snapchat.com/'
2402
2403 - regex: "Let's Encrypt validation server"
2404 name: "Let's Encrypt Validation"
2405 category: 'Service Agent'
2406 url: 'https://letsencrypt.org/how-it-works/'
2407 producer:
2408 name: "Let's Encrypt"
2409 url: 'https://letsencrypt.org'
2410
2411 - regex: 'GrapeshotCrawler'
2412 name: 'Grapeshot'
2413 category: 'Crawler'
2414 url: 'https://www.grapeshot.com/crawler'
2415 producer:
2416 name: 'Grapeshot'
2417 url: 'https://www.grapeshot.com'
2418
2419 - regex: 'www\.monitor\.us'
2420 name: 'Monitor.Us'
2421 category: 'Site Monitor'
2422 url: 'http://www.monitor.us'
2423 producer:
2424 name: 'Monitor.Us'
2425 url: 'http://www.monitor.us'
2426
2427 - regex: 'Catchpoint'
2428 name: 'Catchpoint'
2429 category: 'Site Monitor'
2430 url: 'https://www.catchpoint.com/'
2431 producer:
2432 name: 'Catchpoint Systems'
2433 url: 'https://www.catchpoint.com/'
2434
2435 - regex: 'bitlybot'
2436 name: 'BitlyBot'
2437 category: 'Crawler'
2438 url: 'https://bitly.com'
2439 producer:
2440 name: 'Bitly, Inc.'
2441 url: 'https://bitly.com'
2442
2443 - regex: 'Zao/'
2444 name: 'Zao'
2445 category: 'Crawler'
2446
2447 - regex: 'lycos'
2448 name: 'Lycos'
2449
2450 - regex: 'Slurp'
2451 name: 'Inktomi Slurp'
2452
2453 - regex: 'Speedy ?Spider'
2454 name: 'Speedy'
2455
2456 - regex: 'nrsbot|NetResearchServer'
2457 name: 'NetResearchServer'
2458
2459 - regex: 'scooter'
2460 name: 'Scooter'
2461
2462 - regex: 'gigabot'
2463 name: 'Gigabot'
2464
2465 - regex: 'charlotte'
2466 name: 'Charlotte'
2467 category: 'Crawler'
2468 url: 'https://web.archive.org/web/20070225121634/http://www.searchme.com/support/pages/spider.php'
2469 producer:
2470 name: 'Searchme, Inc.'
2471 url: 'https://web.archive.org/web/20070217233037/http://www.searchme.com/'
2472
2473 - regex: 'Pompos'
2474 name: 'Pompos'
2475 category: 'Crawler'
2476 url: 'https://web.archive.org/web/20090124084536/http://dir.com/pompos.html'
2477 producer:
2478 name: 'ILIAD SA'
2479 url: 'https://www.iliad.fr/'
2480
2481 - regex: 'PagePeeker'
2482 name: 'PagePeeker'
2483 category: 'Crawler'
2484 url: 'https://pagepeeker.com/robots/'
2485 producer:
2486 name: 'PAGEPEEKER SRL'
2487 url: 'https://pagepeeker.com/'
2488
2489 - regex: 'WebThumbnail'
2490 name: 'WebThumbnail'
2491
2492 - regex: 'Willow Internet Crawler'
2493 name: 'Willow Internet Crawler'
2494 category: 'Crawler'
2495 url: 'https://twotrees.com/company/indexing-web-crawlers/'
2496 producer:
2497 name: 'Twotrees Technologies, LLC'
2498 url: 'https://twotrees.com/'
2499
2500 - regex: 'EmailWolf'
2501 name: 'EmailWolf'
2502
2503 - regex: 'NetLyzer FastProbe'
2504 name: 'NetLyzer FastProbe'
2505
2506 - regex: 'AdMantX.*admantx\.com'
2507 name: 'ADMantX'
2508
2509 - regex: 'Server Density Service Monitoring'
2510 name: 'Server Density'
2511
2512 - regex: 'RSSRadio \(Push Notification Scanner;support@dorada\.co\.uk\)'
2513 name: 'RSSRadio Bot'
2514
2515 - regex: '^sentry'
2516 name: 'Sentry Bot'
2517 producer:
2518 name: 'Sentry'
2519 url: 'https://sentry.io'
2520
2521 - regex: '^Spotify/[\d.]+$'
2522 name: 'Spotify'
2523 producer:
2524 name: 'Spotify'
2525 url: 'https://www.spotify.com'
2526
2527 - regex: 'Embedly'
2528 name: 'Embedly'
2529 category: 'Crawler'
2530 url: 'https://support.embed.ly/hc/en-us'
2531 producer:
2532 name: 'A Medium, Corp.'
2533 url: 'https://medium.com/'
2534
2535 - regex: 'BrandVerity'
2536 name: 'BrandVerity'
2537 category: 'Crawler'
2538 url: 'https://www.brandverity.com/why-is-brandverity-visiting-me'
2539 producer:
2540 name: 'BrandVerity, Inc.'
2541 url: 'https://www.brandverity.com/'
2542
2543 - regex: 'Kaspersky Lab CFR link resolver'
2544 name: 'Kaspersky'
2545 category: 'Security Checker'
2546 url: 'https://www.kaspersky.com/'
2547 producer:
2548 name: 'AO Kaspersky Lab'
2549 url: 'https://www.kaspersky.com/'
2550
2551 - regex: 'eZ Publish Link Validator'
2552 name: 'eZ Publish Link Validator'
2553 category: 'Crawler'
2554 url: 'https://ez.no/'
2555 producer:
2556 name: 'eZ Systems AS'
2557 url: 'https://ez.no/'
2558
2559 - regex: 'woorankreview'
2560 name: 'WooRank'
2561 category: 'Search bot'
2562 url: 'https://www.woorank.com/'
2563 producer:
2564 name: 'WooRank sprl'
2565 url: 'https://www.woorank.com/'
2566
2567 - regex: 'Siteimprove'
2568 name: 'Siteimprove'
2569 category: 'Search bot'
2570 url: 'https://siteimprove.com/'
2571 producer:
2572 name: 'Siteimprove GmbH'
2573 url: 'https://siteimprove.com/'
2574
2575 - regex: 'CATExplorador'
2576 name: 'CATExplorador'
2577 category: 'Search bot'
2578 url: 'https://fundacio.cat/ca/domini/'
2579 producer:
2580 name: 'Fundació puntCAT'
2581 url: 'https://fundacio.cat/ca/domini/'
2582
2583 - regex: 'Buck'
2584 name: 'Buck'
2585 category: 'Search bot'
2586 url: 'https://hypefactors.com/'
2587 producer:
2588 name: 'Hypefactors A/S'
2589 url: 'https://hypefactors.com/'
2590
2591 - regex: 'tracemyfile'
2592 name: 'TraceMyFile'
2593 category: 'Search bot'
2594 url: 'https://www.tracemyfile.com/'
2595 producer:
2596 name: 'Idee Inc.'
2597 url: 'http://ideeinc.com/'
2598
2599 - regex: 'zelist\.ro feed parser'
2600 name: 'Ze List'
2601 url: 'https://www.zelist.ro/'
2602 category: 'Feed Fetcher'
2603 producer:
2604 name: 'Treeworks SRL'
2605 url: 'https://www.tree.ro/'
2606
2607 - regex: 'weborama-fetcher'
2608 name: 'Weborama'
2609 category: 'Search bot'
2610 url: 'https://weborama.com/'
2611 producer:
2612 name: 'Weborama SA'
2613 url: 'https://weborama.com/'
2614
2615 - regex: 'BoardReader Favicon Fetcher'
2616 name: 'BoardReader'
2617 category: 'Search bot'
2618 url: 'https://boardreader.com/'
2619 producer:
2620 name: 'Effyis Inc'
2621 url: 'https://boardreader.com/'
2622
2623 - regex: 'IDG/(?:EU|IT|RU|UK)'
2624 name: 'IDG'
2625 category: 'Crawler'
2626 url: 'https://www.spaziodati.eu/'
2627 producer:
2628 name: 'SpazioDati S.r.l.'
2629 url: 'https://www.spaziodati.eu/'
2630
2631 - regex: 'Bytespider'
2632 name: 'Bytespider'
2633 category: 'Search bot'
2634 url: 'https://bytedance.com/'
2635 producer:
2636 name: 'ByteDance Ltd.'
2637 url: 'https://bytedance.com/'
2638
2639 - regex: 'TikTokSpider'
2640 name: 'TikTokSpider'
2641 category: 'Search bot'
2642 url: 'https://www.tiktok.com/'
2643 producer:
2644 name: 'TikTok Inc.'
2645 url: 'https://www.tiktok.com/'
2646
2647 - regex: 'WikiDo'
2648 name: 'WikiDo'
2649 category: 'Search bot'
2650 url: 'https://www.wikido.com/'
2651 producer:
2652 name: 'Fotolitografie Fiorentine di Becchi Antonio s.n.c.'
2653 url: 'https://www.wikido.com/'
2654
2655 - regex: 'Awario(?:Smart)?Bot'
2656 name: 'Awario'
2657 category: 'Search bot'
2658 url: 'https://awario.com/bots.html'
2659 producer:
2660 name: 'TechFusion Ltd.'
2661 url: 'https://www.techfusion.com.cy/'
2662
2663 - regex: 'AwarioRssBot'
2664 name: 'Awario'
2665 category: 'Feed Fetcher'
2666 url: 'https://awario.com/bots.html'
2667 producer:
2668 name: 'TechFusion Ltd.'
2669 url: 'https://www.techfusion.com.cy/'
2670
2671 - regex: 'oBot'
2672 name: 'oBot'
2673 category: 'Search bot'
2674 url: 'https://www.xforce-security.com/crawler/'
2675 producer:
2676 name: 'IBM Germany Research & Development GmbH'
2677 url: 'https://exchange.xforce.ibmcloud.com/'
2678
2679 - regex: 'SMTBot'
2680 name: 'SMTBot'
2681 category: 'Search bot'
2682 url: 'https://www.similartech.com/smtbot'
2683 producer:
2684 name: 'SimilarTech Ltd.'
2685 url: 'https://www.similartech.com/'
2686
2687 - regex: 'LCC'
2688 name: 'LCC'
2689 category: 'Search bot'
2690 url: 'https://corpora.uni-leipzig.de/crawler_faq.html'
2691 producer:
2692 name: 'Universität Leipzig'
2693 url: 'https://www.uni-leipzig.de/'
2694
2695 - regex: 'Startpagina-Linkchecker'
2696 name: 'Startpagina Linkchecker'
2697 category: 'Search bot'
2698 url: 'https://www.startpagina.nl/linkchecker'
2699 producer:
2700 name: 'Startpagina B.V.'
2701 url: 'https://www.startpagina.nl/'
2702
2703 - regex: 'MoodleBot-Linkchecker'
2704 name: 'MoodleBot Linkchecker'
2705 category: 'Search bot'
2706 url: 'https://docs.moodle.org/en/Usage'
2707 producer:
2708 name: 'Moodle Pty Ltd'
2709 url: 'https://moodle.org/'
2710
2711 - regex: 'GTmetrix'
2712 name: 'GTmetrix'
2713 category: 'Crawler'
2714 url: 'https://gtmetrix.com/'
2715 producer:
2716 name: 'Carbon60 Operating Co. Ltd.'
2717 url: 'https://www.carbon60.com/'
2718
2719 - regex: 'CyberFind ?Crawler'
2720 name: 'CyberFind Crawler'
2721 category: 'Crawler'
2722 url: 'https://www.cyberfind.net/bot.html'
2723 producer:
2724 name: 'Find.tf'
2725 url: 'https://find.tf/'
2726
2727 - regex: 'Nutch'
2728 name: 'Nutch-based Bot'
2729 category: 'Crawler'
2730 url: 'https://nutch.apache.org'
2731 producer:
2732 name: 'The Apache Software Foundation'
2733 url: 'https://www.apache.org/foundation/'
2734
2735 - regex: 'Seobility'
2736 name: 'Seobility'
2737 category: 'Crawler'
2738 url: 'https://www.seobility.net/en/faq/?category=crawling#!aboutourbot'
2739
2740 - regex: 'Vercelbot'
2741 name: 'Vercel Bot'
2742 category: 'Service bot'
2743 url: 'https://vercel.com'
2744
2745 - regex: 'Grammarly'
2746 name: 'Grammarly'
2747 category: 'Service bot'
2748 url: 'https://www.grammarly.com'
2749
2750 - regex: 'Domains Project'
2751 name: 'Domains Project'
2752 category: 'Crawler'
2753 url: 'https://domainsproject.org'
2754
2755 - regex: 'PetalBot'
2756 name: 'Petal Bot'
2757 category: 'Crawler'
2758 url: 'https://aspiegel.com/petalbot'
2759
2760 - regex: 'SerendeputyBot'
2761 name: 'Serendeputy Bot'
2762 category: 'Crawler'
2763 url: 'https://serendeputy.com/about/serendeputy-bot'
2764
2765 - regex: 'ias-(?:va|sg).*admantx.*service-fetcher|admantx\.com.*service-fetcher'
2766 name: 'ADmantX Service Fetcher'
2767 category: 'Service bot'
2768 url: 'https://www.admantx.com/service-fetcher.html'
2769
2770 - regex: 'SemanticScholarBot'
2771 name: 'Semantic Scholar Bot'
2772 category: 'Crawler'
2773 url: 'https://www.semanticscholar.org/crawler'
2774
2775 - regex: 'VelenPublicWebCrawler'
2776 name: 'Velen Public Web Crawler'
2777 category: 'Crawler'
2778 url: 'https://hunter.io/robot'
2779
2780 - regex: 'Barkrowler'
2781 name: 'Barkrowler'
2782 category: 'Crawler'
2783 url: 'http://www.exensa.com/crawl'
2784
2785 - regex: 'BDCbot'
2786 name: 'BDCbot'
2787 category: 'Crawler'
2788 url: 'https://bigweb.bigdatacorp.com.br/pages/faq.aspx'
2789 producer:
2790 name: 'BIG Data Solucoes Em Tecnologia de Informatica LTDA'
2791 url: 'https://bigdatacorp.com.br/'
2792
2793 - regex: 'adbeat'
2794 name: 'Adbeat'
2795 category: 'Crawler'
2796 url: 'https://www.adbeat.com/operation_policy'
2797 producer:
2798 name: 'PPC Labs LLC'
2799 url: 'https://www.adbeat.com/'
2800
2801 - regex: '(?:BuiltWith|BW/)'
2802 name: 'BuiltWith'
2803 category: 'Crawler'
2804 url: 'https://builtwith.com/biup'
2805 producer:
2806 name: 'BuiltWith Pty Ltd'
2807 url: 'https://builtwith.com/'
2808
2809 - regex: 'https://whatis\.contentkingapp\.com'
2810 name: 'ContentKing'
2811 category: 'Site Monitor'
2812 url: 'https://whatis.contentkingapp.com/'
2813 producer:
2814 name: 'ContentKing BV'
2815 url: 'https://www.contentkingapp.com/'
2816
2817 - regex: 'MicroAdBot'
2818 name: 'MicroAdBot'
2819 category: 'Crawler'
2820 url: 'https://www.microad.co.jp/'
2821 producer:
2822 name: 'MicroAd, Inc.'
2823 url: 'https://www.microad.co.jp/'
2824
2825 - regex: 'PingAdmin\.Ru'
2826 name: 'PingAdmin.Ru'
2827 category: 'Site Monitor'
2828 url: 'https://ping-admin.ru/'
2829
2830 - regex: 'notifyninja.+monitoring'
2831 name: 'Notify Ninja'
2832 category: 'Site Monitor'
2833 url: 'http://notifyninja.com'
2834
2835 - regex: 'WebDataStats'
2836 name: 'WebDataStats'
2837 category: 'Crawler'
2838 url: 'https://webdatastats.com/policy.html'
2839 producer:
2840 name: 'WebTehRazrabotka LLC'
2841 url: 'https://webdatastats.com/'
2842
2843 - regex: 'parse\.ly scraper'
2844 name: 'parse.ly'
2845 category: 'Crawler'
2846 url: 'https://www.parse.ly/help/integration/crawler'
2847 producer:
2848 name: 'Parsely, Inc.'
2849 url: 'https://www.parse.ly/'
2850
2851 - regex: 'Nimbostratus-Bot'
2852 name: 'Nimbostratus Bot'
2853 category: 'Site Monitor'
2854 url: 'http://cloudsystemnetworks.com'
2855
2856 - regex: 'HeartRails_Capture'
2857 name: 'HeartRails Capture'
2858 category: 'Service Agent'
2859 url: 'http://capture.heartrails.com'
2860
2861 - regex: 'Project-Resonance'
2862 name: 'Project Resonance'
2863 category: 'Crawler'
2864 url: 'https://project-resonance.com/'
2865 producer:
2866 name: 'RedHunt Labs Limited'
2867 url: 'https://redhuntlabs.com/'
2868
2869 - regex: 'DataXu'
2870 name: 'DataXu'
2871 category: 'Service Agent'
2872 url: 'https://advertising.roku.com/dataxu'
2873 producer:
2874 name: 'Roku, Inc.'
2875 url: 'https://roku.com'
2876
2877 - regex: 'Cocolyzebot'
2878 name: 'Cocolyzebot'
2879 category: 'Crawler'
2880 url: 'https://cocolyze.com/en/cocolyzebot'
2881 producer:
2882 name: 'VSI INNOVATION SAS'
2883 url: 'https://vsi-innovation.com/'
2884
2885 - regex: 'veryhip'
2886 name: 'VeryHip'
2887 category: 'Crawler'
2888 url: 'https://veryhip.com/'
2889 producer:
2890 name: 'VeryHip'
2891 url: 'https://veryhip.com/'
2892
2893 - regex: 'LinkpadBot'
2894 name: 'LinkpadBot'
2895 category: 'Crawler'
2896 url: 'https://www.linkpad.org/'
2897 producer:
2898 name: 'Solomono LLC'
2899 url: 'https://www.linkpad.org/'
2900
2901 - regex: 'MuscatFerret'
2902 name: 'MuscatFerret'
2903 category: 'Crawler'
2904 url: 'http://www.webtop.com/'
2905
2906 - regex: 'PageThing\.com'
2907 name: 'PageThing'
2908 category: 'Crawler'
2909 url: 'https://www.pagething.com/'
2910 producer:
2911 name: 'SPECIALNOISE LTD'
2912 url: 'https://www.specialnoise.com/'
2913
2914 - regex: 'ArchiveBox'
2915 name: 'ArchiveBox'
2916 url: 'https://archivebox.io/'
2917 category: 'Crawler'
2918 producer:
2919 name: ''
2920 url: ''
2921
2922 - regex: 'Choosito'
2923 name: 'Choosito'
2924 url: 'https://www.choosito.com/'
2925 category: 'Crawler'
2926 producer:
2927 name: 'Choosito! Inc.'
2928 url: 'https://www.choosito.com/'
2929
2930 - regex: 'datagnionbot'
2931 name: 'datagnionbot'
2932 url: 'https://www.datagnion.com/bot.html'
2933 category: 'Crawler'
2934 producer:
2935 name: 'DATAGNION GMBH'
2936 url: 'https://www.datagnion.com/'
2937
2938 - regex: 'WhatCMS'
2939 name: 'WhatCMS'
2940 url: 'https://whatcms.org/'
2941 category: 'Crawler'
2942 producer:
2943 name: 'Nineteen Ten LLC'
2944 url: 'https://whatcms.org/'
2945
2946 - regex: 'httpx'
2947 name: 'httpx'
2948 url: 'https://github.com/projectdiscovery/httpx'
2949 category: 'Crawler'
2950 producer:
2951 name: 'ProjectDiscovery, Inc.'
2952 url: 'https://projectdiscovery.io/'
2953
2954 - regex: '.*\.oast\.'
2955 name: 'Interactsh'
2956 category: 'Security Checker'
2957 url: 'https://github.com/projectdiscovery/interactsh'
2958 producer:
2959 name: 'ProjectDiscovery, Inc.'
2960 url: 'https://projectdiscovery.io/'
2961
2962 - regex: '(?:expanseinc|paloaltonetworks)\.com'
2963 name: 'Cortex Xpanse'
2964 category: 'Security Checker'
2965 url: 'https://docs-cortex.paloaltonetworks.com/r/1/Cortex-Xpanse/Scanning-activity'
2966 producer:
2967 name: 'Palo Alto Networks, Inc.'
2968 url: 'https://www.paloaltonetworks.com/'
2969
2970 - regex: 'HuaweiWebCatBot'
2971 name: 'HuaweiWebCatBot'
2972 category: 'Crawler'
2973 url: 'https://isecurity.huawei.com'
2974 producer:
2975 name: 'Huawei Technologies Co., Ltd.'
2976 url: 'https://huawei.com'
2977
2978 - regex: 'Hatena-Favicon'
2979 name: 'Hatena Favicon'
2980 category: 'Crawler'
2981 url: 'https://www.hatena.ne.jp/faq/'
2982 producer:
2983 name: 'Hatena Co., Ltd.'
2984 url: 'https://www.hatena.ne.jp'
2985 - regex: 'Hatena-?Bookmark'
2986 name: 'Hatena Bookmark'
2987 category: 'Crawler'
2988 url: 'https://www.hatena.ne.jp/faq/'
2989 producer:
2990 name: 'Hatena Co., Ltd.'
2991 url: 'https://www.hatena.ne.jp'
2992
2993 - regex: 'RyowlEngine'
2994 name: 'Ryowl'
2995 category: 'Crawler'
2996 url: 'https://ryowl.org'
2997
2998 - regex: 'OdklBot'
2999 name: 'Odnoklassniki Bot'
3000 category: 'Crawler'
3001 url: 'https://odnoklassniki.ru'
3002
3003 - regex: 'Mediatoolkitbot'
3004 name: 'Mediatoolkit Bot'
3005 category: 'Crawler'
3006 url: 'https://mediatoolkit.com'
3007
3008 - regex: 'ZoominfoBot'
3009 name: 'ZoominfoBot'
3010 category: 'Crawler'
3011 url: 'https://www.zoominfo.com'
3012
3013 - regex: 'WeViKaBot'
3014 name: 'WeViKaBot'
3015 category: 'Crawler'
3016 url: 'http://www.wevika.de'
3017
3018 - regex: 'SEOkicks'
3019 name: 'SEOkicks'
3020 category: 'Crawler'
3021 url: 'https://www.seokicks.de/robot.html'
3022 producer:
3023 name: 'SEOkicks'
3024 url: 'https://www.seokicks.de/'
3025
3026 - regex: 'Plukkie'
3027 name: 'Plukkie'
3028 category: 'Crawler'
3029 url: 'http://www.botje.com/plukkie.htm'
3030
3031 - regex: 'proximic;'
3032 name: 'Comscore'
3033 category: 'Crawler'
3034 url: 'https://www.comscore.com/Web-Crawler'
3035
3036 - regex: 'SurdotlyBot'
3037 name: 'SurdotlyBot'
3038 category: 'Crawler'
3039 url: 'http://sur.ly/bot.html'
3040
3041 - regex: 'Gowikibot'
3042 name: 'Gowikibot'
3043 category: 'Crawler'
3044 url: 'http:/www.gowikibot.com'
3045
3046 - regex: 'SabsimBot'
3047 name: 'SabsimBot'
3048 category: 'Crawler'
3049 url: 'https://sabsim.com'
3050
3051 - regex: 'LumtelBot'
3052 name: 'LumtelBot'
3053 category: 'Crawler'
3054 url: 'https://lumtel.com'
3055
3056 - regex: 'PiplBot'
3057 name: 'PiplBot'
3058 category: 'Crawler'
3059 url: 'http://www.pipl.com/bot'
3060
3061 - regex: 'woobot'
3062 name: 'WooRank'
3063 category: 'Crawler'
3064 url: 'https://www.woorank.com/bot'
3065
3066 - regex: 'Cookiebot'
3067 name: 'Cookiebot'
3068 category: 'Crawler'
3069 url: 'https://support.cookiebot.com/hc/en-us/articles/360014264140-Scanner-User-Agent'
3070 producer:
3071 name: 'Cybot A/S'
3072 url: 'https://www.cybot.com/'
3073
3074 - regex: 'NetSystemsResearch'
3075 name: 'NetSystemsResearch'
3076 category: 'Security Checker'
3077 url: 'https://www.netsystemsresearch.com/'
3078 producer:
3079 name: 'NET SYSTEMS RESEARCH LLC'
3080 url: 'https://www.netsystemsresearch.com/'
3081
3082 - regex: 'CensysInspect'
3083 name: 'CensysInspect'
3084 category: 'Security Checker'
3085 url: 'https://about.censys.io/'
3086 producer:
3087 name: 'Censys, Inc.'
3088 url: 'https://censys.io/'
3089
3090 - regex: 'gdnplus\.com'
3091 name: 'GDNP'
3092 category: 'Crawler'
3093 url: 'https://gdnplus.com/'
3094 producer:
3095 name: 'Global Digital Network Plus, LLC'
3096 url: 'https://gdnplus.com/'
3097
3098 - regex: 'WellKnownBot'
3099 name: 'WellKnownBot'
3100 category: 'Crawler'
3101 url: 'https://well-known.dev'
3102
3103 - regex: 'Adsbot'
3104 name: 'Adsbot'
3105 category: 'Crawler'
3106 url: 'https://seostar.co/robot/'
3107
3108 - regex: 'MTRobot'
3109 name: 'MTRobot'
3110 category: 'Crawler'
3111 url: 'https://metrics-tools.de/robot.html'
3112 producer:
3113 name: 'Metrics Tools'
3114 url: 'https://metrics-tools.de/'
3115
3116 - regex: 'serpstatbot'
3117 name: 'serpstatbot'
3118 category: 'Crawler'
3119 url: 'http://serpstatbot.com/'
3120 producer:
3121 name: 'Netpeak Ltd'
3122 url: 'https://netpeak.net/'
3123
3124 - regex: 'colly'
3125 name: 'colly'
3126 category: 'Crawler'
3127 url: 'https://github.com/gocolly/colly/'
3128
3129 - regex: 'l9tcpid'
3130 name: 'l9tcpid'
3131 category: 'Security Checker'
3132 url: 'https://github.com/LeakIX/l9tcpid'
3133
3134 - regex: 'l9explore'
3135 name: 'l9explore'
3136 category: 'Security Checker'
3137 url: 'https://github.com/LeakIX/l9explore'
3138
3139 - regex: 'l9scan/|^Lkx-.*/'
3140 name: 'LeakIX'
3141 category: 'Security Checker'
3142 url: 'https://leakix.net/'
3143 producer:
3144 name: 'BaDaaS SRL'
3145 url: 'https://leakix.net/'
3146
3147 - regex: 'MegaIndex\.ru'
3148 name: 'MegaIndex'
3149 category: 'Crawler'
3150 url: 'https://megaindex.com/crawler'
3151
3152 - regex: 'Seekport'
3153 name: 'Seekport'
3154 category: 'Crawler'
3155 url: 'https://bot.seekport.com/'
3156 producer:
3157 name: 'SISTRIX GmbH'
3158 url: 'https://www.sistrix.de/'
3159
3160 - regex: 'Seolyt(?:Bot)?'
3161 name: 'SeolytBot'
3162 category: 'Crawler'
3163 url: 'https://seolyt.com/'
3164
3165 - regex: 'YaK/'
3166 name: 'YaK'
3167 category: 'Crawler'
3168 url: 'https://www.linkfluence.com/'
3169 producer:
3170 name: 'Linkfluence SAS'
3171 url: 'https://www.linkfluence.com/'
3172
3173 - regex: 'KomodiaBot'
3174 name: 'KomodiaBot'
3175 category: 'Crawler'
3176 url: 'http://www.komodia.com/newwiki/index.php/URL_server_crawler'
3177 producer:
3178 name: 'Komodia Inc.'
3179 url: 'https://www.komodia.com/'
3180
3181 - regex: 'KStandBot'
3182 name: 'KStandBot'
3183 category: 'Crawler'
3184 url: 'https://url-classification.io/wiki/index.php?title=URL_server_crawler'
3185 producer:
3186 name: 'Komodia Inc.'
3187 url: 'https://www.komodia.com/'
3188
3189 - regex: 'Neevabot'
3190 name: 'Neevabot'
3191 category: 'Search bot'
3192 url: 'https://neeva.com/neevabot'
3193 producer:
3194 name: 'Neeva Inc.'
3195 url: 'https://neeva.com/'
3196
3197 - regex: 'Chatwork LinkPreview'
3198 name: 'Chatwork LinkPreview'
3199 category: 'Service Agent'
3200 url: 'https://go.chatwork.com/en/'
3201 producer:
3202 name: 'kubell Co., Ltd.'
3203 url: 'https://www.kubell.com/en/'
3204
3205 - regex: 'LinkPreview'
3206 name: 'LinkPreview'
3207 category: 'Service Agent'
3208 url: 'https://www.linkpreview.net/'
3209
3210 - regex: 'JungleKeyThumbnail'
3211 name: 'JungleKeyThumbnail'
3212 category: 'Crawler'
3213 url: 'https://junglekey.com/'
3214
3215 - regex: 'rocketmonitor(?:bot)?'
3216 name: 'RocketMonitorBot'
3217 category: 'Site Monitor'
3218 url: 'https://www.radiomast.io/docs/stream-monitoring/technical_details.html'
3219 producer:
3220 name: 'Radio Mast, Inc.'
3221 url: 'https://www.radiomast.io/'
3222
3223 - regex: 'SitemapParser-VIPnytt'
3224 name: 'SitemapParser-VIPnytt'
3225 category: 'Crawler'
3226 url: 'https://github.com/VIPnytt/SitemapParser/'
3227
3228 - regex: 'DMBrowser|DMBrowser-[UB]V'
3229 name: 'Dotcom Monitor'
3230 category: 'Site Monitor'
3231 url: 'https://www.dotcom-monitor.com'
3232
3233 - regex: 'DataForSeoBot'
3234 name: 'DataForSeoBot'
3235 category: 'Crawler'
3236 url: 'https://dataforseo.com/dataforseo-bot'
3237
3238 - regex: 'Discordbot'
3239 name: 'Discord Bot'
3240 category: 'Service Agent'
3241 url: 'https://discordapp.com'
3242
3243 - regex: 'Linespider'
3244 name: 'Linespider'
3245 category: 'Crawler'
3246 url: 'https://lin.ee/4dwXkTH'
3247
3248 - regex: 'Cincraw'
3249 name: 'Cincraw'
3250 category: 'Crawler'
3251 url: 'http://cincrawdata.net/bot/'
3252
3253 - regex: 'CISPA Web Analyzer'
3254 name: 'CISPA Web Analyzer'
3255 category: 'Crawler'
3256 url: 'https://notify.cispa.de/'
3257 producer:
3258 name: 'CISPA - Helmholtz-Zentrum für Informationssicherheit gGmbH'
3259 url: 'https://cispa.de/en'
3260
3261 - regex: 'IonCrawl'
3262 name: 'IONOS Crawler'
3263 category: 'Crawler'
3264 url: 'https://www.ionos.de/terms-gtc/faq-crawler-en/'
3265 producer:
3266 name: 'IONOS SE'
3267 url: 'https://www.ionos.de/'
3268
3269 - regex: 'Crawldad'
3270 name: 'Crawldad'
3271 category: 'Crawler'
3272 url: 'https://gist.github.com/jayhardee9/2f2a2c4dba26564ee040ae32e0dd0972'
3273
3274 - regex: 'https://securitytxt-scan\.cs\.hm\.edu/'
3275 name: 'security.txt scanserver'
3276 category: 'Security Checker'
3277 url: 'https://securitytxt-scan.cs.hm.edu/'
3278 producer:
3279 name: 'Hochschule für angewandte Wissenschaften München'
3280 url: 'https://www.hm.edu/'
3281
3282 - regex: 'TigerBot'
3283 name: 'TigerBot'
3284 category: 'Crawler'
3285 url: 'https://tiger.ch/'
3286
3287 - regex: 'TestCrawler'
3288 name: 'TestCrawler'
3289 category: 'Crawler'
3290 url: 'https://www.comcepta.com/'
3291
3292 - regex: 'CrowdTanglebot'
3293 name: 'CrowdTangle'
3294 category: 'Crawler'
3295 url: 'https://help.crowdtangle.com/en/articles/3009319-crowdtangle-bot'
3296 producer:
3297 name: 'CrowdTangle, Inc.'
3298 url: 'https://www.crowdtangle.com/'
3299
3300 - regex: 'Sellers\.Guide Crawler by Primis'
3301 name: 'Sellers.Guide'
3302 category: 'Crawler'
3303 url: 'https://sellers.guide/'
3304 producer:
3305 name: 'McCann Disciplines, Ltd.'
3306 url: 'https://www.primis.tech/'
3307
3308 - regex: 'OnalyticaBot'
3309 name: 'Onalytica'
3310 category: 'Crawler'
3311 url: 'https://www.airslate.com/bot/explore/onalytica-bot'
3312 producer:
3313 name: 'airSlate, Inc.'
3314 url: 'https://www.airslate.com/'
3315
3316 - regex: 'deepnoc'
3317 name: 'deepnoc'
3318 category: 'Crawler'
3319 url: 'https://deepnoc.com/bot'
3320 producer:
3321 name: 'deepnoc, GmbH'
3322 url: 'https://deepnoc.com/'
3323
3324 - regex: 'Newslitbot'
3325 name: 'Newslitbot'
3326 category: 'Crawler'
3327 url: 'https://www.newslit.co/'
3328 producer:
3329 name: 'Newslit, LLC.'
3330 url: 'https://www.newslit.co/'
3331
3332 - regex: 'um-(?:ANS|CC|FC|IC|LN)'
3333 name: 'uMBot'
3334 category: 'Crawler'
3335 url: 'https://www.ubermetrics-technologies.com/'
3336 producer:
3337 name: 'Ubermetrics Technologies GmbH'
3338 url: 'https://www.ubermetrics-technologies.com/'
3339
3340 - regex: 'Abonti'
3341 name: 'Abonti'
3342 category: 'Crawler'
3343 url: 'http://abonti.com/'
3344
3345 - regex: 'collection@infegy\.com'
3346 name: 'Infegy'
3347 category: 'Crawler'
3348 url: 'https://infegy.com/'
3349 producer:
3350 name: 'Infegy, Inc.'
3351 url: 'https://infegy.com/'
3352
3353 - regex: 'HTTP Banner Detection \(https://security\.ipip\.net\)'
3354 name: 'IPIP'
3355 category: 'Security Checker'
3356 url: 'https://security.ipip.net/'
3357 producer:
3358 name: 'Beijing Tiantexin Tech. Co., Ltd.'
3359 url: 'https://en.ipip.net/'
3360
3361 - regex: 'ev-crawler'
3362 name: 'Headline'
3363 category: 'Crawler'
3364 url: 'https://headline.com/legal/crawler'
3365 producer:
3366 name: 'e.ventures Managementgesellschaft mbH'
3367 url: 'https://headline.com/'
3368
3369 - regex: 'webprosbot'
3370 name: 'WebPros'
3371 category: 'Crawler'
3372 url: 'https://webpros.com/'
3373 producer:
3374 name: 'WebPros Holdco B.V.'
3375 url: 'https://webpros.com/'
3376
3377 - regex: 'ELB-HealthChecker'
3378 name: 'Amazon ELB'
3379 category: 'Site Monitor'
3380 url: 'https://aws.amazon.com/elasticloadbalancing/'
3381 producer:
3382 name: 'Amazon.com, Inc.'
3383 url: 'https://www.amazon.com/'
3384
3385 - regex: 'Wheregoes\.com Redirect Checker'
3386 name: 'WhereGoes'
3387 category: 'Crawler'
3388 url: 'https://wheregoes.com/'
3389
3390 - regex: 'project_patchwatch'
3391 name: 'Project Patchwatch'
3392 category: 'Crawler'
3393 url: 'http://66.240.192.82/'
3394
3395 - regex: 'InternetMeasurement'
3396 name: 'InternetMeasurement'
3397 category: 'Crawler'
3398 url: 'https://internet-measurement.com/'
3399
3400 - regex: 'DomainAppender'
3401 name: 'DomainAppender'
3402 category: 'Crawler'
3403 url: 'https://www.profound.net/product/domain_append/'
3404 producer:
3405 name: 'Profound Networks, LLC'
3406 url: 'https://www.profound.net/'
3407
3408 - regex: 'FreeWebMonitoring SiteChecker'
3409 name: 'FreeWebMonitoring'
3410 category: 'Site Monitor'
3411 url: 'https://www.freewebmonitoring.com/bot.html'
3412 producer:
3413 name: 'GreenWave Online, Inc.'
3414 url: 'http://www.greenwaveonline.com/'
3415
3416 - regex: 'Page Modified Pinger'
3417 name: 'Page Modified Pinger'
3418 category: 'Site Monitor'
3419 url: 'https://www.pagemodified.com/'
3420 producer:
3421 name: 'Valley Hosting, LLC'
3422 url: 'https://www.pagemodified.com/'
3423
3424 - regex: 'adstxtlab\.com'
3425 name: 'adstxtlab.com'
3426 category: 'Crawler'
3427 url: 'https://adstxtlab.com/validator.php'
3428 producer:
3429 name: 'Jaohawi AB'
3430 url: 'https://adstxtlab.com/'
3431
3432 - regex: 'Iframely'
3433 name: 'Iframely'
3434 category: 'Crawler'
3435 url: 'https://iframely.com/'
3436 producer:
3437 name: 'Itteco Software, Corp.'
3438 url: 'https://iframely.com/'
3439
3440 - regex: 'DomainStatsBot'
3441 name: 'DomainStatsBot'
3442 category: 'Crawler'
3443 url: 'https://domainstats.com/pages/our-bot'
3444 producer:
3445 name: 'Domainstats Ltd'
3446 url: 'https://domainstats.com/'
3447
3448 - regex: 'aiHitBot'
3449 name: 'aiHitBot'
3450 category: 'Crawler'
3451 url: 'https://www.aihitdata.com/about'
3452
3453 - regex: 'DomainCrawler/'
3454 name: 'DomainCrawler'
3455 category: 'Crawler'
3456 url: 'https://domaincrawler.com/about-us/'
3457
3458 - regex: 'AdAuth'
3459 name: 'AdAuth'
3460 category: 'Crawler'
3461 url: 'https://www.adauth.com'
3462
3463 - regex: 'faveeo\.com'
3464 name: 'Faveeo'
3465 category: 'Crawler'
3466 url: 'http://www.faveeo.com'
3467
3468 - regex: 'kozmonavt\.'
3469 name: 'Kozmonavt'
3470 category: 'Crawler'
3471 url: 'https://kozmonavt.ml'
3472
3473 - regex: 'CriteoBot/'
3474 name: 'CriteoBot'
3475 category: 'Crawler'
3476 url: 'https://www.criteo.com/criteo-crawler/'
3477
3478 - regex: 'PayPal IPN'
3479 name: 'PayPal IPN'
3480 category: 'Service Agent'
3481 url: 'https://developer.paypal.com/api/nvp-soap/ipn/IPNIntro/'
3482 producer:
3483 name: 'PayPal, Inc.'
3484 url: 'https://www.paypal.com/'
3485
3486 - regex: 'MaCoCu'
3487 name: 'MaCoCu'
3488 category: 'Crawler'
3489 url: 'https://www.clarin.si/info/macocu-massive-collection-and-curation-of-monolingual-and-bilingual-data/'
3490 producer:
3491 name: 'Jožef Stefan Institute'
3492 url: 'https://www.ijs.si/ijsw/JSI'
3493
3494 - regex: 'CLASSLA'
3495 name: 'CLASSLA-web'
3496 category: 'Crawler'
3497 url: 'https://www.clarin.si/info/classla-web-crawler/'
3498 producer:
3499 name: 'Jožef Stefan Institute'
3500 url: 'https://www.ijs.si/ijsw/JSI'
3501
3502 - regex: 'dnt-policy@eff\.org'
3503 name: 'EFF Do Not Track Verifier'
3504 category: 'Crawler'
3505 url: 'https://www.eff.org/issues/do-not-track'
3506 producer:
3507 name: 'Electronic Frontier Foundation'
3508 url: 'https://www.eff.org/'
3509
3510 - regex: 'InfoTigerBot'
3511 name: 'InfoTigerBot'
3512 category: 'Crawler'
3513 url: 'https://infotiger.com/bot'
3514 producer:
3515 name: 'Infotiger UG'
3516 url: 'https://infotiger.com/'
3517
3518 - regex: '(?:Birdcrawlerbot|CrawlaDeBot)'
3519 name: 'Birdcrawlerbot'
3520 category: 'Crawler'
3521 url: 'https://crawla.de/de/index.php'
3522 producer:
3523 name: 'Swoppen Systems GmbH'
3524 url: 'https://www.swoppen.com/de'
3525
3526 - regex: 'ScamadviserExternalHit'
3527 name: 'Scamadviser External Hit'
3528 category: 'Crawler'
3529 url: 'https://www.scamadviser.com/'
3530 producer:
3531 name: 'Ecommerce Operations B.V.'
3532 url: 'https://www.scamadviser.com/'
3533
3534 - regex: 'ZaldamoSearchBot'
3535 name: 'Zaldamo'
3536 category: 'Crawler'
3537 url: 'https://www.zaldamo.com/search.html'
3538 producer:
3539 name: 'Zaldamo, LLC.'
3540 url: 'https://www.zaldamo.com/'
3541
3542 - regex: 'AFB'
3543 name: 'Allloadin Favicon Bot'
3544 category: 'Crawler'
3545 url: 'https://allloadin.com/'
3546
3547 - regex: 'LinkWalker'
3548 name: 'LinkWalker'
3549 category: 'Crawler'
3550 url: 'https://www.phishlabs.com/'
3551 producer:
3552 name: 'PhishLabs, Inc.'
3553 url: 'https://www.phishlabs.com/'
3554
3555 - regex: 'RenovateBot'
3556 name: 'RenovateBot'
3557 category: 'Security Checker'
3558 url: 'https://github.com/renovatebot/renovate'
3559 producer:
3560 name: 'White Source Ltd.'
3561 url: 'https://www.mend.io/free-developer-tools/renovate/'
3562
3563 - regex: 'INETDEX-BOT'
3564 name: 'Inetdex Bot'
3565 category: 'Crawler'
3566 url: 'https://www.inetdex.com/'
3567
3568 - regex: 'NETZZAPPEN'
3569 name: 'NETZZAPPEN'
3570 category: 'Crawler'
3571 url: 'https://www.netzzappen.com/'
3572 producer:
3573 name: 'Marc Huemer'
3574 url: 'https://www.netzzappen.com/'
3575
3576 - regex: 'panscient\.com'
3577 name: 'Panscient'
3578 category: 'Crawler'
3579 url: 'https://www.panscient.com/faq.htm'
3580 producer:
3581 name: 'Panscient, Inc.'
3582 url: 'https://www.panscient.com/'
3583
3584 - regex: 'research@pdrlabs\.net'
3585 name: 'PDR Labs'
3586 category: 'Security Checker'
3587 url: 'https://web.archive.org/web/20220420054123/http://www.pdrlabs.net/'
3588 producer:
3589 name: 'PDR Labs'
3590 url: 'https://web.archive.org/web/20220420054123/http://www.pdrlabs.net/'
3591
3592 - regex: 'Nicecrawler'
3593 name: 'NiceCrawler'
3594 category: 'Crawler'
3595 url: 'https://www.nicecrawler.com/'
3596 producer:
3597 name: 'Intelium Corp.'
3598 url: 'https://www.intelium.com/'
3599
3600 - regex: 't3versionsBot'
3601 name: 't3versions'
3602 category: 'Crawler'
3603 url: 'https://www.t3versions.com/bot'
3604 producer:
3605 name: 'Torben Hansen'
3606 url: 'https://www.t3versions.com/'
3607
3608 - regex: 'Crawlson'
3609 name: 'Crawlson'
3610 category: 'Crawler'
3611 url: 'https://www.crawlson.com/about'
3612 producer:
3613 name: 'Crawlson'
3614 url: 'https://www.crawlson.com/'
3615
3616 - regex: 'tchelebi'
3617 name: 'tchelebi'
3618 category: 'Crawler'
3619 url: 'https://tchelebi.io/'
3620 producer:
3621 name: 'NormShield, Inc.'
3622 url: 'https://blackkite.com/'
3623
3624 - regex: 'JobboerseBot'
3625 name: 'JobboerseBot'
3626 category: 'Crawler'
3627 url: 'https://www.xing.com/jobs'
3628 producer:
3629 name: 'New Work SE'
3630 url: 'https://www.xing.com/'
3631
3632 - regex: 'RepoLookoutBot'
3633 name: 'Repo Lookout'
3634 category: 'Security Checker'
3635 url: 'https://www.repo-lookout.org/'
3636 producer:
3637 name: 'Crissy Field GmbH'
3638 url: 'https://www.crissyfield.de/'
3639
3640 - regex: 'PATHspider'
3641 name: 'PATHspider'
3642 category: 'Security Checker'
3643 url: 'https://pathspider.net/'
3644 producer:
3645 name: 'MAMI Project'
3646 url: 'https://mami-project.eu/'
3647
3648 - regex: 'everyfeed-spider'
3649 name: 'Everyfeed'
3650 url: 'https://web.archive.org/web/20050930235914/http://www.everyfeed.com/'
3651 category: 'Feed Fetcher'
3652 producer:
3653 name: ''
3654 url: ''
3655
3656 - regex: 'Exchange check'
3657 name: 'Exchange check'
3658 category: 'Security Checker'
3659 url: 'https://github.com/GossiTheDog/scanning'
3660 producer:
3661 name: 'Kevin Beaumont'
3662 url: 'https://doublepulsar.com/'
3663
3664 - regex: 'Sublinq'
3665 name: 'Sublinq'
3666 category: 'Crawler'
3667 url: 'https://web.archive.org/web/20220626191617/https://sublinq.com/'
3668 producer:
3669 name: ''
3670 url: ''
3671
3672 - regex: 'Gregarius'
3673 name: 'Gregarius'
3674 category: 'Feed Fetcher'
3675 url: 'https://web.archive.org/web/20100614011837/http://devlog.gregarius.net/docs/ua/'
3676 producer:
3677 name: ''
3678 url: ''
3679
3680 - regex: 'COMODO DCV'
3681 name: 'COMODO DCV'
3682 category: 'Service Agent'
3683 url: 'https://www.comodo.com/'
3684 producer:
3685 name: 'Comodo Security Solutions, Inc.'
3686 url: 'https://www.comodo.com/'
3687
3688 - regex: 'Sectigo DCV|acme\.sectigo\.com'
3689 name: 'Sectigo DCV'
3690 category: 'Service Agent'
3691 url: 'https://sectigo.com/'
3692 producer:
3693 name: 'Sectigo Limited'
3694 url: 'https://sectigo.com/'
3695
3696 - regex: 'KlarnaBot-(?:DownloadProductImage|EnrichProducts|PriceWatcher)'
3697 name: 'KlarnaBot'
3698 category: 'Crawler'
3699 url: 'https://docs.klarna.com/klarna-bot/'
3700 producer:
3701 name: 'Klarna Bank AB'
3702 url: 'https://www.klarna.com/'
3703
3704 - regex: 'Taboolabot'
3705 name: 'Taboolabot'
3706 category: 'Crawler'
3707 url: 'https://help.taboola.com/hc/en-us/articles/115002347594-The-Taboola-Crawler'
3708 producer:
3709 name: 'Taboola, Inc.'
3710 url: 'https://www.taboola.com/'
3711
3712 - regex: 'Asana'
3713 name: 'Asana'
3714 category: 'Crawler'
3715 url: 'https://asana.com/'
3716 producer:
3717 name: 'Asana, Inc.'
3718 url: 'https://asana.com/'
3719
3720 - regex: 'Chrome Privacy Preserving Prefetch Proxy'
3721 name: 'Chrome Privacy Preserving Prefetch Proxy'
3722 category: 'Service Agent'
3723 url: 'https://developer.chrome.com/blog/private-prefetch-proxy/'
3724 producer:
3725 name: 'Google Inc.'
3726 url: 'https://www.google.com/'
3727
3728 - regex: 'URLinspectorBot'
3729 name: 'URLinspector'
3730 category: 'Site Monitor'
3731 url: 'https://www.urlinspector.com/bot/'
3732 producer:
3733 name: 'LinkResearchTools GmbH'
3734 url: 'https://www.linkresearchtools.com/'
3735
3736 - regex: 'EntferBot'
3737 name: 'Entfer'
3738 category: 'Crawler'
3739 url: 'https://entfer.com/'
3740 producer:
3741 name: 'Entfer Ltd.'
3742 url: 'https://entfer.com/'
3743
3744 - regex: 'TagInspector'
3745 name: 'Tag Inspector'
3746 category: 'Crawler'
3747 url: 'https://taginspector.com/'
3748 producer:
3749 name: 'InfoTrust, LLC'
3750 url: 'https://infotrust.com/'
3751
3752 - regex: 'pageburst'
3753 name: 'Pageburst'
3754 category: 'Crawler'
3755 url: 'https://pageburstls.elsevier.com/'
3756 producer:
3757 name: 'Elsevier Ltd'
3758 url: 'https://www.elsevier.com/'
3759
3760 - regex: 'Doximity-Diffbot'
3761 name: 'Doximity-Diffbot'
3762 category: 'AI Data Scraper'
3763 url: 'https://docs.diffbot.com/docs/getting-started-with-crawl'
3764 producer:
3765 name: 'Diffbot Technologies Corp.'
3766 url: 'https://www.diffbot.com/'
3767
3768 - regex: '.+diffbot'
3769 name: 'Diffbot'
3770 category: 'AI Data Scraper'
3771 url: 'https://docs.diffbot.com/docs/getting-started-with-crawl'
3772 producer:
3773 name: 'Diffbot Technologies Corp.'
3774 url: 'https://www.diffbot.com/'
3775
3776 - regex: 'DisqusAdstxtCrawler'
3777 name: 'Disqus'
3778 category: 'Crawler'
3779 url: 'https://help.disqus.com/en/articles/1765357-ads-txt-implementation-guide'
3780 producer:
3781 name: 'Disqus, Inc.'
3782 url: 'https://disqus.com/'
3783
3784 - regex: 'startmebot'
3785 name: 'start.me'
3786 category: 'Crawler'
3787 url: 'https://about.start.me/'
3788 producer:
3789 name: 'start.me BV'
3790 url: 'https://about.start.me/'
3791
3792 - regex: '2ip bot'
3793 name: '2ip'
3794 category: 'Crawler'
3795 url: 'https://2ip.io/'
3796
3797 - regex: 'ReqBin Curl Client'
3798 name: 'ReqBin'
3799 category: 'Crawler'
3800 url: 'https://reqbin.com/curl'
3801
3802 - regex: 'XoviBot'
3803 name: 'XoviBot'
3804 category: 'Crawler'
3805 url: 'https://www.xovibot.net'
3806 producer:
3807 name: 'Xovi GmbH'
3808 url: 'http://www.xovi.de'
3809
3810 - regex: 'Overcast/.+Podcast Sync'
3811 name: 'Overcast Podcast Sync'
3812 category: 'Service Agent'
3813 url: 'https://overcast.fm/podcasterinfo'
3814
3815 - regex: '^Verity'
3816 name: 'GumGum Verity'
3817 category: 'Service Agent'
3818 url: 'https://gumgum.com/verity'
3819
3820 - regex: 'hackermention'
3821 name: 'hackermention'
3822 category: 'Feed Reader'
3823 url: 'https://github.com/snarfed/hackermention'
3824
3825 - regex: 'BitSightBot'
3826 name: 'BitSight'
3827 category: 'Security Checker'
3828 url: 'https://www.bitsight.com/'
3829 producer:
3830 name: 'BitSight Technologies, Inc.'
3831 url: 'https://www.bitsight.com/'
3832
3833 - regex: 'Ezgif'
3834 name: 'Ezgif'
3835 category: 'Service Agent'
3836 url: 'https://ezgif.com/about'
3837
3838 - regex: 'intelx\.io_bot'
3839 name: 'Intelligence X'
3840 category: 'Crawler'
3841 url: 'https://intelx.io/'
3842 producer:
3843 name: 'Kleissner Investments s.r.o.'
3844 url: 'https://intelx.io/'
3845
3846 - regex: 'FemtosearchBot'
3847 name: 'Femtosearch'
3848 category: 'Crawler'
3849 url: 'http://femtosearch.com/'
3850 producer:
3851 name: 'Grier Forensics, LLC'
3852 url: 'https://www.grierforensics.com/'
3853
3854 - regex: 'AdsTxtCrawler/'
3855 name: 'AdsTxtCrawler'
3856 category: 'Crawler'
3857 url: 'https://github.com/InteractiveAdvertisingBureau/adstxtcrawler'
3858 producer:
3859 name: 'IAB Technology Laboratory, Inc.'
3860 url: 'https://iabtechlab.com/'
3861
3862 - regex: 'Morningscore'
3863 name: 'Morningscore Bot'
3864 category: 'Crawler'
3865 url: 'https://morningscore.io/'
3866 producer:
3867 name: 'Morningscore'
3868 url: 'https://morningscore.io/'
3869
3870 - regex: 'Uptime-Kuma'
3871 name: 'Uptime-Kuma'
3872 category: 'Site Monitor'
3873 url: 'https://github.com/louislam/uptime-kuma'
3874
3875 - regex: 'OAI-SearchBot'
3876 name: 'OAI-SearchBot'
3877 category: 'AI Search Crawler'
3878 url: 'https://platform.openai.com/docs/bots'
3879 producer:
3880 name: 'OpenAI OpCo, LLC'
3881 url: 'https://openai.com/'
3882
3883 - regex: 'GPTBot'
3884 name: 'GPTBot'
3885 category: 'AI Data Scraper'
3886 url: 'https://platform.openai.com/docs/bots'
3887 producer:
3888 name: 'OpenAI OpCo, LLC'
3889 url: 'https://openai.com/'
3890
3891 - regex: 'ChatGPT-User'
3892 name: 'ChatGPT-User'
3893 category: 'AI Assistant'
3894 url: 'https://platform.openai.com/docs/bots'
3895 producer:
3896 name: 'OpenAI OpCo, LLC'
3897 url: 'https://openai.com/'
3898
3899 - regex: 'ChatGPT-Browser'
3900 name: 'ChatGPT-Browser'
3901 category: 'AI Assistant'
3902 url: 'https://platform.openai.com/docs/bots'
3903 producer:
3904 name: 'OpenAI OpCo, LLC'
3905 url: 'https://openai.com/'
3906
3907 - regex: 'BrightEdge Crawler'
3908 name: 'BrightEdge'
3909 category: 'Crawler'
3910 url: 'https://www.brightedge.com/'
3911 producer:
3912 name: 'BrightEdge Technologies, Inc'
3913 url: 'https://www.brightedge.com/'
3914
3915 - regex: 'sfFeedReader'
3916 name: 'sfFeedReader'
3917 url: 'https://github.com/diem-project/sfFeed2Plugin'
3918 category: 'Feed Fetcher'
3919
3920 - regex: 'cyberscan\.io'
3921 name: 'Cyberscan'
3922 category: 'Security Checker'
3923 url: 'https://www.cyberscan.io/'
3924 producer:
3925 name: 'DGC Verwaltungs GmbH'
3926 url: 'https://dgc.org/'
3927
3928 - regex: 'researchscan\.comsys\.rwth-aachen\.de'
3929 name: 'Research Scan'
3930 category: 'Crawler'
3931 url: 'http://researchscan.comsys.rwth-aachen.de/'
3932 producer:
3933 name: 'RWTH Aachen University'
3934 url: 'https://www.comsys.rwth-aachen.de/'
3935
3936 - regex: 'newspaper'
3937 name: 'Scraping Robot'
3938 category: 'Crawler'
3939 url: 'https://scrapingrobot.com/'
3940 producer:
3941 name: 'Sprious LLC'
3942 url: 'https://sprious.com/'
3943
3944 - regex: 'Ant(?:\.com beta|Bot)'
3945 name: 'Ant'
3946 category: 'Crawler'
3947 url: 'https://www.ant.com/'
3948 producer:
3949 name: 'Ant.com Ltd.'
3950 url: 'https://www.ant.com/'
3951
3952 - regex: 'WebwikiBot'
3953 name: 'Webwiki'
3954 category: 'Crawler'
3955 url: 'https://www.webwiki.com/'
3956 producer:
3957 name: 'webwiki GmbH'
3958 url: 'https://www.webwiki.com/'
3959
3960 - regex: 'phpMyAdmin'
3961 name: 'phpMyAdmin'
3962 category: 'Service Agent'
3963 url: 'https://www.phpmyadmin.net/'
3964
3965 - regex: 'Matomo/[\d.]+'
3966 name: 'Matomo'
3967 category: 'Service Agent'
3968 url: 'https://github.com/matomo-org/matomo'
3969 producer:
3970 name: 'InnoCraft Ltd'
3971 url: 'https://matomo.org/'
3972
3973 - regex: 'Prometheus'
3974 name: 'Prometheus'
3975 category: 'Service Agent'
3976 url: 'https://github.com/prometheus/prometheus'
3977 producer:
3978 name: 'The Linux Foundation'
3979 url: 'https://www.cncf.io/'
3980
3981 - regex: 'ArchiveTeam ArchiveBot'
3982 name: 'ArchiveBot'
3983 category: 'Crawler'
3984 url: 'https://wiki.archiveteam.org/index.php?title=ArchiveBot'
3985 producer:
3986 name: 'ArchiveTeam'
3987 url: 'https://wiki.archiveteam.org/'
3988
3989 - regex: 'MADBbot'
3990 name: 'MADBbot'
3991 category: 'Crawler'
3992 url: 'https://madb.zapto.org/bot.html'
3993
3994 - regex: 'MeltwaterNews'
3995 name: 'MeltwaterNews'
3996 category: 'Crawler'
3997 producer:
3998 name: 'Meltwater Deutschland GmbH'
3999 url: 'https://www.meltwater.com/'
4000
4001 - regex: 'owler'
4002 name: 'OWLer'
4003 category: 'Crawler'
4004 url: 'https://openwebsearch.eu/owler/'
4005 producer:
4006 name: 'Open Search Foundation e.V.'
4007 url: 'https://openwebsearch.eu/'
4008
4009 - regex: 'bbc\.co\.uk/display/men/Page\+Monitor'
4010 name: 'BBC Page Monitor'
4011 category: 'Site Monitor'
4012 url: 'https://confluence.dev.bbc.co.uk/display/men/Page+Monitor'
4013 producer:
4014 name: 'BBC'
4015 url: 'https://www.bbc.com/'
4016
4017 - regex: 'BBC-Forge-URL-Monitor-Twisted'
4018 name: 'BBC Forge URL Monitor'
4019 category: 'Site Monitor'
4020 url: 'https://www.bbc.com/'
4021 producer:
4022 name: 'BBC'
4023 url: 'https://www.bbc.com/'
4024
4025 - regex: 'ClaudeBot|Anthropic-Claude'
4026 name: 'ClaudeBot'
4027 category: 'AI Data Scraper'
4028 url: 'https://support.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler'
4029 producer:
4030 name: 'Anthropic PBC'
4031 url: 'https://www.anthropic.com/'
4032
4033 - regex: 'Claude-SearchBot'
4034 name: 'Claude-SearchBot'
4035 category: 'AI Search Crawler'
4036 url: 'https://support.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler'
4037 producer:
4038 name: 'Anthropic PBC'
4039 url: 'https://www.anthropic.com/'
4040
4041 - regex: 'Claude-User'
4042 name: 'Claude-User'
4043 category: 'AI Assistant'
4044 url: 'https://support.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler'
4045 producer:
4046 name: 'Anthropic PBC'
4047 url: 'https://www.anthropic.com/'
4048
4049 - regex: 'Claude-Web'
4050 name: 'Claude-Web'
4051 category: 'AI Search Crawler'
4052 url: 'https://support.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler'
4053 producer:
4054 name: 'Anthropic PBC'
4055 url: 'https://www.anthropic.com/'
4056
4057 - regex: 'Imagesift'
4058 name: 'ImageSift'
4059 category: 'AI Data Scraper'
4060 url: 'https://imagesift.com/'
4061 producer:
4062 name: 'Castle Global, Inc.'
4063 url: 'https://thehive.ai/'
4064
4065 - regex: 'TactiScout'
4066 name: 'TactiScout'
4067 category: 'Crawler'
4068 url: 'https://find-it.world/TempCrawl/Crawltheque.php'
4069 producer:
4070 name: 'Tactikast'
4071
4072 - regex: 'Brightbot'
4073 name: 'BrightBot'
4074 category: 'Crawler'
4075 url: 'https://www.brightbot.app/'
4076 producer:
4077 name: 'Bright Interactive Ltd'
4078 url: 'https://www.builtbybright.com/'
4079
4080 - regex: 'DaspeedBot'
4081 name: 'DaspeedBot'
4082 category: 'Crawler'
4083 url: 'https://daspeed.io/'
4084 producer:
4085 name: 'DAWAP SARL'
4086 url: 'https://dawap.fr/'
4087
4088 - regex: 'StractBot'
4089 name: 'Stract'
4090 category: 'Crawler'
4091 url: 'https://stract.com/webmasters'
4092 producer:
4093 name: 'Stract'
4094 url: 'https://github.com/StractOrg/stract/'
4095
4096 - regex: 'GeedoBot'
4097 name: 'GeedoBot'
4098 category: 'Crawler'
4099 url: 'https://geedo.com/bot/'
4100
4101 - regex: 'GeedoProductSearch'
4102 name: 'GeedoProductSearch'
4103 category: 'Crawler'
4104 url: 'https://geedo.com/product-search/'
4105
4106 - regex: 'BackupLand'
4107 name: 'BackupLand'
4108 category: 'Crawler'
4109 url: 'https://go.backupland.com/'
4110 producer:
4111 name: 'ООО «КВАРТА»'
4112 url: 'https://go.backupland.com/'
4113
4114 - regex: 'Konturbot'
4115 name: 'Konturbot'
4116 category: 'Crawler'
4117 url: 'https://kontur.ru/'
4118 producer:
4119 name: 'АО «ПФ «СКБ Контур»'
4120 url: 'https://kontur.ru/'
4121
4122 - regex: 'keys-so-bot'
4123 name: 'Keys.so'
4124 category: 'Crawler'
4125 url: 'https://www.keys.so/'
4126 producer:
4127 name: 'ООО «МОДЕСКО»'
4128 url: 'https://www.modesco.ru/'
4129
4130 - regex: 'LetsearchBot'
4131 name: 'LetSearch'
4132 category: 'Crawler'
4133 url: 'https://letsearch.ru/bots'
4134
4135 - regex: 'Example3'
4136 name: 'Example3'
4137 category: 'Crawler'
4138 url: 'https://www.example3.com/'
4139
4140 - regex: 'StatOnlineRuBot'
4141 name: 'StatOnline.ru'
4142 category: 'Crawler'
4143 url: 'https://statonline.ru/'
4144 producer:
4145 name: 'ООО «Регистратор доменны�
4146 имен РЕГ.РУ»'
4147 url: 'https://statonline.ru/'
4148
4149 - regex: 'Spawning-AI'
4150 name: 'Spawning AI'
4151 category: 'Crawler'
4152 url: 'https://spawning.ai/'
4153 producer:
4154 name: 'Spawning, Inc'
4155 url: 'https://spawning.ai/'
4156
4157 - regex: 'domain research project'
4158 name: 'Domain Research Project'
4159 category: 'Crawler'
4160 url: 'https://trentwil.es/domains.html'
4161 producer:
4162 name: 'Trent Wiles'
4163 url: 'https://trentwil.es/'
4164
4165 - regex: 'getodin\.com'
4166 name: 'Odin'
4167 category: 'Security Checker'
4168 url: 'https://docs.getodin.com/'
4169 producer:
4170 name: 'Cyble Inc.'
4171 url: 'https://cyble.com/'
4172
4173 - regex: 'YouBot'
4174 name: 'YouBot'
4175 category: 'AI Search Crawler'
4176 url: 'https://about.you.com/youbot/'
4177 producer:
4178 name: 'SuSea, Inc.'
4179 url: 'https://you.com/'
4180
4181 - regex: 'SiteScoreBot'
4182 name: 'SiteScore'
4183 category: 'Crawler'
4184 url: 'https://sitescore.ai/'
4185
4186 - regex: 'MBCrawler'
4187 name: 'Monitor Backlinks'
4188 category: 'Crawler'
4189 url: 'https://www.seoptimer.com/monitor-backlinks/'
4190 producer:
4191 name: 'SEOptimer'
4192 url: 'https://www.seoptimer.com/'
4193
4194 - regex: 'mariadb-mysql-kbs-bot'
4195 name: 'MariaDB/MySQL Knowledge Base'
4196 category: 'Crawler'
4197 url: 'https://github.com/williamdes/mariadb-mysql-kbs'
4198 producer:
4199 name: 'WDES SAS'
4200 url: 'https://wdes.fr/en/'
4201
4202 - regex: 'GitHubCopilotChat'
4203 name: 'GitHubCopilotChat'
4204 category: 'AI Assistant'
4205 url: 'https://github.com/microsoft/vscode-copilot-chat'
4206
4207 - regex: '^pdrl\.fm'
4208 name: 'Podroll Analyzer'
4209 category: 'Crawler'
4210 url: 'https://podroll.fm'
4211
4212 - regex: 'PodUptime/'
4213 name: 'PodUptime'
4214 category: 'Site Monitor'
4215 url: 'https://poduptime.com'
4216
4217 - regex: 'anthropic-ai'
4218 name: 'Anthropic AI'
4219 category: 'AI Data Scraper'
4220 url: 'https://www.anthropic.com/'
4221 producer:
4222 name: 'Anthropic, PBC'
4223 url: 'https://www.anthropic.com/'
4224
4225 - regex: 'NetpeakCheckerBot'
4226 name: 'Netpeak Checker'
4227 category: 'Crawler'
4228 url: 'https://netpeaksoftware.com/checker'
4229 producer:
4230 name: 'Netpeak LTD'
4231 url: 'https://netpeaksoftware.com/'
4232
4233 - regex: 'SandobaCrawler'
4234 name: 'Sandoba//Crawler'
4235 category: 'Crawler'
4236 url: 'https://www.sandoba.com/en/crawler/'
4237 producer:
4238 name: 'SANDOBA//EBUSINESS SOLUTIONS'
4239 url: 'https://www.sandoba.com/'
4240
4241 - regex: 'SirdataBot'
4242 name: 'Sirdata'
4243 category: 'Crawler'
4244 url: 'https://semantic-api.docs.sirdata.net/contextual-api/contextual-api/introduction'
4245 producer:
4246 name: 'Sirdata SAS'
4247 url: 'https://www.sirdata.com/'
4248
4249 - regex: 'CheckMarkNetwork'
4250 name: 'CheckMark Network'
4251 category: 'Crawler'
4252 url: 'https://www.checkmarknetwork.com/spider.html/'
4253 producer:
4254 name: 'Exipert, Inc.'
4255 url: 'https://www.checkmarknetwork.com/'
4256
4257 - regex: 'cohere-ai'
4258 name: 'Cohere AI'
4259 category: 'AI Data Scraper'
4260 url: 'https://cohere.com/'
4261 producer:
4262 name: 'Cohere, Inc.'
4263 url: 'https://cohere.com/'
4264
4265 - regex: 'Cohere-Command'
4266 name: 'Cohere-Command'
4267 category: 'AI Data Scraper'
4268 url: 'https://cohere.com/'
4269 producer:
4270 name: 'Cohere, Inc.'
4271 url: 'https://cohere.com/'
4272
4273 - regex: 'cohere-training'
4274 name: 'cohere-training-data-crawler'
4275 category: 'AI Data Scraper'
4276 url: 'https://cohere.com/'
4277 producer:
4278 name: 'Cohere, Inc.'
4279 url: 'https://cohere.com/'
4280
4281 - regex: 'PerplexityBot'
4282 name: 'PerplexityBot'
4283 category: 'AI Search Crawler'
4284 url: 'https://docs.perplexity.ai/guides/bots'
4285 producer:
4286 name: 'Perplexity AI, Inc.'
4287 url: 'https://www.perplexity.ai/'
4288
4289 - regex: 'Perplexity-User'
4290 name: 'Perplexity-User'
4291 category: 'AI Assistant'
4292 url: 'https://docs.perplexity.ai/guides/bots'
4293 producer:
4294 name: 'Perplexity AI, Inc.'
4295 url: 'https://www.perplexity.ai/'
4296
4297 - regex: 'TTD-Content'
4298 name: 'The Trade Desk Content'
4299 category: 'Crawler'
4300 url: 'https://www.thetradedesk.com/us/ttd-content'
4301 producer:
4302 name: 'The Trade Desk, Inc.'
4303 url: 'https://www.thetradedesk.com/'
4304
4305 - regex: 'montastic-monitor'
4306 name: 'Montastic Monitor'
4307 category: 'Site Monitor'
4308 url: 'https://www.montastic.com/'
4309 producer:
4310 name: 'Metadot, Corp.'
4311 url: 'https://www.metadot.com/'
4312
4313 - regex: 'Ruby, Twurly v'
4314 name: 'Twurly'
4315 category: 'Crawler'
4316 url: 'https://twurly.org/'
4317
4318 - regex: 'Mixnode(?:Cache)?'
4319 name: 'Mixnode'
4320 category: 'Crawler'
4321 url: 'https://www.mixnode.com/'
4322 producer:
4323 name: 'Mixnode Technologies, Inc.'
4324 url: 'https://www.mixnode.com/'
4325
4326 - regex: 'CSSCheck'
4327 name: 'CSSCheck'
4328 category: 'Validator'
4329
4330 - regex: 'MicrosoftPreview'
4331 name: 'Microsoft Preview'
4332 category: 'Service Agent'
4333 url: 'https://www.bing.com/webmasters/help/which-crawlers-does-bing-use-8c184ec0'
4334 producer:
4335 name: 'Microsoft Corporation'
4336 url: 'https://www.microsoft.com/'
4337
4338 - regex: 's~virustotalcloud'
4339 name: 'VirusTotal Cloud'
4340 category: 'Crawler'
4341 url: 'https://www.virustotal.com/'
4342 producer:
4343 name: 'Chronicle Security Ireland Limited'
4344 url: 'https://chronicle.security/'
4345
4346 - regex: 'TinEye'
4347 name: 'TinEye'
4348 category: 'Crawler'
4349 url: 'https://tineye.com/'
4350 producer:
4351 name: 'Idée, Inc.'
4352 url: 'https://tineye.com/'
4353
4354 - regex: 'e~arsnova-filter-system'
4355 name: 'ARSNova Filter System'
4356 category: 'Crawler'
4357 url: 'https://particify.de/en/'
4358 producer:
4359 name: 'Particify Gerhardt & Weingarten OHG'
4360 url: 'https://particify.de/en/'
4361
4362 - regex: 'botify'
4363 name: 'Botify'
4364 category: 'Crawler'
4365 url: 'https://www.botify.com/'
4366 producer:
4367 name: 'BOTIFY SAS'
4368 url: 'https://www.botify.com/'
4369
4370 - regex: 'adscanner'
4371 name: 'Adscanner'
4372 category: 'Crawler'
4373 url: 'https://www.alleyesonscreens.com/'
4374 producer:
4375 name: 'AdScanner d.o.o'
4376 url: 'https://www.alleyesonscreens.com/'
4377
4378 - regex: 'online-webceo-bot'
4379 name: 'WebCEO'
4380 category: 'Crawler'
4381 url: 'https://www.webceo.com/'
4382 producer:
4383 name: 'WebCEO, LLC'
4384 url: 'https://www.webceo.com/'
4385
4386 - regex: 'NetTrack'
4387 name: 'NetTrack'
4388 category: 'Crawler'
4389 url: 'https://web.archive.org/web/20160607151934/https://nettrack.info/'
4390
4391 - regex: 'htmlyse'
4392 name: 'htmlyse'
4393 category: 'Crawler'
4394 url: 'https://www.htmlyse.com/'
4395 producer:
4396 name: 'Vistex LTD'
4397 url: 'https://www.htmlyse.com/'
4398
4399 - regex: 'TrendsmapResolver'
4400 name: 'Trendsmap'
4401 category: 'Crawler'
4402 url: 'https://www.trendsmap.com/'
4403 producer:
4404 name: 'Trendsmap Pty Ltd'
4405 url: 'https://www.trendsmap.com/'
4406
4407 - regex: 'Shareaholic(?:bot)?'
4408 name: 'Steve Bot'
4409 category: 'Crawler'
4410 url: 'https://www.shareaholic.com/steve'
4411 producer:
4412 name: 'Shareaholic, Inc.'
4413 url: 'https://www.shareaholic.com/'
4414
4415 - regex: 'keycdn-tools:'
4416 name: 'KeyCDN Tools'
4417 category: 'Service Agent'
4418 url: 'https://tools.keycdn.com/geo'
4419
4420 - regex: 'keycdn-tools/'
4421 name: 'KeyCDN Tools'
4422 category: 'Service Agent'
4423 url: 'https://tools.keycdn.com/'
4424 producer:
4425 name: 'proinity LLC'
4426 url: 'https://www.keycdn.com/'
4427
4428 - regex: 'Arquivo-web-crawler'
4429 name: 'Arquivo.pt'
4430 category: 'Crawler'
4431 url: 'https://sobre.arquivo.pt/en/help/crawling-and-archiving-web-content/'
4432 producer:
4433 name: 'FCT|FCCN'
4434 url: 'https://www.fct.pt/'
4435
4436 - regex: 'WhatsMyIP\.org'
4437 name: 'WhatsMyIP.org'
4438 category: 'Service Agent'
4439 url: 'https://www.whatsmyip.org/ua/'
4440
4441 - regex: 'SenutoBot'
4442 name: 'Senuto'
4443 category: 'Crawler'
4444 url: 'https://www.senuto.com/'
4445 producer:
4446 name: 'Senuto Sp. z o.o.'
4447 url: 'https://www.senuto.com/'
4448
4449 - regex: 'GozleBot'
4450 name: 'Gozle'
4451 category: 'Crawler'
4452 url: 'https://gozle.com.tm/en/blog/post/1'
4453 producer:
4454 name: 'Doly Horjun HJ'
4455 url: 'https://gozle.com.tm/'
4456
4457 - regex: 'Quantcastbot'
4458 name: 'Quantcast'
4459 category: 'Crawler'
4460 url: 'https://www.quantcast.com/bot/'
4461 producer:
4462 name: 'Quantcast Corp.'
4463 url: 'https://www.quantcast.com/'
4464
4465 - regex: 'FontRadar'
4466 name: 'FontRadar'
4467 category: 'Crawler'
4468 url: 'https://www.fontradar.com/'
4469 producer:
4470 name: 'EMDASH SAS'
4471 url: 'https://www.fontradar.com/'
4472
4473 - regex: 'ViberUrlDownloader'
4474 name: 'Viber Url Downloader'
4475 category: 'Service Agent'
4476 url: 'https://www.viber.com/'
4477 producer:
4478 name: 'Viber Media S.à r.l.'
4479 url: 'https://www.viber.com/'
4480
4481 - regex: '^Zeno$'
4482 name: 'Zeno'
4483 category: 'Crawler'
4484 url: 'https://github.com/internetarchive/Zeno'
4485 producer:
4486 name: 'The Internet Archive'
4487 url: 'https://archive.org/'
4488
4489 - regex: 'Barracuda Sentinel'
4490 name: 'Barracuda Sentinel'
4491 category: 'Service Agent'
4492 url: 'https://sentinel.barracudanetworks.com/'
4493 producer:
4494 name: 'Barracuda Networks, Inc.'
4495 url: 'https://www.barracudanetworks.com/'
4496
4497 - regex: 'RuxitSynthetic'
4498 name: 'RuxitSynthetic'
4499 category: 'Site Monitor'
4500 url: 'https://community.dynatrace.com/t5/Troubleshooting/Basic-Commands-for-Synthetic/ta-p/198164'
4501 producer:
4502 name: 'Dynatrace LLC'
4503 url: 'https://www.dynatrace.com/'
4504
4505 - regex: 'DynatraceSynthetic'
4506 name: 'DynatraceSynthetic'
4507 category: 'Site Monitor'
4508 url: 'https://community.dynatrace.com/t5/Troubleshooting/Basic-Commands-for-Synthetic/ta-p/198164'
4509 producer:
4510 name: 'Dynatrace LLC'
4511 url: 'https://www.dynatrace.com/'
4512
4513 - regex: 'sitebulb'
4514 name: 'Sitebulb'
4515 category: 'Crawler'
4516 url: 'https://sitebulb.com/'
4517 producer:
4518 name: 'Sitebulb Limited'
4519 url: 'https://sitebulb.com/'
4520
4521 - regex: 'Monsidobot'
4522 name: 'Monsidobot'
4523 category: 'Crawler'
4524 url: 'https://monsido.com/bot-html'
4525 producer:
4526 name: 'Monsido LLC'
4527 url: 'https://monsido.com/'
4528
4529 - regex: 'AccompanyBot'
4530 name: 'AccompanyBot'
4531 category: 'Crawler'
4532 url: 'https://www.accompany.com/'
4533 producer:
4534 name: 'Accompani, Inc'
4535 url: 'https://www.accompany.com/'
4536
4537 - regex: 'Ghost Inspector'
4538 name: 'Ghost Inspector'
4539 category: 'Site Monitor'
4540 url: 'https://docs.ghostinspector.com/faq/#how-do-i-detect-ghost-inspector-test-runner-traffic-on-my-site'
4541 producer:
4542 name: 'Ghost Inspector, Inc.'
4543 url: 'https://www.ghostinspector.com/'
4544
4545 - regex: 'Google-Apps-Script'
4546 name: 'Google Apps Script'
4547 category: 'Service Agent'
4548 url: 'https://www.google.com/script/start/'
4549
4550 - regex: 'SiteOne-Crawler'
4551 name: 'SiteOne Crawler'
4552 category: 'Crawler'
4553 url: 'https://crawler.siteone.io/bot/'
4554 producer:
4555 name: 'SiteOne s.r.o.'
4556 url: 'https://www.siteone.io/'
4557
4558 - regex: 'Detectify'
4559 name: 'Detectify'
4560 category: 'Security Checker'
4561 url: 'https://support.detectify.com/support/solutions/articles/48001049001-how-to-allow-detectify-to-access-your-site'
4562 producer:
4563 name: 'Detectify AB'
4564 url: 'https://detectify.com/'
4565
4566 - regex: 'DomCopBot'
4567 name: 'DomCop Bot'
4568 category: 'Crawler'
4569 url: 'https://www.domcop.com/bot'
4570 producer:
4571 name: 'Axeman Technology Solutions LLP'
4572 url: 'https://axemantech.com/'
4573
4574 - regex: 'Paqlebot'
4575 name: 'Paqlebot'
4576 category: 'Crawler'
4577 url: 'https://www.paqle.dk/about/paqlebot'
4578 producer:
4579 name: 'Paqle A/S'
4580 url: 'https://www.paqle.dk/'
4581
4582 - regex: 'Wibybot'
4583 name: 'Wibybot'
4584 category: 'Crawler'
4585 url: 'https://www.wiby.me/'
4586
4587 - regex: 'Synapse'
4588 name: 'Synapse'
4589 category: 'Crawler'
4590 url: 'https://github.com/matrix-org/synapse'
4591
4592 - regex: 'OSZKbot'
4593 name: 'OSZKbot'
4594 category: 'Crawler'
4595 url: 'http://mekosztaly.oszk.hu/mia/'
4596 producer:
4597 name: 'National Szechenyi Library'
4598 url: 'https://webarchivum.oszk.hu/'
4599
4600 - regex: 'ZoomBot'
4601 name: 'ZoomBot'
4602 category: 'Crawler'
4603 url: 'https://suite.seozoom.it/bot.html'
4604 producer:
4605 name: 'SEO Cube S.r.l.'
4606 url: 'https://www.seocube.it/'
4607
4608 - regex: 'RavenCrawler'
4609 name: 'RavenCrawler'
4610 category: 'Crawler'
4611 url: 'https://raventools.com/site-auditor/'
4612 producer:
4613 name: 'TapClicks, Inc.'
4614 url: 'https://www.tapclicks.com/'
4615
4616 - regex: 'KadoBot'
4617 name: 'KadoBot'
4618 category: 'Crawler'
4619 url: 'https://www.kadolijst.nl/bot'
4620 producer:
4621 name: 'Kadolijst'
4622 url: 'https://www.kadolijst.nl/'
4623
4624 - regex: 'Dubbotbot'
4625 name: 'Dubbotbot'
4626 category: 'Crawler'
4627 url: 'https://help.dubbot.com/en/articles/6746594-example-custom-user-agent'
4628 producer:
4629 name: 'DubBot'
4630 url: 'https://dubbot.com/'
4631
4632 - regex: 'Swiftbot'
4633 name: 'Swiftbot'
4634 category: 'Crawler'
4635 url: 'https://swiftype.com/swiftbot'
4636 producer:
4637 name: 'Elasticsearch, B.V.'
4638 url: 'https://www.elastic.co/'
4639
4640 - regex: 'EyeMonIT'
4641 name: 'EyeMonit'
4642 category: 'Site Monitor'
4643 url: 'https://eyemonit.com/'
4644 producer:
4645 name: 'EyeMonit'
4646 url: 'https://eyemonit.com/'
4647
4648 - regex: 'ThousandEyes'
4649 name: 'ThousandEyes'
4650 category: 'Site Monitor'
4651 url: 'https://www.thousandeyes.com/'
4652 producer:
4653 name: 'Cisco Systems, Inc.'
4654 url: 'https://www.cisco.com/'
4655
4656 - regex: 'OmtrBot'
4657 name: 'OmtrBot'
4658 category: 'Site Monitor'
4659
4660 - regex: 'WebMoney Advisor'
4661 name: 'WebMoney Advisor'
4662 category: 'Service Agent'
4663 url: 'https://advisor.web.money/en/'
4664 producer:
4665 name: 'DEED Baltic, UAB'
4666 url: 'http://www.deed.lt/'
4667
4668 - regex: 'WebMon/'
4669 name: 'WebMon'
4670 category: 'Site Monitor'
4671
4672 - regex: 'fragFINN'
4673 name: 'fragFINN'
4674 category: 'Crawler'
4675 url: 'https://www.fragfinn.de/'
4676 producer:
4677 name: 'fragFINN e.V.'
4678 url: 'https://www.fragfinn.de/'
4679
4680 - regex: 'Clickagy'
4681 name: 'Clickagy'
4682 category: 'Crawler'
4683 url: 'https://www.clickagy.com/'
4684 producer:
4685 name: 'Clickagy, LLC'
4686 url: 'https://www.clickagy.com/'
4687
4688 - regex: 'kiwitcms-gitops'
4689 name: 'Kiwi TCMS GitOps'
4690 category: 'Service Agent'
4691 url: 'https://kiwitcms.org'
4692 producer:
4693 name: 'Open Technologies Bulgaria, Ltd.'
4694 url: 'https://kiwitcms.org'
4695
4696 - regex: 'webtru_crawler'
4697 name: 'webtru'
4698 category: 'Crawler'
4699 url: 'https://webtru.io/'
4700 producer:
4701 name: 'DataSign Inc.'
4702 url: 'https://datasign.jp/'
4703
4704 - regex: 'URLSuMaBot'
4705 name: 'URLSuMaBot'
4706 category: 'Crawler'
4707 url: 'https://www.urlsuma.de/'
4708
4709 - regex: '360JK yunjiankong'
4710 name: '360JK'
4711 category: 'Site Monitor'
4712 url: 'http://jk.cloud.360.cn/'
4713 producer:
4714 name: '360 Security Technology Inc.'
4715 url: 'https://www.360.cn/'
4716
4717 - regex: 'UCSBNetworkMeasurement'
4718 name: 'UCSB Network Measurement'
4719 category: 'Crawler'
4720 url: 'https://www.it.ucsb.edu/'
4721 producer:
4722 name: 'University of California, Santa Barbara'
4723 url: 'https://www.it.ucsb.edu/'
4724
4725 - regex: 'Plesk screenshot bot'
4726 name: 'Plesk Screenshot Service'
4727 category: 'Service Agent'
4728 url: 'https://support.plesk.com/hc/en-us/articles/13302778306199-What-is-Plesk-Screenshot-Service'
4729 producer:
4730 name: 'Plesk International GmbH'
4731 url: 'https://www.plesk.com/'
4732
4733 - regex: 'Who\.is'
4734 name: 'Who.is Bot'
4735 category: 'Crawler'
4736 url: 'https://who.is/'
4737
4738 - regex: 'Probely'
4739 name: 'Probely'
4740 category: 'Security Checker'
4741 url: 'https://probely.com/sos/'
4742 producer:
4743 name: 'Probely - Soluções de Cibersegurança, S.A.'
4744 url: 'https://probely.com/'
4745
4746 - regex: 'Uptimia'
4747 name: 'Uptimia'
4748 category: 'Site Monitor'
4749 url: 'https://www.uptimia.com/'
4750 producer:
4751 name: 'JJ Online GmbH'
4752 url: 'https://www.uptimia.com/'
4753
4754 - regex: '2GDPR'
4755 name: '2GDPR'
4756 category: 'Service Agent'
4757 url: 'https://2gdpr.com/tos'
4758 producer:
4759 name: '2GDPR'
4760 url: 'https://2gdpr.com/'
4761
4762 - regex: 'abuse\.xmco\.fr'
4763 name: 'Serenety'
4764 category: 'Security Checker'
4765 url: 'https://abuse.xmco.fr/'
4766 producer:
4767 name: 'XMCO, SASU'
4768 url: 'https://www.xmco.fr/'
4769
4770 - regex: 'CheckHost'
4771 name: 'CheckHost'
4772 category: 'Site Monitor'
4773 url: 'https://check-host.net/'
4774 producer:
4775 name: 'CheckHost'
4776 url: 'https://check-host.net/'
4777
4778 - regex: 'LAC_IAHarvester'
4779 name: 'LAC IA Harvester'
4780 category: 'Crawler'
4781 url: 'https://library-archives.canada.ca/eng/services/government-canada/web-social-media-preservation-program/Pages/web-archive.aspx'
4782 producer:
4783 name: 'Library and Archives Canada'
4784 url: 'https://library-archives.canada.ca/'
4785
4786 - regex: 'InsytfulBot'
4787 name: 'InsytfulBot'
4788 category: 'Crawler'
4789 url: 'https://www.insytful.com/'
4790 producer:
4791 name: 'Zengenti Limited'
4792 url: 'https://www.zengenti.com/'
4793
4794 - regex: 'statista\.com'
4795 name: 'Statista'
4796 category: 'Crawler'
4797 url: 'https://www.statista.com/'
4798 producer:
4799 name: 'Statista, Inc.'
4800 url: 'https://www.statista.com/'
4801
4802 - regex: 'SubstackContentFetch'
4803 name: 'Substack Content Fetch'
4804 category: 'Crawler'
4805 url: 'https://substack.com/'
4806 producer:
4807 name: 'Substack, Inc.'
4808 url: 'https://substack.com/'
4809
4810 - regex: '^ds9'
4811 name: 'Deep SEARCH 9'
4812 category: 'Crawler'
4813 url: 'https://www.copyright.com/blog/ccc-expands-corporate-solutions-offering-with-new-technology/'
4814 producer:
4815 name: 'Copyright Clearance Center, Inc.'
4816 url: 'https://www.copyright.com/'
4817
4818 - regex: 'LiveJournal\.com'
4819 name: 'LiveJournal'
4820 url: 'https://www.livejournal.com/'
4821 category: 'Feed Fetcher'
4822 producer:
4823 name: 'ООО "СИМ"'
4824 url: 'https://www.livejournal.com/'
4825
4826 - regex: 'bitdiscovery'
4827 name: 'Tenable.asm'
4828 category: 'Security Checker'
4829 url: 'https://bitdiscovery.com/'
4830 producer:
4831 name: 'Tenable, Inc.'
4832 url: 'https://www.tenable.com/'
4833
4834 - regex: 'Castopod'
4835 name: 'Castopod'
4836 category: 'Crawler'
4837 url: 'https://www.castopod.org/'
4838
4839 - regex: 'Elastic/Synthetics'
4840 name: 'Elastic Synthetics'
4841 category: 'Site Monitor'
4842 url: 'https://github.com/elastic/synthetics'
4843 producer:
4844 name: 'Elasticsearch B.V.'
4845 url: 'https://www.elastic.co/'
4846
4847 - regex: 'WDG_Validator'
4848 name: 'WDG HTML Validator'
4849 category: 'Validator'
4850 url: 'http://www.htmlhelp.com/tools/validator/'
4851
4852 - regex: 'scan@aegis.network'
4853 name: 'Aegis'
4854 category: 'Crawler'
4855 url: 'https://web.archive.org/web/20180910002802/http://www.aegis.network/'
4856
4857 - regex: 'CrawlyProjectCrawler'
4858 name: 'Crawly Project'
4859 category: 'Crawler'
4860 url: 'https://web.archive.org/web/20240326141952/https://crawlyproject.digitaldragon.dev/'
4861
4862 - regex: 'BDFetch'
4863 name: 'BDFetch'
4864 category: 'Crawler'
4865 url: 'https://web.archive.org/web/20130821043949/http://www.branddimensions.com/'
4866
4867 - regex: 'PunkMap'
4868 name: 'Punk Map'
4869 category: 'Security Checker'
4870 url: 'https://github.com/openeasm/punkmap'
4871
4872 - regex: 'GenomeCrawlerd'
4873 name: 'Deepfield Genome'
4874 category: 'Crawler'
4875 url: 'https://www.nokia.com/networks/ip-networks/deepfield/genome/'
4876 producer:
4877 name: 'Nokia Corporation'
4878 url: 'https://www.nokia.com/'
4879
4880 - regex: 'Gaisbot'
4881 name: 'Gaisbot'
4882 category: 'Crawler'
4883 url: 'https://web.archive.org/web/20090604121511/https://gais.cs.ccu.edu.tw/robot.php'
4884
4885 - regex: 'FAST-WebCrawler'
4886 name: 'AlltheWeb'
4887 category: 'Crawler'
4888 url: 'https://web.archive.org/web/20041020050801/http://www.alltheweb.com/help/webmaster/crawler'
4889
4890 - regex: 'ducks\.party'
4891 name: 'ducks.party'
4892 category: 'Security Checker'
4893 url: 'https://ducks.party/'
4894
4895 - regex: 'DepSpid'
4896 name: 'DepSpid'
4897 category: 'Crawler'
4898 url: 'https://web.archive.org/web/20080321224033/http://about.depspid.net/'
4899
4900 - regex: 'Website-info\.net'
4901 name: 'Website-info'
4902 category: 'Crawler'
4903 url: 'https://website-info.net/robot'
4904 producer:
4905 name: 'Meins und Vogel GmbH'
4906 url: 'https://muv.com/'
4907
4908 - regex: 'RedekenBot'
4909 name: 'RedekenBot'
4910 category: 'Crawler'
4911 url: 'https://www.redeken.com/en/help/bot.html'
4912 producer:
4913 name: 'Redeken'
4914 url: 'https://www.redeken.com/'
4915
4916 - regex: 'semaltbot'
4917 name: 'semaltbot'
4918 category: 'Crawler'
4919 url: 'https://semalt.net/'
4920 producer:
4921 name: 'Semalt LP'
4922 url: 'https://semalt.net/'
4923
4924 - regex: 'MakeMerryBot'
4925 name: 'MakeMerryBot'
4926 category: 'Crawler'
4927 url: 'https://makemerry.app/bots'
4928
4929 - regex: 'Timpibot'
4930 name: 'Timpibot'
4931 category: 'Crawler'
4932 url: 'https://timpi.io/'
4933 producer:
4934 name: 'Timpi Inc.'
4935 url: 'https://timpi.io/'
4936
4937 - regex: 'Validbot'
4938 name: 'ValidBot'
4939 category: 'Crawler'
4940 url: 'https://www.validbot.com/'
4941 producer:
4942 name: 'Jake Olefsky LLC'
4943 url: 'https://www.validbot.com/'
4944
4945 - regex: 'NPBot'
4946 name: 'NameProtectBot'
4947 category: 'Crawler'
4948 url: 'https://www.cscglobal.com/cscglobal/home/'
4949 producer:
4950 name: 'NameProtect, Inc.'
4951 url: 'https://www.cscglobal.com/'
4952
4953 - regex: 'domaincodex\.com'
4954 name: 'Domain Codex'
4955 category: 'Crawler'
4956 url: 'https://www.domaincodex.com/'
4957 producer:
4958 name: 'Erie Data Systems, LLC'
4959 url: 'https://www.eriedatasys.com/'
4960
4961 - regex: 'Swisscows Favicons'
4962 name: 'Swisscows Favicons'
4963 category: 'Crawler'
4964 url: 'https://swisscows.com/'
4965 producer:
4966 name: 'Swisscows AG'
4967 url: 'https://swisscows.com/'
4968
4969 - regex: 'leak\.info'
4970 name: 'leak.info'
4971 category: 'Crawler'
4972 url: 'http://www.leak.info/'
4973
4974 - regex: 'workona'
4975 name: 'Workona'
4976 category: 'Crawler'
4977 url: 'https://workona.com/'
4978 producer:
4979 name: 'Workona, Inc.'
4980 url: 'https://workona.com/'
4981
4982 - regex: 'Bloglines'
4983 name: 'Bloglines'
4984 category: 'Crawler'
4985 url: 'https://web.archive.org/web/20140309033202/http://www.bloglines.com/'
4986 producer:
4987 name: 'Reply!, Inc.'
4988 url: 'https://www.reply.com/'
4989
4990 - regex: 'heritrix'
4991 name: 'Heritrix'
4992 category: 'Crawler'
4993 url: 'https://webarchive.jira.com/wiki/display/Heritrix/Heritrix'
4994 producer:
4995 name: 'The Internet Archive'
4996 url: 'https://archive.org'
4997
4998 - regex: 'search\.marginalia\.nu'
4999 name: 'Marginalia'
5000 category: 'Crawler'
5001 url: 'https://www.marginalia.nu/marginalia-search/for-webmasters/'
5002 producer:
5003 name: 'Marginalia'
5004 url: 'https://www.marginalia.nu/'
5005
5006 - regex: 'vu-server-health-scanner'
5007 name: 'VU Server Health Scanner'
5008 category: 'Security Checker'
5009 url: 'https://130.37.198.75/index.html'
5010 producer:
5011 name: 'VU Amsterdam'
5012 url: 'https://vu.nl/en'
5013
5014 - regex: 'Functionize'
5015 name: 'Functionize'
5016 category: 'Crawler'
5017 url: 'https://www.functionize.com/'
5018 producer:
5019 name: 'Functionize, Inc.'
5020 url: 'https://www.functionize.com/'
5021
5022 - regex: 'Prerender'
5023 name: 'Prerender'
5024 category: 'Crawler'
5025 url: 'https://docs.prerender.io/docs/33-overview-of-prerender-crawlers'
5026 producer:
5027 name: 'saas.group Inc.'
5028 url: 'https://saas.group/'
5029
5030 - regex: 'bl\.uk_ldfc_bot'
5031 name: 'The British Library Legal Deposit Bot'
5032 category: 'Crawler'
5033 url: 'https://www.bl.uk/'
5034 producer:
5035 name: 'The British Library'
5036 url: 'https://www.bl.uk/'
5037
5038 - regex: 'Miniature\.io'
5039 name: 'Miniature.io'
5040 category: 'Service Agent'
5041 url: 'https://miniature.io/'
5042 producer:
5043 name: 'LCX Ventures Ltd'
5044 url: 'https://www.lcxventures.com/'
5045
5046 - regex: 'Convertify'
5047 name: 'Convertify'
5048 category: 'Service Agent'
5049 url: 'https://www.convertify.app/'
5050 producer:
5051 name: 'Convertify'
5052 url: 'https://www.convertify.app/'
5053
5054 - regex: 'ZoteroTranslationServer'
5055 name: 'Zotero Translation Server'
5056 category: 'Service Agent'
5057 url: 'https://github.com/wikimedia/mediawiki-services-zotero'
5058 producer:
5059 name: 'The Wikimedia Foundation, Inc.'
5060 url: 'https://www.wikimedia.org/'
5061
5062 - regex: 'MuckRack'
5063 name: 'MuckRack'
5064 category: 'Crawler'
5065 url: 'https://muckrack.com/'
5066 producer:
5067 name: 'Muck Rack, LLC'
5068 url: 'https://muckrack.com/'
5069
5070 - regex: 'Golfe'
5071 name: 'Golfe'
5072 category: 'Crawler'
5073 url: 'http://www.goo-olfe.ae/bot.html'
5074
5075 - regex: 'SpiderLing'
5076 name: 'SpiderLing'
5077 category: 'Crawler'
5078 url: 'https://nlp.fi.muni.cz/projects/biwec/'
5079 producer:
5080 name: 'Natural Language Processing Centre'
5081 url: 'https://nlp.fi.muni.cz/'
5082
5083 - regex: 'Bravebot'
5084 name: 'Bravebot'
5085 category: 'Search bot'
5086 url: 'https://search.brave.com/help/brave-search-crawler'
5087 producer:
5088 name: 'Brave Software, Inc.'
5089 url: 'https://brave.com/'
5090
5091 - regex: '1001FirmsBot'
5092 name: '1001FirmsBot'
5093 category: 'Crawler'
5094 url: 'https://www.1001firms.com/1001firmsbot.php'
5095
5096 - regex: 'SteamChatURLLookup'
5097 name: 'Steam Chat URL Lookup'
5098 category: 'Service Agent'
5099 url: 'https://help.steampowered.com/en/faqs/view/595C-42F4-3B66-E02F'
5100 producer:
5101 name: 'Valve Corporation'
5102 url: 'https://www.valvesoftware.com/'
5103
5104 - regex: 'ohdear\.app'
5105 name: 'Oh Dear'
5106 category: 'Site Monitor'
5107 url: 'https://ohdear.app/docs/faq/what-is-the-oh-dear-crawler-doing-in-my-logs'
5108 producer:
5109 name: 'Immutable, SNC'
5110 url: 'https://ohdear.app/'
5111
5112 - regex: 'Inspici'
5113 name: 'Inspici'
5114 category: 'Crawler'
5115 url: 'https://www.inspici.com/'
5116 producer:
5117 name: 'Inspici, LLC'
5118 url: 'https://www.inspici.com/'
5119
5120 - regex: 'peer39_crawler'
5121 name: 'Peer39'
5122 category: 'Crawler'
5123 url: 'https://www.peer39.com/crawler-notice'
5124 producer:
5125 name: 'Peer39 Tech, LLC'
5126 url: 'https://www.peer39.com/'
5127
5128 - regex: 'Pandalytics'
5129 name: 'Pandalytics'
5130 category: 'Crawler'
5131 url: 'https://www.domainsbot.com/business-intelligence/'
5132 producer:
5133 name: 'DomainsBot, Inc.'
5134 url: 'https://www.domainsbot.com/'
5135
5136 - regex: 'CloudServerMarketSpider'
5137 name: 'CloudServerMarketSpider'
5138 category: 'Crawler'
5139 url: 'https://web.archive.org/web/20151228225429/https://cloudservermarket.com/spider.html'
5140
5141 - regex: 'Pigafetta'
5142 name: 'Pigafetta'
5143 category: 'Crawler'
5144 url: 'https://visual-seo.com/Pigafetta-Bot'
5145 producer:
5146 name: 'aStonish Studio Srl'
5147 url: 'http://www.astonishstudio.com/'
5148
5149 - regex: 'Cotoyogi'
5150 name: 'Cotoyogi'
5151 category: 'Crawler'
5152 url: 'https://ds.rois.ac.jp/center8/crawler/'
5153 producer:
5154 name: 'Joint Support-Center for Data Science Research (ROIS-DS)'
5155 url: 'https://ds.rois.ac.jp/'
5156
5157 - regex: 'SuggestBot'
5158 name: 'SuggestBot'
5159 category: 'Crawler'
5160 url: 'https://github.com/nettrom/suggestbot'
5161
5162 - regex: 'cms-experiment'
5163 name: 'CMS Experiment'
5164 category: 'Security Checker'
5165 url: 'https://securitee.org/cms-experiment-fall2024/'
5166
5167 - regex: 'SiteCheckerBotCrawler'
5168 name: 'SiteCheckerBotCrawler'
5169 category: 'Crawler'
5170 url: 'https://sitechecker.pro/'
5171 producer:
5172 name: 'Cyber Circus Limited'
5173 url: 'https://sitechecker.pro/'
5174
5175 - regex: 'SBIder'
5176 name: 'SBIder'
5177 category: 'Crawler'
5178 url: 'https://www.sitesell.com/sbider.html'
5179 producer:
5180 name: 'SiteSell Inc.'
5181 url: 'https://www.sitesell.com/'
5182
5183 - regex: 'LightspeedSystemsCrawler'
5184 name: 'LightspeedSystemsCrawler'
5185 category: 'Crawler'
5186 url: 'https://www.lightspeedsystems.com/'
5187 producer:
5188 name: 'Lightspeed Systems, Inc.'
5189 url: 'https://www.lightspeedsystems.com/'
5190
5191 - regex: 'Research JLU'
5192 name: 'Research JLU'
5193 category: 'Crawler'
5194 url: 'https://www.uni-giessen.de/en/research'
5195 producer:
5196 name: 'Justus Liebig University Giessen'
5197 url: 'https://www.uni-giessen.de/en'
5198
5199 - regex: '(?:hgf|OS)AlphaXCrawl'
5200 name: 'AlphaXCrawl'
5201 category: 'Crawler'
5202 url: 'https://www.fim.uni-passau.de/en/data-science/research/open-search'
5203 producer:
5204 name: 'University of Passau'
5205 url: 'https://www.uni-passau.de/en/'
5206
5207 - regex: 'WPMU DEV'
5208 name: 'WPMU DEV'
5209 category: 'Crawler'
5210 url: 'https://wpmudev.com/docs/wpmu-dev-plugins/broken-link-checker/#broken-link-checker-user-agent'
5211 producer:
5212 name: 'Incsub, LLC.'
5213 url: 'https://incsub.com/'
5214
5215 - regex: 'SnoopSecInspect'
5216 name: 'SnoopSecInspect'
5217 category: 'Security Checker'
5218 url: 'https://web.archive.org/web/20241206193253/https://snoopsec.us.to/'
5219
5220 - regex: 'ModatScanner'
5221 name: 'ModatScanner'
5222 category: 'Security Checker'
5223 url: 'https://www.modat.io/scanning'
5224 producer:
5225 name: 'Modat B.V.'
5226 url: 'https://www.modat.io/'
5227
5228 - regex: 'researchcyber\.net'
5229 name: 'researchcyber.net'
5230 category: 'Security Checker'
5231 url: 'https://web.archive.org/web/20241219082407/https://researchcyber.net/'
5232
5233 - regex: 'CrystalSemanticsBot'
5234 name: 'CrystalSemanticsBot'
5235 category: 'Crawler'
5236 url: 'https://web.archive.org/web/20121230203310/http://www.crystalsemantics.com/user-agent/'
5237 producer:
5238 name: 'Crystal Semantics Ltd.'
5239 url: 'https://web.archive.org/web/20121029062239/http://www.crystalsemantics.com/'
5240
5241 - regex: 'najdu\.s\.holubem\.eu'
5242 name: 'najdu.s.holubem.eu'
5243 category: 'Crawler'
5244 url: 'https://najdu.s.holubem.eu/'
5245
5246 - regex: 'VORTEX/'
5247 name: 'VORTEX'
5248 category: 'Crawler'
5249 url: 'https://marty.anstey.ca/robots/vortex'
5250
5251 - regex: 'xtate/(\d+\.[.\d]+)'
5252 name: 'xtate'
5253 category: 'Crawler'
5254 url: 'https://github.com/babycoff/xtate'
5255
5256 - regex: 'FediList Agent/'
5257 name: 'FediList'
5258 category: 'Social Media Agent'
5259 url: 'https://fedilist.com/'
5260
5261 - regex: 'Grafana/(\d+\.[.\d]+)'
5262 name: 'Grafana'
5263 category: 'Site Monitor'
5264 url: 'https://github.com/grafana/grafana'
5265 producer:
5266 name: 'Grafana Labs'
5267 url: 'https://grafana.com/'
5268
5269 - regex: 'github-camo'
5270 name: 'Github Camo'
5271 category: 'Crawler'
5272 url: 'https://github.com/atmos/camo'
5273 producer:
5274 name: 'Github'
5275 url: 'https://docs.github.com/en/authentication/keeping-your-account-and-data-secure/about-anonymized-urls'
5276
5277 - regex: 'Bluesky'
5278 name: 'Bluesky'
5279 category: 'Social Media Agent'
5280 url: 'https://bsky.app'
5281 producer:
5282 name: 'Bluesky Social PBC'
5283 url: 'https://bsky.app'
5284
5285 - regex: 'OpenGraph\.io'
5286 name: 'OpenGraph.io'
5287 category: 'Crawler'
5288 url: 'https://www.opengraph.io'
5289 producer:
5290 name: 'OpenGraph.io'
5291 url: 'https://www.opengraph.io'
5292
5293 - regex: 'microsoft-flow/'
5294 name: 'Microsoft Power Automate'
5295 category: 'Service Agent'
5296 url: 'https://www.microsoft.com/en-us/power-platform/products/power-automate'
5297 producer:
5298 name: 'Microsoft Corporation'
5299 url: 'https://www.microsoft.com/'
5300
5301 - regex: 'Simbiat Software'
5302 name: 'Simbiat Software'
5303 category: 'Crawler'
5304 url: 'https://www.simbiat.eu'
5305 producer:
5306 name: 'Simbiat Software'
5307 url: 'https://www.simbiat.eu'
5308
5309 - regex: 'IbouBot'
5310 name: 'IbouBot'
5311 category: 'AI Search Crawler'
5312 url: 'https://ibou.io/iboubot.html'
5313
5314 - regex: 'AddSearchBot'
5315 name: 'AddSearchBot'
5316 category: 'Crawler'
5317 url: 'https://www.addsearch.com/docs/indexing/whitelisting-addsearch-bot/'
5318 producer:
5319 name: 'AddSearch Oy'
5320 url: 'https://www.addsearch.com/'
5321
5322 - regex: 'TerraCotta'
5323 name: 'TerraCotta'
5324 category: 'AI Data Scraper'
5325 url: 'https://github.com/CeramicTeam/CeramicTerracotta'
5326 producer:
5327 name: 'Ceramic, Inc.'
5328 url: 'https://ceramic.ai/'
5329
5330 - regex: 'KeybaseBot'
5331 name: 'KeybaseBot'
5332 category: 'Social Media Agent'
5333 url: 'http://keybase.io'
5334 producer:
5335 name: 'Zoom Video Communications, Inc'
5336 url: 'https://www.zoom.com/'
5337
5338 - regex: 'Replicate-Bot'
5339 name: 'Replicate-Bot'
5340 category: 'AI Data Scraper'
5341 url: 'https://replicate.com/'
5342 producer:
5343 name: 'Replicate, Inc.'
5344 url: 'https://replicate.com/'
5345
5346 - regex: 'cypex\.ai'
5347 name: 'Cypex'
5348 category: 'Security Checker'
5349 url: 'https://cypex.ai/scanning/'
5350 producer:
5351 name: 'Cypex'
5352 url: 'https://cypex.ai/'
5353
5354 - regex: 'fhms-its-research-scanner'
5355 name: 'FHMS ITS Research Scanner'
5356 category: 'Security Checker'
5357 url: 'https://fb02itsscan02.fh-muenster.de/'
5358 producer:
5359 name: 'University of Applied Sciences Muenster'
5360 url: 'https://www.fh-muenster.de/'
5361
5362 - regex: 'Together-Bot'
5363 name: 'Together-Bot'
5364 category: 'AI Data Scraper'
5365 url: 'https://www.together.ai/'
5366 producer:
5367 name: 'Together Computer Inc.'
5368 url: 'https://www.together.ai/'
5369
5370 - regex: 'xAI-Bot'
5371 name: 'xAI-Bot'
5372 category: 'AI Data Scraper'
5373 url: 'https://x.ai/'
5374 producer:
5375 name: 'X.AI LLC'
5376 url: 'https://x.ai/'
5377
5378 - regex: 'Groq-Bot'
5379 name: 'Groq-Bot'
5380 category: 'AI Data Scraper'
5381 url: 'https://groq.com/'
5382 producer:
5383 name: 'Groq, Inc.'
5384 url: 'https://groq.com/'
5385
5386 - regex: 'bigsur\.ai'
5387 name: 'Big Sur AI'
5388 category: 'AI Assistant'
5389 url: 'https://bigsur.ai/'
5390 producer:
5391 name: 'Big Sur AI, Inc.'
5392 url: 'https://bigsur.ai/'
5393
5394 - regex: 'FirecrawlAgent'
5395 name: 'FirecrawlAgent'
5396 category: 'AI Data Scraper'
5397 url: 'https://www.firecrawl.dev/'
5398 producer:
5399 name: 'SideGuide Technologies, Inc.'
5400 url: 'https://www.sideguide.dev/'
5401
5402 - regex: 'SecurityHeaders'
5403 name: 'SecurityHeaders'
5404 category: 'Security Checker'
5405 url: 'https://securityheaders.com/'
5406 producer:
5407 name: 'Snyk Limited'
5408 url: 'https://snyk.io/'
5409
5410 - regex: 'HaloBot'
5411 name: 'HaloBot'
5412 category: 'Crawler'
5413 url: 'https://www.haloscan.com/'
5414 producer:
5415 name: 'ARCHI301'
5416 url: 'https://www.haloscan.com/'
5417
5418 - regex: 'RSiteAuditor'
5419 name: 'RSiteAuditor'
5420 category: 'Crawler'
5421 url: 'https://help.agencyanalytics.com/en/articles/3469586-allow-our-site-auditor-via-robots-txt-and-firewall'
5422 producer:
5423 name: 'My SEO Tool Inc'
5424 url: 'https://agencyanalytics.com/'
5425
5426 - regex: 'ORTc\.me'
5427 name: 'OpenRobotsTXT'
5428 category: 'Crawler'
5429 url: 'https://openrobotstxt.org/ua'
5430 producer:
5431 name: 'Majestic-12 Limited'
5432 url: 'https://majestic.com/'
5433
5434 - regex: 'obsrvr\.net'
5435 name: 'Observer'
5436 category: 'Security Checker'
5437 url: 'https://obsrvr.net/about'
5438
5439 - regex: 'AliyunSecBot'
5440 name: 'AliyunSecBot'
5441 category: 'Security Checker'
5442 url: 'https://service.alibaba.com/'
5443
5444 - regex: 'Mediumbot'
5445 name: 'Mediumbot'
5446 category: 'Crawler'
5447 url: 'https://medium.com/'
5448 producer:
5449 name: 'A Medium Corporation'
5450 url: 'https://medium.com/'
5451
5452 - regex: 'Heexybot'
5453 name: 'Heexybot'
5454 category: 'Search bot'
5455 url: 'https://heexy.org/bot'
5456
5457 - regex: 'ForwardQR'
5458 name: 'ForwardQR'
5459 category: 'Service Agent'
5460 url: 'https://forwardqr.com/bot.html'
5461
5462 - regex: 'CybaaBot'
5463 name: 'CybaaBot'
5464 category: 'Security Checker'
5465 url: 'https://cybaa.io/bot-policy'
5466 producer:
5467 name: 'Cybaa Ltd'
5468 url: 'https://cybaa.io/'
5469
5470 - regex: 'CybaaAgent'
5471 name: 'CybaaAgent'
5472 category: 'Service Agent'
5473 url: 'https://cybaa.io/bot-policy'
5474 producer:
5475 name: 'Cybaa Ltd'
5476 url: 'https://cybaa.io/'
5477
5478 - regex: 'DVbot'
5479 name: 'DVbot'
5480 category: 'Service Agent'
5481 url: 'https://doubleverify.com/'
5482 producer:
5483 name: 'DoubleVerify Inc.'
5484 url: 'https://doubleverify.com/'
5485
5486 - regex: 'Assetnote'
5487 name: 'Assetnote'
5488 category: 'Security Checker'
5489 url: 'https://www.assetnote.io/'
5490 producer:
5491 name: 'Assetnote Pty Ltd'
5492 url: 'https://www.assetnote.io/'
5493
5494 - regex: 'UGAResearchAgent'
5495 name: 'UGAResearchAgent'
5496 category: 'Security Checker'
5497 url: 'https://nislabuga-scan.uga.edu/'
5498 producer:
5499 name: 'School of Computing at the University of Georgia (UGA)'
5500 url: 'https://computing.uga.edu/'
5501
5502 - regex: 'SERankingBacklinksBot'
5503 name: 'SERankingBacklinksBot'
5504 category: 'Crawler'
5505 url: 'https://help.seranking.com/hc/en-us/articles/23020353159964-SERankingBacklinksBot-Crawler'
5506 producer:
5507 name: 'SER Acquisition Inc,'
5508 url: 'https://seranking.com/'
5509
5510 - regex: 'VertexWP'
5511 name: 'VertexWP'
5512 category: 'Security Checker'
5513 url: 'https://vertexwp.com/bot'
5514
5515 - regex: 'Friendica'
5516 name: 'Friendica'
5517 category: 'Social Media Agent'
5518
5519 - regex: 'Webliobot'
5520 name: 'Webliobot'
5521 category: 'Crawler'
5522 url: 'https://help.weblio.jp/ejje/jpdictionary/j_info/j_i_bcontents/h0021'
5523 producer:
5524 name: 'GRAS Group, Inc.'
5525 url: 'https://gras-group.co.jp/'
5526
5527 - regex: 'sqalix'
5528 name: 'sqalix'
5529 category: 'Crawler'
5530 url: 'https://www.sqalix.com/'
5531
5532 - regex: 'RecordedFuture'
5533 name: 'RecordedFuture'
5534 category: 'Security Checker'
5535 url: 'https://www.recordedfuture.com/'
5536 producer:
5537 name: 'Recorded Future, Inc.'
5538 url: 'https://www.recordedfuture.com/'
5539
5540 - regex: 'Valimail'
5541 name: 'Valimail'
5542 category: 'Service Agent'
5543 url: 'https://www.valimail.com/domain-checker/'
5544 producer:
5545 name: 'Valimail Inc.'
5546 url: 'https://www.valimail.com/'
5547
5548 - regex: 'FindFiles\.net'
5549 name: 'FindFiles.net'
5550 category: 'Crawler'
5551 url: 'https://findfiles.net/bot'
5552 producer:
5553 name: 'FindFiles.net UG'
5554 url: 'https://findfiles.net/'
5555
5556 - regex: 'WanscannerBot'
5557 name: 'WanscannerBot'
5558 category: 'Security Checker'
5559 url: 'https://abuse.pend.re/'
5560
5561 - regex: 'Kagibot'
5562 name: 'Kagibot'
5563 category: 'Search bot'
5564 url: 'https://kagi.com/bot'
5565 producer:
5566 name: 'Kagi Inc.'
5567 url: 'https://kagi.com/'
5568
5569 - regex: 'Ai2Bot-Dolma'
5570 name: 'Ai2Bot-Dolma'
5571 category: 'AI Data Scraper'
5572 url: 'https://allenai.org/crawler'
5573 producer:
5574 name: 'The Allen Institute for Artificial Intelligence'
5575 url: 'https://allenai.org/'
5576
5577 - regex: 'Ai2Bot-DeepResearchEval'
5578 name: 'Ai2Bot-DeepResearchEval'
5579 category: 'AI Assistant'
5580 url: 'https://allenai.org/crawler'
5581 producer:
5582 name: 'The Allen Institute for Artificial Intelligence'
5583 url: 'https://allenai.org/'
5584
5585 - regex: 'Ai2Bot'
5586 name: 'Ai2Bot'
5587 category: 'AI Data Scraper'
5588 url: 'https://allenai.org/crawler'
5589 producer:
5590 name: 'The Allen Institute for Artificial Intelligence'
5591 url: 'https://allenai.org/'
5592
5593 - regex: 'WARDBot'
5594 name: 'WARDBot'
5595 category: 'Site Monitor'
5596 url: 'https://ward.ai/robot'
5597 producer:
5598 name: 'W.A.R.D. LLC'
5599 url: 'https://ward.ai/'
5600
5601 - regex: 'Character-AI'
5602 name: 'Character-AI'
5603 category: 'AI Assistant'
5604 url: 'https://character.ai/'
5605 producer:
5606 name: 'Character Technologies, Inc.'
5607 url: 'https://character.ai/'
5608
5609 - regex: 'DeepseekBot'
5610 name: 'DeepseekBot'
5611 category: 'AI Data Scraper'
5612 url: 'https://www.deepseek.com/bot'
5613 producer:
5614 name: 'Hangzhou Deep Search Artificiell Intelligens Basic Technology Research Co., Ltd.'
5615 url: 'https://www.deepseek.com/'
5616
5617 - regex: 'MistralAI-User'
5618 name: 'MistralAI-User'
5619 category: 'AI Assistant'
5620 url: 'https://docs.mistral.ai/robots'
5621 producer:
5622 name: 'Mistral AI'
5623 url: 'https://mistral.ai/'
5624
5625 - regex: 'Crawlspace'
5626 name: 'Crawlspace'
5627 category: 'AI Data Scraper'
5628 url: 'https://crawlspace.dev/'
5629 producer:
5630 name: 'Crawlspace Company'
5631 url: 'https://crawlspace.dev/'
5632
5633 - regex: 'Devin'
5634 name: 'Devin'
5635 category: 'AI Assistant'
5636 url: 'https://cognition.ai/'
5637 producer:
5638 name: 'Cognition AI, Inc.'
5639 url: 'https://cognition.ai/'
5640
5641 - regex: 'Andibot'
5642 name: 'Andibot'
5643 category: 'AI Search Crawler'
5644 url: 'https://andisearch.com/'
5645 producer:
5646 name: 'Andi'
5647 url: 'https://andisearch.com/'
5648
5649 - regex: 'HypeStat'
5650 name: 'HypeStat'
5651 category: 'Crawler'
5652 url: 'https://hypestat.com/crawler'
5653
5654 - regex: 'StatusNestBacklinkSpider'
5655 name: 'StatusNestBacklinkSpider'
5656 category: 'Crawler'
5657 url: 'https://statusnest.com/bot'
5658
5659 - regex: 'RunPod-Bot'
5660 name: 'RunPod-Bot'
5661 category: 'AI Data Scraper'
5662 url: 'https://www.runpod.io/'
5663 producer:
5664 name: 'RunPod Inc.'
5665 url: 'https://www.runpod.io/'
5666
5667 - regex: 'HuggingFace-Bot'
5668 name: 'HuggingFace-Bot'
5669 category: 'AI Data Scraper'
5670 url: 'https://huggingface.co/'
5671 producer:
5672 name: 'Hugging Face, Inc'
5673 url: 'https://huggingface.co/'
5674
5675 - regex: 'LinkBloom'
5676 name: 'LinkBloom'
5677 category: 'Crawler'
5678 url: 'https://hamidsoltani.com/linkbloom'
5679
5680 - regex: 'img2dataset'
5681 name: 'img2dataset'
5682 category: 'Crawler'
5683 url: 'https://github.com/rom1504/img2dataset'
5684
5685 - regex: 'iAskBot'
5686 name: 'iAskBot'
5687 category: 'AI Data Scraper'
5688 url: 'https://iask.ai/'
5689 producer:
5690 name: 'Ai Search Inc.'
5691 url: 'https://iask.ai/'
5692
5693 - regex: 'LinerBot'
5694 name: 'LinerBot'
5695 category: 'AI Assistant'
5696 url: 'https://docs.getliner.com/docs/linerbot'
5697 producer:
5698 name: 'Liner'
5699 url: 'https://liner.com/'
5700
5701 - regex: 'Poggio-Citations'
5702 name: 'Poggio-Citations'
5703 category: 'AI Assistant'
5704 url: 'https://docs.poggio.io/dev-resources/robots'
5705 producer:
5706 name: 'Poggio Labs, Inc.'
5707 url: 'https://poggio.io/'
5708
5709 - regex: 'QualifiedBot'
5710 name: 'QualifiedBot'
5711 category: 'AI Assistant'
5712 url: 'https://www.qualified.com/legal/qualified-crawler-user-agent'
5713 producer:
5714 name: 'Qualified.com, Inc.'
5715 url: 'https://www.qualified.com/'
5716
5717 - regex: 'ZanistaBot'
5718 name: 'ZanistaBot'
5719 category: 'AI Search Crawler'
5720 url: 'https://zanista.ai/crawler-info'
5721 producer:
5722 name: 'Zanista AI LTD.'
5723 url: 'https://zanista.ai/'
5724
5725 - regex: 'ChatGLM-Spider'
5726 name: 'ChatGLM-Spider'
5727 category: 'AI Data Scraper'
5728 url: 'https://chatglm.cn/'
5729 producer:
5730 name: 'Beijing Zhipu Huazhang Technology Co., Ltd.'
5731 url: 'https://zhipuai.cn/'
5732
5733 - regex: 'gochitchat\.ai'
5734 name: 'Sider'
5735 category: 'AI Data Scraper'
5736 url: 'https://sider.ai/'
5737 producer:
5738 name: 'Sider AI'
5739 url: 'https://sider.ai/'
5740
5741 - regex: 'SBIntuitionsBot'
5742 name: 'SBIntuitionsBot'
5743 category: 'AI Data Scraper'
5744 url: 'https://www.sbintuitions.co.jp/en/bot/'
5745 producer:
5746 name: 'SB Intuitions Corp.'
5747 url: 'https://www.sbintuitions.co.jp/'
5748
5749 - regex: 'ias_crawler'
5750 name: 'IAS Crawler'
5751 category: 'AI Data Scraper'
5752 url: 'https://integralads.com/ias-privacy-data-management/policies/site-indexing-policy/'
5753 producer:
5754 name: 'Integral Ad Science, Inc.'
5755 url: 'https://integralads.com/'
5756
5757 - regex: 'ias_wombles'
5758 name: 'IAS Wombles'
5759 category: 'AI Data Scraper'
5760 url: 'https://integralads.com/ias-privacy-data-management/policies/site-indexing-policy/'
5761 producer:
5762 name: 'Integral Ad Science, Inc.'
5763 url: 'https://integralads.com/'
5764
5765 - regex: 'ShapBot'
5766 name: 'ShapBot'
5767 category: 'AI Data Scraper'
5768 url: 'https://docs.parallel.ai/resources/crawler'
5769 producer:
5770 name: 'Parallel Web Systems Inc.'
5771 url: 'https://parallel.ai/'
5772
5773 - regex: 'LumeWebScan'
5774 name: 'LumeWebScan'
5775 category: 'Crawler'
5776 url: 'https://lumeweaver.com/'
5777 producer:
5778 name: 'LumeWeaver Labs'
5779 url: 'https://lumeweaver.com/'
5780
5781 - regex: 'PanguBot'
5782 name: 'PanguBot'
5783 category: 'AI Data Scraper'
5784 url: 'https://www.huawei.com/'
5785 producer:
5786 name: 'Huawei Technologies Co., Ltd.'
5787 url: 'https://www.huawei.com/'
5788
5789 - regex: 'Manus-User'
5790 name: 'Manus-User'
5791 category: 'AI Assistant'
5792 url: 'https://manus.im/help/Manus-user'
5793 producer:
5794 name: 'Butterfly Effect Pte. Ltd.'
5795 url: 'https://manus.im/'
5796
5797 - regex: 'HubSpotContentSearchBot'
5798 name: 'HubSpotContentSearchBot'
5799 category: 'Crawler'
5800 url: 'https://developers.hubspot.com/docs/cms/start-building/building-blocks/modules/content-search'
5801 producer:
5802 name: 'HubSpot, Inc.'
5803 url: 'https://www.hubspot.com/'
5804
5805 - regex: 'ProRata'
5806 name: 'ProRata'
5807 category: 'AI Search Crawler'
5808 url: 'https://platform.gist.ai/docs/gcn-overview'
5809 producer:
5810 name: 'ProRataAI, Inc.'
5811 url: 'https://prorata.ai/'
5812
5813 - regex: 'blackboardally'
5814 name: 'Blackboard Ally'
5815 category: 'Crawler'
5816 url: 'https://ally.ac/'
5817 producer:
5818 name: 'Anthology Inc.'
5819 url: 'https://www.anthology.com/'
5820
5821 - regex: 'semantic-visions\.com'
5822 name: 'svEye'
5823 category: 'Crawler'
5824 url: 'https://sveye.semantic-visions.com/'
5825 producer:
5826 name: 'Semantic Visions, s.r.o.'
5827 url: 'https://www.semantic-visions.com/'
5828
5829 - regex: 'CopyvioDetector'
5830 name: 'CopyvioDetector'
5831 category: 'Crawler'
5832 url: 'https://copyvios.toolforge.org/'
5833 producer:
5834 name: 'Ben Kurtovic'
5835 url: 'https://github.com/earwig'
5836
5837 - regex: 'Eyeotabot'
5838 name: 'Eyeotabot'
5839 category: 'Crawler'
5840 url: 'https://www.eyeota.com/'
5841 producer:
5842 name: 'Eyeota Pte Ltd'
5843 url: 'https://www.eyeota.com/'
5844
5845 - regex: 'YioopBot'
5846 name: 'YioopBot'
5847 category: 'Search bot'
5848 url: 'https://www.yioop.com/bot'
5849 producer:
5850 name: 'Chris Pollett'
5851 url: 'https://www.pollett.org/'
5852
5853 - regex: 'yoozBot'
5854 name: 'yoozBot'
5855 category: 'Search bot'
5856 url: 'https://www.yooz.ir/'
5857 producer:
5858 name: 'yooz'
5859 url: 'https://www.yooz.ir/'
5860
5861 # Generic bots
5862 - regex: '(ABEvalBot|AdsTxtCrawlerTP|DNSResearchBot|Dormouse|FormFinder|GitCrawlerBot|HanaleiBot|ImportDomains|PrivacyPolicyBot|Robozilla|Secweb-Sectxt|SeoCherryBot|StudyBot|The Knowledge AI|Thinkbot|ThinkChaos|TprAdsTxtCrawler)'
5863 name: '$1'
5864 category: 'Crawler'
5865
5866 - regex: 'nuhk|grub-client|Download Demon|SearchExpress|Microsoft URL Control|borg|altavista|dataminr\.com|teoma|oegp|http%20client|htdig|mogimogi|larbin|scrubby|searchsight|semanticdiscovery|snappy|zeal(?!ot)|dataparksearch|findlinks|BrowserMob|URL2PNG|ZooShot|GomezA|Google SketchUp|Read%20Later|7Siters|centuryb\.o\.t9|InterNaetBoten|EasyBib AutoCite|Bidtellect|tomnomnom/meg|cortex|Re-re Studio|adreview|AHC/|NameOfAgent|Request-Promise|ALittle Client|Hello,? world|wp_is_mobile|0xAbyssalDoesntExist|Anarchy99|^revolt|nvd0rz|xfa1|Hakai|gbrmss|fuck-your-hp|IDBTE4M CODE87|Antoine|Insomania|Hells-Net|b3astmode|Linux Gnu \(cow\)|Test Certificate Info|iplabel|Magellan|TheSafex?Internetx?Search|Searcherx?web|kirkland-signature|LinkChain|survey-security-dot-txt|infrawatch|Time/|r00ts3c-owned-you|nvdorz|Root Slut|NiggaBalls|BotPoke|GlobalWebSearch|xx032_bo9vs83_2a|sslshed|geckotrail|Wordup|Keydrop|\(compatible\)|John Recon|SPARK COMMIT|masjesu|Komaru_The_Cat|Jesus Christ of Nazareth is LORD|Kowai|Hakai|LoliSec|LMAO|^xenu|^(?:chrome|desktop|firefox|Abcd|Dark|KvshClient|node|Node\.js|Report Runner|url|Zeus|ZmEu)$|OnlyScans|TheInternetSearchx|Laravel Reaver|bang2013|libredtail|Mozilliqa|Tiberius|honeygain|AW-WB-Filter|SaferSoftwashLeadGen|YourUserAgentHere|phpneuralnetwork'
5867 name: 'Generic Bot'
5868
5869 # Generic detections
5870 - regex: '[a-z0-9_-]*(?:(?<!cu|Hu|power[ _]|m[ _])bot(?![ _]TAB|[ _]?5[0-9]|[ _]Senior|[ _]Junior)|analyzer|appengine|archiver?|checker|collector|crawl|crawler|(?<!node-|uclient-|Mikrotik/\d\.[IAWPSCOPED\x\d] |electron-)fetch(?:er)?|(?<!url)grabber|indexer|inspector|monitor|^parser|(?<!Microsoft |banshee-)project(?!or)|(?<!Google Wap |Blue |SpeedMode; )proxy|(?<!P)research|resolver|robots|(?<!Cam)scanner|scraper|script|searcher|(?<!-)security|spider(?! 8)|study|transcoder|uptime|user[ _]?agent|validator|-(?:AI|Extended|User)/)(?:[^a-z]|$)'
5871 name: 'Generic Bot'
5872