Domain Name: BIRDSOFTHEWORLD.ORG
Registrar: GoDaddy.com, LLC
Domain Status: client delete prohibited
Domain Status: client renew prohibited
Domain Status: client transfer prohibited
Domain Status: client update prohibited
Registry Expiry Date: 2027-01-12T13:32:33Z
Creation Date: 2002-01-12T13:32:33.141Z
Updated Date: 2026-02-26T13:33:03.327Z
Name Server: BIGRED.CIT.CORNELL.EDU
Name Server: DNS.CIT.CORNELL.EDU
Name Server: DRDNS2.CIT.CORNELL.EDU
REGISTRAR Contact: GoDaddy.com, LLC
>>> Last update of RDAP database: 2026-03-15T06:46:17Z
# Don't crawl the redirect pages or managed content (visible to google)
User-agent: *
Disallow: /*/redirect/
Disallow: /*/managed-content/
# Disallow AI Crawlers. From: https://github.com/ai-robots-txt/ai.robots.txt
# Note that some google agents allowed (to hopefully allow Google Scholar)
User-agent: AI2Bot
User-agent: Ai2Bot-Dolma
User-agent: aiHitBot
User-agent: Amazonbot
User-agent: Andibot
User-agent: anthropic-ai
User-agent: Applebot
User-agent: Applebot-Extended
User-agent: Awario
User-agent: bedrockbot
User-agent: Brightbot 1.0
User-agent: Bytespider
User-agent: CCBot
User-agent: ChatGPT-User
User-agent: Claude-SearchBot
User-agent: Claude-User
User-agent: Claude-Web
User-agent: ClaudeBot
User-agent: cohere-ai
User-agent: cohere-training-data-crawler
User-agent: Cotoyogi
User-agent: Crawlspace
User-agent: Datenbank Crawler
User-agent: Devin
User-agent: Diffbot
User-agent: DuckAssistBot
User-agent: Echobot Bot
User-agent: EchoboxBot
User-agent: FacebookBot
User-agent: facebookexternalhit
User-agent: Factset_spyderbot
User-agent: FirecrawlAgent
User-agent: FriendlyCrawler
User-agent: Gemini-Deep-Research
User-agent: Google-CloudVertexBot
User-agent: Google-Extended
User-agent: GoogleAgent-Mariner
#User-agent: GoogleOther
#User-agent: GoogleOther-Image
#User-agent: GoogleOther-Video
User-agent: GPTBot
User-agent: iaskspider/2.0
User-agent: ICC-Crawler
User-agent: ImagesiftBot
User-agent: img2dataset
User-agent: ISSCyberRiskCrawler
User-agent: Kangaroo Bot
User-agent: meta-externalagent
User-agent: Meta-ExternalAgent
User-agent: meta-externalfetcher
User-agent: Meta-ExternalFetcher
User-agent: MistralAI-User
User-agent: MistralAI-User/1.0
User-agent: MyCentralAIScraperBot
User-agent: netEstate Imprint Crawler
User-agent: NovaAct
User-agent: OAI-SearchBot
User-agent: omgili
User-agent: omgilibot
User-agent: Operator
User-agent: PanguBot
User-agent: Panscient
User-agent: panscient.com
User-agent: Perplexity-User
User-agent: PerplexityBot
User-agent: PetalBot
User-agent: PhindBot
User-agent: Poseidon Research Crawler
User-agent: QualifiedBot
User-agent: QuillBot
User-agent: quillbot.com
User-agent: SBIntuitionsBot
User-agent: Scrapy
User-agent: SemrushBot-OCOB
User-agent: SemrushBot-SWA
User-agent: Sidetrade indexer bot
User-agent: SummalyBot
User-agent: Thinkbot
User-agent: TikTokSpider
User-agent: Timpibot
User-agent: VelenPublicWebCrawler
User-agent: WARDBot
User-agent: Webzio-Extended
User-agent: wpbot
User-agent: YandexAdditional
User-agent: YandexAdditionalBot
User-agent: YouBot
Disallow: /
# Sitemap for all species accounts
# NOTE: URL must be absolute, so using birdsoftheworld.org
# despite the fact that this may be deployed to test/demo sites.
Sitemap: https://birdsoftheworld.org/bow/sitemap-accounts.xml
| Pozice | Fráze | Strana | Úryvek |
|---|---|---|---|
| 1 | / | ||
| 2 | / | ||
| 3 | / | ||
| 4 | / | ||
| 5 | /bow/species/cintit1... | ||
| 6 | / | ||
| 20 | /bow/species/indtit1... | ||
| 30 | /bow/species/baleag/... | ||
| 32 | /bow/species/torduc1... | ||
| 38 | /bow/species/blutit/... |