Domain name: lobste.rs
Domain status: Active https://www.rnids.rs/en/domain-name-status-codes#Active
Registration date: 13.12.2011 10:00:16
Modification date: 17.03.2025 19:54:44
Expiration date: 13.12.2029 10:00:16
Confirmed: 13.12.2011 10:00:16
Registrar: Mainstream Public Cloud Services d.o.o.
Registrant: Individual
Administrative contact: Marcaria.com Corp
Address: 1000177, 22 Grace Church St, New York, United States of America
Postal Code:
ID Number: 4104929
Tax ID:
Technical contact: Marcaria.com Corp
Address: 1000177, 22 Grace Church St, New York, United States of America
Postal Code:
ID Number: 4104929
Tax ID:
DNS: ns1.dnsimple.com -
DNS: ns2.dnsimple.com -
DNS: ns3.dnsimple.com -
DNS: ns4.dnsimple.com -
DNSSEC signed: no
Whois Timestamp: 08.11.2025 06:09:18
# https://lobste.rs/s/ybowdq/great_gpt_firewall
User-agent: AI2Bot
User-agent: Ai2Bot-Dolma
User-agent: Amazonbot
User-agent: anthropic-ai
User-agent: Applebot
User-agent: Applebot-Extended
User-agent: Bytespider
User-agent: CCBot
User-agent: ChatGPT-User
User-agent: Claude-Web
User-agent: ClaudeBot
User-agent: cohere-ai
User-agent: cohere-training-data-crawler
User-agent: Crawlspace
User-agent: Diffbot
User-agent: DuckAssistBot
User-agent: FacebookBot
User-agent: FriendlyCrawler
User-agent: Google-Extended
User-agent: GoogleOther
User-agent: GoogleOther-Image
User-agent: GoogleOther-Video
User-agent: GPTBot
User-agent: iaskspider/2.0
User-agent: ICC-Crawler
User-agent: ImagesiftBot
User-agent: img2dataset
User-agent: ISSCyberRiskCrawler
User-agent: Kangaroo Bot
User-agent: Meta-ExternalAgent
User-agent: Meta-ExternalFetcher
User-agent: OAI-SearchBot
User-agent: omgili
User-agent: omgilibot
User-agent: PanguBot
User-agent: PerplexityBot
User-agent: PetalBot
User-agent: Scrapy
User-agent: SemrushBot
User-agent: Sidetrade indexer bot
User-agent: Timpibot
User-agent: VelenPublicWebCrawler
User-agent: Webzio-Extended
User-agent: YouBot
Disallow: /
# SEO/spam tools
User-agent: AhrefsBot
User-agent: BLEXBot
User-agent: Clickagy
User-agent: SemrushBot
User-agent: SemrushBot-BA
User-agent: SemrushBot-COUB
User-agent: SemrushBot-CT
User-agent: SemrushBot-SI
User-agent: SemrushBot-SWA
User-agent: SiteAuditBot
User-agent: SplitSignalBot
Disallow: /
# Google refuses to support crawl-delay so when this was at the top they
# combined it with the following (anti-LLM slop) rules and blocked the site
# https://developers.google.com/search/blog/2019/07/a-note-on-unsupported-rules-in-robotstxt
User-agent: *
Crawl-delay: 1
Disallow: /search
Disallow: /page/
Disallow: /comments/page/
# https://developers.google.com/search/docs/crawling-indexing/robots/create-robots-txt
Sitemap: https://lobste.rs/sitemap.xml.gz
| Posição | Frase | Página | Trecho |
|---|---|---|---|
| 3 | /s/vtcocq/c_is_truly... |