# robots.txt — EGE Trainer # # Назначение: закрыть банк задач от индексации и от краулеров, собирающих # данные для обучения моделей. Технически robots.txt никого не останавливает # (его соблюдают добровольно), но он создаёт явно выраженный запрет: доступ # к материалам без разрешения нельзя считать «открытым», см. /terms.html. # # Правило простое: индексируем лендинги, всё остальное — нет. # --- Краулеры, собирающие данные для обучения моделей: полный запрет --- User-agent: GPTBot Disallow: / User-agent: OAI-SearchBot Disallow: / User-agent: ChatGPT-User Disallow: / User-agent: ClaudeBot Disallow: / User-agent: Claude-Web Disallow: / User-agent: anthropic-ai Disallow: / User-agent: CCBot Disallow: / User-agent: Google-Extended Disallow: / User-agent: PerplexityBot Disallow: / User-agent: Perplexity-User Disallow: / User-agent: Bytespider Disallow: / User-agent: Amazonbot Disallow: / User-agent: Applebot-Extended Disallow: / User-agent: Meta-ExternalAgent Disallow: / User-agent: FacebookBot Disallow: / User-agent: cohere-ai Disallow: / User-agent: Diffbot Disallow: / User-agent: ImagesiftBot Disallow: / User-agent: Omgilibot Disallow: / User-agent: Timpibot Disallow: / User-agent: YouBot Disallow: / # --- Все остальные: лендинги можно, банк задач и приложение — нет --- User-agent: * Disallow: /content/ Disallow: /app/ Disallow: /tasks/ Disallow: /home_student.html Disallow: /home_teacher.html Disallow: /student.html Disallow: /version.json Allow: /$ Allow: /index.html Allow: /terms.html Allow: /privacy.html