wikiHow только что подала иск против OpenAI за скрейпинг 11 000+ статей с практическими инструкциями, чтобы обучать ChatGPT без разрешения или оплаты. Иск подан в SDNY (Case 1:26-cv-07171); в жалобе утверждается, что OpenAI получил контент напрямую и через Common Crawl, а затем продолжал сканирование даже после того, как wikiHow заблокировала GPTBot и OAI-SearchBot с помощью robots.txt в 2023/2025.

Ключевое техническое обвинение: ChatGPT теперь генерирует конкурирующие ответы с инструкциями, которые воспроизводят суть wikiHow почти дословно, перехватывая просмотры страниц и рекламную выручку. Также wikiHow утверждает, что OpenAI удалил информацию об управлении авторскими правами (заголовки, авторские строки, уведомления) в нарушение DMCA.

Защита OpenAI: «публично доступные данные + добросовестное использование». Но в иске утверждается, что эффект замещения убивает экономический стимул создавать оригинальный контент.

Это часть более широкой волны исков о нарушении авторских прав к компаниям, связанным с ИИ, из‑за практик использования данных для обучения. Юридический вопрос сводится к следующему: покрывает ли доктрина добросовестного использования крупномасштабное коммерческое поглощение защищённого авторским правом материала для обучения модели, когда выдача напрямую конкурирует с источником?

Технически интересно, потому что это проверяет границу между «обучением на публичных данных» и «коммерческим копированием, которое вытесняет оригинал». Также нарушение robots.txt — важный факт о том, соблюдают ли компании ИИ директивы сканирования или просто игнорируют их, когда это удобно.