⚡ Главное за 5 секунд - Суть: OpenAI опасалась появления на Hacker News заголовков о том, что компания использует данные с «скетчи» российского сайта. - Где доступно: рассекреченные документы по иску Authors Guild против OpenAI опубликованы на сайте Authors Guild. - Ограничение: это лишь часть масштабного разбирательства, дальнейшие слушания ожидаются в начале 2027 года. ### 🔍 Что обнаружено Согласно рассекреченным материалам дела Authors Guild против OpenAI и Microsoft, топ-менеджеры компании знали об использовании пиратской библиотеки LibGen при обучении моделей. В служебной переписке исследователь OpenAI Сэм Маккэндлиш объяснил, что его беспокоит не законность, а «оптика»: он опасался, что на Hacker News появится заголовок «openai uses copyrighted data from sketchy russian website». Тогдашний директор по исследованиям Дарио Амодеи также признал, что LibGen как тренировочный набор «выглядит сомнительно». В документах цитируется переписка 2019 года, когда Сэм Альтман и Дарио Амодеи представили раннюю версию GPT-3 Биллу Гейтсу и техническому директору Microsoft Кевину Скотту, раскрыв использование LibGen. Позже, летом 2022 года, OpenAI запустила проект «Clear» по удалению следов LibGen из своих систем — сотрудники обсуждали, как «вычистить» упоминания из Slack, GitHub и хранилищ. В иске утверждается, что это было сделано для сокрытия улик. ### 💡 Почему это важно Эти факты показывают, что для OpenAI приоритетом была не юридическая чистота, а репутация в технологическом сообществе. Руководители осознанно использовали пиратские материалы и беспокоились, как это будет выглядеть в глазах разработчиков и инженеров на Hacker News. Для наблюдателей за развитием ИИ это важный маркер корпоративной этики: компания готова была рисковать нарушениями, но не хотела публичного осуждения. Практическая польза для сообщества — понимание того, как формируются решения в крупных AI-лабораториях. ### 🧩 Контекст Речь идёт о коллективном иске, поданном Authors Guild и известными писателями, включая Джорджа Мартина, Джона Гришэма и Джоди Пиколт, к OpenAI и Microsoft. В иске утверждается, что компании обучали модели на защищённых авторским правом книгах, намеренно игнорируя права авторов. Новые документы, обнародованные 21 сентября 2026 года, стали поворотным моментом: они доказывают, что руководители знали о потенциальном вреде для писателей и американской культуры, но всё равно продолжали использовать пиратские источники. Дело находится на стадии рассмотрения в Манхэттене, ожидаются новые заявления.
🔗 Читать на authorsguild.org