НОВОСТИ

Microsoft и OpenAI в суде: обучение ИИ назвали «кражей труда»

В деле New York Times против OpenAI и Microsoft рассекретили цитаты: обучение на статьях называли кражей труда и угрозой журналистике. Компании это отрицают.

Microsoft и OpenAI в суде: обучение ИИ назвали «кражей труда»
Содержание 4
  1. 01Платный доступ обходили, копирайты стирали
  2. 02Позиция в суде и чужие слова сотрудников
  3. 03Минск: прямой пользы нет, последствия — да
  4. 04Текст: TehnoRex

В американском суде по иску New York Times к OpenAI и Microsoft рассекретили внутренние реплики 2023 года. Их впервые широко разобрали 18 сентября. Директор Microsoft Applied Science Брент Хект называл сбор текстов для обучения «крупнейшей кражей труда в истории человечества» и предупреждал о «петле гибели» для издателей. У OpenAI Ник Тёрли говорил об «экзистенциальной угрозе» для прессы. Это не приговор. Это куски переписки без полного контекста, которые компании сейчас от себя дистанцируют.

Платный доступ обходили, копирайты стирали

По тем же материалам модели кормили миллионами документов, обходя paywall, и снимали знаки охраны авторского права с обучающей выборки. Сотрудник писал президенту OpenAI Грегу Брокману о новом способе обойти подписку — и получил короткое «ah nice». Внутренний документ Microsoft 2023 года формулировал жёстче: миллионы людей скоро сочтут, что большие модели «пылесосят» их работу, и назовут это кражей невиданного масштаба.

Хект отдельно сказал, что крупные модели — «продукт, который уничтожает свою цепочку поставок». Инженер OpenAI в 2023-м предупреждал коллег: как бы заметно ни ставили ссылки, пользователи не будут по ним кликать. Тёрли это подтвердил: ИИ-продукты в основном подменяют журналистику, а не отправляют трафик на оригинал. Если это так, спор не про «цитату в ответе», а про то, останется ли кому писать тексты, на которых модель учится. Рядом лежит свежий разбор самой OpenAI, как модели на тестах прятали следы: отчёт о опасном поведении вышел накануне.

Позиция в суде и чужие слова сотрудников

Microsoft от собственных формулировок открестилась. Представитель Алекс Хаурек сослался на судебные бумаги компании: Copilot не заменяет журналистику, а «трансформирующее» использование якобы укладывается в авторское право. Несколько похожих исков в США уже заканчивались в пользу ИИ-компаний, но судьи прямо писали, что закон вокруг обучения моделей ещё не устоялся. Дело Times считают одним из ключевых именно поэтому: решит ли суд, что загрузка чужих статей в датасет — fair use, как пародия, или это обычное копирование.

Иск Times вместе с группой авторов идёт с 2023 года. Обвинение простое: тексты забрали без разрешения и без оплаты, чтобы собрать LLM. Защита отвечает, что модель не воспроизводит газету целиком и что обучение похоже на чтение. Рассекреченные цитаты бьют не по юридической формуле, а по внутреннему пониманию риска. Те же корпорации параллельно просят государства навести правила: главы OpenAI, Anthropic, Google и Microsoft уже выходили за регулирование. Выглядит противоречиво, пока в архиве суда лежит «кража труда».

Минск: прямой пользы нет, последствия — да

Белорусскому читателю из этого не купить гаджет и не сэкономить на подписке. Зато именно такие процессы решают, останутся ли нормальные тексты на русском и английском в открытом доступе или издатели ещё плотнее закроют архивы. Если суд встанет на сторону газет, лицензии на датасеты подорожают, а бесплатные сводки моделей станут короче. Если на сторону лабораторий — пресса останется сырьём. Практический вывод простой: не принимать ответ чат-бота за первоисточник. Даже OpenAI свой GPT-5.5 скоро выключит, дата отключения — 14 октября, а цитаты из суда никуда не денутся.

Текст: TehnoRex

ПОДПИШИТЕСЬ НА РАССЫЛКУ

Новые обзоры и сравнения — на почту