Сотрудники Microsoft назвали AI-скрейпинг крупнейшей кражей труда в истории

Документы по делу NYT против OpenAI раскрыли дискуссию сотрудников Microsoft: обучение ИИ на новостном контенте сочли величайшей кражей труда в истории.

Eliza Crichton-Stuart

Eliza Crichton-Stuart

Обновлено

Microsoft Staff Debated AI Scraping as Massive Labor Theft
Реклама

"Миллионы людей по всему миру вскоре осознают, что крупные модели, поглощающие весь их труд, — это поразительная кража беспрецедентных масштабов".

Эти слова принадлежат не стороннему критику. Они прозвучали внутри Microsoft.

Судебные документы, обнародованные на этой неделе в рамках иска New York Times о нарушении авторских прав против OpenAI и Microsoft, приоткрыли завесу над некоторыми неудобными внутренними дискуссиями. Материалы дела показывают, что сотрудники Microsoft задавали острые вопросы о методах обучения ИИ за годы до того, как эта тема стала предметом публичных дебатов, в том числе о том, не является ли вся эта операция крупнейшей кражей труда в истории человечества.

ЭКСКЛЮЗИВНОЕ ПРЕДЛОЖЕНИЕ

Используйте код TRYHARD33 при оформлении заказа, пока срок его действия не истек.

Скидка 33% на подписку GAMES+

Что на самом деле говорят обнародованные документы

К иску, который Times подала в конце 2023 года, с тех пор присоединились еще одиннадцать издателей. Судья Sidney Stein из Южного округа Нью-Йорка в настоящее время рассматривает ходатайства о вынесении решения в порядке упрощенного судопроизводства, и в рамках этого процесса документы становятся публичными.

Самая резкая формулировка содержится в записке Brent Hecht, директора по прикладным наукам Microsoft, который также занимал должность в Northwestern University. Во внутреннем документе 2023 года Hecht написал, что крупные ИИ-модели "являются продуктом, который уничтожает собственную цепочку поставок", и предупредил, что общественность в конечном итоге воспримет массовое поглощение их работ как кражу в беспрецедентных масштабах.

Microsoft поспешила дистанцироваться от этих слов. Компания заявляет, что Hecht был нанят специально для того, чтобы "представлять различные и асимметричные точки зрения", и не принимал решений. Его записки, утверждает Microsoft, не отражают позицию компании.

Однако вот в чем дело: тот факт, что кому-то платили за озвучивание этих опасений, и что эти опасения были задокументированы, — это именно те доказательства, которые имеют вес в суде.

Показания Nadella и вопрос платного доступа

Satya Nadella, генеральный директор Microsoft, дал показания, что "все, что находится за пейволлом, должно лицензироваться любым, кто хочет это использовать". Он пошел дальше, заявив, что если бы знал, что OpenAI обучается на контенте за пейволлом, он бы воспользовался договорным правом Microsoft потребовать переобучения моделей. Позже представитель компании заявил, что Nadella "говорил об общих принципах" того, как люди находят и потребляют информацию, что выглядит как довольно значительное отступление от своих слов.

На разрыв между тем, что Nadella сказал под присягой, и тем, что позже уточнил представитель компании, стоит обратить внимание по мере развития дела.

Внутренние дискуссии OpenAI были не менее откровенными

Документы не оставляют в стороне и OpenAI. Сотрудник OpenAI рассказал президенту Greg Brockman о создании обходного пути для преодоления пейволла Times во время обучения. Ответ Brockman: "а, неплохо".

Nick Turley, руководивший командой продукта ChatGPT, в июне 2023 года написал, что ИИ представляет "экзистенциальную угрозу" для издателей. К февралю 2024 года он уже писал, что ИИ-продукты "будут становиться все более замещающими по мере своего совершенствования". Инженер OpenAI в феврале 2023 года отметил, что "как бы заметно мы ни показывали ссылки, пользователи не будут кликать" по источникам, что прямо противоречит аргументу о том, что чат-боты возвращают трафик издателям.

Большинство игроков упускают из виду, что это не слитые документы от информатора. Это внутренняя переписка, которую OpenAI и Microsoft создали, хранили и теперь обязаны предоставить в рамках судебного разбирательства. Компании знали, что писали в то время.

Предупреждение о "петле гибели"

Помимо темы кражи труда, в записке Hecht от 2023 года поднимался еще один вопрос, который с тех пор стал предметом активных дебатов в кругах исследователей ИИ. Аргумент заключался в том, что обучение на контенте, созданном ИИ, создает петлю обратной связи, которая со временем снижает качество моделей, поскольку результаты работы одного поколения моделей становятся обучающими данными для следующего.

Это не маргинальное опасение. Исследователи изучают, что происходит с результатами моделей, когда синтетические данные насыщают пул обучения, и результаты не обнадеживают. Ключевой момент здесь в том, что кто-то внутри Microsoft указывал на этот риск внутри компании в то же самое время, когда она публично заявляла о потенциале ИИ.

Аргумент о добросовестном использовании и позиция издателей

И Microsoft, и OpenAI утверждают, что обучение на опубликованном контенте является добросовестным использованием (fair use), преобразующим статьи в нечто новое, а не заменяющим оригиналы. Этот аргумент еще не был проверен в суде.

Steven Lieberman, представляющий New York Daily News и семь других издателей-истцов, кратко резюмировал взгляд истцов на обнародованные документы: "Мир может увидеть, что OpenAI и Microsoft все это время думали о справедливости своего собственного поведения".

В записке 2020 года от Jack Clark, тогдашнего директора по политике OpenAI, содержалось предупреждение, что компания "создает системы, которые замещают труд людей, определяющих культуру общества", и "станет символом того, как Кремниевая долина бездумно вторгается в другие сферы жизни, оставляя после себя беспорядок". Позже Clark ушел, чтобы стать соучредителем Anthropic.

Times, будучи истцом по собственному делу, от комментариев отказалась. OpenAI не ответила на запросы о комментариях.

Что это значит для ИИ и игровой экосистемы в целом

Это дело имеет значение далеко за пределами издательской индустрии. Те же вопросы об обучающих данных, согласии и компенсации задаются во всех творческих сферах, включая разработку игр, концепт-арт, озвучку и написание сценариев. Если суды в конечном итоге постановят, что массовый ИИ-скрейпинг не является добросовестным использованием, последствия для того, как создаются и лицензируются ИИ-инструменты, затронут всю креативную индустрию.

Для геймеров и разработчиков, наблюдающих, как ИИ-инструменты становятся стандартной частью производственных пайплайнов, исход этого дела может определить, как будут выглядеть эти инструменты и кто будет получать оплату за их использование. Вам стоит следить за решением судьи Stein по упрощенному судопроизводству, которое даст понять, дойдет ли дело до полноценного процесса или будет разрешено до того, как вся доказательная база будет проверена.

Чтобы узнать больше о событиях в индустрии, влияющих на создание игр, ознакомьтесь с нашими гейминг-гайдами и продолжайте следить за обновлениями по мере развития судебного процесса.

Отчёты

обновлено

September 18th 2026

опубликовано

September 18th 2026

Реклама

Похожие новости