В Microsoft назвали обучение ИИ на новостях крупнейшим ограблением в истории
Компании подозревали, что по ссылкам на источники никто не пойдет.
Внутренние документы Microsoft и OpenAI показали, что сотрудники обеих компаний еще до распространения генеративного ИИ обсуждали риск нанесения серьезного ущерба новостным изданиям. Эти материалы были опубликованы в рамках судебного разбирательства с группой СМИ во главе с The New York Times.
В частности, директор Microsoft по прикладным исследованиям Брент Хехт назвал использование новостного контента для обучения ИИ воровством беспрецедентного масштаба и допустил, что речь может идти о крупнейшем ограблении в истории.
Руководитель ChatGPT Ник Терли писал, что нейросети, обученные на новостном контенте, могут создать для СМИ серьезную угрозу, потому что начнут заменять первоисточники. Во внутреннем документе Microsoft этот эффект назвали петлей смерти: падение трафика и доходов издателей сокращает производство качественного контента, а это ухудшает набор данных для обучения ИИ.
По данным, приведенным истцами, Microsoft фиксировала снижение кликабельности ссылок на сайты отдельных новостных изданий на 83-93%. Добавление ссылок на первоисточники в ответах чат-бота посчитали бесполезным: в OpenAI пришли к выводу, что если в ответе уже есть нужная информация, то пользователь все равно не будет переходить по ссылкам.
Публично Microsoft и OpenAI декларируют другую позицию: компании утверждают, что их чат-боты не заменяют новостные сайты. В Microsoft также подчеркнули, что оценка Хехта — это его личное мнение, а не точка зрения самой корпорации.

