Ключевой вопрос процесса — подпадает ли обучение нейросетей на защищенных книгах и новостях под доктрину `fair use` (добросовестного использования). Это макроэкономический рубикон для всего ИТ-рынка. Если суд признает парсинг сырых данных нарушением копирайта, юнит-экономика LLM-разработки будет уничтожена: стартапам и корпорациям придется платить лицензионные отчисления за каждый скормленный модели терабайт текста. Обучение алгоритмов превратится из инженерной задачи в бухгалтерский кошмар, что мгновенно заморозит появление новых open-source моделей и оставит на рынке только монополистов, способных покупать целые издательства.
Источник: The New York Times / OpenAI / Reuters
CopyrightOpenAILegalFair UseMacroeconomics