Seattle Times та Newsday подають позов проти OpenAI та Microsoft через порушення авторських прав

The Verge AI14 днів тому3 перегляди

Seattle Times та Newsday подали позов проти OpenAI та Microsoft, стверджуючи, що їх журналістика використовувалась без дозволу для навчання моделей ШІ. Моделі відтворюють фрагменти статей у відповідях на запити користувачів.

ВердиктНегативнаImpact 7/10

⚖️ Регуляторний ризик. Визначення меж fair use для навчання ШІ може змінити бізнес-моделі генеративного ШІ — для компаній, що залежать від даних третіх сторін.

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд
Детальний розбір ↓

TL;DR

  • Seattle Times та Newsday подали позов проти OpenAI та Microsoft через використання їх статей для навчання ШІ без дозволу
  • Позов стверджує, що моделі ШІ відтворюють фрагменти оригінальних статей у відповідях
  • Microsoft включено як відповідальний через Copilot, який базується на технологіях OpenAI
  • Це частина хвилі подібних позов від New York Times, Ziff Davis та інших виdawnictв
  • Рішення суду може вимагати від ШІ-компаній ліцензування даних для навчання

Як це змінить ваш ринок?

Якщо суди визНАЧАть, що використання журналістики для навчання ШІ без дозволу порушує авторські права, це може призвести до зобов'язання платити за дані. Для медіакомпаній це новий дохідний потік. Для ШІ-розробників — зростання витрат на тренінг моделей, особливо для тих, хто залежить від високоякісних текстових даних.

Визначення:

Fair use — доктрина авторського права, що дозволяє обмежене використання захищеного матеріалу без дозволу для таких цілей, як критика, новини, навчання або дослідження.

Для кого це і за яких умов (ОБОВ'ЯЗКОВО: мін. обладнання/бюджет, потрібна команда чи ні, мін. масштаб, час на впровадження.

  • Для медіакомпаній: потрібна юридична команда для моніторингу та подачі позовів; бюджет від $50K на справу; ефективно для виdawnictв з унікальним вмістом
  • Для ШІ-компаній: потрібна юридична та комендантська функція для оцінки ризиків ліцензування даних; можливо потрібна команда для переходу на ліцензовані або синтетичні дані

Альтернативи

ПродуктЦінаДе працюєМін. вимогиКлючова різниця
Тренінг на публічних даних$0Веб, хмараІнтернет-з'єднанняРизик порушення авторських прав
Тренінг на ліцензованих даних$0.50–2.00 за 1K токенівAPI-провайдериДоговір з постачальником данихЗаконність використання
Синтетичні дані$100–500 за датасетЛокально, хмараГенеративна модельВідсутність ризиків авторських прав

💬 Часті запитання

Ні, але може збільшити витрати. Компанії вже переходять на ліцензовані дані або синтетичні альтернативи.

🔒 Підтекст (Insider)

Видавці не просто захищають авторські права — вони намагаються змусити ШІ-компанії платити за дані, що сьогодні беруть безкоштовно. Це може призвести до нової ліцензійної моделі для тренінгу моделей.

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
copyrightinfringementAItrainingdataOpenAIMicrosoftlawsuit

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live