Керівник Microsoft назвав збір даних для ШІ «найбільшою крадіжкою праці в історії»

GPT/ChatGPT/AI Central Александра Горногоблизько 1 години тому0 переглядів

Брент Хехт, директор із прикладних досліджень Microsoft, назвав навчання ШІ на чужому контенті «найбільшою крадіжкою результатів праці в історії людства» у внутрішній записці 2023 року. Його слова стали публічними у судовому спорі NYT з Microsoft та OpenAI через авторські права.

ВердиктНегативнаImpact 6/10

⚖️ Регуляторний ризик. Це сигнал для компаній, що використовують AI: юридична чистка даних може стати вартішою, ніж саме навчання моделей. Для тих, хто залежить від зовнішнього контенту — час переглядати джерела даних.

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд
Детальний розбір ↓

TL;DR

  • Брент Хехт, директор Microsoft по прикладним дослідженням, назвав навчання AI на чужому контенті «крупнейшою кражою праці в історії»
  • Його слова з внутрішньої записки 2023 року стали публічними у судовому спорі NYT з Microsoft та OpenAI
  • Хехт попереджав про замкнуте коло: AI забирає аудиторію у створників контенту, необхідного для навчання моделей
  • Microsoft заявляє, що це його особиста думка, а не офіційна позиція компанії
  • Справа стосується авторських прав і може змінити спосіб навчання AI моделей у майбутньо

Як це змінить ваш ринок?

Для медіа та видавничої індустрії це сигнал, що авторські права можуть стати реальним інструментом боротьби з несанкціонованним використанням контенту в AI. Якщо суди визведуть, що навчання моделей на чужому тексті без дозволу — порушення, компаніям AI доведеться платити за ліцензії або розробляти власний контент. Це зростає вартість розробки AI, особливо для менших гравців, і може сповільнити інновації в секторі.

Визначення: авторські права — юридичне право створника контролювати використання його творчого твору, включаючи репродукцію, поширення та створення похідних творів.

Для кого це і за яких умов (ОБОВ'ЯЗКОВО: мін. обладнання/бюджет, потрібна команда чи ні, мін. масштаб, час на впровадження.

  • Для видавництв та медіакомпаній: потрібна юридична команда або зовнішній консультант для моніторингу використання контенту в AI моделях, бюджет від $5K/рік на інструменти виявлення порушень
  • Для компаній, що розробляють AI: потрібна команда з юридичними та даними експертами для переходу на ліцензовані або синтетичні дані, інвестиції від $50K у інфраструктуру даних
  • Для SMB, що використовують AI-інструменти: немає прямої дії, але слід слідкувати за змінами у умовах ліцензування інструментів, які ви використовуєте

Альтернативи

Синтетичні даніЛіцензовані контентиВласний контент
Ціна$0-0.001/1K токенів$5-50/1K токенівЗарплати креативної команди
Де працюєУсі хмари та локальноAPI провайдерів данихВнутрішні системи
Мін. вимогиГенеративні моделіДоговори з правовласникамиЕкіп контент-креаторів
Ключова різницяНе порушує авторські права, але може мати нижу ясністьЗаконно чистий, але дорогоПовний контроль, але вимагає ресурсів

💬 Часті запитання

Ні, це залежить від джерел даних та юрисдикції. Деякі моделі навчаються на публічних даних або даних з ліцензією, але спір NYT показує, що границя нечітка.

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
AItrainingdatacopyrightlawsuitMicrosoftOpenAINewYorkTimesdatascrapinglabortheftcontentcreators

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live