Керівник Microsoft назвав збір даних для ШІ «найбільшою крадіжкою праці в історії»
Брент Хехт, директор із прикладних досліджень Microsoft, назвав навчання ШІ на чужому контенті «найбільшою крадіжкою результатів праці в історії людства» у внутрішній записці 2023 року. Його слова стали публічними у судовому спорі NYT з Microsoft та OpenAI через авторські права.
⚖️ Регуляторний ризик. Це сигнал для компаній, що використовують AI: юридична чистка даних може стати вартішою, ніж саме навчання моделей. Для тих, хто залежить від зовнішнього контенту — час переглядати джерела даних.
🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Брент Хехт, директор Microsoft по прикладним дослідженням, назвав навчання AI на чужому контенті «крупнейшою кражою праці в історії»
- •Його слова з внутрішньої записки 2023 року стали публічними у судовому спорі NYT з Microsoft та OpenAI
- •Хехт попереджав про замкнуте коло: AI забирає аудиторію у створників контенту, необхідного для навчання моделей
- •Microsoft заявляє, що це його особиста думка, а не офіційна позиція компанії
- •Справа стосується авторських прав і може змінити спосіб навчання AI моделей у майбутньо
Як це змінить ваш ринок?
Для медіа та видавничої індустрії це сигнал, що авторські права можуть стати реальним інструментом боротьби з несанкціонованним використанням контенту в AI. Якщо суди визведуть, що навчання моделей на чужому тексті без дозволу — порушення, компаніям AI доведеться платити за ліцензії або розробляти власний контент. Це зростає вартість розробки AI, особливо для менших гравців, і може сповільнити інновації в секторі.
Визначення: авторські права — юридичне право створника контролювати використання його творчого твору, включаючи репродукцію, поширення та створення похідних творів.
Для кого це і за яких умов (ОБОВ'ЯЗКОВО: мін. обладнання/бюджет, потрібна команда чи ні, мін. масштаб, час на впровадження.
- •Для видавництв та медіакомпаній: потрібна юридична команда або зовнішній консультант для моніторингу використання контенту в AI моделях, бюджет від $5K/рік на інструменти виявлення порушень
- •Для компаній, що розробляють AI: потрібна команда з юридичними та даними експертами для переходу на ліцензовані або синтетичні дані, інвестиції від $50K у інфраструктуру даних
- •Для SMB, що використовують AI-інструменти: немає прямої дії, але слід слідкувати за змінами у умовах ліцензування інструментів, які ви використовуєте
Альтернативи
| Синтетичні дані | Ліцензовані контенти | Власний контент | |
|---|---|---|---|
| Ціна | $0-0.001/1K токенів | $5-50/1K токенів | Зарплати креативної команди |
| Де працює | Усі хмари та локально | API провайдерів даних | Внутрішні системи |
| Мін. вимоги | Генеративні моделі | Договори з правовласниками | Екіп контент-креаторів |
| Ключова різниця | Не порушує авторські права, але може мати нижу ясність | Законно чистий, але дорого | Повний контроль, але вимагає ресурсів |
💬 Часті запитання
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Навчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live