Математики вимагають доказів, що OpenAI не використовувала їхню роботу
Математик Андрій Том обвинив OpenAI у використанні неопублікованої математичної роботи з взаємодій з ChatGPT без прозорості. Це піднімає етичні питання про походження даних для навчання моделей.
⚠️ Ризик репутації. Для компаній, що використовують AI — перевірте джерела даних, щоб уникнути етичних спорів та потенційних претензій.
🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Математик Андрій Том обвинив OpenAI у використанні неопублікованої роботи без згоди
- •Серед обвинень — недостатня прозорості щодо даних для навчання ChatGPT
- •Попередній спор про неопубліковану математичну роботу вже вибухнув раніше
- •Акцент на етичних аспектах тренування великих мовних моделей
- •Немає конкретних доказів, лише підозрі на основі взаємодій з chatbot
Як це змінить ваш ринок?
Для юридичних та медиа-компаній це підвищує ризик претензій щодо використання творчих робіт у тренуванні AI. Компанії можуть змушені впроваджувати системи простеження за джерелами даних та ліцензування контенту, щоб уникнути судебних спорів та шкоди репутації.
Визначення: Тренування даних — це набір тексту, зображень або іншої інформації, якою навчають штучний інтелект для виявлення патернів та прийняття рішень.
Для кого це і за яких умов
Для компаній з 10-50 співробітників, що використовують готові AI API (наприклад, ChatGPT через API): немає додаткових вимог, оскільки відповідальність лежить на постачальнику. Для тих, хто тренує власні моделі: потрібна юридична перевірка джерел даних та можливості вилучення за заявою (до 1 тижня на аудит).
Альтернативи
| OpenAI GPT-4 | Anthropic Claude 2 | LLaMA 3 (Meta) | |
|---|---|---|---|
| Ціна | $0.03/1K токенів | $0.011/1K токенів | Вільно (з обмеженнями) |
| Де працює | Хмара/API | Хмара/API | Локально/хмара |
| Мін. вимоги | Інтернет-з’єднання | Інтернет-з’єднання | GPU 24GB+ для повної версії |
| Ключова різниця | Найпопулярніший, але питання про дані | Акцент на безпеці даних | Відкриті ваги, контроль над даними |
🔒 Підтекст (Insider)
Ця новина сигналізує про зростаюче напруження між творцями контенту та AI-компаніями щодо прав на дані. Якщо виявиться, що моделі навчалися на незгоді, це може призвести до нових регуляторних вимог та потреби ліцензування даних для тренування.
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Джерела
The Verge AI — оригіналНавчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live