НейтральнаImpact 4/10🔬 Research🎓 Освіта

Заохочення загальної узагальненості: навчання Gemma чомусь пояснювати

Shir-man Daily Top•близько 22 годин тому•0 переглядів•

Автор впровадив новий тип узагальнення зворотного зв'язку 'за принципами' і тестував навчання з підкріпленням, яке нагороджує модель за посилання на її конституцію під час розсудів. З'ясувалося, що на даний момент найефективніше працює навчання з учителем.

ВердиктНейтральнаImpact 4/10

🔬 Цікаво для дослідників, але без готового продукту. Для компаній до 200 людей це теорія без безпосереднього застосування.

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд
Детальний розбір ↓

TL;DR

  • •Новий тип узагальнення 'за принципами' для покращення зворотного зв'язку у LLM
  • •Тестування RL, яке нагороджує модель за посилання на конституцію під час розсудів
  • •Навчання з учителем залишається найефективнішим методом наразі
  • •Робота оприлюднена на LessWrong, автор — незалежний дослідник
  • •Фокус на прозорість і відповідальність моделей, а не на продуктивність

Як це змінить ваш ринок?

Для галузі освіти та дослідницьких лабораторій ця робота може надати нові підходи до тренування моделей з урахуванням етичних обмежень. Проте для комерційного застосування в компаніях до 200 людей відчутного впливу не очікується, оскільки пропозиція ще не перетворена на готовий інструмент або API.

Визначення:

Узагальнення 'за принципами' — це тип зворотного зв'язку, де модель отримує нагороду не лише за правильність відповіді, а й за те, наскільки вона посилається на свої внутрішні принципи або конституцію під час формування відповіді.

Для кого це і за яких умов

Для дослідників AI та академічних лабораторій, які працюють над прозорістю та відповідальністю моделей. Потрібний доступ до Gemma або подібних моделей, можливість модифікувати функції втрати та проводити експерименти з RL. Не потрібна спеціалізована команда, але потрібні навички у машинному навчанні та доступ до обчислювальних ресурсів.

Альтернативи

| | Продукт 1 | Продукт 2 | Продукт 3 | | Ціна | дані не розкриті | дані не розкриті | дані не розкриті | | Де працює | Gemma, LLaMA, інші відкриті моделі | Gemma, LLaMA, інші відкриті моделі | Gemma, LLaMA, інші відкриті моделі | | Мін. вимоги | знання ML, доступ до моделі, обчислювальні ресурси | знання ML, доступ до моделі, обчислювальні ресурси | знання ML, доступ до моделі, обчислювальні ресурсы | | Ключова різниця | фокус на 'за принципами' узагальненні | стандартне RLHF | стандартне SFT |


Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
Gemmaalignmentgeneralizationreinforcementlearningsupervisedfine-tuningconstitution

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live