Публікація: Навчання з підкріпленням на основі зворотного зв’язку від штучного інтелекту для вирівнювання моделей
| dc.contributor.author | Селін, Я. Ю. | |
| dc.date.accessioned | 2026-07-15T19:31:13Z | |
| dc.date.issued | 2026 | |
| dc.description.abstract | This paper explores Reinforcement Learning from AI Feedback (RLAIF) as a scalable alternative to human feedback (RLHF) for aligning large language models. It examines the core mechanisms of RLAIF, particularly the Constitutional AI framework, where a superior AI evaluates outputs based on predefined ethical guidelines. Key algorithmic stages and potential challenges like reward hacking are analyzed. The findings highlight RLAIF as an efficient, cost-effective methodology for ensuring AI safety without relying on extensive human annotation. | |
| dc.identifier.citation | Селін Я. Ю. Навчання з підкріпленням на основі зворотного зв’язку від штучного інтелекту для вирівнювання моделей // Радіоелектроніка та молодь у XXI столітті : матеріали 30-го Міжнар. молодіж. форуму, 22–24 квітня 2026 р. Харків, 2026. Т. 6. С. 108-109. | |
| dc.identifier.uri | https://openarchive.nure.ua/handle/document/35603 | |
| dc.language.iso | uk | |
| dc.publisher | ХНУРЕ | |
| dc.subject | навчання з підкріпленням | |
| dc.subject | вирівнювання моделей | |
| dc.title | Навчання з підкріпленням на основі зворотного зв’язку від штучного інтелекту для вирівнювання моделей | |
| dc.type | Conference proceedings | |
| dspace.entity.type | Publication |
Файли
Оригінальний пакунок
1 - 1 з 1
Завантаження...
- Назва:
- MRF_2026_T6-108-109.pdf
- Розмір:
- 198.05 KB
- Формат:
- Adobe Portable Document Format
Пакунок ліцензії
1 - 1 з 1
Завантаження...
- Назва:
- license.txt
- Розмір:
- 10.74 KB
- Формат:
- Item-specific license agreed upon to submission
- Опис: