Публікація: Дослідження повного циклу розробки генеративних мовних моделей: від підготовки даних до оптимізації інференсу
| dc.contributor.author | Аргунов, М. К. | |
| dc.date.accessioned | 2026-10-10T06:58:34Z | |
| dc.date.issued | 2026 | |
| dc.description.abstract | Об’єкт дослідження – процес побудови малої мовної моделі на базі архітектури Transformer. Предмет дослідження – методи підготовки даних, архітектурні рішення та стратегії навчання, що впливають на якість генералізації моделі. Мета роботи – демонстрація повного шляху побудови мовної моделі від підготовки та фільтрації даних до оцінки на прикладній задачі машинного перекладу (DE→EN). Методи дослідження – експериментальний метод (побудова та навчання моделі з різними конфігураціями даних), порівняльний аналіз (зіставлення результатів моделей, навчених на фільтрованих та нефільтрованих даних). Розроблено триетапний конвеєр фільтрації веб-корпусу OSCAR, що відсіює приблизно 90% документів. Реалізовано кастомну encoder-decoder Transformer-архітектуру з приблизно 100M параметрами із сучасними модифікаціями (GQA, RoPE, SwiGLU, Pre-LN). Проведено передтренування та дотренування на задачі машинного перекладу. Емпірично підтверджено, що модель, передтренована на 250M фільтрованих токенів, перевершує модель на 384M нефільтрованих токенів за якістю генералізації, що еквівалентно приблизно 35% економії обчислювальних витрат | |
| dc.identifier.citation | Аргунов М. К. Дослідження повного циклу розробки генеративних мовних моделей: від підготовки даних до оптимізації інференсу : пояснювальна записка до кваліфікаційної роботи здобувача вищої освіти на першому (бакалаврському) рівні, спеціальність 122 Комп’ютерні науки / М-во освіти і науки України, Харків. нац. ун-т радіоелектроніки. Харків, 2026. 76 с. | |
| dc.identifier.uri | https://openarchive.nure.ua/handle/document/36269 | |
| dc.language.iso | uk | |
| dc.subject | веб-корпус, | |
| dc.subject | transformer | |
| dc.subject | якість даних | |
| dc.subject | фільтрація даних | |
| dc.subject | передтренування | |
| dc.subject | мовна модель | |
| dc.subject | машинний переклад | |
| dc.title | Дослідження повного циклу розробки генеративних мовних моделей: від підготовки даних до оптимізації інференсу | |
| dc.type | Other | |
| dspace.entity.type | Publication |
Файли
Оригінальний пакунок
1 - 2 з 2
Завантаження...
- Назва:
- 2026_B_ShI_Argunov_MK.pdf
- Розмір:
- 696.22 KB
- Формат:
- Adobe Portable Document Format
Завантаження...
- Назва:
- Dodatok_Argunov.pdf
- Розмір:
- 239.15 KB
- Формат:
- Adobe Portable Document Format
Пакунок ліцензії
1 - 1 з 1
Завантаження...
- Назва:
- license.txt
- Розмір:
- 10.74 KB
- Формат:
- Item-specific license agreed upon to submission
- Опис: