Публікація:
Дослідження стійкості великих мовних моделей до атак типу prompt injection

dc.contributor.authorЛісовський, А. С.
dc.date.accessioned2026-09-28T16:22:17Z
dc.date.issued2026
dc.description.abstractОб’єкт дослідження – процес функціонування великих мовних моделей в умовах реалізації атак типу промпт-ін’єкцій. Предмет дослідження – методи та механізми реалізації прямих і непрямих промпт-ін’єкцій, а також показники стійкості LLM до таких атак. Мета роботи – проведення порівняльного аналізу вразливостей великих мовних моделей до атак типу промпт-ін’єкції, виявлення залежностей між архітектурними особливостями моделей та рівнем їх стійкості, а також побудова системи тестування безпеки LLM. Методи дослідження – аналіз наукових публікацій у сфері безпеки штучного інтелекту, формалізація типології промпт-ін’єкцій, моделювання атак різних категорій, експериментальне тестування моделей через API- провайдерів, розрахунок показника ASR. У процесі виконання дослідження проводиться аналіз архітектурних передумов вразливостей трансформерів, зокрема механізму самоуваги та шару токенізації. Також систематизуються сучасні техніки прямих промпт ін’єкцій та формується експериментального тестування. структурований датасет атак для Крім того, розробляється програмна система автоматизованої взаємодії з мовними моделями для проведення серії тестів і обчислення показників успішності атак. Отримані результати дозволяють оцінити рівень безпеки досліджуваних LLM та визначити ключові фактори, що впливають на їхню стійкість до атак типу промпт-ін’єкція.
dc.identifier.citationЛісовський А. С. Дослідження стійкості великих мовних моделей до атак типу prompt injection : пояснювальна записка до кваліфікаційної роботи здобувача вищої освіти на другому (магістерському) рівні, спеціальність 122 Комп’ютерні науки / М-во освіти і науки України, Харків. нац. ун-т радіоелектроніки. Харків, 2026. 79 с.
dc.identifier.urihttps://openarchive.nure.ua/handle/document/36216
dc.language.isouk
dc.subjectбезпека штучного інтелекту
dc.subjectтрансформер
dc.subjectджейлбрейк
dc.titleДослідження стійкості великих мовних моделей до атак типу prompt injection
dc.typeOther
dspace.entity.typePublication

Файли

Оригінальний пакунок

Зараз показано 1 - 1 з 1
Завантаження...
Зображення мініатюри
Назва:
2026_M_ShI_Lisovsky_AS.pdf
Розмір:
3.01 MB
Формат:
Adobe Portable Document Format

Пакунок ліцензії

Зараз показано 1 - 1 з 1
Завантаження...
Зображення мініатюри
Назва:
license.txt
Розмір:
10.74 KB
Формат:
Item-specific license agreed upon to submission
Опис: