АТАКИ З ПРОМПТ-ІН’ЄКЦІЯМИ ТА МЕТОДИ ЇХ ЗАПОБІГАННЯ
Опубліковано 14.06.2024
Як цитувати
Завантаження
Авторське право (c) 2024 Микола Пелипад ; Максим Делембовський (Науковий керівник)

Ця робота ліцензується відповідно до Creative Commons Attribution-ShareAlike 4.0 International License.
Анотація
Вступ. Нинішній сплеск продуктів штучного інтелекту, включаючи відомих чат-ботів, таких як ChatGPT, ґрунтується на великих мовних моделях (Large Language Model - LLM) [1]. Ці складні нейронні мережі спеціально створені для розуміння людської природної мови та навчаються на великій кількості текстових даних, що дозволяє їм уловлювати лінгвістичні тонкощі, використання слів та закономірності у мові. Таке навчання дає можливість виконувати безліч вимог користувачів, включаючи, крім іншого, створення статей різного ступеня складності, підтримку інтерактивних діалогів та інші речі, що потребують креативного підходу.
Посилання
- OpenAI. GPT-4 Technical Report. arXiv.org e-Print archive. URL: https://arxiv.org/pdf/ 2303.08774 (дата звернення: 17.05.2024).
- Prompt Injection Attacks and Defenses in LLM-Integrated Applications. / Y. Liu та ін. arXiv.org e-Print archive. URL: https://arxiv.org/pdf/2310.12815 (дата звернення: 17.05.2024).
- Jose Selvi. Exploring prompt injection attacks. URL: https://research.nccgroup.com/2022/12/05/exploring-prompt-injection-attacks. (дата звернення: 17.05.2024).
- Julian Hazell. Large Language Models Can Be Used To Effectively Scale Spear Phishing Campaigns. arXiv.org e-Print archive. URL: https://arxiv.org/pdf/2305.06972 (дата звернення: 17.05.2024).
- From Prompt Injections to SQL Injection Attacks: How Protected is Your LLM-Integrated Web Application? / R. Pedro та ін. arXiv.org e-Print archive. URL: https://arxiv.org/pdf/2308.01990 (дата звернення: 17.05.2024).
- Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks. / D. Kang та ін. arXiv.org e-Print archive. URL: https://arxiv.org/pdf/2302.05733 (дата звернення: 17.05.2024).
- Bye Bye Bye...: Evolution of repeated token attacks on ChatGPT models. Dropbox Tech Blog - Dropbox. URL: https://dropbox.tech/machine-learning/bye-bye-bye-evolution-of-repeated-token-attacks-on-chatgpt-models (date of access: 17.05.2024).