Розробка системи розпізнавання графічних captcha-систем за допомогою конкуруючих клітинних автоматів
DOI:
https://doi.org/10.15587/1729-4061.2018.148307Ключові слова:
конкуруючий клітинний автомат, рухомий клітинний автомат, captcha-системиАнотація
Розглянуто особливості застосування конкуруючих клітинних автоматів до задач з розпізнавання складних captcha-систем. Для цього введено поняття конкуруючих клітинних автоматів та розроблено алгоритми їх функціонування та взаємодії. Описано математичну модель конкуруючих клітинних автоматів на основі теорії множин для опису рухомих клітинних автоматів, що пересуваються по сусідніх станах символів і в такий спосіб реалізують свої правила переходу.На основі математичної моделі розроблено систему розпізнавання captha-зображень, яка реалізована в програмному коді засобами технології JavaFX 2.0, що дозволила досягти кросплатформеності та правильного функціонування на різних операційних системах.
Бібліотеки клітинних автоматів розроблялися для англійської мови. Кожен символ алфавіту представляється у вигляді системи станів, котрій поставлено у відповідність клітинний автомат зі станами, що описують даний символ.
Для розробки було використано мову програмування Java та можливості обробки зображень бібліотекою OpenCV, яка дозволила досягти якісного результату розпізнавання. Розглянуто архітектуру розробленої системи розпізнавання складних captcha-зображень у вигляді діаграм класів головних блоків з детальним описом кожного класу. Проведено комп'ютерні експерименти з різними наборами спотворених символів, що використовуються у реальних captcha-системах та отримано показники якості розпізнавання розробленим програмним забезпеченням.
Показано, що ймовірність отримання правильного результату розпізнавання captcha-зображень перевищує 80 % при ступені деформації символів до 20 %. При ступені деформації символів понад 30 % існує велика ймовірність помилкового розпізнавання символів.
До перевагам методу розпізнавання символів тексту на основі конкуруючих клітинних автоматів слід віднести простоту правил взаємодії, можливість легкого розпаралелювання процесу розпізнавання, можливість розпізнавання спотворених та частково накладених символів, які складають основу сучасних captcha-систем
Посилання
- T'yuring, A. M. (2003). Vychislitel'nye mashiny i razum. Samara: Bahrah-M, 128.
- Wolfram, S. A. (2002). New Kind of Science. Wolfram Media. Inc., 1197.
- Oliveira, C. C., de Oliveira, P. P. B. (2008). An Approach to Searching for Two-Dimensional Cellular Automata for Recognition of Handwritten Digits. Lecture Notes in Computer Science, 462–471. doi: https://doi.org/10.1007/978-3-540-88636-5_44
- Suyasov, D. I. (2010). Retrieving structural features from symbol images based on the cellular automata with labels. Informacionno-upravlyayushchie sistemy, 4, 39–45.
- Wu, H., Zhou, J., Gong, X., Wen, Y., Li, B. (2011). A new JPEG Image Watermarking Algorithm Based on Cellular Automata. Journal of Information & Computational Science, 8 (12), 2431–2439.
- Belan, S. N. (2011). Specialized cellular structures for image contour analysis. Cybernetics and Systems Analysis, 47 (5), 695–704. doi: https://doi.org/10.1007/s10559-011-9349-8
- Hussain, R., Gao, H., Shaikh, R. A. (2016). Segmentation of connected characters in text-based CAPTCHAs for intelligent character recognition. Multimedia Tools and Applications, 76 (24), 25547–25561. doi: https://doi.org/10.1007/s11042-016-4151-2
- Hussain, R., Gao, H., Shaikh, R. A., Soomro, S. P. (2016). Recognition based segmentation of connected characters in text based CAPTCHAs. 2016 8th IEEE International Conference on Communication Software and Networks (ICCSN). doi: https://doi.org/10.1109/iccsn.2016.7586608
- Abdullah Hasan, W. K. (2016). A Survey of Current Research on CAPTCHA. International Journal of Computer Science & Engineering Survey, 7 (3), 1–21. doi: https://doi.org/10.5121/ijcses.2016.7301
- Anti-captcha. Available at: https://anti-captcha.com/mainpage/
- Myroniv, I. (2016). Development of the character recognition software on the base cellular authomata. VI-th International Conference of Students, PhD-Students and Young Scientists “Engineer of XXI Century”, 229–240.
- OpenCV library. Available at: https://opencv.org/
- Leonenkov, A. V. (2004). Samouchitel' UML. Sankt-Peterburg: BHV Peterburg, 576.
- Fake Captcha is the #1 free fake captcha maker! Available at: https://fakecaptcha.com/
##submission.downloads##
Опубліковано
Як цитувати
Номер
Розділ
Ліцензія
Авторське право (c) 2018 Ivan Myroniv, Viktoriia Zhebka, Sergey Ostapov, Oleksander Val

Ця робота ліцензується відповідно до Creative Commons Attribution 4.0 International License.
Закріплення та умови передачі авторських прав (ідентифікація авторства) здійснюється у Ліцензійному договорі. Зокрема, автори залишають за собою право на авторство свого рукопису та передають журналу право першої публікації цієї роботи на умовах ліцензії Creative Commons CC BY. При цьому вони мають право укладати самостійно додаткові угоди, що стосуються неексклюзивного поширення роботи у тому вигляді, в якому вона була опублікована цим журналом, але за умови збереження посилання на першу публікацію статті в цьому журналі.
Ліцензійний договір – це документ, в якому автор гарантує, що володіє усіма авторськими правами на твір (рукопис, статтю, тощо).
Автори, підписуючи Ліцензійний договір з ПП «ТЕХНОЛОГІЧНИЙ ЦЕНТР», мають усі права на подальше використання свого твору за умови посилання на наше видання, в якому твір опублікований. Відповідно до умов Ліцензійного договору, Видавець ПП «ТЕХНОЛОГІЧНИЙ ЦЕНТР» не забирає ваші авторські права та отримує від авторів дозвіл на використання та розповсюдження публікації через світові наукові ресурси (власні електронні ресурси, наукометричні бази даних, репозитарії, бібліотеки тощо).
За відсутності підписаного Ліцензійного договору або за відсутністю вказаних в цьому договорі ідентифікаторів, що дають змогу ідентифікувати особу автора, редакція не має права працювати з рукописом.
Важливо пам’ятати, що існує і інший тип угоди між авторами та видавцями – коли авторські права передаються від авторів до видавця. В такому разі автори втрачають права власності на свій твір та не можуть його використовувати в будь-який спосіб.