Comparison of data consistency models in distributed database management systems
Автор
Myrhorodskyi, А.
Romanyuk, О.
Миргородський, А. В.
Романюк, О. В.
Дата
2025Metadata
Показати повну інформаціюCollections
Анотації
The use of distributed infrastructure to ensure scalability and high availability creates new challenges for maintaining data consistency between rapidly growing information system nodes that require reliable data management for correct operation. The aim of the study was to comprehensively systematise and comparatively analyse methods for ensuring data consistency in distributed database management systems, taking into account the fundamental trade-offs between consistency, availability and delays described by the CAP and PACELC theorems. To achieve this goal, methods of theoretical analysis, formal modelling of system behaviour, and comparative expert evaluation were used. As a result of the study, consistency models were systematised according to two main approaches: data-centric and clientcentric. The first approach analyses models that determine the global behaviour of the system: linearity, sequential, causal and eventual consistency. The advantages, disadvantages and typical application scenarios are identified for each model. The second approach considers client-oriented models that provide guarantees within a single user session: read and write consistency, monotonic read, monotonic write, and session causality. A generalised classification is proposed that visualises the relationship between the degree of consistency, delays, flexibility, fault tolerance and potential performance for each model. All considered data consistency models are compared using a number of ed essential characteristics (PACELC class, consistency, fault tolerance, potential performance, etc.) and diagrams based on their parameters. The practical value of the work lies in the formulation of clear recommendations for ing the optimal consistency model depending on the requirements for reliability, performance, and architectural features of the information system. The results can be used to improve the efficiency of designing distributed databases in high-load systems, such as financial services, Internet of Things platforms, and cloud applications. Використання розподіленої інфраструктури для забезпечення масштабованості та високої
доступності створює нові виклики для підтримки узгодженості даних між вузлами інформаційних систем, що
стрімко зростають та вимагають надійного управління даними для коректної роботи. Метою дослідження була
комплексна систематизація та порівняльний аналіз методів забезпечення узгодженості даних у розподілених
системах керування базами даних, враховуючи фундаментальні компроміси між узгодженістю, доступністю
та затримками оновлення, що описуються теоремами CAP та PACELC. Для досягнення мети було використано
методи теоретичного аналізу, формального моделювання поведінки систем та порівняльного експертного
оцінювання. В результаті дослідження було систематизовано моделі узгодженості за двома основними підходами:
інформаційно-орієнтованим та клієнтоорієнтованим. В рамках першого підходу проаналізовано моделі, що
визначають глобальну поведінку системи: лінеаризовність, послідовну, причинну та кінцеву узгодженість.
Для кожної моделі визначено переваги, недоліки та типові сценарії застосування. У рамках другого підходу
розглянуто клієнтоорієнтовані моделі, що надають гарантії в межах сесії одного користувача: узгодженість
читання і запису, монотонне зчитування, монотонний запис та сесійну причинність. Запропоновано узагальнену
класифікацію, яка візуалізує співвідношення між ступенем узгодженості, затримками, гнучкістю, стійкістю
до збоїв та потенційною продуктивністю для кожної моделі. Проведено порівняння усіх розглянутих моделей
узгодженості даних за допомогою ряду відібраних істотних характеристик (клас за PACELC, узгодженість,
стійкість до збоїв, потенційна продуктивність тощо) та діаграм на основі їх параметрів. Практична цінність
роботи полягає у формулюванні чітких рекомендацій щодо вибору оптимальної моделі узгодженості залежно від
вимог до надійності, продуктивності та архітектурних особливостей інформаційної системи. Результати можуть
бути використані для підвищення ефективності проектування розподілених баз даних у високонавантажених
системах, таких як фінансові сервіси, платформи Інтернету речей та хмарні застосунки.
URI:
https://ir.lib.vntu.edu.ua//handle/123456789/52430

