ایندکس ستونی خوشه‌ای در SQL Server با ۱۰ مثال عملی در SQL Server

ایندکس ستونی خوشه‌ای در SQL Server

توسط admin | گروه SQL Server | 1405/05/05

نظرات 0

ایندکس ستونی خوشه‌ای در SQL Server

ایندکس ستونی خوشه‌ای یا CCI کل جدول را به ساختار ستونی تبدیل می‌کند و داده‌ها را در Rowgroupهای فشرده نگه می‌دارد. این ساختار برای انبار داده، گزارش‌گیری تحلیلی و اسکن حجم زیاد داده طراحی شده است. در این راهنما موضوع از سطح مقدماتی تا طراحی عملی، خطاهای رایج، ملاحظات کارایی و سناریوهای نگه‌داری بررسی می‌شود.

مخاطب مقاله برنامه‌نویسان، مدیران پایگاه داده و تحلیل‌گرانی هستند که می‌خواهند Clustered Columnstore Index را بدون تصمیم‌های حدسی در Microsoft SQL Server به‌کار بگیرند. بازگشت به راهنمای جامع کارایی Columnstore در SQL Server

تعریف و جایگاه موضوع

ایندکس ستونی خوشه‌ای یا CCI کل جدول را به ساختار ستونی تبدیل می‌کند و داده‌ها را در Rowgroupهای فشرده نگه می‌دارد. این ساختار برای انبار داده، گزارش‌گیری تحلیلی و اسکن حجم زیاد داده طراحی شده است.

این قابلیت را باید در کنار مفاهیم Clustered Columnstore Index، Rowgroup، Column Segment و Compression تحلیل کرد. تصمیم درست تنها با مشاهده یک Query سریع حاصل نمی‌شود؛ بلکه نرخ رشد داده، الگوی DML، نحوه بارگذاری، محدودیت منابع و زمان نگه‌داری نیز باید وارد مدل تصمیم شوند.

نکته نسخه: در نسخه‌های جدید SQL Server قابلیت‌های نگه‌داری خودکار و اجرای Batch Mode کامل‌تر شده‌اند؛ جزئیات دقیق به نسخه موتور وابسته است.

چرا این موضوع مهم است؟

در جداول تحلیلی بزرگ، تفاوت میان طراحی درست و اجرای صرف یک دستور می‌تواند به اختلاف قابل‌توجه در IO، CPU و زمان پاسخ منجر شود. ایندکس ستونی خوشه‌ای وقتی ارزش واقعی ایجاد می‌کند که با هدف کسب‌وکار، الگوی Query و ظرفیت زیرساخت هماهنگ باشد.

  • انبار داده فروش
  • گزارش‌های تجمیعی
  • جداول Fact بزرگ
  • بارگذاری دسته‌ای
  • کاهش فضای ذخیره‌سازی

به همین دلیل لازم است معیار موفقیت پیش از پیاده‌سازی تعریف شود. برای نمونه می‌توان زمان گزارش ماهانه، تعداد Rowgroupهای کم‌حجم، درصد ردیف‌های حذف‌شده، حجم Log یا تعداد Segmentهای خوانده‌شده را به‌عنوان شاخص پایه ثبت کرد.

نقشه مفهومی ایندکس ستونی خوشه‌اینمایش اجزای اصلی، رابطه Rowgroup و مسیر داده در موضوع Clustered Columnstore Indexنقشه مفهومی ایندکس ستونی خوشه‌ایClustered Columnstore Index1Clustered Columnstore Indexورودی2Rowgroupساختار مرکزی3Column Segmentفراداده4Compressionمرحله میانی5Batch Modeپردازش6Delta Storeخروجی

این نمودار اجزای کلیدی «ایندکس ستونی خوشه‌ای» و ارتباط میان Clustered Columnstore Index، Rowgroup و Column Segment را نشان می‌دهد.

نحو، اجزا و پارامترهای اصلی

نحو پایه زیر نقطه شروع است. نام شیء، Schema، پارتیشن و گزینه‌ها باید با محیط واقعی جایگزین شوند. در رشته‌های فارسی SQL از پیشوند N استفاده شده تا داده یونیکد درست ذخیره شود.

CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSales ON dbo.FactSales;

اجزای کلیدی

مفهومنقش در موضوعنکته عملی
Clustered Columnstore Indexبخشی از معماری یا رفتار ایندکس ستونی خوشه‌ایبارگذاری در Batchهای بزرگ
Rowgroupبخشی از معماری یا رفتار ایندکس ستونی خوشه‌ایپایش DMVها
Column Segmentبخشی از معماری یا رفتار ایندکس ستونی خوشه‌ایانتخاب پارتیشن‌بندی مناسب
Compressionبخشی از معماری یا رفتار ایندکس ستونی خوشه‌ایاجتناب از Rebuild بی‌دلیل
Batch Modeبخشی از معماری یا رفتار ایندکس ستونی خوشه‌ایآزمون روی Workload واقعی
Delta Storeبخشی از معماری یا رفتار ایندکس ستونی خوشه‌ایبارگذاری در Batchهای بزرگ

نوع خروجی بسته به موضوع ممکن است یک ساختار ایندکس، Plan اجرایی، مجموعه Rowgroup، شمارنده DMV یا مقدار عددی باشد. همیشه خروجی را با Metadata و Plan واقعی تأیید کنید؛ پیام موفقیت دستور به‌تنهایی نشان‌دهنده بهبود نیست.

فرایند تصمیم‌گیری و پیاده‌سازی

  1. Workload اصلی را مشخص کنید و Queryهای پرتکرار مرتبط با ایندکس ستونی خوشه‌ای را از Query Store یا مانیتورینگ استخراج کنید.
  2. وضعیت فعلی Rowgroup و Column Segment را ثبت کنید تا خط پایه قابل مقایسه باشد.
  3. Syntax را در محیط آزمایشی اجرا کنید و اثر آن را روی اندازه Rowgroup و نرخ حذف منطقی بسنجید.
  4. سناریوهای بارگذاری، حذف، به‌روزرسانی، گزارش‌گیری و بازیابی خطا را جداگانه آزمایش کنید.
  5. پس از تأیید، اجرای Production را با پنجره تغییر، Rollback Plan و گزارش کنترلی انجام دهید.

این روش مرحله‌ای مانع آن می‌شود که یک بهبود محلی، هزینه پنهان در ETL یا عملیات تراکنشی ایجاد کند. همچنین مستندسازی خروجی‌های قبل و بعد، تصمیم‌های نگه‌داری آینده را قابل دفاع می‌سازد.

جریان اجرای ایندکس ستونی خوشه‌اینمایش جریان ورودی تا خروجی و نقاط کنترلی مرتبط با Clustered Columnstore Indexجریان اجرای ایندکس ستونی خوشه‌ایClustered Columnstore Index1Clustered Columnstore Indexداده ورودی2Rowgroupتشخیص3Column Segmentپردازش4Compressionکنترل5Batch Modeنتیجه6Delta Storeپایش

در این جریان، داده از مرحله ورودی عبور می‌کند، در نقطه‌های کنترلی مرتبط با Rowgroup و Compression ارزیابی می‌شود و سپس نتیجه قابل پایش تولید می‌گردد.

۱۰ مثال عملی از ساده تا حرفه‌ای

مثال 1: مثال پایه و اجرای نخست

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی مثال پایه و اجرای نخست بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    SELECT SUM(Amount) AS total_amount FROM dbo.FactSalesDemo;
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف25,137مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی40 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ اندازه Rowgroup را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

مثال 2: کار روی داده نمونه واقعی

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی کار روی داده نمونه واقعی بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    SELECT YEAR(OrderDate) AS sales_year,SUM(Amount) AS total_amount FROM dbo.FactSalesDemo GROUP BY YEAR(OrderDate);
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف25,274مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی38 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ نرخ حذف منطقی را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

مثال 3: استفاده در SELECT تحلیلی

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی استفاده در SELECT تحلیلی بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    SELECT TOP (10) CustomerID,SUM(Amount) AS customer_amount FROM dbo.FactSalesDemo GROUP BY CustomerID ORDER BY customer_amount DESC;
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف25,411مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی36 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ Segment Elimination را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

مثال 4: فیلتر و شرط کاربردی

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی فیلتر و شرط کاربردی بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    SELECT SUM(Amount) FROM dbo.FactSalesDemo WHERE OrderDate>='2026-01-01' AND OrderDate<'2026-02-01';
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف25,548مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی34 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ حافظه ساخت ایندکس را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

مثال 5: ترکیب با قابلیت دیگر

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی ترکیب با قابلیت دیگر بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    INSERT INTO dbo.FactSalesDemo VALUES (30001,'2026-07-27',77,8,NULL,NULL);
    SELECT COUNT(*) AS null_rows FROM dbo.FactSalesDemo WHERE Amount IS NULL;
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف25,685مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی32 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ الگوی بارگذاری را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

مثال 6: رفتار با NULL یا تغییر داده

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی رفتار با NULL یا تغییر داده بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    DELETE TOP (1000) FROM dbo.FactSalesDemo;
    SELECT SUM(deleted_rows) AS deleted_rows FROM sys.dm_db_column_store_row_group_physical_stats WHERE object_id=OBJECT_ID(N'dbo.FactSalesDemo');
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف25,822مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی30 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ اندازه Rowgroup را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

مثال 7: حالت مرزی و کنترل Metadata

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی حالت مرزی و کنترل Metadata بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    SELECT state_desc,COUNT(*) AS groups,SUM(total_rows) AS rows_count FROM sys.dm_db_column_store_row_group_physical_stats WHERE object_id=OBJECT_ID(N'dbo.FactSalesDemo') GROUP BY state_desc;
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف25,959مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی28 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ نرخ حذف منطقی را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

مثال 8: سناریوی گزارش‌گیری سازمانی

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی سناریوی گزارش‌گیری سازمانی بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    SET STATISTICS IO ON;
    SELECT ProductID,AVG(Amount) FROM dbo.FactSalesDemo GROUP BY ProductID;
    SET STATISTICS IO OFF;
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف26,096مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی26 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ Segment Elimination را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

مثال 9: روش اشتباه و نسخه اصلاحی

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی روش اشتباه و نسخه اصلاحی بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    SELECT i.name,i.type_desc FROM sys.indexes i WHERE i.object_id=OBJECT_ID(N'dbo.FactSalesDemo');
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف26,233مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی24 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ حافظه ساخت ایندکس را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

مثال 10: آزمون کارایی و بهینه‌سازی

در این مثال، «ایندکس ستونی خوشه‌ای» در سناریوی آزمون کارایی و بهینه‌سازی بررسی می‌شود. Query به‌گونه‌ای نوشته شده که در یک محیط آزمایشی SQL Server قابل اجرا باشد و نتیجه آن با DMV، خروجی تجمیعی یا Metadata کنترل شود.

USE tempdb;
    DROP TABLE IF EXISTS dbo.FactSalesDemo;
    CREATE TABLE dbo.FactSalesDemo
    (
        SaleID bigint NOT NULL,
        OrderDate date NOT NULL,
        CustomerID int NOT NULL,
        ProductID int NOT NULL,
        Quantity smallint NULL,
        Amount decimal(18,2) NULL
    );

    INSERT INTO dbo.FactSalesDemo
    (
        SaleID, OrderDate, CustomerID, ProductID, Quantity, Amount
    )
    SELECT TOP (25000)
        ROW_NUMBER() OVER (ORDER BY (SELECT NULL)),
        DATEADD(day, -ABS(CHECKSUM(NEWID())) % 730, CONVERT(date, '20260727')),
        1 + ABS(CHECKSUM(NEWID())) % 5000,
        1 + ABS(CHECKSUM(NEWID())) % 800,
        1 + ABS(CHECKSUM(NEWID())) % 12,
        CONVERT(decimal(18,2), 10 + ABS(CHECKSUM(NEWID())) % 50000 / 10.0)
    FROM sys.all_objects AS a
    CROSS JOIN sys.all_objects AS b;

    CREATE CLUSTERED COLUMNSTORE INDEX CCI_FactSalesDemo
    ON dbo.FactSalesDemo;

    SELECT CustomerID,SUM(Amount) AS total_amount FROM dbo.FactSalesDemo WHERE OrderDate>='2025-01-01' GROUP BY CustomerID HAVING SUM(Amount)>10000;
شاخصخروجی نمونهتفسیر
وضعیتCOMPRESSEDساختار برای اسکن تحلیلی آماده است
تعداد ردیف26,370مقدار نمونه برای مقایسه قبل و بعد
هزینه منطقی22 صفحهخروجی نمونه و وابسته به محیط واقعی

نکته فنی: هنگام استفاده از Clustered Columnstore Index فقط به موفق‌بودن دستور اکتفا نکنید؛ الگوی بارگذاری را قبل و بعد اندازه بگیرید و اثر آن را روی Workload واقعی ثبت کنید.

خطاهای رایج

خطاهای زیر در پروژه‌های واقعی مرتبط با Clustered Columnstore Index دیده می‌شوند. شدت هر خطا به حجم داده و نسخه SQL Server وابسته است، اما اصل کنترل برای همه محیط‌ها یکسان است.

  • استفاده برای جداول OLTP بسیار کوچک
  • بارگذاری ردیفی مداوم بدون طراحی
  • نادیده گرفتن کیفیت Rowgroup
  • توقع مرتب‌سازی فیزیکی کامل

مهم‌ترین هشدار: استفاده برای جداول OLTP بسیار کوچک. پیش از هر تغییر گسترده، Backup/Restore آزمایشی، ظرفیت Log و امکان بازگشت را بررسی کنید.

ملاحظات کارایی و پایش

برای ارزیابی ایندکس ستونی خوشه‌ای حداقل پنج محور باید هم‌زمان دیده شود: اندازه Rowgroup, نرخ حذف منطقی, Segment Elimination, حافظه ساخت ایندکس, الگوی بارگذاری. اندازه‌گیری تنها زمان اجرا ممکن است نتیجه گمراه‌کننده بدهد، زیرا Cache گرم، Parallelism، Memory Grant و بار هم‌زمان روی نتیجه اثر دارند.

معیارچرا مهم است؟روش پیشنهادی
اندازه Rowgroupاثر مستقیم بر کیفیت یا هزینه ایندکس ستونی خوشه‌ای داردبارگذاری در Batchهای بزرگ
نرخ حذف منطقیاثر مستقیم بر کیفیت یا هزینه ایندکس ستونی خوشه‌ای داردپایش DMVها
Segment Eliminationاثر مستقیم بر کیفیت یا هزینه ایندکس ستونی خوشه‌ای داردانتخاب پارتیشن‌بندی مناسب
حافظه ساخت ایندکساثر مستقیم بر کیفیت یا هزینه ایندکس ستونی خوشه‌ای دارداجتناب از Rebuild بی‌دلیل
الگوی بارگذاریاثر مستقیم بر کیفیت یا هزینه ایندکس ستونی خوشه‌ای داردآزمون روی Workload واقعی

یک Snapshot منفرد برای تصمیم بلندمدت کافی نیست. داده پایش را در چند بازه کاری، پس از ETL و در ساعات اوج جمع‌آوری کنید تا روند واقعی مشخص شود.

سناریوی عملی و بهینه‌سازی ایندکس ستونی خوشه‌ایمقایسه روش نامناسب و بهترین روش برای کارایی و نگه‌داری Clustered Columnstore Indexسناریوی عملی و بهینه‌سازی ایندکس ستونی خوشه‌ایClustered Columnstore Index1Clustered Columnstore Indexروش ضعیف2Rowgroupاثر3Column Segmentریسک4Compressionبهترین روش5Batch Modeبهبود6Delta Storeکنترل

این سناریو تفاوت میان اجرای بدون پایش و اجرای مبتنی بر Best Practice را برای ایندکس ستونی خوشه‌ای مقایسه می‌کند؛ معیارهای اصلی شامل اندازه Rowgroup و نرخ حذف منطقی هستند.

بهترین روش‌ها

  • بارگذاری در Batchهای بزرگ
  • پایش DMVها
  • انتخاب پارتیشن‌بندی مناسب
  • اجتناب از Rebuild بی‌دلیل
  • آزمون روی Workload واقعی

Best Practice به‌معنای اجرای یک نسخه ثابت برای همه سرورها نیست. باید توصیه‌ها را با اندازه داده، Edition، Compatibility Level، معماری HA/DR و محدودیت پنجره نگه‌داری تطبیق داد.

پرسش‌های متداول

ایندکس ستونی خوشه‌ای دقیقاً چه مشکلی را حل می‌کند؟

ایندکس ستونی خوشه‌ای یا CCI کل جدول را به ساختار ستونی تبدیل می‌کند و داده‌ها را در Rowgroupهای فشرده نگه می‌دارد. این ساختار برای انبار داده، گزارش‌گیری تحلیلی و اسکن حجم زیاد داده طراحی شده است. انتخاب آن باید براساس نوع بارکاری و معیارهای قابل اندازه‌گیری انجام شود.

برای شروع یادگیری Clustered Columnstore Index چه پیش‌نیازی لازم است؟

آشنایی با Execution Plan، ایندکس‌ها و دستورات پایه T-SQL کافی است. سپس باید مفاهیم Rowgroup و Column Segment را روی یک پایگاه داده آزمایشی مشاهده کنید.

آیا ایندکس ستونی خوشه‌ای برای همه پروژه‌های تجاری مناسب است؟

خیر. سودمندی آن به حجم داده، نسبت خواندن به نوشتن، SLA گزارش‌ها و هزینه نگه‌داری وابسته است. ارزیابی فنی یا مشاوره SQL Server پیش از استقرار می‌تواند از هزینه‌های بازطراحی جلوگیری کند.

هزینه پیاده‌سازی ایندکس ستونی خوشه‌ای چگونه برآورد می‌شود؟

برآورد باید شامل تحلیل Workload، طراحی آزمایش، زمان مهاجرت، پایش پس از اجرا و آموزش تیم باشد. اندازه جدول و حساسیت توقف سرویس نیز روی زمان انجام پروژه اثر مستقیم دارد.

تفاوت ایندکس ستونی خوشه‌ای با یک ایندکس یا روش عمومی چیست؟

روش عمومی معمولاً فقط ساختار یا دستور را می‌بیند، اما این موضوع روی Clustered Columnstore Index، Compression و رفتار واقعی موتور تمرکز دارد. مقایسه باید با Plan، IO، CPU و مدت اجرا انجام شود.

چه زمانی برای اجرای پروژه یا دریافت خدمات مرتبط با Clustered Columnstore Index مناسب است؟

هنگامی که گزارش‌ها کند شده‌اند، رشد داده سریع است یا نگه‌داری فعلی نتیجه قابل پیش‌بینی ندارد، بررسی تخصصی ارزشمند است. بهتر است ابتدا Snapshot فنی و معیار موفقیت تعیین شود.

رایج‌ترین خطا در استفاده از ایندکس ستونی خوشه‌ای چیست؟

یکی از خطاهای پرتکرار «استفاده برای جداول OLTP بسیار کوچک» است. خطای دیگر تصمیم‌گیری بدون مقایسه قبل و بعد و بدون توجه به نسخه SQL Server است.

ایندکس ستونی خوشه‌ای چه اثری بر Performance دارد؟

اثر اصلی از مسیر اندازه Rowgroup، نرخ حذف منطقی و Segment Elimination دیده می‌شود. نتیجه می‌تواند بسیار مثبت یا در Workload نامناسب منفی باشد، بنابراین تست کنترل‌شده ضروری است.

بهترین روش عملی برای ایندکس ستونی خوشه‌ای چیست؟

از یک محیط آزمایشی مشابه Production شروع کنید، بارگذاری در Batchهای بزرگ و پایش DMVها را اجرا کنید و معیارها را در Query Store یا سامانه پایش ثبت نمایید.

سازگاری Clustered Columnstore Index با نسخه‌های SQL Server چگونه است؟

در نسخه‌های جدید SQL Server قابلیت‌های نگه‌داری خودکار و اجرای Batch Mode کامل‌تر شده‌اند؛ جزئیات دقیق به نسخه موتور وابسته است. پیش از انتشار در Production، Syntax و گزینه‌های قابل پشتیبانی را روی همان Edition، Version و Compatibility Level بررسی کنید.

سؤالات مصاحبه

پاسخ مناسب به پرسش‌های زیر باید علاوه بر تعریف، شامل سناریو، Trade-off، معیار اندازه‌گیری و نمونه T-SQL باشد.

  1. تفاوت Clustered Columnstore Index و Rowgroup را با یک سناریوی واقعی توضیح دهید.
  2. برای سنجش اثر Clustered Columnstore Index چه شاخص‌هایی را قبل و بعد ثبت می‌کنید؟
  3. در چه شرایطی «استفاده برای جداول OLTP بسیار کوچک» باعث افت کارایی می‌شود؟
  4. چگونه با استفاده از Column Segment و Compression مشکل را عیب‌یابی می‌کنید؟
  5. در طراحی یک Job سازمانی برای ایندکس ستونی خوشه‌ای چه کنترل خطا و Rollback در نظر می‌گیرید؟
  6. چرا توصیه «بارگذاری در Batchهای بزرگ» برای محیط Production مهم است؟

چک‌لیست نهایی

  1. نسخه و Compatibility Level برای Clustered Columnstore Index کنترل شد.
  2. خط پایه IO، CPU، Duration و فضای مصرفی ثبت شد.
  3. Query و Syntax در محیط آزمایشی اجرا شد.
  4. اثرات DML و ETL جداگانه سنجیده شد.
  5. خروجی DMV یا Metadata پس از اجرا بررسی شد.
  6. Rollback Plan و ظرفیت Log مشخص شد.
  7. گزارش مقایسه قبل و بعد ذخیره شد.
  8. Job یا رویه نگه‌داری دارای شرط و کنترل خطا است.

جمع‌بندی

ایندکس ستونی خوشه‌ای زمانی مفید است که از حالت یک دستور منفرد خارج و به یک فرایند اندازه‌گیری‌شده تبدیل شود. ایندکس ستونی خوشه‌ای یا CCI کل جدول را به ساختار ستونی تبدیل می‌کند و داده‌ها را در Rowgroupهای فشرده نگه می‌دارد. این ساختار برای انبار داده، گزارش‌گیری تحلیلی و اسکن حجم زیاد داده طراحی شده است. در عمل باید با نسخه SQL Server، شکل داده و هدف گزارش‌گیری سازگار شود.

برای مطالعه ارتباط این موضوع با سایر اجزای Columnstore، راهنمای جامع کارایی Columnstore در SQL Server را ببینید.

خدمات برنامه‌نویسی و پایگاه داده

برنامه‌نویسی در اصفهان

قبول سفارش‌های برنامه‌نویسی و پایگاه داده: 09131253620

انجام پروژه‌های برنامه‌نویسی، آموزش برنامه‌نویسی و آموزش پایگاه داده SQL Server با رویکرد حرفه‌ای، مستندسازی مناسب و قابلیت توسعه انجام می‌شود.

مجموعه‌ای معتبر با سابقه فعالیت حرفه‌ای از سال ۱۳۷۵ شمسی

از سال ۱۳۷۵ شمسی تاکنون در زمینه طراحی و اجرای پروژه‌های برنامه‌نویسی، پایگاه داده، سیستم‌های تحت وب، وب‌سایت و راهکارهای نرم‌افزاری فعالیت می‌کنیم.

برای سفارش پروژه‌های برنامه‌نویسی و پایگاه داده، سیستم‌های تحت وب، وب‌سایت و راهکارهای نرم‌افزاری جدید، با شماره تلفن همراه 09131253620 تماس حاصل فرمایید.

ایتا، واتساپ و تماس مستقیم: +989131253620

تماس با ما

 

0 نظر

نظر محترم شما در مورد مقاله های وب سایت برنامه نویسی و پایگاه داده

نظرات محترم شما در خدمات رسانی بهتر ما را یاری می نمایند. لطفا اگر مایل بودید یک نظر ما را مهمان فرمائید. آدرس ایمیل و وب سایت شما نمایش داده نخواهد شد.

حرف 500 حداکثر