آموزش CREATE STATISTICS و ساخت آمار دستی در SQL Server | آموزش تخصصی SQL Server

آموزش CREATE STATISTICS و ساخت آمار دستی در SQL Server

توسط admin | گروه SQL Server | 1405/05/09

نظرات 0

آموزش CREATE STATISTICS و ساخت آمار دستی در SQL Server

مسئله‌ای که این موضوع در عمل حل می‌کند

در بررسی‌های واقعی SQL Server، پرسش اصلی درباره CREATE STATISTICS صرفاً دانستن نام یک DMV، فرمان یا گزینه نیست؛ باید مشخص شود این ابزار چگونه برای آمار ستونی یا چندستونی مستقل از ایندکس ایجاد می‌کند تا Cardinality Estimator توزیع داده را دقیق‌تر تخمین بزند. به کار می‌رود و چه شواهدی برای تصمیم بعدی تولید می‌کند.

این آموزش از تعریف و Scope شروع می‌شود، سپس Syntax، مفاهیم statistics_name و column_list، ده سناریوی اجرایی، خطاهای تفسیر و کنترل Performance را پوشش می‌دهد. پیش‌نیاز عملی آن شناخت شیء هدف و رعایت مجوز «کاربر باید مجوز ALTER روی جدول یا مجوز مناسب DDL داشته باشد.» است.

برای دیدن جایگاه این موضوع در خانواده بزرگ‌تر، ابتدا راهنمای مادر «راهنمای جامع دستورات، گزینه‌ها و DMFهای Statistics در SQL Server» را مرور کنید؛ این صفحه وارد جزئیات تک‌موضوعی می‌شود و لینک خانواده را جایگزین آموزش عمیق نمی‌کند.

دسترسی سریع و مسیر مطالعه

  1. ابتدا Scope و معنای شاخص‌ها را مشخص کنید.
  2. Syntax مربوط به CREATE STATISTICS را با نسخه هدف تطبیق دهید.
  3. مثال‌ها را از Query فقط‌خواندنی تا سناریوی تصمیم دنبال کنید.
  4. در پایان خطاها، Performance و چک‌لیست Production را اجرا نمایید.

تعریف فنی و جایگاه در معماری SQL Server

CREATE STATISTICS در این مقاله به‌عنوان یک موضوع GENERAL_TOPIC بررسی می‌شود. ماهیت اصلی آن این است که آمار ستونی یا چندستونی مستقل از ایندکس ایجاد می‌کند تا Cardinality Estimator توزیع داده را دقیق‌تر تخمین بزند. این قابلیت در لایه «دستور روی جدول یا Indexed View اجرا می‌شود و می‌تواند Filter، Sample، FULLSCAN و گزینه‌های نگهداری داشته باشد.» قرار می‌گیرد و بدون تعیین همان محدوده، عدد یا خروجی می‌تواند چند تفسیر متفاوت داشته باشد.

مفاهیم محوری این صفحه عبارت‌اند از statistics_name، column_list، WHERE filter_predicate، FULLSCAN، SAMPLE. ارتباط میان این مفاهیم باید به‌صورت زنجیره علت، مشاهده و اقدام خوانده شود؛ به همین دلیل هیچ ستون یا Option به‌تنهایی معیار تغییر Production نیست.

آموزش CREATE STATISTICS و ساخت آمار دستی در SQL Server — نقشه جایگاه و اجزای اصلی — Decision Matrixنمای فنی اختصاصی CREATE STATISTICS که مفاهیم statistics_name, column_list, WHERE filter_predicate, FULLSCAN, SAMPLE را در قالب Decision Matrix برای بخش نقشه جایگاه و اجزای اصلی مرتبط می‌کند.CREATE STATISTICSنقشه جایگاه و اجزای اصلی | Decision Matrixstatistics_nameInputcolumn_listRuleWHERE filter_predicateMetricFULLSCANOutputSAMPLERiskNORECOMPUTEBest PathDecision / Metric PanelM1M2M3M4Operational Detail

این تصویر، جایگاه CREATE STATISTICS را با تمرکز بر statistics_name، column_list و WHERE filter_predicate نشان می‌دهد؛ پنل عددی پایین شکل برای جداکردن مشاهده خام از تصمیم اجرایی طراحی شده است.

نحو دستور، هدف و اثر اجرایی

Syntax مرجع

CREATE STATISTICS statistics_name ON schema.table (column1, column2) [WHERE predicate] [WITH option];

ورودی، محدوده و مجوز

Scope این موضوع چنین تعریف می‌شود: دستور روی جدول یا Indexed View اجرا می‌شود و می‌تواند Filter، Sample، FULLSCAN و گزینه‌های نگهداری داشته باشد. برای اجرای درست، کاربر باید مجوز ALTER روی جدول یا مجوز مناسب DDL داشته باشد. انتخاب پارامتر یا Target باید از مسئله عیب‌یابی بیاید و استفاده از NULL، همه اشیا یا تنظیم سطح دیتابیس فقط با دلیل مشخص انجام شود.

خروجی یا اثر قابل مشاهده

در خروجی یا رفتار CREATE STATISTICS باید حداقل statistics_name، WHERE filter_predicate و SAMPLE بررسی شود. اگر مقدار NULL، صفر یا نبود ردیف مشاهده شد، ابتدا Metadata Visibility، نسخه و زمان ایجاد داده کنترل می‌شود؛ نتیجه خالی همیشه به معنی نبود مشکل نیست.

اجزای اصلی و منطق تحلیل

جزء 1: statistics_name

statistics_name لایه مشاهده اولیه CREATE STATISTICS است و باید همراه نام شیء، Capture Time و Scope ذخیره شود تا در گزارش بعدی قابل مقایسه باشد.

جزء 2: column_list

در تحلیل column_list، مقدار خام به یک سؤال عملی تبدیل می‌شود: آیا تغییر این شاخص با رفتار Workload هم‌زمان است یا فقط یک شمارنده تاریخی بزرگ دیده می‌شود؟

جزء 3: WHERE filter_predicate

برای WHERE filter_predicate یک آستانه جهانی وجود ندارد؛ Baseline همان سامانه و هزینه اقدام تعیین می‌کند چه مقداری نیازمند بررسی است.

آموزش CREATE STATISTICS و ساخت آمار دستی در SQL Server — جریان اجرا و تبدیل ورودی به خروجی — Swimlaneنمای فنی اختصاصی CREATE STATISTICS که مفاهیم statistics_name, column_list, WHERE filter_predicate, FULLSCAN, SAMPLE را در قالب Swimlane برای بخش جریان اجرا و تبدیل ورودی به خروجی مرتبط می‌کند.CREATE STATISTICSجریان اجرا و تبدیل ورودی به خروجی | Swimlaneورودیپردازشتحلیلstatistics_namecolumn_listWHERE filter_predicateFULLSCANSAMPLEDecision / Metric PanelM1M2M3M4Operational Detail

در نمودار دوم، مسیر statistics_name تا FULLSCAN به‌صورت مرحله‌ای ترسیم شده تا ورودی، تبدیل و خروجی CREATE STATISTICS در یک نگاه قابل دنبال‌کردن باشد.

ده مثال عملی از مشاهده ساده تا تصمیم قابل اجرا

مثال 1: راه‌اندازی سناریوی پایه و مشاهده اثر گزینه

مثال 1 موضوع CREATE STATISTICS را در زاویه «راه‌اندازی سناریوی پایه و مشاهده اثر گزینه» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
CREATE STATISTICS ST_Lab_14_Region ON #StatsLab_14(RegionCode);
شاخص کنترلنمونهنتیجه
statistics_name16ایجاد شد

این اجرا نقطه شروع قابل تکرار برای CREATE STATISTICS می‌سازد و باید در محیط آزمایش انجام شود.

مثال 2: اعمال موضوع روی یک Statistics مشخص

مثال 2 موضوع CREATE STATISTICS را در زاویه «اعمال موضوع روی یک Statistics مشخص» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
CREATE STATISTICS ST_Lab_14_RegionDate ON #StatsLab_14(RegionCode,OrderDate);
شاخص کنترلنمونهنتیجه
column_list32به‌روزرسانی شد

هدف‌گیری یک Statistics مشخص، دامنه I/O و Recompile مرتبط با CREATE STATISTICS را قابل کنترل می‌کند.

مثال 3: بررسی رفتار پس از ورود داده جدید

مثال 3 موضوع CREATE STATISTICS را در زاویه «بررسی رفتار پس از ورود داده جدید» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
CREATE STATISTICS ST_Lab_14_Filtered ON #StatsLab_14(StatusCode) WHERE StatusCode=1;
شاخص کنترلنمونهنتیجه
WHERE filter_predicate48تغییر ثبت شد

پس از تغییر داده، فقط خروجی ظاهری کافی نیست؛ ستون اول را بر اساس Predicate غالب انتخاب کنید و Sample را با اندازه و Skew داده هماهنگ سازید.

مثال 4: استفاده در Statistics فیلترشده یا محدوده‌دار

مثال 4 موضوع CREATE STATISTICS را در زاویه «استفاده در Statistics فیلترشده یا محدوده‌دار» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
CREATE STATISTICS ST_Lab_14_Full ON #StatsLab_14(Amount) WITH FULLSCAN;
شاخص کنترلنمونهنتیجه
FULLSCAN64Scope محدود شد

فیلتر یا Scope محدود نشان می‌دهد CREATE STATISTICS چگونه با توزیع واقعی داده تعامل دارد.

مثال 5: خواندن Metadata و Header پس از عملیات

مثال 5 موضوع CREATE STATISTICS را در زاویه «خواندن Metadata و Header پس از عملیات» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
CREATE STATISTICS ST_Lab_14_Sample ON #StatsLab_14(OrderDate) WITH SAMPLE 50 PERCENT;
شاخص کنترلنمونهنتیجه
SAMPLE80Metadata خوانده شد

Metadata به شما اجازه می‌دهد اثر ثبت‌شده را از تصور درباره اجرای دستور جدا کنید.

مثال 6: کنترل زمان آخرین Update و وضعیت ثبت‌شده

مثال 6 موضوع CREATE STATISTICS را در زاویه «کنترل زمان آخرین Update و وضعیت ثبت‌شده» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
CREATE STATISTICS ST_Lab_14_NoRecompute ON #StatsLab_14(RegionCode) WITH NORECOMPUTE;
شاخص کنترلنمونهنتیجه
NORECOMPUTE96تاریخ کنترل شد

زمان آخرین Update را با Modification Counter تفسیر کنید؛ ساخت آمار اضافی هزینه Compile و نگهداری ایجاد می‌کند؛ آمار چندستونی فقط Histogram ستون اول را نگه می‌دارد.

مثال 7: کار با Statistics ایندکس یا شیء وابسته

مثال 7 موضوع CREATE STATISTICS را در زاویه «کار با Statistics ایندکس یا شیء وابسته» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
IF NOT EXISTS(SELECT 1 FROM tempdb.sys.stats WHERE object_id=OBJECT_ID(N'tempdb..#StatsLab_14') AND name=N'ST_Lab_14_Safe')
    CREATE STATISTICS ST_Lab_14_Safe ON #StatsLab_14(Amount,StatusCode);
شاخص کنترلنمونهنتیجه
statistics_name112وابستگی بررسی شد

آمار ایندکس قواعد متفاوتی از Statistics مستقل دارد و باید نوع هدف پیش از عملیات مشخص باشد.

مثال 8: تفسیر Histogram بعد از اجرای دستور

مثال 8 موضوع CREATE STATISTICS را در زاویه «تفسیر Histogram بعد از اجرای دستور» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
CREATE STATISTICS ST_Lab_14_Persist ON #StatsLab_14(Amount) WITH SAMPLE 75 PERCENT, PERSIST_SAMPLE_PERCENT=ON;
شاخص کنترلنمونهنتیجه
column_list128Histogram تحلیل شد

Histogram ابزار تحلیل تخمین است، نه نسخه کامل همه مقادیر ستون.

مثال 9: مدیریت خطای نسخه، مجوز یا Syntax

مثال 9 موضوع CREATE STATISTICS را در زاویه «مدیریت خطای نسخه، مجوز یا Syntax» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
CREATE STATISTICS ST_Lab_14_Composite ON #StatsLab_14(StatusCode,RegionCode,OrderDate);
DBCC SHOW_STATISTICS (N'tempdb..#StatsLab_14',N'ST_Lab_14_Composite') WITH DENSITY_VECTOR;
شاخص کنترلنمونهنتیجه
WHERE filter_predicate144خطا مدیریت شد

Error Handling برای قابلیت‌های نسخه‌محور مهم است؛ رفتار دقیق را با نسخه و سطح سازگاری پایگاه داده بررسی کنید.

مثال 10: ساخت گزارش نهایی برای Runbook نگهداری

مثال 10 موضوع CREATE STATISTICS را در زاویه «ساخت گزارش نهایی برای Runbook نگهداری» بررسی می‌کند تا تفاوت میان Syntax و نتیجه عملی روشن شود.

DROP TABLE IF EXISTS #StatsLab_14;
CREATE TABLE #StatsLab_14
(
    RowID int IDENTITY(1,1) NOT NULL,
    RegionCode int NULL,
    OrderDate date NOT NULL,
    Amount decimal(12,2) NOT NULL,
    StatusCode tinyint NOT NULL
);
INSERT INTO #StatsLab_14(RegionCode,OrderDate,Amount,StatusCode)
VALUES (1,'2026-01-01',1200,1),(1,'2026-01-02',1800,1),(2,'2026-02-01',350,2),(NULL,'2026-03-01',90,3);
CREATE STATISTICS ST_Lab_14_Review ON #StatsLab_14(OrderDate) WITH FULLSCAN;
SELECT s.name, STATS_DATE(s.object_id,s.stats_id) AS last_updated FROM tempdb.sys.stats AS s WHERE s.object_id=OBJECT_ID(N'tempdb..#StatsLab_14');
شاخص کنترلنمونهنتیجه
FULLSCAN160Runbook تکمیل شد

گزارش Runbook باید مالک، زمان اجرا، Scope و معیار موفقیت CREATE STATISTICS را ثبت کند.

کاربردهای واقعی در پروژه و عملیات

در پایش روزانه، CREATE STATISTICS می‌تواند برای ساخت یک Snapshot محدود به اشیای حساس استفاده شود. تیم عملیات با ثبت statistics_name و FULLSCAN در کنار زمان رخداد، میان تغییر طبیعی بار و نشانه Regression تفاوت می‌گذارد.

در پروژه بهینه‌سازی، خروجی این موضوع به فرضیه قابل آزمایش تبدیل می‌شود؛ برای نمونه، به‌جای «سیستم کند است» سؤال می‌شود آیا تغییر شاخص اصلی با Query یا Deployment خاص هم‌بستگی دارد. سپس Plan و معیار قبل/بعد جمع‌آوری می‌شود.

در فرایند آموزش یا تحویل پروژه، Runbook باید Query امن، سطح دسترسی، مسیر Escalation و شرط توقف را ثبت کند. این کار وابستگی به حافظه یک DBA را کم و اجرای CREATE STATISTICS را قابل ممیزی می‌کند.

هشدار مهم پیش از تصمیم Production

ساخت آمار اضافی هزینه Compile و نگهداری ایجاد می‌کند؛ آمار چندستونی فقط Histogram ستون اول را نگه می‌دارد. هرگونه DDL، تغییر تنظیم یا Maintenance ناشی از این تحلیل باید پس از تهیه Baseline، آزمون در محیط مشابه و تعریف Rollback اجرا شود. خروجی آموزشی این صفحه مجوز اجرای کور در ساعات پرترافیک نیست.

اشتباهات رایج و اصلاح عملی

  • اشتباه: خواندن statistics_name بدون ثبت زمان. اصلاح: Capture Time و زمان شروع سرویس یا دیتابیس را کنار Snapshot نگه دارید.
  • اشتباه: اجرای CREATE STATISTICS روی همه اشیا در هر دقیقه. اصلاح: Scope را با فیلتر دیتابیس، Object یا Statistics محدود و تناوب را با نرخ تغییر تنظیم کنید.
  • اشتباه: تبدیل شاخص اصلی به حکم قطعی. اصلاح: آن را با شاخص مکمل، Plan و الگوی Workload اعتبارسنجی نمایید.
  • اشتباه: نادیده‌گرفتن مجوز و Metadata Visibility. اصلاح: نبود ردیف را با کاربر دارای دسترسی کنترل‌شده دوباره بررسی کنید.
  • اشتباه: نبود مسیر بازگشت. اصلاح: قبل از تغییر، Script معکوس، Snapshot تنظیمات و معیار شکست را آماده سازید.

Performance Considerations اختصاصی این موضوع

ستون اول را بر اساس Predicate غالب انتخاب کنید و Sample را با اندازه و Skew داده هماهنگ سازید. Query جمع‌آوری باید فقط ستون‌های موردنیاز را برگرداند، از Sorting بدون Top روی مجموعه بزرگ دوری کند و در صورت امکان یک Object یا دیتابیس مشخص را هدف بگیرد.

هزینه مستقیم CREATE STATISTICS با نوع موضوع متفاوت است: DMVهای گسترده می‌توانند خروجی حجیم تولید کنند، DBCC یا Update Statistics ممکن است I/O داشته باشد و گزینه سطح دیتابیس می‌تواند Compileهای بعدی را تغییر دهد. به همین علت اجرای نخست باید با Elapsed Time و Reads ثبت شود.

برای تحلیل روند، Snapshotهای کوچک و منظم از column_list بهتر از Query سنگین و نامنظم است. نگهداری تاریخچه نیز باید Retention مشخص داشته باشد تا مخزن مانیتورینگ خود به منبع رشد و Lock تبدیل نشود.

Best Practices اولویت‌بندی‌شده

  • هدف تحلیلی CREATE STATISTICS را در یک جمله و پیش از اجرای Query بنویسید.
  • قبل از ساخت، sys.stats را بررسی کنید تا آمار مشابه یا Auto Stats موجود تکرار نشود.
  • نسخه، Edition و مجوزهای مرتبط با WHERE filter_predicate را در Deployment Checklist ثبت کنید.
  • خروجی را با یک منبع مستقل مانند Query Store، Actual Plan یا Catalog View مرتبط تطبیق دهید.
  • برای اقدام تغییردهنده معیار قبل/بعد و زمان مشاهده اثر را از پیش تعیین کنید.
  • Script جمع‌آوری CREATE STATISTICS را Version Control کنید و تغییر Thresholdها را مستند نگه دارید.
آموزش CREATE STATISTICS و ساخت آمار دستی در SQL Server — تصمیم عملی، خطا و کارایی — Benchmark Boardنمای فنی اختصاصی CREATE STATISTICS که مفاهیم statistics_name, column_list, WHERE filter_predicate, FULLSCAN, SAMPLE را در قالب Benchmark Board برای بخش تصمیم عملی، خطا و کارایی مرتبط می‌کند.CREATE STATISTICSتصمیم عملی، خطا و کارایی | Benchmark Boardstatistics_nameInputcolumn_listRuleWHERE filter_predicateMetricFULLSCANOutputSAMPLERiskNORECOMPUTEBest PathDecision / Metric PanelM1M2M3M4Operational Detail

نمای سوم، رابطه column_list، SAMPLE و NORECOMPUTE را در کنار شاخص‌های تصمیم نمایش می‌دهد و مشخص می‌کند کدام مسیر برای Performance یا رفع خطا اولویت دارد.

مزایا، محدودیت‌ها و زمان نامناسب استفاده

مزیت اصلی CREATE STATISTICS این است که مسئله آمار ستونی یا چندستونی مستقل از ایندکس ایجاد می‌کند تا Cardinality Estimator توزیع داده را دقیق‌تر تخمین بزند. را به داده یا رفتار قابل مشاهده تبدیل می‌کند. این شفافیت، گفت‌وگوی DBA و تیم توسعه را از حدس به فرضیه قابل آزمون منتقل می‌سازد.

محدودیت اصلی به Scope و ماندگاری داده مربوط است: دستور روی جدول یا Indexed View اجرا می‌شود و می‌تواند Filter، Sample، FULLSCAN و گزینه‌های نگهداری داشته باشد. همچنین ساخت آمار اضافی هزینه Compile و نگهداری ایجاد می‌کند؛ آمار چندستونی فقط Histogram ستون اول را نگه می‌دارد. بنابراین گزارش باید Timestamp، نسخه و Context داشته باشد.

زمان نامناسب استفاده زمانی است که تیم بدون دسترسی کافی، بدون Baseline یا در میانه Incident حساس قصد اجرای فرمان سنگین دارد. در آن وضعیت ابتدا Query کم‌خطر، داده موجود و روش Escalation انتخاب می‌شود. در Runbook خانواده 16، تفسیر این بند به شواهد اختصاصی CREATE STATISTICS وابسته است.

سؤالات متداول اختصاصی

CREATE STATISTICS دقیقاً چه مسئله‌ای را در SQL Server حل می‌کند؟

CREATE STATISTICS برای آمار ستونی یا چندستونی مستقل از ایندکس ایجاد می‌کند تا Cardinality Estimator توزیع داده را دقیق‌تر تخمین بزند. کاربرد دارد. ارزش آن زمانی آشکار می‌شود که خروجی با Scope صحیح، زمان Capture و شواهد Workload تفسیر شود، نه اینکه یک مقدار منفرد به‌عنوان حکم نهایی در نظر گرفته شود.

برای شروع یادگیری CREATE STATISTICS چه پیش‌نیازی لازم است؟

آشنایی با Metadata، اجرای SELECT امن و مفهوم statistics_name پایه مناسبی است. کاربر باید تفاوت محیط آزمایش و Production را بداند و مجوز «کاربر باید مجوز ALTER روی جدول یا مجوز مناسب DDL داشته باشد.» را بدون گسترش غیرضروری دسترسی مدیریت کند.

آیا CREATE STATISTICS برای پروژه‌های کوچک هم ارزش پیاده‌سازی دارد؟

در پروژه کوچک می‌توان Scope را محدود و فقط شاخص‌های column_list و WHERE filter_predicate را ثبت کرد. همین نسخه سبک از پایش، رشد آینده را قابل اندازه‌گیری می‌کند و از تصمیم‌های حدسی هنگام افزایش حجم جلوگیری خواهد کرد.

در یک پروژه سازمانی چگونه خروجی CREATE STATISTICS مستندسازی شود؟

پیشنهاد می‌شود Capture Time، نام دیتابیس، مالک سرویس، Query یا Job مرتبط و تصمیم حاصل ثبت شود. در خدمات مشاوره SQL Server نیز چنین فرم شواهدی باعث می‌شود تغییرات قابل بازبینی و مسئولیت هر اقدام روشن باشد. کاربرد این اصل در CREATE STATISTICS با معیارهای ویژه مجموعه 16 سنجیده می‌شود.

CREATE STATISTICS چه تفاوتی با نگاه‌کردن صرف به Execution Plan دارد؟

Execution Plan مسیر یک Query را توضیح می‌دهد، اما CREATE STATISTICS زاویه «دستور روی جدول یا Indexed View اجرا می‌شود و می‌تواند Filter، Sample، FULLSCAN و گزینه‌های نگهداری داشته باشد.» را اضافه می‌کند. ترکیب این دو، فاصله میان رفتار یک اجرا و الگوی تجمعی سیستم را کاهش می‌دهد.

چه زمانی برای تحلیل CREATE STATISTICS از متخصص SQL Server کمک بگیریم؟

وقتی خروجی به تغییر Schema، حذف یا ساخت ایندکس، تنظیم دیتابیس یا عملیات پرهزینه منتهی می‌شود، بازبینی تخصصی ارزش دارد. تیم اجرا می‌تواند ابتدا Snapshot و Queryهای مقاله را آماده کند تا جلسه مشاوره بر تصمیم واقعی متمرکز بماند. در مجموعه 16، این تصمیم برای CREATE STATISTICS باید جدا از خانواده‌های دیگر ثبت شود.

رایج‌ترین خطای تفسیر CREATE STATISTICS چیست؟

خطای پرتکرار، جداکردن عدد FULLSCAN از بازه زمانی و Context است. ساخت آمار اضافی هزینه Compile و نگهداری ایجاد می‌کند؛ آمار چندستونی فقط Histogram ستون اول را نگه می‌دارد. راه اصلاح، ثبت Baseline و مقایسه چند Snapshot هم‌شرایط است.

چگونه هزینه Performance خود Queryهای CREATE STATISTICS را پایین نگه داریم؟

ستون‌های لازم را انتخاب کنید، فیلتر Scope را زود اعمال نمایید و Capture را با فاصله منطقی انجام دهید. ستون اول را بر اساس Predicate غالب انتخاب کنید و Sample را با اندازه و Skew داده هماهنگ سازید. این رویکرد مانع تبدیل ابزار تشخیص به منبع بار اضافی می‌شود.

بهترین الگوی عملی برای استفاده پایدار از CREATE STATISTICS چیست؟

قبل از ساخت، sys.stats را بررسی کنید تا آمار مشابه یا Auto Stats موجود تکرار نشود. علاوه بر آن، معیار موفقیت هر تغییر باید پیش از اجرا تعریف شود تا پس از تغییر بتوان اثر را با همان شاخص‌ها سنجید.

CREATE STATISTICS در همه نسخه‌های SQL Server یکسان رفتار می‌کند؟

رفتار دقیق را با نسخه و سطح سازگاری پایگاه داده بررسی کنید. همچنین نام مجوزها، ستون‌های قابل اتکا و قابلیت‌های وابسته به Edition یا Platform باید در محیط هدف آزمایش شوند؛ Script آموزشی جای تست سازگاری نسخه را نمی‌گیرد. برای CREATE STATISTICS، اجرای این توصیه در خانواده 16 نیازمند Baseline مخصوص همان موضوع است.

سؤالات مصاحبه فنی

چگونه Scope مناسب برای CREATE STATISTICS را تعیین می‌کنید؟

از مسئله عملی شروع می‌کنم، دیتابیس و شیء مرتبط را محدود می‌سازم، سپس فقط ستون‌های statistics_name و column_list را برای پاسخ به همان فرضیه انتخاب می‌کنم.

چرا یک Snapshot از CREATE STATISTICS کافی نیست؟

زیرا دستور روی جدول یا Indexed View اجرا می‌شود و می‌تواند Filter، Sample، FULLSCAN و گزینه‌های نگهداری داشته باشد. می‌تواند با Restart، بارکاری یا تغییر داده جابه‌جا شود. دو یا چند Capture هم‌شرایط نرخ تغییر و پایداری سیگنال را مشخص می‌کند.

خروجی CREATE STATISTICS را با کدام منبع دوم اعتبارسنجی می‌کنید؟

بسته به موضوع از Query Store، Actual Execution Plan، sys.stats، Catalog Viewهای ایندکس یا Baseline منابع استفاده می‌کنم تا یک DMV یا فرمان به‌تنهایی مبنای تغییر نشود. این نکته در تحلیل خانواده 16 با محور CREATE STATISTICS به‌صورت مستقل ارزیابی می‌شود.

یک ضدالگو در خودکارسازی CREATE STATISTICS نام ببرید.

تبدیل مستقیم خروجی به DDL یا Maintenance بدون Approval ضدالگو است. Handle موقت، Threshold عمومی و نبود Rollback می‌تواند توصیه ظاهراً مفید را به Regression تبدیل کند. برای موضوع CREATE STATISTICS در مجموعه 16، همین قاعده باید با داده همان Scope تطبیق داده شود.

معیار موفقیت اقدام مرتبط با CREATE STATISTICS چیست؟

قبل از تغییر، معیارهایی مانند کاهش شاخص اصلی، ثبات شاخص مکمل، زمان پاسخ Query یا هزینه نگهداری را ثبت می‌کنم و بعد از بازه معنادار همان‌ها را دوباره می‌سنجم.

چگونه ریسک Production را هنگام کار با CREATE STATISTICS کنترل می‌کنید؟

ابتدا Query فقط‌خواندنی و محدود اجرا می‌شود، Plan جمع‌آوری و زمان مناسب انتخاب می‌گردد؛ هر فرمان تغییردهنده نیز در محیط مشابه، با نسخه پشتیبان و مسیر بازگشت آزموده می‌شود. در Runbook خانواده 16، تفسیر این بند به شواهد اختصاصی CREATE STATISTICS وابسته است.

چک‌لیست نهایی اجرا

  1. نسخه و وجود CREATE STATISTICS یا Syntax متناظر را کنترل کنید.
  2. کاربر اجرایی را با حداقل مجوز لازم انتخاب نمایید.
  3. Scope دیتابیس، جدول، ایندکس، Statistics یا Option را صریح تعیین کنید.
  4. Baseline مربوط به شاخص اصلی و شاخص مکمل را ثبت نمایید.
  5. مثال مناسب را ابتدا در محیط آزمایش یا با Target محدود اجرا کنید.
  6. خروجی را با منبع مستقل و Plan مرتبط اعتبارسنجی کنید.
  7. برای تغییر Production مالک، پنجره اجرا و Rollback تعیین کنید.
  8. نتیجه پس از تغییر را در همان بازه و با همان معیار دوباره اندازه بگیرید.

جمع‌بندی تصمیم‌محور

CREATE STATISTICS زمانی ارزش عملی دارد که برای مسئله مشخص، با Scope محدود و معیار قبل/بعد استفاده شود. اگر هدف فقط جمع‌آوری عدد باشد، خروجی به‌سرعت به گزارش بی‌اقدام تبدیل می‌شود؛ اما اتصال statistics_name به FULLSCAN و شواهد Workload، تصمیم را قابل دفاع می‌کند.

قدم بعدی، ثبت Query منتخب این مقاله در Runbook و مقایسه آن با اعضای مرتبط در راهنمای مادر «راهنمای جامع دستورات، گزینه‌ها و DMFهای Statistics در SQL Server» است. پس از آن می‌توان اقدام تغییردهنده را فقط در صورت وجود منفعت اندازه‌گیری‌شده برنامه‌ریزی کرد.

خدمات برنامه‌نویسی و پایگاه داده

برنامه‌نویسی در اصفهان؛ قبول سفارش‌های برنامه‌نویسی و پایگاه داده با شماره 09131253620، همراه با انجام پروژه، آموزش برنامه‌نویسی و آموزش SQL Server.

مجموعه‌ای معتبر با سابقه فعالیت حرفه‌ای از سال ۱۳۷۵ شمسی تاکنون در طراحی سامانه‌های نرم‌افزاری، پایگاه داده، وب‌سایت و راهکارهای سازمانی فعالیت می‌کند.

برای سفارش پروژه، مشاوره یا آموزش تخصصی از طریق ایتا، واتساپ و تماس مستقیم با +989131253620 اقدام کنید یا صفحه تماس با ما را ببینید.

 

0 نظر

نظر محترم شما در مورد مقاله های وب سایت برنامه نویسی و پایگاه داده

نظرات محترم شما در خدمات رسانی بهتر ما را یاری می نمایند. لطفا اگر مایل بودید یک نظر ما را مهمان فرمائید. آدرس ایمیل و وب سایت شما نمایش داده نخواهد شد.

حرف 500 حداکثر