Metabase

ترکیب و join کردن جداول

نگاهی به مدل‌های ذهنی مختلف برای صفحه‌گسترده‌ها و جداول پایگاه داده.

نحوه تفاوت جداول بین صفحه‌گسترده‌ها و پایگاه‌های داده

نگاهی به مدل‌های ذهنی مختلف برای صفحه‌گسترده‌ها و جداول پایگاه داده.

هم صفحه‌گسترده‌ها و هم پایگاه‌های داده در نهایت بر اساس جداول ساخته شده‌اند: چیدمان‌های منظم داده با ردیف‌ها و ستون‌ها، جایی که هر ردیف تمایل به داشتن یک مقدار در هر ستون دارد.

در حالی که جداول در صفحه‌گسترده‌ها و پایگاه‌های داده در نگاه اول مشابه به نظر می‌رسند، داده را به روش‌های مختلف سازماندهی می‌کنند. هر کدام نقاط قوت متفاوتی برای تحلیل داده و سازماندهی بصری دارند.

  • داده در صفحه‌گسترده‌ها در ردیف‌ها و ستون‌ها چیده شده است، در حالی که جداول پایگاه داده نقش‌های معنایی ثابت به ستون‌ها اختصاص می‌دهند.
  • صفحه‌گسترده‌ها از یک فرمت "عریض" مناسب برای خلاصه‌ها و حاشیه‌نویسی‌ها استفاده می‌کنند، در حالی که پایگاه‌های داده از یک فرمت "طولی"، نرمال‌شده استفاده می‌کنند که منجر به ردیف‌هایی با ساختار یکنواخت می‌شود.
  • جداول پایگاه داده افزودن مقادیر زیادی به همان جدول با افزودن ستون‌های بیشتر را آسان می‌کنند. برای افزودن مقادیر به داده صفحه‌گسترده، ممکن است نیاز به ایجاد جداول اضافی داشته باشید.
  • جداول را می‌توان بین فرمت‌های صفحه‌گسترده و پایگاه داده با استفاده از عملیاتی به نام pivoting ترجمه کرد.

صفحه‌گسترده‌ها می‌توانند چیدمان‌های زیادی داشته باشند

صفحه‌گسترده‌ها در همه اشکال و اندازه‌ها می‌آیند. آن‌ها می‌توانند شامل بسیاری از جداول با سلسله‌مراتب، محاسباتی مثل مجموع‌ها در عرض و پایین، و محاسبات تصادفی یک‌باره باشند. این مثال از دفتر آمار کار نمونه‌ای از داده دولتی است.

یک صفحه‌گسترده با سلسله‌مراتب

کمبود محدودیت‌ها صفحه‌گسترده‌ها را به شدت قدرتمند می‌کند، و برای جداولی که قرار است مستقیماً توسط انسان‌ها مصرف شوند به خوبی کار می‌کند. اما برای تحلیل و تجسم، نیاز به ساختاردهی داده به روشی سخت‌تر و سازگارتر داریم.

مقایسه چیدمان‌های صفحه‌گسترده و پایگاه داده

یک جدول معمولی در یک صفحه‌گسترده از یک چیدمان 2D استفاده می‌کند، با برچسب‌ها در کنار و بالا. می‌توانیم جدول را به دو نوع مقدار تقسیم کنیم، ابعاد که ساختار آن را تعیین می‌کنند، و معیارها که مقادیری را که مشاهده یا محاسبه کرده‌ایم نشان می‌دهند.

به عنوان مثال، در اینجا یک جدول فروش سالانه برای تعدادی دسته‌بندی محصول وجود دارد:

تقسیم ساختار یک جدول صفحه‌گسترده به ابعاد و معیارها

ابعاد مقادیر کیفی هستند، حتی زمانی که عددی هستند، به این معنی که در محاسبات استفاده نمی‌شوند بلکه به عنوان شناسه عمل می‌کنند. معیارها، از طرف دیگر، می‌توانند برای محاسبه مجموع‌ها، میانگین‌ها و غیره استفاده شوند.

راه دیگر برای فکر کردن به ابعاد به عنوان مختصات است. در مثال جدول صفحه‌گسترده بالا، هر مقدار در تقاطع یک شبکه قرار می‌گیرد. برای جستجوی مقدار فروش Gadget در 2024، ستون Gadget را پیدا می‌کنید و سپس ردیف برای 2024.

در مقابل، در یک چیدمان به سبک پایگاه داده، هر ردیف همان چیدمان را دارد، با هر ستون که یا یک بعد یا یک معیار است. جایی که یک جدول صفحه‌گسترده مقادیر را در یک شبکه از سلول‌ها می‌چیند، یک جدول پایگاه داده بیشتر شبیه یک فهرست طولانی از ردیف‌ها به نظر می‌رسد.

ابعاد در جداول پایگاه داده در ستون‌ها قرار دارند، اجازه افزودن معیارهای بیشتر را می‌دهند

پیدا کردن یک مقدار در چیدمان مبتنی بر ردیف یک پایگاه داده فقط به اطلاعات موجود در هر ردیف بستگی دارد. هنگام جستجوی فروش Gadget در 2024، یک پایگاه داده می‌تواند هر ردیف را اسکن کند و مقادیر در ستون‌های Product و Year آن را بررسی کند.

ذخیره داده به عنوان ردیف‌ها به پایگاه داده اجازه می‌دهد بر اساس هر ترکیبی از ستون‌ها مرتب و فیلتر کند، مقادیر را درون ردیف‌ها محاسبه کند (مثل قیمت به ازای واحد)، و تجمیع‌هایی از مقادیر در بسیاری از ردیف‌ها ایجاد کند (مثل مجموع‌ها به ازای سال).

Pivot کردن جداول بین فرمت صفحه‌گسترده و پایگاه داده

فرآیند تبدیل بین سبک‌های جداول صفحه‌گسترده و پایگاه داده pivoting نامیده می‌شود. هنگام رفتن از صفحه‌گسترده‌ها به پایگاه‌های داده، pivoting معیارها را دوباره مرتب می‌کند و ستون‌هایی برای دو بعد اضافه می‌کند. هنگام رفتن از پایگاه‌های داده به صفحه‌گسترده‌ها، عملیات pivot تعداد زیادی ردیف را به یک شبکه دو بعدی از مقادیر تبدیل می‌کند.

در اینجا یک جدول صفحه‌گسترده (در سمت چپ) pivot شده به چیدمان مبتنی بر ردیف یک جدول پایگاه داده (در سمت راست) وجود دارد. رنگ‌ها دسته‌بندی‌های محصول مربوطه را نشان می‌دهند.

همان داده به عنوان یک صفحه‌گسترده و جدول پایگاه داده، با رنگ‌ها نشان‌دهنده ورودی‌های مربوطه

داده دقیقاً همان بین دو نوع جدول است، ما فقط آن را دوباره سازماندهی کرده‌ایم. به جای شبکه 4x4 صفحه‌گسترده که 16 سلول به ما می‌دهد، جدول پایگاه داده حالا 16 ردیف دارد.

به طور گیج‌کننده، pivot کردن یک جدول همان ایجاد یک pivot table نیست. یک pivot table به معنای اکسل صرفاً یک تبدیل ردیف‌های داده به ستون‌ها (و برعکس) نیست، بلکه راهی برای تجمیع و خلاصه کردن مقادیر نیز هست. این pivot tableها در غیر این صورت به عنوان cross-tabulationها، یا crosstabs شناخته می‌شوند.

ترکیب و join کردن جداول

هم صفحه‌گسترده‌ها و هم پایگاه‌های داده می‌توانند داده را از چندین جدول ترکیب کنند، اما آن را به روش‌های مختلف انجام می‌دهند. VLOOKUP/XLOOKUP به Joinها را بررسی کنید.

[

](xlookup-vs-joins.html)