رفتن به محتوای اصلی
Koohestun
توضیح کوهستانتحلیل داده‌های پادکستمقاله تشریحی· 6 دقیقه مطالعه· در سرگرمی

استاندارد IAB v2.1: پلتفرم‌های میزبان پادکست چگونه ربات‌ها را فیلتر و «دانلود» را تعریف می‌کنند؟

دستورالعمل‌های نسخه ۲.۱ از IAB Tech Lab با تعیین یک آستانه سخت‌گیرانه ۶۰ ثانیه‌ای و یک بازه ۲۴ ساعته برای حذف داده‌های تکراری، شنوندگان واقعی پادکست را از ربات‌های خودکار و همگام‌سازی‌های چنددستگاهی جدا می‌کند. این استاندارد، لاگ‌های سرور را به یک ارز قابل‌اعتماد برای تبلیغ‌دهندگان تبدیل می‌کند.

به قلم سلین خسروشاهی

مدافعان اندازه‌گیری استاندارد 70%تحلیلگران داده‌های خام 30%
مدافعان اندازه‌گیری استاندارد
استدلال می‌کنند که فیلترینگ سخت‌گیرانه برای جلب اعتماد تبلیغ‌دهندگان و رشد این صنعت ضروری است.
تحلیلگران داده‌های خام
برای عیب‌یابی و تشخیص‌های فنی دقیق، به لاگ‌های فیلترنشده سرور اهمیت می‌دهند.

دیدگاه‌هایی که این گزارش پوشش نداده

  • تولیدکنندگان مستقلی که برای ارضای حس غرور خود به اعداد و ارقام خام وابسته‌اند
  • توسعه‌دهندگان اپلیکیشن‌های پادکست که رفتارهای پیش‌بارگذاری (pre-fetch) را پیاده‌سازی می‌کنند

تصور کنید شنونده‌ای در مسیر رفتن به سر کار، دکمه پخش اپیزود جدید یک پادکست را لمس می‌کند؛ یک حرکت ساده که آبشاری از داده‌های نامرئی را به راه می‌اندازد. اگر بخواهیم فقط بر اساس ترافیک خام سرور قضاوت کنیم، همین یک انسان ممکن است شبیه سه یا چهار آدم مجزا به نظر برسد. گوشی او برای بررسی فید RSS به سرور میزبان پینگ می‌فرستد، یک تکه کوچک از فایل صوتی را برای بافر کردن دانلود می‌کند و بعد، همین وضعیت را با اسپیکر هوشمند خانه و لپ‌تاپ روی میز کارش همگام‌سازی می‌کند. اگر یک میزبان پادکست بخواهد صرفاً هر درخواست HTTP GET که به سرورهایش می‌رسد را بشمارد، یک مخاطب ۱۰,۰۰۰ نفری از انسان‌های واقعی به‌راحتی می‌تواند در لباس ۳۰,۰۰۰ یا ۴۰,۰۰۰ دانلود ظاهر شود. این توهم ریاضی دقیقاً همان چیزی است که «دفتر تبلیغات تعاملی» (IAB) کمر به نابودی آن بسته است.[1][5]

صنعت پادکست روی یک معماری غیرمتمرکز می‌چرخد؛ چیزی که همزمان بزرگ‌ترین نقطه قوت و عمیق‌ترین دردسر آن برای اندازه‌گیری آمار است. برخلاف یک اکوسیستم بسته که در آن یک سرور مرکزی دقیقاً می‌داند چه کسی و برای چه مدتی در حال تماشاست، پادکست در واقع فقط یک فایل صوتی است که روی یک سرور نشسته و منتظر است تا یک اپلیکیشن شخص ثالث سراغش را بگیرد. «دستورالعمل‌های فنی اندازه‌گیری پادکست نسخه ۲.۱» از IAB Tech Lab، دقیقاً نقش فیلتر نهایی را برای این محیط پرهرج‌ومرج بازی می‌کند. این استاندارد مجموعه‌ای از قوانین سفت‌وسخت را وضع می‌کند تا سیگنال یک شنونده واقعی را از نویز ربات‌های خودکار، پیش‌بارگذاری‌های تهاجمی و همگام‌سازی‌های تکراری دستگاه‌ها جدا کند.[1][4]

در هسته مرکزی استاندارد v2.1، قانون ۶۰ ثانیه قرار دارد. برای اینکه یک دانلود مشروع و معتبر به حساب بیاید، سرور میزبان باید بایت‌های کافی برای حداقل یک دقیقه از صدای اپیزود را تحویل دهد. شنونده‌ای که دستش می‌خورد و اشتباهی یک اپیزود را باز می‌کند و فوراً اپلیکیشن را می‌بندد، به حساب نمی‌آید. اپلیکیشنی که به‌طور خودکار بخش کوچکی از فایل را دانلود می‌کند تا شاید کاربر بعداً بخواهد به آن گوش دهد هم به حساب نمی‌آید. این استاندارد، پلتفرم‌های میزبان را مجبور می‌کند تا اندازه دقیق بایت‌های یک دقیقه از محتوای هر اپیزود را با در نظر گرفتن بیت‌ریت (bitrate) خاص و حجم هدرهای متادیتا ID3 محاسبه کنند و هر درخواستی که به این حد نصاب نرسد را دور بریزند.[1]

استاندارد IAB v2.1 چگونه ترافیک خام سرور را فیلتر کرده و به دانلودهای تاییدشده تبدیل می‌کند.

بعد نوبت به پنجره حذف داده‌های تکراری (deduplication) می‌رسد؛ مکانیزمی که جلوی یک طرفدار دوآتشه را می‌گیرد تا با رفرش کردن مداوم فید، آمار را بالا نبرد. دستورالعمل‌های IAB v2.1 یک دوره ۲۴ ساعته را برای این کار الزامی می‌کند که می‌تواند به‌صورت یک روز تقویمی ثابت یا یک چرخه ۲۴ ساعته گردان پیاده‌سازی شود. در طول این بازه، پلتفرم میزبان باید به ترکیب آدرس IP درخواست‌کننده و User Agent او (همان رشته متنی که اپلیکیشن پادکست و سیستم‌عامل خاص را شناسایی می‌کند) نگاه کند. اگر یک IP و User Agent یکسان، یک فایل را در یک بعدازظهر ده بار درخواست کنند، استاندارد IAB دقیقاً یک دانلود را می‌شمارد.[1][3]

بعد نوبت به پنجره حذف داده‌های تکراری (deduplication) می‌رسد؛ مکانیزمی که جلوی یک طرفدار دوآتشه را می‌گیرد تا با رفرش کردن مداوم فید، آمار را بالا نبرد.

این جفت شدن IP و User Agent، نزدیک‌ترین چیزی است که دنیای غیرمتمرکز پادکست می‌تواند برای شناسایی یک شنونده فردی به آن برسد. البته که یک شاخص بی‌نقص نیست. یک دفتر شرکتی یا خوابگاه دانشجویی ممکن است صدها انسان واقعی را از طریق یک آدرس IP واحد هدایت کند، در حالی که یک شنونده موبایلی در حال رفت‌وآمد با قطار ممکن است بین دکل‌های مخابراتی جابه‌جا شود و در عرض یک ساعت سه آدرس IP مختلف تولید کند. استاندارد IAB این موارد استثنا را می‌پذیرد، اما قانون ترکیب IP و User Agent را به‌عنوان قابل‌اعتمادترین خط پایه موجود اعمال می‌کند و صراحتاً پلتفرم‌ها را از شمارش درخواست‌های خام بدون این لایه حذف تکرار، منع می‌کند.[1]

این استاندارد همچنین یک جنگ خاموش را علیه ترافیک غیرانسانی به راه انداخته است. اینترنت پر از ربات‌های خودکار، خزنده‌های موتورهای جستجو و اسکریپت‌های نمایه‌سازی است که برای نقشه‌برداری از وب، مدام به فیدهای RSS پینگ می‌فرستند. IAB Tech Lab یک لیست سیاه متمرکز و دائماً به‌روزشونده از آدرس‌های IP و User Agentهای ربات‌های شناخته‌شده را نگهداری می‌کند. پلتفرم‌های میزبان تاییدشده مانند Libsyn و Triton Digital باید قبل از گزارش دادن حتی یک عدد به تولیدکننده، این فیلتر را روی لاگ‌های سرور خود اعمال کنند. اگر سروری در یک دیتاسنتر، کل یک مصاحبه دوساعته را دانلود کند، فیلتر، امضای IP دیتاسنتر را مچ‌گیری کرده و بی‌سروصدا این رویداد را از داشبورد تحلیل داده‌ها حذف می‌کند.[1][3]

لاگ‌های فیلترنشده سرور با در نظر گرفتن همگام‌سازی‌های چنددستگاهی به‌عنوان شنوندگان مجزا، می‌توانند اندازه واقعی مخاطبان پادکست را متورم کنند.

نسخه ۲.۱ چندین اصلاح فنی خاص را معرفی کرد تا با نحوه واقعی مصرف محتوای صوتی توسط مردم همگام بماند. این نسخه پشتیبانی صریح از آدرس‌های IPv6 را اضافه کرد تا مطمئن شود نسل بعدی مسیریابی اینترنت، ریاضیات حذف داده‌های تکراری را به هم نمی‌ریزد. همچنین راهنمایی‌های دقیقی برای فیلتر کردن درخواست‌های دستگاه‌های Apple watchOS ارائه داد؛ دستگاه‌هایی که عادت دارند با آیفون‌های جفت‌شده‌شان به شکلی تهاجمی همگام‌سازی کنند و در گذشته باعث تورم آمار دانلود می‌شدند. این به‌روزرسانی‌های موشکافانه، بازتابی از بازی همیشگی موش و گربه میان اپلیکیشن‌های پادکست (که سعی در ارائه یک تجربه کاربری روان دارند) و پلتفرم‌های میزبان (که در تلاش برای حفظ واقعیت ریاضی هستند) است.[1][2]

پایه‌های این واقعیت ریاضی کاملاً مالی است. تبلیغ‌دهندگان، فضای تبلیغاتی پادکست را بر اساس هزینه به ازای هر هزار دانلود (CPM) می‌خرند؛ معیاری که اگر آمار دانلودِ زیربنایی‌اش یک سراب باشد، فرو می‌ریزد. وقتی یک خریدار رسانه ۳۰ دلار برای یک تبلیغ میان‌برنامه می‌پردازد، در واقع برای توجه انسان پول می‌دهد، نه همگام‌سازی‌های سرور. استاندارد IAB v2.1 با مجبور کردن صنعت به پذیرش یک تعریف واحد و محافظه‌کارانه از دانلود، تضمین می‌کند که عدد گزارش‌شده توسط یک پلتفرم میزبان دقیقاً همان معنایی را داشته باشد که عدد گزارش‌شده توسط پلتفرمی دیگر دارد. همان‌طور که برایان بارلتا (Bryan Barletta) از Sounds Profitable در تحلیل سال ۲۰۲۰ خود از این استاندارد اشاره کرد، فلسفه اصلی، شفافیت است: «در نهایت، همان‌طور که در جاهای دیگر این سند ذکر شده، نیاز کلیدی این است که در مورد روش‌شناسی استفاده‌شده شفاف باشیم.» حالا که این استاندارد به‌طور جهانی توسط میزبان‌های بزرگ پذیرفته شده، مرز فنی بعدی در استانداردسازی داده‌های پخش سمت کاربر (client-side) نهفته است تا ثابت کند نه تنها یک فایل تحویل داده شده، بلکه یک انسان واقعاً آن تبلیغ را شنیده است.[2]

نکات کلیدی

  1. استاندارد IAB v2.1 ایجاب می‌کند که برای ثبت یک دانلود معتبر، حداقل ۶۰ ثانیه از داده‌های صوتی منتقل شود.
  2. پلتفرم‌های میزبان باید درخواست‌های ثبت‌شده از یک آدرس IP و User Agent یکسان را در یک بازه ۲۴ ساعته یکپارچه و بدون تکرار (deduplicate) کنند.
  3. این استاندارد استفاده از یک لیست سیاه متمرکز را برای فیلتر کردن ربات‌های خودکار و خزنده‌های موتورهای جستجو الزامی می‌کند.
  4. لاگ‌های فیلترنشده سرور می‌توانند با شمارش همگام‌سازی‌های چنددستگاهی و پیش‌بارگذاری‌های زیر یک دقیقه به‌عنوان شنوندگان مجزا، آمار مخاطبان را به‌طور مصنوعی متورم کنند.

بررسی عمیق دیدگاه‌ها

اندازه‌گیری تاییدشده IAB v2.1

معیار فیلترشده و استاندارد صنعت که جفت‌های IP/User-Agent را در طول ۲۴ ساعت یکپارچه کرده و به ۶۰ ثانیه داده صوتی نیاز دارد.

این رویکرد، واقعیت مالی را بر حجم خام داده‌ها ترجیح می‌دهد. استاندارد IAB با حذف ربات‌ها، پیش‌بارگذاری‌های زیر ۶۰ ثانیه و همگام‌سازی‌های تکراری دستگاه‌ها، یک عدد محافظه‌کارانه و بسیار قابل‌دفاع تولید می‌کند که تبلیغ‌دهندگان می‌توانند به آن اعتماد کنند. استدلال اصلی برای این معیار کاملاً درباره استانداردسازی است: این روش تضمین می‌کند که دانلودی که توسط Libsyn گزارش می‌شود، از نظر ریاضی معادل دانلودی است که توسط یک رقیب گزارش می‌شود. نقطه ضعف اصلی این است که اغلب منجر به یک عدد کلی بسیار پایین‌تر می‌شود؛ حقیقتی که هضم آن برای تولیدکنندگان مستقلی که به آمارهای متورم و غرورآفرین لاگ‌های فیلترنشده سرور عادت کرده‌اند، می‌تواند سخت باشد. این معیار برای فروش فضای تبلیغاتی یا مقایسه اندازه مخاطب در پلتفرم‌های میزبان مختلف کاملاً مناسب است، اما زمانی که یک مهندس شبکه نیاز به تشخیص کل بار پهنای باند وارد بر یک سرور دارد، اصلاً به کار نمی‌آید.

اندازه‌گیری لاگ خام سرور

شمارش فیلترنشده هر درخواست HTTP GET که به سرور میزبان می‌رسد، از جمله ربات‌ها، پیش‌بارگذاری‌ها و همگام‌سازی‌های چنددستگاهی.

این معیار، حقیقتِ بی‌کم‌وکاستِ فعالیت سرور را بدون تلاش برای حدس زدن نیت انسان ثبت می‌کند. استدلال برای استفاده از لاگ‌های خام، دقت فنی است: هر بار که یک اپلیکیشن پادکست یک بایت داده درخواست می‌کند، سرور آن رویداد را ثبت می‌کند. این روش نمای دقیقی از نحوه رفتار کلاینت‌های مختلف پادکست، میزان تهاجمی بودن آن‌ها در پیش‌بارگذاری صدا و کل پهنای باندی که یک برنامه مصرف می‌کند، ارائه می‌دهد. نقص کشنده این رویکرد این است که همگام‌سازی خودکار یک ماشین را با گوش دادن آگاهانه یک انسان برابر می‌داند و اندازه ظاهری مخاطب را تا ۳ برابر یا بیشتر متورم می‌کند. این روش زمانی که یک ارائه‌دهنده هاست در حال محاسبه هزینه‌های زیرساخت یا عیب‌یابی یک جهش ناگهانی در ترافیک است، به‌خوبی جواب می‌دهد، اما برای قیمت‌گذاری فضای تبلیغاتی یا اندازه‌گیری تعامل واقعی انسان کاملاً نامناسب است.

چرا مهم است

بدون یک استاندارد فیلترینگ دقیق، لاگ‌های خام سرور آمار شنوندگان واقعی پادکست را تا سه برابر بیشتر نشان می‌دهند و قیمت‌گذاری دقیق تبلیغات را برای تولیدکنندگان غیرممکن می‌کنند. استاندارد IAB v2.1 تضمین می‌کند که کلمه «دانلود» در تمام پلتفرم‌های میزبان معنای واحدی داشته باشد و اعتمادی را که برای تامین مالی این رسانه نیاز است، بنا کند.

منابع

پوشش منابع

5 منبع

2 دیدگاه شناسایی‌شده

مدافعان اندازه‌گیری استاندارد 70%تحلیلگران داده‌های خام 30%
  1. [1]IAB Tech Labمدافعان اندازه‌گیری استاندارد

    Podcast Measurement Technical Guidelines Version 2.1

    مطالعه در IAB Tech Lab
  2. [2]Sounds Profitableمدافعان اندازه‌گیری استاندارد

    IAB Podcast Measurement v2.1 – What You Need to Know

    مطالعه در Sounds Profitable
  3. [3]Libsynمدافعان اندازه‌گیری استاندارد

    Libsyn Earns IAB 2.1 Certification: Setting the Standard in Podcast Measurement

    مطالعه در Libsyn
  4. [4]Wikipediaتحلیلگران داده‌های خام

    Podcast

    مطالعه در Wikipedia
  5. [5]تیم سردبیری کوهستانمدافعان اندازه‌گیری استاندارد

    تحلیل تیم سردبیری کوهستان

    مطالعه در تیم سردبیری کوهستان

نظرات

همیشه در جریان باشید

هر زاویه. هر روز.

دریافت سرگرمی اخبار همراه با پوشش کامل منابع و تحلیل دیدگاه‌ها، مستقیم در صندوق ورودی شما.