استاندارد IAB v2.1: پلتفرمهای میزبان پادکست چگونه رباتها را فیلتر و «دانلود» را تعریف میکنند؟
دستورالعملهای نسخه ۲.۱ از IAB Tech Lab با تعیین یک آستانه سختگیرانه ۶۰ ثانیهای و یک بازه ۲۴ ساعته برای حذف دادههای تکراری، شنوندگان واقعی پادکست را از رباتهای خودکار و همگامسازیهای چنددستگاهی جدا میکند. این استاندارد، لاگهای سرور را به یک ارز قابلاعتماد برای تبلیغدهندگان تبدیل میکند.
به قلم سلین خسروشاهی
این خبر را به اشتراک بگذارید
- مدافعان اندازهگیری استاندارد
- استدلال میکنند که فیلترینگ سختگیرانه برای جلب اعتماد تبلیغدهندگان و رشد این صنعت ضروری است.
- تحلیلگران دادههای خام
- برای عیبیابی و تشخیصهای فنی دقیق، به لاگهای فیلترنشده سرور اهمیت میدهند.
دیدگاههایی که این گزارش پوشش نداده
- تولیدکنندگان مستقلی که برای ارضای حس غرور خود به اعداد و ارقام خام وابستهاند
- توسعهدهندگان اپلیکیشنهای پادکست که رفتارهای پیشبارگذاری (pre-fetch) را پیادهسازی میکنند
تصور کنید شنوندهای در مسیر رفتن به سر کار، دکمه پخش اپیزود جدید یک پادکست را لمس میکند؛ یک حرکت ساده که آبشاری از دادههای نامرئی را به راه میاندازد. اگر بخواهیم فقط بر اساس ترافیک خام سرور قضاوت کنیم، همین یک انسان ممکن است شبیه سه یا چهار آدم مجزا به نظر برسد. گوشی او برای بررسی فید RSS به سرور میزبان پینگ میفرستد، یک تکه کوچک از فایل صوتی را برای بافر کردن دانلود میکند و بعد، همین وضعیت را با اسپیکر هوشمند خانه و لپتاپ روی میز کارش همگامسازی میکند. اگر یک میزبان پادکست بخواهد صرفاً هر درخواست HTTP GET که به سرورهایش میرسد را بشمارد، یک مخاطب ۱۰,۰۰۰ نفری از انسانهای واقعی بهراحتی میتواند در لباس ۳۰,۰۰۰ یا ۴۰,۰۰۰ دانلود ظاهر شود. این توهم ریاضی دقیقاً همان چیزی است که «دفتر تبلیغات تعاملی» (IAB) کمر به نابودی آن بسته است.[1][5]
صنعت پادکست روی یک معماری غیرمتمرکز میچرخد؛ چیزی که همزمان بزرگترین نقطه قوت و عمیقترین دردسر آن برای اندازهگیری آمار است. برخلاف یک اکوسیستم بسته که در آن یک سرور مرکزی دقیقاً میداند چه کسی و برای چه مدتی در حال تماشاست، پادکست در واقع فقط یک فایل صوتی است که روی یک سرور نشسته و منتظر است تا یک اپلیکیشن شخص ثالث سراغش را بگیرد. «دستورالعملهای فنی اندازهگیری پادکست نسخه ۲.۱» از IAB Tech Lab، دقیقاً نقش فیلتر نهایی را برای این محیط پرهرجومرج بازی میکند. این استاندارد مجموعهای از قوانین سفتوسخت را وضع میکند تا سیگنال یک شنونده واقعی را از نویز رباتهای خودکار، پیشبارگذاریهای تهاجمی و همگامسازیهای تکراری دستگاهها جدا کند.[1][4]
در هسته مرکزی استاندارد v2.1، قانون ۶۰ ثانیه قرار دارد. برای اینکه یک دانلود مشروع و معتبر به حساب بیاید، سرور میزبان باید بایتهای کافی برای حداقل یک دقیقه از صدای اپیزود را تحویل دهد. شنوندهای که دستش میخورد و اشتباهی یک اپیزود را باز میکند و فوراً اپلیکیشن را میبندد، به حساب نمیآید. اپلیکیشنی که بهطور خودکار بخش کوچکی از فایل را دانلود میکند تا شاید کاربر بعداً بخواهد به آن گوش دهد هم به حساب نمیآید. این استاندارد، پلتفرمهای میزبان را مجبور میکند تا اندازه دقیق بایتهای یک دقیقه از محتوای هر اپیزود را با در نظر گرفتن بیتریت (bitrate) خاص و حجم هدرهای متادیتا ID3 محاسبه کنند و هر درخواستی که به این حد نصاب نرسد را دور بریزند.[1]
بعد نوبت به پنجره حذف دادههای تکراری (deduplication) میرسد؛ مکانیزمی که جلوی یک طرفدار دوآتشه را میگیرد تا با رفرش کردن مداوم فید، آمار را بالا نبرد. دستورالعملهای IAB v2.1 یک دوره ۲۴ ساعته را برای این کار الزامی میکند که میتواند بهصورت یک روز تقویمی ثابت یا یک چرخه ۲۴ ساعته گردان پیادهسازی شود. در طول این بازه، پلتفرم میزبان باید به ترکیب آدرس IP درخواستکننده و User Agent او (همان رشته متنی که اپلیکیشن پادکست و سیستمعامل خاص را شناسایی میکند) نگاه کند. اگر یک IP و User Agent یکسان، یک فایل را در یک بعدازظهر ده بار درخواست کنند، استاندارد IAB دقیقاً یک دانلود را میشمارد.[1][3]
بعد نوبت به پنجره حذف دادههای تکراری (deduplication) میرسد؛ مکانیزمی که جلوی یک طرفدار دوآتشه را میگیرد تا با رفرش کردن مداوم فید، آمار را بالا نبرد.
این جفت شدن IP و User Agent، نزدیکترین چیزی است که دنیای غیرمتمرکز پادکست میتواند برای شناسایی یک شنونده فردی به آن برسد. البته که یک شاخص بینقص نیست. یک دفتر شرکتی یا خوابگاه دانشجویی ممکن است صدها انسان واقعی را از طریق یک آدرس IP واحد هدایت کند، در حالی که یک شنونده موبایلی در حال رفتوآمد با قطار ممکن است بین دکلهای مخابراتی جابهجا شود و در عرض یک ساعت سه آدرس IP مختلف تولید کند. استاندارد IAB این موارد استثنا را میپذیرد، اما قانون ترکیب IP و User Agent را بهعنوان قابلاعتمادترین خط پایه موجود اعمال میکند و صراحتاً پلتفرمها را از شمارش درخواستهای خام بدون این لایه حذف تکرار، منع میکند.[1]
این استاندارد همچنین یک جنگ خاموش را علیه ترافیک غیرانسانی به راه انداخته است. اینترنت پر از رباتهای خودکار، خزندههای موتورهای جستجو و اسکریپتهای نمایهسازی است که برای نقشهبرداری از وب، مدام به فیدهای RSS پینگ میفرستند. IAB Tech Lab یک لیست سیاه متمرکز و دائماً بهروزشونده از آدرسهای IP و User Agentهای رباتهای شناختهشده را نگهداری میکند. پلتفرمهای میزبان تاییدشده مانند Libsyn و Triton Digital باید قبل از گزارش دادن حتی یک عدد به تولیدکننده، این فیلتر را روی لاگهای سرور خود اعمال کنند. اگر سروری در یک دیتاسنتر، کل یک مصاحبه دوساعته را دانلود کند، فیلتر، امضای IP دیتاسنتر را مچگیری کرده و بیسروصدا این رویداد را از داشبورد تحلیل دادهها حذف میکند.[1][3]
نسخه ۲.۱ چندین اصلاح فنی خاص را معرفی کرد تا با نحوه واقعی مصرف محتوای صوتی توسط مردم همگام بماند. این نسخه پشتیبانی صریح از آدرسهای IPv6 را اضافه کرد تا مطمئن شود نسل بعدی مسیریابی اینترنت، ریاضیات حذف دادههای تکراری را به هم نمیریزد. همچنین راهنماییهای دقیقی برای فیلتر کردن درخواستهای دستگاههای Apple watchOS ارائه داد؛ دستگاههایی که عادت دارند با آیفونهای جفتشدهشان به شکلی تهاجمی همگامسازی کنند و در گذشته باعث تورم آمار دانلود میشدند. این بهروزرسانیهای موشکافانه، بازتابی از بازی همیشگی موش و گربه میان اپلیکیشنهای پادکست (که سعی در ارائه یک تجربه کاربری روان دارند) و پلتفرمهای میزبان (که در تلاش برای حفظ واقعیت ریاضی هستند) است.[1][2]
پایههای این واقعیت ریاضی کاملاً مالی است. تبلیغدهندگان، فضای تبلیغاتی پادکست را بر اساس هزینه به ازای هر هزار دانلود (CPM) میخرند؛ معیاری که اگر آمار دانلودِ زیربناییاش یک سراب باشد، فرو میریزد. وقتی یک خریدار رسانه ۳۰ دلار برای یک تبلیغ میانبرنامه میپردازد، در واقع برای توجه انسان پول میدهد، نه همگامسازیهای سرور. استاندارد IAB v2.1 با مجبور کردن صنعت به پذیرش یک تعریف واحد و محافظهکارانه از دانلود، تضمین میکند که عدد گزارششده توسط یک پلتفرم میزبان دقیقاً همان معنایی را داشته باشد که عدد گزارششده توسط پلتفرمی دیگر دارد. همانطور که برایان بارلتا (Bryan Barletta) از Sounds Profitable در تحلیل سال ۲۰۲۰ خود از این استاندارد اشاره کرد، فلسفه اصلی، شفافیت است: «در نهایت، همانطور که در جاهای دیگر این سند ذکر شده، نیاز کلیدی این است که در مورد روششناسی استفادهشده شفاف باشیم.» حالا که این استاندارد بهطور جهانی توسط میزبانهای بزرگ پذیرفته شده، مرز فنی بعدی در استانداردسازی دادههای پخش سمت کاربر (client-side) نهفته است تا ثابت کند نه تنها یک فایل تحویل داده شده، بلکه یک انسان واقعاً آن تبلیغ را شنیده است.[2]
نکات کلیدی
- استاندارد IAB v2.1 ایجاب میکند که برای ثبت یک دانلود معتبر، حداقل ۶۰ ثانیه از دادههای صوتی منتقل شود.
- پلتفرمهای میزبان باید درخواستهای ثبتشده از یک آدرس IP و User Agent یکسان را در یک بازه ۲۴ ساعته یکپارچه و بدون تکرار (deduplicate) کنند.
- این استاندارد استفاده از یک لیست سیاه متمرکز را برای فیلتر کردن رباتهای خودکار و خزندههای موتورهای جستجو الزامی میکند.
- لاگهای فیلترنشده سرور میتوانند با شمارش همگامسازیهای چنددستگاهی و پیشبارگذاریهای زیر یک دقیقه بهعنوان شنوندگان مجزا، آمار مخاطبان را بهطور مصنوعی متورم کنند.
بررسی عمیق دیدگاهها
اندازهگیری تاییدشده IAB v2.1
معیار فیلترشده و استاندارد صنعت که جفتهای IP/User-Agent را در طول ۲۴ ساعت یکپارچه کرده و به ۶۰ ثانیه داده صوتی نیاز دارد.
این رویکرد، واقعیت مالی را بر حجم خام دادهها ترجیح میدهد. استاندارد IAB با حذف رباتها، پیشبارگذاریهای زیر ۶۰ ثانیه و همگامسازیهای تکراری دستگاهها، یک عدد محافظهکارانه و بسیار قابلدفاع تولید میکند که تبلیغدهندگان میتوانند به آن اعتماد کنند. استدلال اصلی برای این معیار کاملاً درباره استانداردسازی است: این روش تضمین میکند که دانلودی که توسط Libsyn گزارش میشود، از نظر ریاضی معادل دانلودی است که توسط یک رقیب گزارش میشود. نقطه ضعف اصلی این است که اغلب منجر به یک عدد کلی بسیار پایینتر میشود؛ حقیقتی که هضم آن برای تولیدکنندگان مستقلی که به آمارهای متورم و غرورآفرین لاگهای فیلترنشده سرور عادت کردهاند، میتواند سخت باشد. این معیار برای فروش فضای تبلیغاتی یا مقایسه اندازه مخاطب در پلتفرمهای میزبان مختلف کاملاً مناسب است، اما زمانی که یک مهندس شبکه نیاز به تشخیص کل بار پهنای باند وارد بر یک سرور دارد، اصلاً به کار نمیآید.
اندازهگیری لاگ خام سرور
شمارش فیلترنشده هر درخواست HTTP GET که به سرور میزبان میرسد، از جمله رباتها، پیشبارگذاریها و همگامسازیهای چنددستگاهی.
این معیار، حقیقتِ بیکموکاستِ فعالیت سرور را بدون تلاش برای حدس زدن نیت انسان ثبت میکند. استدلال برای استفاده از لاگهای خام، دقت فنی است: هر بار که یک اپلیکیشن پادکست یک بایت داده درخواست میکند، سرور آن رویداد را ثبت میکند. این روش نمای دقیقی از نحوه رفتار کلاینتهای مختلف پادکست، میزان تهاجمی بودن آنها در پیشبارگذاری صدا و کل پهنای باندی که یک برنامه مصرف میکند، ارائه میدهد. نقص کشنده این رویکرد این است که همگامسازی خودکار یک ماشین را با گوش دادن آگاهانه یک انسان برابر میداند و اندازه ظاهری مخاطب را تا ۳ برابر یا بیشتر متورم میکند. این روش زمانی که یک ارائهدهنده هاست در حال محاسبه هزینههای زیرساخت یا عیبیابی یک جهش ناگهانی در ترافیک است، بهخوبی جواب میدهد، اما برای قیمتگذاری فضای تبلیغاتی یا اندازهگیری تعامل واقعی انسان کاملاً نامناسب است.
چرا مهم است
بدون یک استاندارد فیلترینگ دقیق، لاگهای خام سرور آمار شنوندگان واقعی پادکست را تا سه برابر بیشتر نشان میدهند و قیمتگذاری دقیق تبلیغات را برای تولیدکنندگان غیرممکن میکنند. استاندارد IAB v2.1 تضمین میکند که کلمه «دانلود» در تمام پلتفرمهای میزبان معنای واحدی داشته باشد و اعتمادی را که برای تامین مالی این رسانه نیاز است، بنا کند.
منابع
[1]IAB Tech Labمدافعان اندازهگیری استانداردPodcast Measurement Technical Guidelines Version 2.1
مطالعه در IAB Tech Lab →
[2]Sounds Profitableمدافعان اندازهگیری استانداردIAB Podcast Measurement v2.1 – What You Need to Know
مطالعه در Sounds Profitable →
[3]Libsynمدافعان اندازهگیری استانداردLibsyn Earns IAB 2.1 Certification: Setting the Standard in Podcast Measurement
مطالعه در Libsyn →
[4]Wikipediaتحلیلگران دادههای خامPodcast
مطالعه در Wikipedia →
[5]تیم سردبیری کوهستانمدافعان اندازهگیری استانداردتحلیل تیم سردبیری کوهستان
مطالعه در تیم سردبیری کوهستان →
نظرات
بیشتر در سرگرمی
مشاهده همه →اقتصاد نشر
از ۱۰ تا ۱۵ درصدِ سود خالص: پشتپرده قراردادهای نشر، پیشپرداختها و حق اقتباس
4 منبع
مهندسی ویدیو
استانداردهای PQ و HLG: ریاضیات پنهان در پس درخشش و رنگهای تلویزیونهای HDR
7 منبع
لجستیک کنسرت
سیستم پرش قورباغهای: تورهای استادیومی چگونه صحنههای ۳۰۰۰ تنی را یکشبه جابهجا میکنند؟
6 منبع
فناوری فیلمبرداری
فشردهسازی دو برابری و بازگشایی آن: لنزهای آنامورفیک چگونه جادوی تصویر عریض را خلق میکنند
5 منبع
هر زاویه. هر روز.
دریافت سرگرمی اخبار همراه با پوشش کامل منابع و تحلیل دیدگاهها، مستقیم در صندوق ورودی شما.





