رفتن به محتوای اصلی
زیرساخت هوش مصنوعیتوضیح و تحلیل۲۱ تیر ۱۴۰۵، ۷:۲۴· 7 دقیقه مطالعه· در هوش مصنوعی

«OpenAI» با همکاری «Broadcom» از چیپ استنتاجی «Jalapeño» رونمایی کرد؛ هدف: کنترل کامل پشته و کاهش هزینه‌های محاسباتی

OpenAI با Broadcom برای عرضه اولین شتاب‌دهنده سیلیکونی سفارشی خود که به طور خاص برای کاهش هزینه‌های سرسام‌آور اجرای مدل‌های زبان بزرگ در محیط عملیاتی طراحی شده، همکاری کرده است.

به قلم کوروش پاکزاد

OpenAI و شرکای سخت‌افزاری 40%تحلیلگران مالی 35%تولیدکنندگان اصلی سیلیکون تجاری 25%
OpenAI و شرکای سخت‌افزاری
سیلیکون سفارشی تنها مسیر پایدار برای مقیاس‌دهی هوش مصنوعی پیشرو است.
تحلیلگران مالی
کارایی استنتاج، کلید ارزش‌گذاری و عرضه عمومی سهام (IPO) نهایی OpenAI است.
تولیدکنندگان اصلی سیلیکون تجاری
چیپ‌های سفارشی یک جایگاه خاص را پر می‌کنند، اما پردازنده‌های گرافیکی (GPU) همچنان موتور بلامنازع پیشرفت هوش مصنوعی هستند.

OpenAI رسماً وارد عرصه نیمه‌رساناها شده و با Broadcom همکاری کرده تا از «Jalapeño»، اولین شتاب‌دهنده سیلیکونی سفارشی طراحی شده توسط این شرکت هوش مصنوعی، رونمایی کند. این چیپ که به عنوان یک «پردازنده هوش» معرفی شده، نشان‌دهنده یک تغییر استراتژیک بزرگ برای خالق ChatGPT است و شرکت را فراتر از توسعه نرم‌افزار و مدل، به سمت زیرساخت فیزیکی که محصولاتش را قدرت می‌دهد، سوق می‌دهد. این اعلامیه، که شامل Celestica به عنوان شریک تولید نیز می‌شود، یک پلتفرم محاسباتی چند نسلی را ترسیم می‌کند که برای سریع‌تر، قابل اعتمادتر و به طور قابل توجهی ارزان‌تر کردن عملیات هوش مصنوعی پیشرفته در مقیاس جهانی طراحی شده است.[1][2]

برخلاف واحدهای پردازش گرافیکی (GPU) همه‌کاره که در حال حاضر بر بازار سخت‌افزار هوش مصنوعی تسلط دارند، Jalapeño یک مدار مجتمع با کاربرد خاص (ASIC) است که از ابتدا ساخته شده است. این چیپ برای یک وظیفه خاص مهندسی شده است: استنتاج مدل زبان بزرگ. در حالی که چیپ‌های عمومی باید بین ریاضیات پیچیده مورد نیاز برای آموزش مدل‌های جدید و سرعت لازم برای ارائه خدمات به آن‌ها تعادل برقرار کنند، Jalapeño معماری آموزش را به طور کامل حذف می‌کند. در عوض، بر گلوگاه‌های دقیقی تمرکز دارد که محصولات هوش مصنوعی زنده را کند می‌کنند، و برای حرکت سریع داده، پهنای باند حافظه و شبکه‌سازی با تأخیر کم بهینه‌سازی شده است.[1]

برای درک اهمیت این حرکت، باید دو فاز متمایز هوش مصنوعی را از هم تفکیک کرد: آموزش (Training) و استنتاج (Inference). آموزش فرآیند بسیار پر سر و صدا و از نظر محاسباتی عظیم است که طی آن به یک مدل یاد داده می‌شود که چگونه فکر کند، با تغذیه تریلیون‌ها کلمه در طول چندین ماه. در مقابل، استنتاج فرآیند روزمره و مداوم اجرای درخواست‌های زنده کاربران از طریق آن مدل تکمیل‌شده برای تولید پاسخ است. در حالی که آموزش نیاز به یک سرمایه‌گذاری اولیه هنگفت دارد، استنتاج یک هزینه عملیاتی دائمی است که مستقیماً با پذیرش کاربر مقیاس می‌یابد.[3]

در حالی که آموزش نیازمند سرمایه‌گذاری اولیه هنگفت است، استنتاج بخش اعظم هزینه طول عمر یک مدل هوش مصنوعی را تشکیل می‌دهد.

واقعیت اقتصادی رونق هوش مصنوعی این است که استنتاج به سنگین‌ترین لنگر مالی این صنعت تبدیل شده است. بر اساس تحلیل‌های اخیر زیرساختی، پیش‌بینی می‌شود که بارهای کاری استنتاج تا سال ۲۰۲۹، ۶۵ درصد از کل محاسبات هوش مصنوعی را مصرف کنند. مهم‌تر اینکه، از آنجایی که استنتاج به طور مداوم برای پاسخگویی به میلیون‌ها پرسش روزانه اجرا می‌شود، اکنون ۸۰ تا ۹۰ درصد از هزینه مادام‌العمر یک سیستم هوش مصنوعی عملیاتی را تشکیل می‌دهد. هر بار که یک کاربر سندی تولید می‌کند، خط کدی می‌نویسد، یا سؤالی از یک چت‌بات می‌پرسد، یک کنتور در مرکز داده در حال کار است.

برای OpenAI، که به صدها میلیون کاربر فعال خدمات می‌دهد و هزاران برنامه سازمانی را از طریق API خود قدرت می‌بخشد، این کنتورهای در حال کار به معنای صورت‌حساب‌های ابری گزاف است. صنعت گسترده‌تر نیز همین فشار را احساس می‌کند؛ یک نظرسنجی اخیر از توسعه‌دهندگان نشان داد که ۴۴ درصد از سازمان‌ها اکنون بیش از سه چهارم کل بودجه هوش مصنوعی خود را صرفاً به استنتاج اختصاص می‌دهند. OpenAI امیدوار است با طراحی سخت‌افزاری که به طور خاص برای مدل‌های خودش تنظیم شده است، این منحنی هزینه را بشکند و استقرار هوش مصنوعی با حجم بالا را از نظر مالی پایدار سازد.[3]

معماری سخت‌افزاری Jalapeño نشان‌دهنده همکاری عمیق بین مهندسان نرم‌افزار OpenAI و طراحان سیلیکون Broadcom است. از آنجایی که OpenAI الگوهای سرویس‌دهی خاص، حرکت حافظه و هسته‌های نرم‌افزاری مدل‌های پیشرو خود را به خوبی درک می‌کند، توانست چیپی را طراحی کند که ناکارآمدی‌های موجود در سخت‌افزارهای آماده را از بین ببرد. Broadcom تخصص سیلیکونی پایه را فراهم کرد، از جمله ادغام چیپ‌های شبکه‌سازی Tomahawk با عملکرد بالا برای اطمینان از اینکه هزاران پردازنده Jalapeño می‌توانند به طور یکپارچه در قفسه‌های عظیم مراکز داده با یکدیگر ارتباط برقرار کنند.

معماری سخت‌افزاری Jalapeño نشان‌دهنده همکاری عمیق بین مهندسان نرم‌افزار OpenAI و طراحان سیلیکون Broadcom است.

این سطح از یکپارچگی عمودی – کنترل کل پشته فناوری از رابط کاربری تا سیلیکون فیزیکی – مدت‌هاست که آرمان اصلی شرکت‌های بزرگ فناوری بوده است. OpenAI با فعالیت در کل پشته، می‌تواند مدل‌های آینده و چیپ‌های آینده خود را به طور همزمان طراحی کند. اگر یک معماری جدید هوش مصنوعی به نوع خاصی از دسترسی به حافظه نیاز داشته باشد، تیم سخت‌افزار می‌تواند آن قابلیت را مستقیماً در نسل بعدی Jalapeño بسازد و یک حلقه بازخورد ایجاد کند که خریداران سخت‌افزار آماده به سادگی نمی‌توانند با آن رقابت کنند.[1][2]

در حالی که OpenAI و Broadcom معیارهای عملکرد دقیق را تا زمان انتشار یک مقاله فنی کامل مخفی نگه داشته‌اند، اهداف مالی بسیار تهاجمی هستند. گزارش‌های اولیه نشان می‌دهد که Jalapeño برای کاهش هزینه‌های استنتاج OpenAI تا حدود ۵۰ درصد طراحی شده است. علاوه بر این، این شرکت‌ها ادعا می‌کنند که این چیپ عملکرد قابل توجهی بالاتر به ازای هر وات نسبت به سخت‌افزارهای پیشرو فعلی ارائه خواهد داد، که یک معیار حیاتی است زیرا مراکز داده در سراسر جهان تحت فشار محدودیت‌های شبکه‌های برق محلی قرار دارند.[2]

پیش‌بینی می‌شود بارهای کاری استنتاج تا سال ۲۰۲۹، ۶۵٪ از کل محاسبات هوش مصنوعی را مصرف کنند.

جدول زمانی توسعه Jalapeño سرعت سرسام‌آوری را برای صنعت نیمه‌رسانای که به کندی شهرت دارد، تعیین کرده است. این پروژه تنها در نُه ماه از طرح‌های اولیه به نمونه‌های مهندسی فیزیکی رسید – چرخه‌ای که معمولاً سال‌ها طول می‌کشد. OpenAI این سرعت را به فرآیند توسعه مشترک نرم‌افزار و سخت‌افزار نسبت داد که به طور فعال از مدل‌های هوش مصنوعی خود شرکت برای تسریع بخش‌هایی از طراحی چیپ استفاده کرد، در واقع از هوش مصنوعی برای ساخت زیرساخت نسل بعدی هوش مصنوعی استفاده شد.[2]

این چیپ‌ها در حال حاضر از فاز تئوری خارج شده‌اند. نمونه‌های مهندسی Jalapeño در حال حاضر در آزمایشگاه‌های OpenAI با سرعت کلاک و سطوح توان هدف کار می‌کنند. این شرکت تأیید کرد که بارهای کاری یادگیری ماشین در سطح تولید را به طور فعال بر روی سیلیکون جدید اجرا می‌کند، از جمله مدل نسل قبلی خود یعنی GPT-5.3-Codex-Spark، که ثابت می‌کند معماری جدید می‌تواند با موفقیت وظایف استدلال پیچیده مورد نیاز هوش مصنوعی عاملیت‌محور مدرن را مدیریت کند.[1]

با وجود این پیشرفت، عرضه Jalapeño به معنای قطع رابطه بین OpenAI و Nvidia، پادشاه بلامنازع سخت‌افزار هوش مصنوعی، نیست. پردازنده‌های گرافیکی Nvidia همچنان استاندارد طلایی برای وظیفه از نظر محاسباتی طاقت‌فرسای آموزش مدل‌ها باقی می‌مانند. اوایل امسال، Nvidia یک سرمایه‌گذاری مستقیم عظیم در OpenAI نهایی کرد و توافقی را برای استقرار گیگاوات‌ها ظرفیت محاسباتی با استفاده از پلتفرم نسل بعدی Vera Rubin خود تضمین کرد. Jalapeño طراحی شده است تا مکمل این زیرساخت باشد، نه جایگزین آن، با به عهده گرفتن بار کاری پس از آموزش کامل مدل‌ها.[2]

OpenAI قصد دارد استقرار چیپ‌های Jalapeño را در مراکز داده فعال تا پایان سال ۲۰۲۶ آغاز کند.

ورود OpenAI به عرصه سیلیکون سفارشی، منعکس‌کننده یک روند گسترده‌تر در میان سنگین‌ترین بازیگران صنعت فناوری است. گوگل یک دهه را صرف بهینه‌سازی واحدهای پردازش تنسور (TPU) خود کرده است، مایکروسافت اخیراً تلاش‌های سیلیکونی سفارشی خود را با شتاب‌دهنده Azure Maia 200 افزایش داده است، و متا همچنان چیپ‌های MTIA خود را مستقر می‌کند. از آنجایی که مدل‌های هوش مصنوعی به موتور اصلی اینترنت مدرن تبدیل می‌شوند، اتکای کامل به سیلیکون تجاری شخص ثالث برای عملیات روزمره به طور فزاینده‌ای به عنوان یک ریسک استراتژیک و مالی غیرقابل قبول تلقی می‌شود.[2]

پیامدهای مالی Jalapeño بسیار فراتر از قفسه سرور است. در حالی که OpenAI زمینه را برای عرضه عمومی سهام مورد انتظار فراهم می‌کند، این شرکت تحت فشار شدید سرمایه‌گذاران خصوصی و بازارهای عمومی قرار دارد تا مسیر قابل دوامی برای سودآوری نشان دهد. OpenAI با کاهش شدید هزینه کالاهای فروخته شده خود – در این مورد، محاسبات مورد نیاز برای ارائه خدمات مدل‌هایش – تلاش می‌کند ثابت کند که هزینه‌های سرمایه‌ای سرسام‌آور عصر هوش مصنوعی در نهایت منجر به یک کسب‌وکار پایدار و با حاشیه سود بالا خواهد شد.[2]

با طراحی سیلیکون اختصاصی خود، اوپن‌ای‌آی می‌تواند سخت‌افزار و نرم‌افزار خود را به طور همزمان بهینه‌سازی کند.

با سپردن مسئولیت مدیریت برد، قفسه و یکپارچه‌سازی در سطح سیستم به شریک تولیدی Celestica، OpenAI قصد دارد استقرار Jalapeño را در مراکز داده فعال تا پایان سال آغاز کند. اگر این چیپ در مقیاس طبق وعده عمل کند، می‌تواند اقتصاد هوش مصنوعی را به طور اساسی تغییر دهد و به توسعه‌دهندگان اجازه دهد مدل‌های پیچیده‌تر و استدلال‌محور را برای میلیون‌ها کاربر مستقر کنند، بدون اینکه شرکت‌هایی که آن‌ها را می‌سازند ورشکسته شوند.

نکات کلیدی

  • OpenAI و Broadcom از «Jalapeño»، یک چیپ سیلیکونی سفارشی که منحصراً برای استنتاج هوش مصنوعی طراحی شده، رونمایی کردند.
  • این چیپ معماری آموزش را حذف کرده و بر حرکت داده تمرکز دارد و هدف آن کاهش هزینه‌های استنتاج تا حدود ۵۰ درصد است.
  • استنتاج در حال حاضر ۸۰ تا ۹۰ درصد از هزینه‌های محاسباتی مادام‌العمر برای سیستم‌های هوش مصنوعی عملیاتی را تشکیل می‌دهد.
  • OpenAI قصد دارد این چیپ‌ها را تا پایان سال ۲۰۲۶ مستقر کند تا حاشیه سود خود را پیش از عرضه عمومی سهام شایعه شده، بهبود بخشد.

چرا مهم است

با گسترش جهانی استفاده از هوش مصنوعی، هزینه مداوم تولید پاسخ‌ها (که به آن استنتاج یا Inference گفته می‌شود) به بزرگترین گلوگاه مالی این صنعت تبدیل شده است. OpenAI با طراحی سیلیکون اختصاصی خود، قصد دارد قیمت دسترسی به هوش مصنوعی را به شدت کاهش دهد و مسیر خود را برای سودآوری پیش از عرضه عمومی سهام مورد انتظار، تضمین کند.

آنچه نمی‌دانیم

  • معیارهای عملکرد دقیق و معیارهای کارایی توان چیپ Jalapeño در مقایسه با جدیدترین سخت‌افزارهای استنتاج Nvidia.
  • اینکه آیا OpenAI قصد دارد ظرفیت محاسباتی Jalapeño را به مشتریان سازمانی خارجی اجاره دهد، یا آن را منحصراً برای مدل‌های خود رزرو کند.
  • اینکه Celestica و Broadcom با چه سرعتی می‌توانند تولید را برای پاسخگویی به زیرساخت عظیم مراکز داده جهانی OpenAI افزایش دهند.

اصطلاحات کلیدی

استنتاج (Inference)
فاز هوش مصنوعی که در آن یک مدل آموزش‌دیده، داده‌های جدید یا درخواست‌های کاربر را پردازش می‌کند تا یک پیش‌بینی، تصمیم یا پاسخ متنی تولید کند.
ASIC (مدار مجتمع با کاربرد خاص)
یک ریزتراشه که برای یک هدف واحد و خاص – مانند اجرای استنتاج هوش مصنوعی – به جای محاسبات عمومی طراحی شده است.
یکپارچگی کامل پشته (Full-Stack Integration)
استراتژی‌ای که در آن یک شرکت واحد، هر لایه از یک محصول فناوری را کنترل می‌کند، از نرم‌افزار رو به کاربر تا سخت‌افزار فیزیکی و شبکه‌سازی.
آموزش هوش مصنوعی (AI Training)
فرآیند اولیه و بسیار فشرده محاسباتی تغذیه مجموعه داده‌های عظیم به یک شبکه عصبی تا بتواند الگوها و رفتارها را بیاموزد.
سیلیکون تجاری (Merchant Silicon)
ریزتراشه‌هایی که توسط شرکت‌های مستقل نیمه‌رسانا (مانند Nvidia یا AMD) طراحی و فروخته می‌شوند تا توسط هر مشتری استفاده شوند، برخلاف چیپ‌های سفارشی داخلی.

منابع

پوشش منابع

3 منبع

3 دیدگاه شناسایی‌شده

OpenAI و شرکای سخت‌افزاری 40%تحلیلگران مالی 35%تولیدکنندگان اصلی سیلیکون تجاری 25%
  1. [1]OpenAIOpenAI و شرکای سخت‌افزاری

    OpenAI and Broadcom introduce Jalapeño

    مطالعه در OpenAI
  2. [2]VentureBeatتحلیلگران مالی

    OpenAI unveils first custom AI inference chip, Jalapeño, with Broadcom — and its development was sped-up with OpenAI's own models

    مطالعه در VentureBeat
  3. [3]DigitalOceanتولیدکنندگان اصلی سیلیکون تجاری

    AI inference vs training FAQ

    مطالعه در DigitalOcean

نظرات

همیشه در جریان باشید

هر زاویه. هر روز.

دریافت هوش مصنوعی اخبار همراه با پوشش کامل منابع و تحلیل دیدگاه‌ها، مستقیم در صندوق ورودی شما.