اوپنایآی قیمت GPT-5.6 لونا را ۸۰٪ کاهش داد؛ بازتعریف اقتصاد هوش مصنوعی پیشرو
اوپنایآی قیمتهای رابط برنامهنویسی (API) خانواده مدلهای GPT-5.6 خود را به شدت کاهش داده است. این کاهش عمدتاً ناشی از افزایش کارایی مدلها در بهینهسازی کد سرویسدهی خودشان است. این اقدام، عرصه رقابت را از هوش خام به سمت هزینه تمامشده برای هر وظیفه تکمیلشده تغییر میدهد.
به قلم کاوان رامین
این خبر را به اشتراک بگذارید
- پذیرندگان هوش مصنوعی سازمانی
- تمرکز بر فروپاشی هزینه به ازای هر وظیفه و امکانپذیری اتوماسیونهای عامل پسزمینه.
- تحلیلگران صنعت
- برجسته کردن پیامدهای بلندمدت بهینهسازی کد سرویسدهی توسط خود مدلها.
- رقبای جهانی
- استدلال میکنند که مدلهای اختصاصی برای جلوگیری از فرار توسعهدهندگان، قیمتها را به صورت دفاعی کاهش میدهند.
نکات کلیدی
- اوپنایآی قیمت API مدل GPT-5.6 لونا را ۸۰ درصد کاهش داد.
- مدل پرچمدار GPT-5.6 سول نیز بیش از ۲۰ درصد کاهش قیمت داشت.
- صرفهجویی در هزینهها ناشی از بهینهسازی مستقل کد سرویسدهی توسط خود مدلها بود.
- این کاهش قیمتها با هدف دفاع از سهم بازار سازمانی در برابر آنتروپیک و مدلهای متنباز ارزانقیمت انجام شده است.
- تمرکز صنعت از قیمتگذاری خام توکن به سمت هزینه تمامشده برای هر وظیفه تکمیلشده در حال تغییر است.
چرا مهم است
برای توسعهدهندگان و شرکتها، کاهش ۸۰ درصدی قیمت مدلهای هوش مصنوعی توانمند، برای اولین بار امکانپذیری اقتصادی اتوماسیونهای پسزمینه با حجم بالا را فراهم میکند. همچنین، این نشان میدهد که هزینه هوشمندی بسیار سریعتر از آنچه محدودیتهای سختافزاری پیشبینی میکردند، در حال فروپاشی است.
تصور رایج در مورد هوش مصنوعی پیشرو این است که مدلها صرفاً بزرگتر، گرانتر و نیازمند منابع بیشتری خواهند شد تا زمانی که به یک سد فیزیکی برخورد کنند. اما مسیر اقتصادی واقعی در جهت مخالف حرکت میکند. آخرین بهروزرسانیهای قیمتگذاری اوپنایآی برای خانواده GPT-5.6، از فروپاشی منحنی هزینه پرده برمیآورد؛ فروپاشیای که نه فقط ناشی از سختافزار ارزانتر، بلکه ناشی از یادگیری مدلها برای بهینهسازی نرمافزار خودشان است.
در ۳۰ جولای، اوپنایآی کاهش قیمت ۸۰ درصدی را برای GPT-5.6 لونا، سبکترین مدل در نسل فعلی خود، اعلام کرد. نرخ جدید ۲۰ سنت برای هر میلیون توکن ورودی و ۱.۲۰ دلار برای هر میلیون توکن خروجی است که اساساً محاسبات اقتصادی برای استقرار در مقیاس بزرگ را تغییر میدهد.[1][2][7]
مدل میانرده، GPT-5.6 ترا، همزمان ۲۰ درصد کاهش قیمت داشت. هزینههای API آن به ۲ دلار برای هر میلیون توکن ورودی و ۱۲ دلار برای هر میلیون توکن خروجی کاهش یافت، در حالی که محدودیتهای استفاده برای مشترکین پولی ChatGPT Work و Codex عملاً کاهش یافت تا حجم بالاتری از استفاده مجاز شود.[1][4]
چند هفته بعد، در اواخر آگوست، این شرکت این کاهشها را به مدل پرچمدار خود نیز گسترش داد. قیمتگذاری API مدل GPT-5.6 سول بیش از ۲۰ درصد کاهش یافت و برای استفاده استاندارد با زمینه کوتاه، به ۴ دلار برای هر میلیون توکن ورودی و ۲۰ دلار برای هر میلیون توکن خروجی رسید.[3][5][6]
اگرچه اعداد اصلی شبیه به یک جنگ قیمتگذاری استاندارد علیه رقبایی مانند آنتروپیک و توسعهدهندگان نوظهور چینی به نظر میرسند، اما سازوکار زیربنایی است که اهمیت واقعی دارد. اوپنایآی ادعا میکند که این صرفهجوییها نتیجه مستقیم "خودبهینهسازی" است، فرآیندی که در آن هوش مصنوعی به طور فعال کارایی عملیاتی خود را بهبود میبخشد.[2][4]
طبق افشاگریهای فنی شرکت، GPT-5.6 سول برای بازنویسی و بهینهسازی مستقل هستههای تولیدی خود به کار گرفته شد. این مدل، تحت نظارت انسان، ناکارآمدیها را در کدی که برای سرویسدهی به مشتریان استفاده میشد، شناسایی کرد.[2][4]
این تلاش مهندسی مستقل، بنا بر گزارشها، هزینه سرویسدهی مدل را از ابتدا تا انتها ۲۰ درصد کاهش داد. سول همچنین صدها آزمایش را برای بهبود تولید توکن طراحی و اجرا کرد که منجر به افزایش کارایی ۱۵ درصدی بدون نیاز به سختافزار جدید شد.[2][4]
واقعیت پشت این بازاریابی کمی زمینیتر است. اوپنایآی این موضوع را به عنوان یک پیشرفت بزرگ در خودبهبودی هوش مصنوعی معرفی میکند، اما اساساً این یک شکل بسیار خودکار از پروفایلسازی نرمافزاری است. مدل در حال بازنویسی معماری بنیادی خود نیست؛ بلکه گلوگاهها را در پشته سرویسدهی پیدا کرده و پیادهسازیهای کارآمدتر C++ یا CUDA را پیشنهاد میدهد.
با این حال، تأثیر اقتصادی این پروفایلسازی کاملاً واقعی است. با استخراج خروجی محاسباتی بیشتر از خوشههای سرور موجود، اوپنایآی میتواند قیمتها را به شدت کاهش دهد بدون اینکه لزوماً حاشیه سود خود را از تماسهای API قربانی کند.[4]
با این حال، تأثیر اقتصادی این پروفایلسازی کاملاً واقعی است.
این امر عرصه رقابت را از معیارهای هوش خام به یک معیار عملیتر تغییر میدهد: هزینه به ازای هر وظیفه تکمیلشده. همانطور که ردیابهای مستقلی مانند شاخص هوش تحلیلی مصنوعی نشان میدهند، قیمتهای خام توکن میتوانند بسیار گمراهکننده باشند.[1][7]
به عنوان مثال، مدلهای متنباز چینی مانند Kimi K3 اغلب قیمتهای کمتری به ازای هر توکن نسبت به مدلهای پرچمدار اوپنایآی ارائه میدهند. با این حال، آنها اغلب برای تکمیل همان وظیفه استدلالی پیچیده، به دو برابر توکن نیاز دارند که تخفیف ظاهری را خنثی میکند.[7]
وقتی بر اساس هزینه واقعی تکمیل یک کار اندازهگیری میشود، GPT-5.6 لونا اکنون تقریباً با ۶ سنت به ازای هر وظیفه کار میکند. این قیمت به طور قابل توجهی کمتر از رقبایی مانند Grok 4.5 (حدود ۵۰ سنت) و Claude Opus 5 آنتروپیک (۴۰ سنت) است، در حالی که سطح هوشمندی مشابهی را حفظ میکند.[7]
شیب قیمتگذاری بین مدلهای خود اوپنایآی اکنون برای بسیاری از وظایف روتین، تندتر از شیب تواناییها است. توسعهدهندگانی که به طور پیشفرض از مدل پرچمدار سول برای استخراج دادههای اولیه استفاده میکنند، در مقایسه با هدایت آن کار به لونا، هزینهی بسیار بیشتری میپردازند.[2]
برای رفع نیاز به سرعت در برنامههای کاربردی با ریسک بالا، اوپنایآی به جای معرفی مدلهای جدید، ردههای خدماتی جدیدی را نیز معرفی کرد. GPT-5.6 سول دارای "حالت سریع" (Fast mode) شد که تا ۲.۵ برابر سرعت پردازش استاندارد را با دو برابر هزینه استاندارد ارائه میدهد.[2][4]
یک "حالت فوق سریع" (Ultrafast mode) متعاقب آن در اواسط آگوست، این روند را فراتر برد و تا ۱۴ برابر سرعت استاندارد را برای بارهای کاری سازمانی حساس به تأخیر ارائه داد. این امر انتخاب مدل را به یک ماتریس سهبعدی تبدیل میکند: توسعهدهندگان باید مدل، رده خدماتی و سیاست بودجه را انتخاب کنند.[2]
زمینه بازار گستردهتر، نبردی شدید برای وفاداری توسعهدهندگان سازمانی است. مدلهای Claude Fable 5 و Opus 5 آنتروپیک کشش قابل توجهی برای کدنویسی و وظایف استدلالی پیچیده به دست آوردهاند و اوپنایآی را مجبور به دفاع از سهم بازار خود کردهاند.[3][6]
در همین حال، توسعهدهندگان چینی بازار را با جایگزینهای متنباز بسیار توانمند و ارزانقیمت پر کردهاند. کاهشهای شدید قیمت اوپنایآی یک مانور دفاعی مستقیم است تا از مهاجرت توسعهدهندگان با وظایف پسزمینه با حجم بالا به این پلتفرمهای ارزانتر جلوگیری کند.[3][5]
کاهش ۸۰ درصدی لونا به طور خاص اتوماسیونهای عامل پسزمینه را هدف قرار میدهد—وظایفی که در آنها هوش مصنوعی به طور نامرئی برای دستهبندی دادهها، هدایت تیکتها یا نظارت بر سیستمها عمل میکند. با ۲۰ سنت به ازای هر میلیون توکن، این جریانهای کاری در مقیاس عظیم از نظر اقتصادی مقرون به صرفه میشوند.[1]
در حالی که بازاریابی بر "مرز قیمت-عملکرد" تأکید میکند، واقعیت این است که هوش مصنوعی پیشرو سریعتر از حد انتظار در حال تبدیل شدن به کالا است. حق بیمه هوشمندی در حال کوچک شدن است و جای خود را به رقابت برای کارایی سرویسدهی داده است.[2][4]
اگر مدلها بتوانند به بهینهسازی زیرساخت سرویسدهی خود ادامه دهند، کف قیمتگذاری هوش مصنوعی ممکن است بسیار پایینتر از آن چیزی باشد که صنعت حتی یک سال پیش پیشبینی میکرد. گلوگاه دیگر صرفاً محاسبات آموزشی نیست، بلکه این است که یک ارائهدهنده با چه کارایی میتواند توکنها را از یک پردازنده گرافیکی (GPU) استخراج کند.
اصطلاحات کلیدی
- توکنهای ورودی
- بخشهایی از متن یا داده که توسط کاربر به عنوان پرامپت یا زمینه به مدل هوش مصنوعی ارائه میشود.
- توکنهای خروجی
- متن یا دادهای که توسط مدل هوش مصنوعی در پاسخ به پرامپت تولید و بازگردانده میشود.
- هستههای سرویسدهی
- روالهای نرمافزاری اصلی و بسیار بهینهسازی شده که مستقیماً روی پردازندههای گرافیکی (GPU) اجرا میشوند تا محاسبات مدل هوش مصنوعی را انجام دهند.
- هزینه به ازای هر وظیفه
- معیاری که کل هزینه تکمیل یک کار خاص را اندازهگیری میکند، با در نظر گرفتن اینکه مدل برای رسیدن به پاسخ صحیح به چند توکن نیاز دارد.
- اتوماسیون عاملمحور
- جریانهای کاری که در آنها یک مدل هوش مصنوعی به طور مستقل در پسزمینه برای نظارت بر سیستمها، هدایت دادهها یا اجرای فرآیندهای چند مرحلهای عمل میکند.
روند رویداد
۳۰ جولای ۲۰۲۶
اوپنایآی کاهش قیمت ۸۰ درصدی برای GPT-5.6 لونا و کاهش ۲۰ درصدی برای ترا را اعلام میکند.
۱۳ آگوست ۲۰۲۶
"حالت فوق سریع" (Ultrafast mode) برای GPT-5.6 سول معرفی میشود که تا ۱۴ برابر سرعت استاندارد را ارائه میدهد.
۲۱ آگوست ۲۰۲۶
اوپنایآی کاهش قیمتها را به مدل پرچمدار GPT-5.6 سول گسترش میدهد و هزینههای API را بیش از ۲۰ درصد کاهش میدهد.
منابع
[1]OpenAIپذیرندگان هوش مصنوعی سازمانیAdvancing the price-performance frontier with GPT-5.6
مطالعه در OpenAI →
[2]Developers Digestتحلیلگران صنعتOpenAI Cuts GPT-5.6 Luna by 80%: The Price-Performance Frontier Just Shifted
مطالعه در Developers Digest →
[3]LiveMintرقبای جهانیOpenAI slashes GPT-5.6 Sol API pricing by over 20% — Developers can now access it at ₹380 only
مطالعه در LiveMint →
[4]Stocktwitsپذیرندگان هوش مصنوعی سازمانیOpenAI Slashes API Prices for GPT-5.6 Lineup As Efficiency Gains Pay Off
مطالعه در Stocktwits →
[5]Times Nowرقبای جهانیAfter Pausing Advanced AI Tests, OpenAI Slashes GPT-5.6 Sol Prices By 20%
مطالعه در Times Now →
[6]NextMSCتحلیلگران صنعتOpenAI Slashes GPT-5.6 Sol Prices Amid AI Market Surge
مطالعه در NextMSC →
[7]MindStudioتحلیلگران صنعتOpenAI Cuts GPT-5.6 Luna Price by 80%
مطالعه در MindStudio →
نظرات
هر زاویه. هر روز.
دریافت فناوری اخبار همراه با پوشش کامل منابع و تحلیل دیدگاهها، مستقیم در صندوق ورودی شما.



