کاهش هزینه API مدل‌های o3 و o4-mini با پردازش فلکستکنولوژی 

با «پردازش فلکس» هزینه API مدل‌های o3 و o4-mini را نصف کرد

OpenAI گزینه‌ی جدید پردازش فلکس (Flex Processing) را برای API مدل‌های استدلالی o3 و o4-mini منتشر کرد. این حالتِ بتا، هزینه توکن‌ها را دقیقاً به نصف می‌رساند؛ برای o3 قیمت هر میلیون توکن ورودی ۵ دلار و خروجی ۲۰ دلار و برای o4-mini به‌ترتیب ۰.۵۵ و ۲.۲۰ دلار می‌شود.

محدودیت‌ها و کاربرد

پردازش فلکس سرعت پاسخ‌دهی پایین‌تر و در دسترس نبودن موقت منابع دارد، بنابراین برای کارهای کم‌برتر یا غیرتولیدی نظیر تست مدل، غنی‌سازی داده و پردازش ناهمگام مناسب است.

شرط احراز هویت برای o3

کاربران سطوح ۱ تا ۳ برای دسترسی به o3 باید احراز هویت جدید OpenAI را تکمیل کنند؛ این مرحله برای پیشگیری از سوءاستفاده الزامی شده است.

رونمایی از این گزینه در پی تشدید رقابت با گوگل (مانند مدل Gemini 2.5 Flash) و بالا رفتن هزینه‌های استنتاج پیشرفته اتفاق افتاده است.

پست های مرتبط