به گزارش گروه آنلاین روزنامه دنیای اقتصاد: گروک ۴.۷ با تمرکز بر برنامهنویسی و کارهای تخصصی، مدعی است با همان قیمت و سرعت نسخه قبلی، عملکرد بهتری ارائه میدهد؛ اما ادعای «دو برابر سرعت و نصف قیمت» دقیقا به چه معناست؟
به نوشته مجله اپل، شرکت xAI در ۲۱ سپتامبر از مدل هوش مصنوعی Grok ۴.۷ رونمایی کرد؛ مدلی که برای برنامهنویسی و انجام وظایف حرفهای طراحی شده و به گفته سازندگانش، میتواند مدت بیشتری روی کارهای دشوار تمرکز کند، خروجیهایش را دقیقتر بررسی کند و در مقایسه با نسخه ۴.۶ عملکرد بهتری داشته باشد.
نکته مهم این است که ادعای دو برابر سرعت و نصف قیمت، به مقایسه با مدلهای رقیب مربوط میشود، نه به کاهش قیمت یا افزایش سرعت نسبت به نسخه قبلی گروک.
قیمت گروک ۴.۷ چقدر است؟
قیمت استاندارد گروک 4.7 برای هر یکمیلیون توکن ورودی ۲ دلار و برای هر یکمیلیون توکن خروجی ۶ دلار تعیین شده است. توکنها واحدهایی هستند که حجم دادههای ورودی و خروجی مدل را اندازهگیری میکنند.
xAI همچنین نسخه Grok 4.7 Fast را ارائه کرده که روی زیرساخت سریعتری اجرا میشود و هزینه آن دو برابر نرخ استاندارد است. این نسخه در ابزارهای Cursor و Grok Build در دسترس است و از طریق رابط برنامهنویسی عمومی xAI ارائه نمیشود. با این حال، قیمت هر توکن بهتنهایی نشان نمیدهد که انجام یک وظیفه کامل چقدر هزینه دارد. کارهای پیچیده ممکن است به چندین مرحله پردازش، استدلال، استفاده از ابزارها و اصلاح خروجی نیاز داشته باشند. در نتیجه، حتی با ثابت ماندن قیمت توکنها، هزینه نهایی میتواند افزایش یابد.
تمرکز گروک ۴.۷ بر کارهای چندساعته
xAI میگوید گروک 4.7 با استفاده از یک مدل پایه بزرگتر و فرآیند طولانیتر یادگیری تقویتی آموزش دیده است؛ فرایندی که تمرکز بیشتری بر وظایف دشواری دارد که ممکن است ساعتها طول بکشند.
نتایج منتشرشده این شرکت از بهبود عملکرد در مقایسه با نسخه قبلی حکایت دارد. امتیاز گروک 4.7 در آزمون CursorBench 4.0 از 40.4درصد به 46.3درصد رسیده و در آزمون Terminal-Bench 4.0 نیز از 20.3درصد به ۳۸درصد افزایش یافته است.
این ارقام بر اساس ارزیابیهای منتشرشده از سوی شرکت به دست آمدهاند و لزوما نشان نمیدهند که مدل در تمام کاربردهای واقعی همین میزان پیشرفت را تجربه خواهد کرد.
در وظایف طولانی، صرفا ارائه یک پاسخ اولیه قانعکننده کافی نیست. یک پروژه برنامهنویسی ممکن است به شناسایی خطا، تغییر چند فایل، اجرای آزمایشها و اصلاح راهحل پس از شکست نیاز داشته باشد. در کارهای اسنادی نیز ممکن است مدل مجبور شود اطلاعات متناقض را بررسی و با یکدیگر تطبیق دهد. در چنین شرایطی، پشتکار همراه با دقت اهمیت دارد؛ زیرا ادامهدادن زمانی ارزشمند است که به نتیجهای درست و قابل استفاده منجر شود.
پنجره زمینه ۵۰۰هزارتوکنی و چهار سطح استدلال
بر اساس مستندات رسمی، گروک 4.7 از پنجره زمینه ۵۰۰هزارتوکنی پشتیبانی میکند و میتواند ورودیهای متنی و تصویری را دریافت کند، اما خروجی آن متنی است. این مدل چهار سطح استدلال دارد: پایین، متوسط، بالا و بسیار بالا (xhigh).
پنجره زمینه بزرگ به مدل اجازه میدهد حجم زیادی از اطلاعات و تاریخچه تعامل را در اختیار داشته باشد؛ اما به معنای آن نیست که تمام جزئیات را به یک اندازه در نظر میگیرد یا میتواند همه تناقضها را بهدرستی حل کند. سطح استدلال نیز باید متناسب با پیچیدگی کار انتخاب شود. یک درخواست ساده لزوما به همان میزان پردازش نیاز ندارد که یک تحقیق پیچیده با چندین مرحله نامطمئن به آن نیاز دارد.
سرعت بیشتر گروک Fast به معنای اتمام سریعتر پروژه نیست
xAI میگوید نسخه Fast سرعت تولید خروجی را دو برابر میکند. با این حال، این ادعا به سرعت تولید توکنها مربوط است و تضمینی برای اتمام یک پروژه کامل در نصف زمان محسوب نمیشود.
برای مثال، اگر یک وظیفه شامل جستوجوی اطلاعات، اجرای آزمایشهای نرمافزاری و تهیه گزارش باشد، تولید سریعتر متن فقط بخشی از فرآیند را کوتاه میکند. جستوجو و اجرای آزمایشها همچنان زمانبر خواهند بود. بنابراین، معیار واقعی برای ارزیابی نسخه سریع باید مدتزمان سپریشده از آغاز درخواست تا دریافت نتیجه قابل قبول باشد؛ نه صرفا سرعت تولید پاسخ.
تخفیف ۴۰ رصدی گروک ۴.۷ در Vercel
شرکت Vercel نیز گروک 4.7 را از طریق سرویس AI Gateway ارائه کرده و تخفیف تبلیغاتی ۴۰درصدی را تا ۲۷سپتامبر در نظر گرفته بود. این تخفیف بهصورت خودکار برای درخواستهایی اعمال میشد که از شناسه مدل گروک 4.7 استفاده میکنند.
این پیشنهاد فقط هزینه دسترسی به مدل از طریق Vercel را در دوره تخفیف تغییر میداد و تاثیری بر نرخهای استاندارد اعلامشده از سوی xAI نداشت. بنابراین، تیمهایی که در این دوره مدل را آزمایش میکردند، باید هزینه استفاده پس از پایان تخفیف را نیز در نظر میگرفتند. Vercel همچنین اعلام کرده است که یکپارچهسازی این مدل از قابلیت نگهداری صفر داده (Zero Data Retention) و تنظیماتی برای جلوگیری از استفاده از ورودیها در آموزش مدل پشتیبانی میکند. هزینهها نیز در کنار سایر مدلها در گزارشهای مصرف و بودجهبندی این سرویس قابل مشاهده است.