شرکت SpaceXAI از مدل هوش مصنوعی جدید خود با نام Grok 4.6 رونمایی کرد؛ مدلی که با تمرکز بر اجرای وظایف طولانیمدت، ساخت ایجنتهای هوشمند، برنامهنویسی، تحقیق و کارهای تعاملی و بصری توسعه یافته است. Grok 4.6 در شاخص هوشمندی Artificial Analysis امتیاز ۶۱ را به دست آورده و در مقایسه با GPT-5.6 Sol در بالاترین سطح استدلال، عملکردی رقابتی نشان داده است. قیمت این مدل ۲ دلار برای هر یک میلیون توکن ورودی و ۶ دلار برای هر یک میلیون توکن خروجی تعیین شده است.
به گزارش آی سی تی نیوز، SpaceXAI در ۱۲ آگوست ۲۰۲۶ از Grok 4.6 بهعنوان نسل جدید مدلهای زبانی خود رونمایی کرد. این مدل بیش از آنکه صرفاً برای پاسخگویی به پرسشهای متنی طراحی شده باشد، با هدف اجرای پروژههای چندمرحلهای و طولانیمدت توسعه یافته است؛ بهگونهای که میتواند یک مسئله را در چندین مرحله دنبال کند، در حوزههای ناآشنا تحقیق کند، در کدبیسهای بزرگ فعالیت داشته باشد و یک ایده اولیه را به یک محصول یا اپلیکیشن قابل استفاده تبدیل کند.
تمرکز Grok 4.6 بر ایجنتهای هوش مصنوعی
یکی از مهمترین تفاوتهای Grok 4.6 با نسلهای قبلی، تمرکز ویژه بر وظایف طولانیمدت و ایجنتمحور است. SpaceXAI این مدل را برای پروژههایی طراحی کرده است که نیازمند تعامل مستمر، برنامهریزی چندمرحلهای، تحقیق، اجرای کد و اصلاح خروجی در طول فرایند هستند.
این رویکرد باعث میشود Grok 4.6 بیشتر به یک موتور اجرای پروژههای پیچیده شباهت داشته باشد تا یک چتبات معمولی. این مدل میتواند در یک فرایند چندمرحلهای اطلاعات موردنیاز را جمعآوری کند، روی یک کدبیس کار کند و در نهایت خروجی نهایی را تولید و اصلاح کند.
عملکرد Grok 4.6 در بنچمارکها
Grok 4.6 در شاخص هوشمندی Artificial Analysis امتیاز ۶۱ را به دست آورده است. این شاخص از ترکیب چندین ارزیابی مختلف برای سنجش توانایی مدلها در حوزههایی مانند استدلال، برنامهنویسی، دانش تخصصی و انجام وظایف واقعی تشکیل شده است.
این امتیاز Grok 4.6 را در جمع مدلهای پیشرو قرار میدهد. در مقایسه مستقیم Artificial Analysis، Grok 4.6 با تنظیم High امتیاز ۶۱ گرفته، در حالی که GPT-5.6 Sol با تنظیم xhigh امتیاز ۵۹ دارد. بنابراین ادعای دقیقتر این است که Grok 4.6 در این شاخص از GPT-5.6 Sol در پیکربندی xhigh امتیاز بالاتری گرفته است، نه اینکه صرفاً با آن برابر باشد.
در عین حال، این نتیجه به معنای برتری مطلق Grok 4.6 در تمام کاربردها نیست؛ زیرا عملکرد مدلهای هوش مصنوعی به نوع بنچمارک، میزان استدلال فعال، تنظیمات مدل و نوع وظیفه بستگی دارد.
قیمت Grok 4.6؛ رقابت جدی با مدلهای گرانقیمت
SpaceXAI قیمت Grok 4.6 را برای استفاده از API، ۲ دلار به ازای هر یک میلیون توکن ورودی و ۶ دلار به ازای هر یک میلیون توکن خروجی تعیین کرده است.
این قیمتگذاری یکی از مهمترین نقاط قوت تجاری مدل محسوب میشود؛ زیرا Grok 4.6 در حالی در رده مدلهای پیشرفته Artificial Analysis قرار گرفته که هزینه استفاده از آن پایینتر از بسیاری از مدلهای رقیب است. Artificial Analysis نیز این موضوع را یکی از ویژگیهای مهم Grok 4.6 در مقایسه با مدلهای پیشرو ارزیابی کرده است.
به این ترتیب، توسعهدهندگانی که به مدلهای قدرتمند برای اجرای ایجنتها و پروژههای چندمرحلهای نیاز دارند، میتوانند با هزینه پایینتری به Grok 4.6 دسترسی داشته باشند.
دسترسی به Grok 4.6
Grok 4.6 از زمان عرضه در اختیار کاربران و توسعهدهندگان قرار گرفته و از طریق API و سرویسهایی مانند Grok Build و Cursor قابل استفاده است. این مدل همچنین در پلتفرمهای ارائهدهنده مدلهای هوش مصنوعی مانند OpenRouter در دسترس قرار گرفته است.
این گستردگی دسترسی باعث میشود توسعهدهندگان بتوانند Grok 4.6 را مستقیماً در محیطهای برنامهنویسی یا پروژههای مبتنی بر API آزمایش و استفاده کنند.
بهبود فرایند آموزش و عملکرد ایجنتی
SpaceXAI در معرفی Grok 4.6 تأکید کرده است که این مدل در مقایسه با Grok 4.5 برای کارهای طولانیمدت و پیچیده بهینه شده است. تمرکز اصلی در این مرحله روی توانایی مدل برای حفظ روند کار، تعامل با محیط و تکمیل پروژههای چندمرحلهای قرار گرفته است.
دادههای Artificial Analysis نیز نشان میدهد Grok 4.6 نسبت به نسل قبلی خود پیشرفت محسوسی در ارزیابی کلی داشته است و در برخی آزمونهای مرتبط با کارهای دانشمحور و ایجنتی عملکرد قابلتوجهی ثبت کرده است.
Grok 4.6 در برابر GPT-5.6 Sol
مقایسه Grok 4.6 با GPT-5.6 Sol یکی از مهمترین جنبههای عرضه این مدل است. Artificial Analysis برای Grok 4.6 امتیاز ۶۱ و برای GPT-5.6 Sol در تنظیم xhigh امتیاز ۵۹ ثبت کرده است.
با این حال، نباید این اختلاف دو امتیازی را بهعنوان برتری قطعی Grok 4.6 در همه زمینهها تفسیر کرد. مدلهای هوش مصنوعی ممکن است در آزمونهای مختلف نتایج متفاوتی داشته باشند و امتیاز یک شاخص ترکیبی نمیتواند جایگزین ارزیابی مستقل در برنامهنویسی، تولید محتوا، استدلال، تحقیق یا استفاده روزمره شود.
تحلیل ICTNews
عرضه Grok 4.6 نشان میدهد رقابت مدلهای هوش مصنوعی در سال ۲۰۲۶ تنها بر سر افزایش توانایی مدلها نیست و هزینه استفاده و توانایی اجرای وظایف خودکار نیز به همان اندازه اهمیت پیدا کرده است.
Grok 4.6 با امتیاز ۶۱ در شاخص Artificial Analysis و قیمت ۲ دلار برای ورودی و ۶ دلار برای خروجی، ترکیبی قابلتوجه از عملکرد و هزینه ارائه میکند. تمرکز این مدل بر ایجنتهای طولانیمدت نیز نشان میدهد مسیر رقابت از چتباتهایی که صرفاً پاسخ تولید میکنند، به سمت سیستمهایی حرکت کرده است که میتوانند یک پروژه را از مرحله تحقیق تا اجرا و اصلاح دنبال کنند.
با این حال، برتری Grok 4.6 را نباید صرفاً بر اساس یک شاخص هوش مصنوعی قطعی دانست. عملکرد واقعی مدل در پروژههای پیچیده، کیفیت ابزارهای جانبی، پایداری API و تجربه توسعهدهندگان در استفاده طولانیمدت مشخص خواهد کرد که آیا SpaceXAI میتواند جایگاه خود را در میان مدلهای پیشرو تثبیت کند یا خیر.