اخبار هوش مصنوعی

مدل هوش مصنوعی Grok 4.7 با تمرکز بر برنامه‌نویسی و امنیت معرفی شد

مدل هوش مصنوعی Grok 4.7 را با تمرکز بر برنامه‌نویسی و کارهای دانش‌محور معرفی کرد؛ مدلی با بهبود عملکرد، ابزارهای ایمنی جدید و قیمت‌گذاری رقابتی. هوش مصنوعی تک‌ناک اسپیس‌ایکس‌ای‌آی در اطلاعیه انتشار، Grok 4.7 را توانمندترین مدل خود برای برنامه‌نویسی و فعالیت‌ها…

7 دقیقه مطالعه
  • پشتیبانی شبکه
  • هوش مصنوعی
  • امنیت سایبری
  • Grok
  • درصد
  • امتیاز
  • برابر
  • اسپیس‌ایکس‌ای‌آی
مدل هوش مصنوعی Grok 4.7 با تمرکز بر برنامه‌نویسی و امنیت معرفی شد

خلاصه تحلیلی خبر

مدل هوش مصنوعی Grok 4.7 را با تمرکز بر برنامه‌نویسی و کارهای دانش‌محور معرفی کرد؛ مدلی با بهبود عملکرد، ابزارهای ایمنی جدید و قیمت‌گذاری رقابتی. هوش مصنوعی تک‌ناک اسپیس‌ایکس‌ای‌آی در اطلاعیه انتشار، Grok 4.7 را توانمندترین مدل خود برای برنامه‌نویسی و فعالیت‌ها…

موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، امنیت سایبری، Grok، درصد، امتیاز

مدل هوش مصنوعی Grok 4.7 را با تمرکز بر برنامه‌نویسی و کارهای دانش‌محور معرفی کرد؛ مدلی با بهبود عملکرد، ابزارهای ایمنی جدید و قیمت‌گذاری رقابتی.

هوش مصنوعیتک‌ناکاسپیس‌ایکس‌ای‌آی در اطلاعیه انتشار، Grok 4.7 را توانمندترین مدل خود برای برنامه‌نویسی و فعالیت‌های دانش‌محور معرفی کرده است.

به‌گفته این شرکت، مدل جدید می‌تواند مدت بیشتری روی وظایف دشوار کار کند و با دقت بیشتری نتایج کار خود را بررسی کند.

این شرکت همچنین می‌گوید Grok 4.7 از دقیق‌ترین سازوکارهای حفاظتی تنظیم‌شده در میان مدل‌هایش بهره می‌برد، با همان قیمت و سرعت Grok 4.6 ارائه می‌شود و در مقایسه با مدل‌های مشابه، دو برابر سریع‌تر و نصف قیمت است.

مدل پایه بزرگ‌تر و آموزش طولانی‌تر

طبق اعلام اسپیس‌ایکس‌ای‌آی، Grok 4.7 از مدل پایه‌ای جدید و بزرگ‌تر از Grok 4.6 استفاده می‌کند.

این مدل همچنین با فرایند یادگیری تقویتی طولانی‌تری آموزش دیده است که مجموعه‌ای دشوارتر از وظایف را شامل می‌شود.

در این فرایند، وزن بیشتری به مسائلی داده شده که حل آن‌ها ساعت‌ها زمان می‌برد.

اسپیس‌ایکس‌ای‌آی می‌گوید مدل جدید در بررسی کارهای خودش و مدیریت زمینه‌های طولانی عملکرد بهتری دارد.

این شرکت همچنین اعلام کرده است که Grok 4.7 را به‌گونه‌ای آموزش داده تا چارچوب Grok Bot را به‌صورت بومی درک کند.

به‌گفته اسپیس‌ایکس‌ای‌آی، این قابلیت عملکرد مدل را در وظایف مکالمه‌ای و فعالیت‌های عمومی دانش‌محور بهبود می‌دهد.

اسپیس‌ایکس‌ای‌آی در ۱۱ اوت ۲۰۲۶، Grok Bot را معرفی کرد و آن را مجموعه‌ای از عامل‌های هوش مصنوعی همیشه‌فعال توصیف کرد که کامپیوتر اختصاصی خود را دارند، در ابزارها و اپلیکیشن‌ها کار می‌کنند و به‌صورت شبانه‌روزی به فعالیت ادامه می‌دهند.

این شرکت همچنین می‌گوید Grok 4.7 در تولید اسناد و ارائه‌های تصویری عملکرد بهتری دارد.

Grok 4.7 جایگزین Grok 4.6 شده است که اسپیس‌ایکس‌ای‌آی در ۱۲ اوت ۲۰۲۶ معرفی کرد. شرکت در آن زمان اعلام کرده بود که Grok 4.6 بر پایه Grok 4.5 ساخته شده و تمرکز ویژه‌ای بر عامل‌های طولانی‌مدت و فعالیت‌های تعاملی و بصری پیچیده‌تر دارد.

طبق فهرست‌های تاریخ‌دار آرشیو اخبار شرکت، اسپیس‌ایکس‌ای‌آی در ادامه ماه اوت ۲۰۲۶، دسترسی به Grok 4.6 را به GitHub Copilot، Amazon Bedrock، Gemini Enterprise Agent Platform و Microsoft Foundry نیز گسترش داد.

بیشتر بخوانیدگروک ۴.۵ با قابلیت کدنویسی و پژوهش سریع عرضه شد

امتیازهای اعلام‌شده در بنچمارک‌ها

تصویری از لوگوی Grok داخل گوشی

اسپیس‌ایکس‌ای‌آی جدولی از نتایج بنچمارک‌ها و قیمت‌گذاری منتشر کرده است که در آن Grok 4.7 با Grok 4.6، GPT-5.6 Sol و Fable 5.1 مقایسه می‌شود.

در این جدول، سطح تلاش Grok 4.7 برابر با xhigh، سطح تلاش Grok 4.6 برابر با high و سطح تلاش GPT-5.6 Sol و Fable 5.1 برابر با max اعلام شده است.

در بنچمارک CursorBench 4.0 که به‌گفته اسپیس‌ایکس‌ای‌آی وظایف برنامه‌نویسی طولانی‌مدت را ارزیابی می‌کند، Grok 4.7 امتیاز ۴۶٫۳ درصد را به دست آورده است.

امتیاز Grok 4.6 در این آزمون ۴۰٫۴ درصد، GPT-5.6 Sol برابر با ۴۱٫۷ درصد و Fable 5.1 برابر با ۵۱٫۸ درصد اعلام شده است.

اسپیس‌ایکس‌ای‌آی می‌گوید Grok 4.7 در این بنچمارک از نظر نسبت عملکرد به قیمت، در میان مدل‌های پیشرو قرار دارد.

در ارزیابی DeepSWE v1.1 که مهندسی نرم‌افزار را می‌سنجد، اسپیس‌ایکس‌ای‌آی برای Grok 4.7 در سطح تلاش high امتیاز ۷۱ درصد را گزارش کرده است.

این رقم در مقایسه با امتیاز ۶۵٫۲ درصدی Grok 4.6، امتیاز ۷۲٫۷ درصدی GPT-5.6 Sol و امتیاز ۷۰ درصدی Fable 5.1 قرار می‌گیرد.

در بنچمارک Terminal-Bench 4.0 که وظایف چندساعته مبتنی بر ترمینال را بررسی می‌کند، امتیازهای اعلام‌شده به‌ترتیب عبارت‌اند از: ۳۸ درصد برای Grok 4.7، معادل ۲۰٫۳ درصد برای Grok 4.6، برابر با ۳۷٫۳ درصد برای GPT-5.6 Sol و ۵۷٫۹ درصد برای Fable 5.1.

در آزمون AA Briefcase v1.1 که عملکرد مدل‌ها را در فعالیت‌های اداری چندساعته می‌سنجد، Grok 4.7 امتیاز ۱٬۶۵۷ را ثبت کرده است.

امتیاز Grok 4.6 برابر با ۱٬۵۴۶، GPT-5.6 Sol برابر با ۱٬۴۸۷ و Fable 5.1 برابر با ۱٬۶۷۸ گزارش شده است.

اسپیس‌ایکس‌ای‌آی در بنچمارک Harvey Legal Agent Benchmark نیز امتیاز ۱۹٫۶ درصد را برای Grok 4.7 اعلام کرده است.

این رقم در مقایسه با ۱۵٫۸ درصد برای Grok 4.6، معادل ۲٫۵ درصد برای GPT-5.6 Sol و ۶٫۷ درصد برای Fable 5.1 قرار دارد.

در ارزیابی HealthBench Professional که استدلال بالینی را می‌سنجد، Grok 4.7 امتیاز ۵۶٫۷ درصد را به دست آورده است. امتیازهای Grok 4.6، GPT-5.6 Sol و Fable 5.1 در این آزمون به‌ترتیب ۴۸٫۵، ۶۰٫۵ و ۶۲٫۱ درصد اعلام شده‌اند.

در بنچمارک EEBench که حوزه مهندسی برق را پوشش می‌دهد، اسپیس‌ایکس‌ای‌آی برای Grok 4.7 امتیاز ۶۴ درصد را گزارش کرده است. امتیاز Grok 4.6 برابر با ۵۳ درصد، GPT-5.6 Sol برابر با ۳۹٫۴ درصد و Fable 5.1 برابر با ۵۶٫۴ درصد بوده است.

نمودار جداگانه GDPval نیز امتیازهای Elo مدل‌ها را نشان می‌دهد. در این نمودار، Fable 5.1 با سطح تلاش max امتیاز ۱٬۷۳۵، Grok 4.7 امتیاز ۱٬۶۹۵، Grok 4.6 امتیاز ۱٬۶۰۵ و GPT-6 Astra با سطح تلاش max امتیاز ۱٬۵۴۲ را ثبت کرده‌اند.

اسپیس‌ایکس‌ای‌آی می‌گوید GDPval و AA Briefcase مدل‌های هوش مصنوعی را با وظایفی ارزیابی می‌کنند که متخصصانی مانند وکلا، پرستاران و تحلیلگران مالی انجام می‌دهند. به‌گفته این شرکت، Grok 4.7 در هر دو بنچمارک نسبت به Grok 4.6 پیشرفت کرده و عملکردی قابل‌مقایسه با دیگر مدل‌های پیشرو دارد.

جدول قیمت‌گذاری نیز نشان می‌دهد هزینه هر یک میلیون توکن ورودی و خروجی برای Grok 4.7 و Grok 4.6 به‌ترتیب ۲ و ۶ دلار است. این هزینه برای GPT-5.6 Sol به‌ترتیب ۴ و ۲۰ دلار و برای Fable 5.1 برابر با ۱۰ و ۵۰ دلار اعلام شده است.

بیشتر بخوانیدGrok با داده‌های استارتاپ‌های ورشکسته آموزش می‌بیند

سازوکارهای حفاظتی و امنیت سایبری

اسپیس‌ایکس‌ای‌آی می‌گوید Grok 4.7 با مجموعه‌ای کاملاً جدید از سازوکارهای حفاظتی ساخته شده و در آزمایش‌های این شرکت، قدرتمندترین مدل از نظر رد درخواست‌های نامناسب و مقاومت در برابر دور زدن محدودیت‌هاست.

این شرکت می‌گوید Grok 4.7 در حوزه‌های دومنظوره، مانند امنیت سایبری و زیست‌شناسی، هم در انجام وظایف بی‌خطر و هم در رد درخواست‌های خطرناک عملکرد خوبی دارد.

به‌گفته اسپیس‌ایکس‌ای‌آی، این مدل در بنچمارک ایمنی زیستی LatchBio با امتیاز ۶۲٫۴ درصد در جایگاه نخست قرار گرفته است.

در HackerBench v0.3 که اسپیس‌ایکس‌ای‌آی آن را بنچمارک اختصاصی خود برای ارزیابی وظایف سایبری پرخطر و مخرب توصیف می‌کند، این شرکت می‌گوید Grok 4.7 تنها به ۳٫۳ درصد از درخواست‌های دومنظوره پرخطر اجازه عبور داده است. در عین حال، مدل به‌ندرت فعالیت‌های امنیتی قانونی را مسدود می‌کند.

اسپیس‌ایکس‌ای‌آی همچنین اعلام کرده است که دسترسی دعوت‌محور و محدود به قابلیت‌های تیم قرمز Grok 4.7 را برای برخی شرکای امنیت سایبری آغاز کرده است.

هدف از این دسترسی، انجام پژوهش‌های دفاعی عنوان شده است.

LatchBio پیش‌تر Grok 4.6 را در زمینه پایش امنیت زیستی و وظایف زیستی خصمانه ارزیابی کرده بود.

طبق مطلبی که در ۱ سپتامبر ۲۰۲۶ در آرشیو اخبار این شرکت منتشر شد، مدل قبلی در شناسایی و رد درخواست‌های خطرناک، عملکرد قابل‌اتکاتری از دیگر سامانه‌های پیشرو داشت.

قیمت و زمان دسترسی

Grok 4.7 از ۲۱ سپتامبر ۲۰۲۶ در دسترس قرار گرفته است. کاربران می‌توانند از طریق Cursor، عامل برنامه‌نویسی Grok Build، رابط برنامه‌نویسی کاربردی Grok API، چارچوب‌های برنامه‌نویسی شخص ثالث، مسیریاب‌های مدل و پلتفرم‌های ابری به این مدل دسترسی پیدا کنند.

اسپیس‌ایکس‌ای‌آی در کنار نسخه استاندارد، نسخه سریع Grok 4.7 را نیز ارائه می‌دهد که سرعت تولید خروجی آن دو برابر است، اما قیمت آن نیز دو برابر نسخه معمولی خواهد بود.

این شرکت همچنین امکان استفاده رایگان از Grok 4.7 را در محیط Grok Build فراهم کرده است.

نوشتهمدل هوش مصنوعی Grok 4.7 با تمرکز بر برنامه‌نویسی و امنیت معرفی شداولین بار درTechnoc. پدیدار شد.

برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.