ابزارهای هوش مصنوعی

Argon؛ نسل چهارم خانواده مدل‌های Gemini گوگل

گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است. این مدل به‌گونه‌ای معماری شده که بتواند در جریان‌های کاری طولانی‌مدت و چندمرحله‌ای فرایند استدلال عمیق را حفظ کند. آرگون به طور ویژه عملکردی پیشرو در حوزه‌های مهندسی نرم‌افزار، دانش…

7 دقیقه مطالعه
  • پشتیبانی شبکه
  • هوش مصنوعی
  • امنیت سایبری
  • مدل
  • آرگون
  • سایبری
  • گوگل
  • ارزیابی
Argon؛ نسل چهارم خانواده مدل‌های Gemini گوگل

خلاصه تحلیلی خبر

گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است. این مدل به‌گونه‌ای معماری شده که بتواند در جریان‌های کاری طولانی‌مدت و چندمرحله‌ای فرایند استدلال عمیق را حفظ کند. آرگون به طور ویژه عملکردی پیشرو در حوزه‌های مهندسی نرم‌افزار، دانش…

موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، امنیت سایبری، مدل، آرگون، سایبری

گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است. این مدل به‌گونه‌ای معماری شده که بتواند در جریان‌های کاری طولانی‌مدت و چندمرحله‌ای فرایند استدلال عمیق را حفظ کند. آرگون به طور ویژه عملکردی پیشرو در حوزه‌های مهندسی نرم‌افزار، دانش سازمانی (نظیر حقوق، مالی و مالیات) و پدافند امنیت سایبری ارائه می‌دهد. در حال حاضر، این مدل از طریق Fairwind Program در اختیار گروهی از مدافعان معتمد سایبری قرار گرفته است.

به دلیل حساسیت و سطح بالای قابلیت‌های مرزی این مدل، عرضه آن به‌صورت فازبندی‌شده انجام می‌‌پذیرد. گوگل رسماً اعلام کرده است که در راستای چارچوب‌های ارزیابی امنیتی، در فرایند داوطلبانه دولت ایالات متحده برای اعطای دسترسی پیش از انتشار مشارکت دارد و پس از ارزیابی بازخوردهای تسترهای اولیه و بهبود سازوکارهای امنیتی، این مدل را در دسترس توسعه‌دهندگان، سازمان‌ها و عموم کاربران قرار خواهد داد. مدل جدید با قیمت اولیه ۲ دلار به‌ازای هر یک میلیون توکن ورودی و ۱۰ دلار به‌ازای هر یک میلیون توکن خروجی عرضه می‌شود؛ ضمن این‌که توکن‌های کش‌شده (Cached tokens) با ۹۵ درصد تخفیف محاسبه خواهند شد.

تحول در جریان‌های کاری درون‌سازمانی گوگل

به ادعای گوگل، هزاران مهندس و پژوهشگر در داخل گوگل پیش‌ازاین به‌‌کارگیری Gemini 4 Argon را در فعالیت‌های روزمره خود آغاز کرده‌اند و دستاوردهای چشمگیری در بهره‌وری مهندسی و تحقیقات علمی به ثبت رسانده‌اند

  • بهینه‌سازی الگوریتم‌های کوانتومیآرگون به محققان محاسبات کوانتومی گوگل کمک می‌کند تا منابع فضا-زمان (حاصل‌ضرب کیوبیت در گیت یا qubits × gates ) را در ریزمسیرهایی که به گلوگاه برنامه‌ها تبدیل شده‌اند بهینه‌سازی کنند. این مدل توانسته است یکی از خطوط مبنای منتشرشده را ظرف چند دقیقه تا ۴۰ درصد بهبود بخشد.
  • بهره‌وری و آزادسازی حافظه سرورهاتیمی از عامل‌های آرگون با پایش خودکار داده‌های سنجش تله‌متری پروفایلینگ در کل مجموعه عامل‌ها، نقاط اتلاف حافظه در مراکز داده گوگل را شناسایی و بهینه‌سازی کردند. این اقدام پس از استقرار، بیش از ۳۰۰ ترابایت حافظه آزاد کرد و برآورد می‌شود صرفه‌جویی نهایی آن به ۵۰۰ ترابایت تا ۱ پتابایت برسد.
  • مهاجرت و بازنویسی کدبیس‌های عظیم به زبانRustعامل‌های این مدل در پروژه‌های مهاجرت کدهای C و ++C به زبان Rust مشارکت دارند. این پروژه‌ها مجموعه‌ای از ده‌ها هزار خط در کتابخانه‌های هسته مانند re2 و libgav1 تا بیش از ۸۰۰ هزار خط کد در هسته Zircon سیستم‌عامل Fuchsia را در بر می‌گیرد. باتوجه‌به حساسیت این سیستم‌ها، تمامی کدها پیش از استقرار تحت ممیزی‌های دستی و خودکار دقیق، شبیه‌سازی و بازبینی قرار می‌گیرند.
گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است.

افزایش طول پنجره خروجی به ۱ میلیون توکن

برای میزبانی و پشتیبانی از استدلال‌های طولانی و حل مسائل مرکب، سقف توکن خروجی مدل به میزان قابل‌توجهی افزایش‌یافته و از ۶۴ هزار توکن در نسل‌های قبلی، به ۱ میلیون توکن خروجی رسیده است. این فضای محاسباتی گسترده به مدل اجازه می‌دهد تا صدها هزار توکن را در قالب یک مسیر پیوسته تولید کند و مسائل پیچیده مهندسی و تحلیلی را یکپارچه و در یک گام حل کند.

ارزیابی‌ها در مهندسی نرم‌افزار و تسک‌های سازمانی

قابلیت‌های چندوجهی، کدنویسی و تحلیل داده‌های تصویری آرگون باعث شده تا در معیارهای استاندارد صنعتی رکوردهای جدیدی ثبت کند

  • بنچمارک مهندسی نرم‌افزارDeepSWE v1.1این بنچمارک وظایف پیچیده و طولانی‌مدت توسعه نرم‌افزار در دنیای واقعی را می‌سنجد؛ جمنای ۴ آرگون با ثبت امتیاز ۷۷.۹ درصد رکورد ۳ مدل پیشرفته و مرزی GPT-6 Astra، Claude Fable 5.1 و Claude Opos 5.5 را شکست.
  • شاخص ارزیابی اقتصادیVals Indexاین شاخص تأثیر اقتصادی هوش مصنوعی را در امور مالی، حقوقی، کدنویسی و مالیات با درنظرگرفتن سهم هر بخش در تولید ناخالص داخلی آمریکا ارزیابی می‌کند که آرگون در صدر آن ایستاده است. این مدل همچنین در بنچمارک‌های تخصصی Vals Finance Agent v2 (پژوهش‌های مالی چندمرحله‌ای) و Harvey’s Legal Agent Benchmark (تحقیقات حقوقی و پیش‌نویس اسناد قانونی) نتایج برتر را کسب کرده است.
  • اتوماسیون سازمانی (AutomationBench)در این ارزیابی شرکت Zapier که اجرای زنجیره‌ای فرایندها در سازوکارها و فرایندهای سازمانی را می‌سنجد، آرگون با کسب امتیاز ۵۱.۳ درصد در جایگاه نخست قرار دارد.
  • درک ویدئوهای طولانی (LVBench): آرگون در تحلیل اسناد متوالی، نمودارهای تخصصی و تحلیل ویدئوهای بلند، به بالاترین امتیاز ثبت‌شده؛ یعنی ۹۱.۷ درصد در بنچمارک LVBench دست یافته است.
گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است.
گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است.
گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است.
گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است.
گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است.

پدافند سایبری و کشف آسیب‌پذیری‌ها

یکی از ارکان کلیدی در آموزش جمنای ۴ آرگون، تخصص در حوزه پدافند سایبری است. این مدل می‌تواند آسیب‌پذیری‌های بحرانی نرم‌افزاری را به‌صورت خودکار کشف، اعتبارسنجی و وصله (Patch) کند. گوگل اعلام کرده که به‌‌منظور بهره‌برداری تام از این پتانسیل، نسخه ویژه مدافعان سایبری معتمد و تیم‌های داخلی را بدون سازوکارهای امنیتی محدودکننده سایبری عرضه خواهد کرد.

Claude Opus 5.5؛ جدیدترین عضو آنتروپیک با تمرکز بر عملکرد، بهره‌وری و ایمنی

Claude Sonnet 5.5؛ سریع‌تر، ارزان‌تر و قوی‌تر

بازگشت آنتروپیک به صدر با Fable 5.1 و Mythos 5.1

در بنچمارک CWE-bench v1 (ارزیابی توانایی اصلاح و ترمیم آسیب‌پذیری‌ها)، آرگون با کسب امتیاز برتر ۶۸ درصد مشترکاً با Astra در رتبه نخست ایستاد. همچنین نسبت به مدل 3.8 Flash Cyber جهش‌های فنی زیر را ثبت کرد

  • در بنچمارک جامع داخلی گوگل، طیف وسیعی از باگ‌ها را در کدبیس‌های مبتنی بر ۲۰ زبان برنامه‌نویسی آشکار ساخت.
  • در آزمون نفوذ جعبه‌سیاه (Black-box Penetration Testing) شرکت Wiz، در بررسی سیستم‌های تحت وبِ زنده بدون دسترسی به سورس‌کد، توانایی بالاتری در شناسایی سطح حمله، یافتن آسیب‌پذیری‌ها و تولید شواهد اثبات مفهوم (PoC) نشان داد.
گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است.

تدابیر و پروتکل‌های ایمنی پیشرفته

گوگل فرایند پیش از عرضه عمومی را به تثبیت سازوکارهای امنیتی ذیل چارچوب «Frontier Safety Framework» اختصاص داده است

  • مقابله با سوءاستفاده‌های مخرب (Misuse)مدل طوری تنظیم شده تا از مشارکت در حملات سایبری یا تسلیحات شیمیایی، بیولوژیکی، رادیولوژیکی و هسته‌ای (CBRN) امتناع ورزد، درحالی‌که ماهیت دوگانه تحقیقات مشروع علمی را حفظ می‌کند. تیم‌ها با پایش اکتیویشن‌های داخلی مدل (Internal Activations) تلاش برای دورزدن محدودیت‌ها را رصد می‌کنند.
  • مقاومت در برابر حملات تزریق پرامپت غیرمستقیم (Indirect Prompt Injection)آرگون با بهره‌گیری از آزمون‌های تیم قرمز خودکار و آموزش‌های خصمانه و مقابله‌ای، رتبه برتر پایداری را در بنچمارک IPI از Gray Swan به دست آورده است.
  • نظارت بر هم‌راستایی و اجتناب از انحراف (Misalignment)به‌منظور پیشگیری از رفتارهایی که ورای نیات کاربر است، یک سامانه زنجیره تفکر و اقدامات مدل را به‌صورت برخط رصد کرده و در صورت نیاز عملیات را متوقف می‌کند. گوگل بر شفافیت روند تفکر استدلالی تأکید کرده و یافته‌های این پایش را به فرایند آموزش بازخورد نداده است تا مدل شیوه دورزدن ناظران را یاد نگیرد.
  • ایمن‌سازی محیط‌های سندباکسمحیط‌های ایزوله تست و اجرای مدل باتوجه‌به افزایش خودمختاری عامل‌ها ایزوله و مهروموم شده‌اند تا ارزیابی‌های پرخطر با بالاترین درجه حفاظت اجرا شوند.
گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است.



رونمایی OpenAI از GPT-6 Sol و GPT-6 Luna؛ هوش پیشرفته‌تر با هزینه کمتر

GPT-6 Astra

GPT-6.1 Sol؛ نزدیک به Astra با هزینه کمتر

گوگل به‌تازگی از جدیدترین مدل مرزی خود با نام Gemini 4 Argon رونمایی کرده است.

دسترسی به Gemini 4 Argon

جمنای ۴ آرگون با تمرکز بر کدنویسی، تحلیل‌های تخصصی و پدافند سایبری به‌زودی در مرحله نخست در اختیار مشترکان Google AI Ultra و مشتریان API قرار خواهد گرفت. گوگل مدعی‌ست که جمنای ۴ آرگون را با قابلیت‌هایی در سطح پیشرو در زمینه‌های کدنویسی، کارهای دانش‌محور، امنیت سایبری و نویسندگی خلاق طراحی کرده تا در مسیر حل دشوارترین چالش‌ها، همراه توسعه‌دهندگان، متخصصان و سازمان‌ها باشد. گوگل ضمن تشکر از نخستین گروه مدافعان سایبری و آزمایش‌کنندگان مورداعتماد عنوان می‌کند که این ارزیابی‌ها و بازخوردهای آنان بر اساس تجربیات واقعی، به آن‌ها کمک می‌کند تا پیش از عرضه عمومی این مدل که با مشتریان سرویس API پولی و مشترکین Google AI Ultra آغاز می‌شود؛ قابلیت‌های آن را تقویت کند.

برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.