اخبار هوش مصنوعی

مدل صوتی Grok Voice Think Fast 2.0 از رقبا پیشی گرفت

مدل صوتی Grok Voice Think Fast 2.0 شرکت xAI با کسب رتبه اول در بنچمارک τ-voice Bench، مدل‌های رقیب از OpenAI و گوگل را پشت سر گذاشته است. به‌ گزارش سرویس هوش مصنوعی تک‌ناک ، این مدل که در ۲۹ ژوئیه ۲۰۲۶ عرضه شد، بالاترین امتیاز عملکرد عامل‌محور را در بنچمارک τ-…

3 دقیقه مطالعه
  • پشتیبانی شبکه
  • هوش مصنوعی
  • مدل
  • صوتی
  • درصد
  • Grok
  • امتیاز
  • گفتار
مدل صوتی Grok Voice Think Fast 2.0 از رقبا پیشی گرفت

خلاصه تحلیلی خبر

مدل صوتی Grok Voice Think Fast 2.0 شرکت xAI با کسب رتبه اول در بنچمارک τ-voice Bench، مدل‌های رقیب از OpenAI و گوگل را پشت سر گذاشته است. به‌ گزارش سرویس هوش مصنوعی تک‌ناک ، این مدل که در ۲۹ ژوئیه ۲۰۲۶ عرضه شد، بالاترین امتیاز عملکرد عامل‌محور را در بنچمارک τ-…

موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، مدل، صوتی، درصد، Grok

مدل صوتی Grok Voice Think Fast 2.0 شرکت xAI با کسب رتبه اول در بنچمارک τ-voice Bench، مدل‌های رقیب از OpenAI و گوگل را پشت سر گذاشته است.

به‌ گزارش سرویس هوش مصنوعی تک‌ناک، این مدل که در ۲۹ ژوئیه ۲۰۲۶ عرضه شد، بالاترین امتیاز عملکرد عامل‌محور را در بنچمارک τ-voice Bench ثبت کرده و ایلان ماسک نیز با انتشار پستی در X به این موفقیت اشاره کرده است.

بیشتر بخوانید: خبر خوش برای برنامه‌نویسان؛ قیمت مدل GPT-5.6 Sol کمتر می‌شود

این رتبه دقیقا چه چیزی را اندازه‌گیری می‌کند؟

مدل صوتی Grok Voice Think Fast 2.0 در بخش Agentic Performance بنچمارک τ-voice Bench موفق به کسب امتیاز ۵۶.۵ درصد شده است؛ معیاری که توانایی یک مدل صوتی را برای مدیریت فرایندهای چندمرحله‌ای، استفاده از ابزارها و اجرای دستورات پیچیده ارزیابی می‌کند. برخلاف آزمون‌های معمول کیفیت صدا یا سرعت تشخیص گفتار، این بنچمارک بررسی می‌کند که یک دستیار صوتی تا چه حد می‌تواند وظایف واقعی مانند رزرو خدمات، دریافت داده‌های لحظه‌ای و تعامل میان چند اپلیکیشن را انجام دهد.

مدل صوتی Grok Voice Think Fast 2.0 صدرنشین شد

خبر پیشنهادی: پرپلکسیتی مدل هوش مصنوعی محلی Portable Computer را معرفی کرد

در همین معیار، GPT-Realtime-2.1 از OpenAI با امتیاز ۴۵.۷ درصد و Gemini 3.1 Flash Live از گوگل با امتیاز ۳۷.۷ درصد در رتبه‌های بعدی قرار گرفته‌اند. برتری Grok نسبت به این دو مدل به‌ ترتیب حدود ۱۱ و ۱۹ واحد درصد است؛ اختلافی که نشان‌دهنده فاصله قابل توجه در توانایی اجرای وظایف عامل‌محور است. با وجود این، عملکرد Grok در همه حوزه‌ها صدرنشین نیست. در شاخص کیفیت گفتار به گفتار Artificial Analysis، این مدل با امتیاز ۸۲.۹ درصد در رتبه دوم قرار دارد و اندکی پایین‌تر از Qwen Audio 3.0 Realtime Plus شرکت علی‌بابا با امتیاز ۸۴.۱ درصد است.

برای مطالعه بیشتر: گوگل در حال آزمایش تغییرات کاربردی جدید در جمنای است + تصویر

پیشرفت مدل صوتی Grok Voice Think Fast 2.0

این مدل نسبت به نسل قبل خود نیز پیشرفت چشمگیری داشته است. کیفیت کلی گفتار به گفتار از ۷۵.۷ درصد به ۸۲.۹ درصد افزایش یافته، زمان شروع پاسخ صوتی از ۱.۲۵ ثانیه به ۰.۷۰ ثانیه کاهش پیدا کرده و این مدل را به یکی از سریع‌ترین سیستم‌های صوتی موجود تبدیل کرده است. کاهش تاخیر به کمتر از یک ثانیه اهمیت ویژه‌ای دارد، چرا که در تعاملات صوتی، حتی چند صد میلی‌ثانیه می‌تواند مرز میان یک مکالمه طبیعی و تجربه‌ای مصنوعی باشد. حفظ توانایی‌های عامل‌محور در کنار پاسخ‌دهی سریع، یکی از دشوارترین چالش‌های توسعه دستیارهای صوتی هوشمند محسوب می‌شود. از نظر اکوسیستم تسلا نیز اگرچه این پیشرفت هنوز به معنای تغییر فوری در خودروها نیست، اما مسیر توسعه Grok می‌تواند زمینه‌ساز ادغام عمیق‌تر این دستیار هوش مصنوعی با محصولات تسلا باشد. دستیار صوتی‌ که قادر به اجرای وظایف پیچیده و چندمرحله‌ای باشد، می‌تواند نقش یک کمک‌راننده هوشمند واقعی را ایفا کند.

نوشته مدل صوتی Grok Voice Think Fast 2.0 از رقبا پیشی گرفت اولین بار در Technoc. پدیدار شد.

برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.