فهرست بستن
fidarpolymer.com

کدام مدل‌های هوش مصنوعی در سال ۲۰۲۶ عملکرد بهتری دارند؟

خرید رپورتاژ ارزان
آخرین مطالب سایت
کدام مدل‌های هوش مصنوعی در سال ۲۰۲۶ عملکرد بهتری دارند؟

نتایج بنچمارک Mensa Norway نشان می‌دهد رقابت میان مدل‌های پیشرفته هوش مصنوعی در سال ۲۰۲۶ بسیار نزدیک شده است.

رقابت برای ساخت مدل‌های هوش مصنوعی قدرتمندتر در سال ۲۰۲۶ به مرحله‌ای فشرده رسیده است. داده‌های منتشرشده از آزمون Mensa Norway نشان می‌دهند چند مدل پیشرفته اکنون با اختلاف بسیار کمی در صدر جدول قرار دارند.

این رتبه‌بندی بر اساس داده‌های TrackingAI و نتایج آزمون IQ مؤسسه Mensa Norway تا آوریل ۲۰۲۶ تهیه شده است. تمرکز این آزمون روی توانایی مدل‌ها در حل مسائل انتزاعی و تشخیص الگو است.

کدام مدل‌های هوش مصنوعی در سال ۲۰۲۶ عملکرد بهتری دارند؟

دو مدل در صدر جدول قرار گرفتند

Grok-4.20 Expert Mode و OpenAI GPT 5.4 Pro (Vision) هر دو امتیاز ۱۴۵ را به دست آورده‌اند و در جایگاه نخست مشترک قرار گرفته‌اند. Gemini 3.1 Pro Preview نیز با امتیاز ۱۴۱ تنها چهار امتیاز با صدر جدول فاصله دارد.

فهرست مدل‌ها بر اساس امتیاز ثبت‌شده در آزمون Mensa Norway به این ترتیب است:

مدل امتیاز Mensa Norway
Grok-4.20 Expert Mode ۱۴۵
OpenAI GPT 5.4 Pro (Vision) ۱۴۵
Gemini 3.1 Pro Preview ۱۴۱
OpenAI GPT 5.4 Thinking (Vision) ۱۳۹
OpenAI GPT 5.3 ۱۳۶
Grok-4.20 Expert Mode (Vision) ۱۳۳
OpenAI GPT 5.4 Thinking ۱۳۳
Meta Muse Spark ۱۳۳
Gemini 3.1 Pro Preview (Vision) ۱۳۲
Qwen 3.5 ۱۳۰
Claude-4.6 Opus ۱۳۰
Kimi K2.5 ۱۲۷
Manus ۱۱۵
DeepSeek R1 ۱۱۲
DeepSeek V3 ۱۱۱

نزدیکی امتیازهای بالای جدول نشان می‌دهد رقابت میان مدل‌های پیشرفته بسیار فشرده شده است. برای مثال، تنها چهار امتیاز میان دو مدل صدرنشین و Gemini 3.1 Pro Preview فاصله وجود دارد. چند مدل دیگر نیز با اختلافی محدود در رتبه‌های بعدی قرار گرفته‌اند.

مقایسه نتایج با سال ۲۰۲۵ نیز رشد قابل توجه امتیازهای بالای جدول را نشان می‌دهد. در آن سال، بالاترین امتیاز ثبت‌شده ۱۳۵ بود، اما این رقم در نتایج آوریل ۲۰۲۶ به ۱۴۵ رسیده است. این تغییر می‌تواند نشان‌دهنده بهبود توانایی مدل‌های جدید در حل مسائل مربوط به تشخیص الگو و استدلال باشد.

البته این نتایج به معنای سنجش همه توانایی‌های هوش مصنوعی نیست. آزمون Mensa Norway بیشتر روی حل مسائل انتزاعی و تشخیص الگو تمرکز دارد و نمی‌توان امتیاز آن را معیاری برای سنجش کامل عملکرد یک مدل در تمام کاربردها دانست.

در انتهای این فهرست نیز مدل‌هایی با اختلاف قابل توجه نسبت به صدر جدول دیده می‌شوند. بهترین مدل Mistral در داده‌های مورد بررسی امتیاز ۹۷ کسب کرده که فاصله زیادی با مدل‌های پیشرو دارد.

در مجموع، نتایج آوریل ۲۰۲۶ تصویری از رقابتی نزدیک در بالاترین سطح مدل‌های هوش مصنوعی ارائه می‌کند؛ رقابتی که در آن حتی چند امتیاز می‌تواند فاصله میان چند مدل قدرتمند را مشخص کند.