نتایج بنچمارک Mensa Norway نشان میدهد رقابت میان مدلهای پیشرفته هوش مصنوعی در سال ۲۰۲۶ بسیار نزدیک شده است.
رقابت برای ساخت مدلهای هوش مصنوعی قدرتمندتر در سال ۲۰۲۶ به مرحلهای فشرده رسیده است. دادههای منتشرشده از آزمون Mensa Norway نشان میدهند چند مدل پیشرفته اکنون با اختلاف بسیار کمی در صدر جدول قرار دارند.
این رتبهبندی بر اساس دادههای TrackingAI و نتایج آزمون IQ مؤسسه Mensa Norway تا آوریل ۲۰۲۶ تهیه شده است. تمرکز این آزمون روی توانایی مدلها در حل مسائل انتزاعی و تشخیص الگو است.

دو مدل در صدر جدول قرار گرفتند
Grok-4.20 Expert Mode و OpenAI GPT 5.4 Pro (Vision) هر دو امتیاز ۱۴۵ را به دست آوردهاند و در جایگاه نخست مشترک قرار گرفتهاند. Gemini 3.1 Pro Preview نیز با امتیاز ۱۴۱ تنها چهار امتیاز با صدر جدول فاصله دارد.
فهرست مدلها بر اساس امتیاز ثبتشده در آزمون Mensa Norway به این ترتیب است:
| مدل | امتیاز Mensa Norway |
|---|---|
| Grok-4.20 Expert Mode | ۱۴۵ |
| OpenAI GPT 5.4 Pro (Vision) | ۱۴۵ |
| Gemini 3.1 Pro Preview | ۱۴۱ |
| OpenAI GPT 5.4 Thinking (Vision) | ۱۳۹ |
| OpenAI GPT 5.3 | ۱۳۶ |
| Grok-4.20 Expert Mode (Vision) | ۱۳۳ |
| OpenAI GPT 5.4 Thinking | ۱۳۳ |
| Meta Muse Spark | ۱۳۳ |
| Gemini 3.1 Pro Preview (Vision) | ۱۳۲ |
| Qwen 3.5 | ۱۳۰ |
| Claude-4.6 Opus | ۱۳۰ |
| Kimi K2.5 | ۱۲۷ |
| Manus | ۱۱۵ |
| DeepSeek R1 | ۱۱۲ |
| DeepSeek V3 | ۱۱۱ |
نزدیکی امتیازهای بالای جدول نشان میدهد رقابت میان مدلهای پیشرفته بسیار فشرده شده است. برای مثال، تنها چهار امتیاز میان دو مدل صدرنشین و Gemini 3.1 Pro Preview فاصله وجود دارد. چند مدل دیگر نیز با اختلافی محدود در رتبههای بعدی قرار گرفتهاند.
مقایسه نتایج با سال ۲۰۲۵ نیز رشد قابل توجه امتیازهای بالای جدول را نشان میدهد. در آن سال، بالاترین امتیاز ثبتشده ۱۳۵ بود، اما این رقم در نتایج آوریل ۲۰۲۶ به ۱۴۵ رسیده است. این تغییر میتواند نشاندهنده بهبود توانایی مدلهای جدید در حل مسائل مربوط به تشخیص الگو و استدلال باشد.
البته این نتایج به معنای سنجش همه تواناییهای هوش مصنوعی نیست. آزمون Mensa Norway بیشتر روی حل مسائل انتزاعی و تشخیص الگو تمرکز دارد و نمیتوان امتیاز آن را معیاری برای سنجش کامل عملکرد یک مدل در تمام کاربردها دانست.
در انتهای این فهرست نیز مدلهایی با اختلاف قابل توجه نسبت به صدر جدول دیده میشوند. بهترین مدل Mistral در دادههای مورد بررسی امتیاز ۹۷ کسب کرده که فاصله زیادی با مدلهای پیشرو دارد.
در مجموع، نتایج آوریل ۲۰۲۶ تصویری از رقابتی نزدیک در بالاترین سطح مدلهای هوش مصنوعی ارائه میکند؛ رقابتی که در آن حتی چند امتیاز میتواند فاصله میان چند مدل قدرتمند را مشخص کند.











