برترین مدلهادر کنار یکدیگر.
Claude، GPT، Gemini، Grok، Kimi، DeepSeek و موارد دیگر در یک فضای کاری — هر برگه مشخصات را باز کنید، هزینه آنها را به ستاره مقایسه کنید و در میانه گفتگو بین مدلها جابهجا شوید.
هزینه هر مدل
یک نوار برای هر مدل با قیمتگذاری بر حسب ستاره — از ارزانترین تا پرمیوم در مقیاس لگاریتمی. برای مشاهده مشخصات کامل روی هر نوار کلیک کنید.
امتیازدهی مدلها
همه مدلهای موجود در کاتالوگ روی یک محور، یک نمودار برای هر ارزیابی، با رنگبندی بر اساس آزمایشگاه سازنده. برای مشاهده برگه مشخصات هر مدل روی نوار آن کلیک کنید. امتیازها منتشر شده توسط Artificial Analysis
هوشمندی
34 از 80 مدل ارزیابی شدندامتیاز شاخص: عددی که ارزیابیهای مستقل استدلال، دانش، کدنویسی و ریاضیات را ترکیب میکند. این امتیاز مشخص میکند که «این مدل در کل چقدر توانمند است» — هرچه بالاتر باشد بهتر است و امتیازات از ۰ تا ۱۰۰ هستند.
نماد لامپ نشاندهنده یک مدل استدلالی است
همهچیزدانی
28 از 80 مدل ارزیابی شدندقابلیت اطمینان به دانش و میزان توهم در یک عدد. پاسخ صحیح امتیاز مثبت و پاسخ ساختگی (توهم) امتیاز منفی دارد، و امتناع از پاسخ هیچ امتیازی کسر نمیکند. هرچه بالاتر باشد بهتر است، اما مقیاس از ۱۰۰- تا ۱۰۰ متغیر است: صفر یعنی تعداد پاسخهای درست و نادرست برابر است، و امتیاز منفی یعنی خطاهای مدل بیشتر از پاسخهای درست آن است.
نماد لامپ نشاندهنده یک مدل استدلالی است
کدنویسی
16 از 80 مدل ارزیابی شدندکدنویسی عاملی: اینکه یک مدل روی یک پایگاه کد واقعی چقدر خوب کار میکند، نه اینکه چقدر سینتکس را خوب از حفظ است. شاخص نسخه ۱.۳ سه بنچمارک DeepSWE، Terminal-Bench v2 و SWE-Atlas-QnA را ترکیب میکند. هرچه بالاتر باشد در همان مقیاس ۰ تا ۱۰۰ بهتر است.
نماد لامپ نشاندهنده یک مدل استدلالی است
OpenAI
13Anthropic
5xAI
6Moonshot AI
4DeepSeek
2Perplexity
4Meta
2یکی را انتخاب کرده و شروع کنید
تنها با یک ورود به همه مدلهای اینجا دسترسی دارید — شروع طرحها رایگان است.
