Skip to main content
LLM
Podium
র্যাংকিং
🏆 Overall Leaderboard
Composite index across all flagship LLMs
💻 Coding & SWE-Bench
Real-world programming & software agent benchmark
🧠 Deep Reasoning
GPQA Diamond, AIME & complex logic
🤖 Autonomous Agents
OSWorld, Toolathlon & multi-turn execution
🔓 Open Weights
DeepSeek, Qwen, Llama & Mistral
অ্যারেনা
⚔️ Human Arena Battles
Blind pairwise Elo rankings (700+ models)
⚖️ Side-by-Side Compare
Head-to-head metric comparison of up to 4 models
💰 Cost-per-Task Calculator
Estimate API economics across real workflows
🎯 Model Recommender
Find the optimal model for your budget and speed
মডেল
📦 Model Directory
Detailed profiles, context windows & pricing
🏢 AI Labs & Providers
OpenAI, Anthropic, Google, DeepSeek, Meta
📊 Benchmark Matrix
Evaluation methodologies and leader tables
nav.resources
📐 Podium Methodology
Mathematical aggregation formula explained
📰 Changelog & News
Daily model updates and new evaluations
✍️ Research & Articles
In-depth AI benchmarking whitepapers
❓ Frequently Asked Questions
Common questions on scores and ranking
📖 LLM Glossary
Definitions of TTFT, TPS, Elo, MoE & tokens
nav.search_hint
⌘K
🇧🇩
BN
🇺🇸 English
EN
🇨🇳 中文
ZH
🇮🇳 हिन्दी
HI
🇪🇸 Español
ES
🇫🇷 Français
FR
🇸🇦 العربية
AR
🇧🇩 বাংলা
BN
🇧🇷 Português
PT
🇷🇺 Русский
RU
🇵🇰 اردو
UR
🇮🇩 Bahasa Indonesia
ID
🇩🇪 Deutsch
DE
🇯🇵 日本語
JA
🇰🇷 한국어
KO
🇹🇭 ไทย
TH
🇮🇹 Italiano
IT
র্যাংকিং
🏆 র্যাংকিং
Overall Composite Leaderboard
Coding & Software Agents
Deep Reasoning & Math
Autonomous Agent Swarms
Open Weights & Self-Hosted
⚔️ অ্যারেনা & Compare
Human Battle Arena (700+ Models)
Side-by-Side Model Compare
Cost-per-Task Calculator
Interactive Model Finder
📦 Directories & Evals
Model Specifications Directory
AI Labs & Cloud Providers
Benchmark Methodologies
📖 Research & Info
Scoring Methodology
Research Blog & Articles
Changelog & New Models
Frequently Asked Questions
Technical LLM Glossary
About LLMPodium
🌐 Language / Язык / 语言
🇺🇸
English
🇨🇳
中文
🇮🇳
हिन्दी
🇪🇸
Español
🇫🇷
Français
🇸🇦
العربية
🇧🇩
বাংলা
🇧🇷
Português
🇷🇺
Русский
🇵🇰
اردو
🇮🇩
Bahasa Indonesia
🇩🇪
Deutsch
🇯🇵
日本語
🇰🇷
한국어
🇹🇭
ไทย
🇮🇹
Italiano
Explore Full Leaderboard →
হোম
/
তুলনা
/
Claude বনাম Gemini
Claude বনাম Gemini
Claude বনাম Gemini — GPT-এর দুটি প্রধান বিকল্প। আগস্ট ২০২৬-এ আপডেট।
মুখোমুখি
85
গড় স্কোর
$24.00
গড় দাম
5
মডেল
VS
73
গড় স্কোর
$5.00
গড় দাম
5
মডেল
Anthropic শীর্ষ মডেল
1
Claude Mythos Preview
97.4
2
Claude Fable 5
93.4
3
Claude Opus 5
81.4
4
Claude Opus 4.8
76.0
5
Claude Opus 4 6 Thinking
75.0
Google শীর্ষ মডেল
1
Gemini 3.1 Pro Preview
74.0
2
Gemini 3.5 Flash High
74.0
3
Gemini 3.5 Flash Medium
74.0
4
Gemini 3.1 Flash Lite Preview
72.0
5
Gemini 2.5 Flash Preview 09 2025
70.0
সম্পর্কিত তুলনা
OpenAI বনাম Anthropic
OpenAI বনাম Google
Anthropic বনাম Google
OpenAI বনাম DeepSeek