CompareLLM.ai
Live
Leaderboard
Models
Compare
Best of & Stacks
Research & News
…
CompareLLM.ai
Precision Benchmarks

Programmatic, dated AI model benchmarks, head-to-head comparisons, and Stack Engine presets.

Daily ingest · 06:00 UTC

Analytics & Benchmarks

  • AI Model Leaderboard
  • Head-to-Head Compare Hub
  • Models Directory
  • Stack Engine Presets
  • Frontier Models
  • Open Weights Catalog

Guides & Intent Lists

  • Best LLM Lists (2026)
  • Best Coding LLM
  • Best Cheap LLM
  • Fastest Low-Latency LLM
  • Claude vs GPT Benchmark
  • What is Elo?
  • Methodology Guides
  • News & Dispatches

Transparency & API

  • Evaluation Methodology
  • Benchmark Changelog
  • Public JSON API
  • llms.txt Specification
  • Privacy Policy
  • Sign In / Account

© 2026 CompareLLM. Public benchmark data aggregated from Arena Elo, LiveBench, SWE-bench & OpenRouter.

Every score has a dated snapshot.

Theme:
Currency:
  1. Home
  2. Models
  3. GPT-4.5 Orion
  4. vs all
Comparison Matrix Hub
100 pairwise matchups

GPT-4.5 Orion vs All Models

Detailed head-to-head fact sheets comparing GPT-4.5 Orion (OpenAI) against every indexable model in the benchmark catalog.

Elo Rating1,540
SWE-bench71%
Out $/1M$150
Context Window128k
Showing 100 of 100 comparisons
GPT-4.5 OrionvsClaude Opus 5Anthropic
Compare

Anthropic current default flagship. Official API $5/$25 per 1M tokens and a 1M context window (Anthropic, Jul 24 2026).

Elo:Claude Opus 5+84SWE:Claude Opus 5+8.2%
GPT-4.5 OrionvsClaude Fable 5Anthropic
Compare

Anthropic top-tier X-High reasoning model engineered for heavy multi-step tasks. Official API $10/$50 per 1M tokens (Claude Platform pricing, Aug 2026).

Elo:Claude Fable 5+76SWE:Claude Fable 5+9%
GPT-4.5 OrionvsGPT-5.6 SolOpenAI
Compare

OpenAI 5.6 flagship tier. Official API $5/$30 per 1M tokens (OpenAI pricing, Jul 30 2026 update left Sol unchanged).

Elo:GPT-5.6 Sol+68SWE:GPT-5.6 Sol+6.6%
GPT-4.5 OrionvsClaude Opus 4.8Anthropic
Compare

Prior Opus generation still billed at $5/$25. Kept as a compare baseline against Opus 5.

Elo:Claude Opus 4.8+58SWE:Claude Opus 4.8+7.4%
GPT-4.5 OrionvsGrok 4.6xAI
Compare

xAI Aug 12 2026 post-training refresh of Grok 4.5. Same $2/$6 API price, 500k context, stronger agentic traces.

Elo:Grok 4.6+52SWE:GPT-4.5 Orion+1.9%
GPT-4.5 OrionvsClaude Opus 4.6Anthropic
Compare

Follow-on Opus release. Slightly behind 4.5 on official SWE-bench bash-only in the last published sweep; stronger multi-step autonomous agent reasoning.

Elo:Claude Opus 4.6+34SWE:Claude Opus 4.6+4.9%
GPT-4.5 OrionvsGemini 3.6 ProGoogle
Compare

Current Google Pro-class multimodal model. Long context, strong coding, billed like the 3.x Pro tier.

Elo:Gemini 3.6 Pro+30SWE:Gemini 3.6 Pro+3.6%
GPT-4.5 OrionvsClaude Opus 4.5Anthropic
Compare

Anthropic frontier coding and computer-use model. SWE-bench leader on the official mini-SWE-agent harness in the Feb 2026 refresh.

Elo:Claude Opus 4.5+28SWE:Claude Opus 4.5+5.8%
GPT-4.5 OrionvsOpenAI: o3 MiniOpenAI
Compare

Auto-discovered from OpenRouter (openai/o3-mini). Preview until a second source matches.

Elo:OpenAI: o3 Mini+20SWE:OpenAI: o3 Mini+7.5%
GPT-4.5 OrionvsGPT-5OpenAI
Compare

OpenAI flagship reasoning model for 2025–26. Strong general preference Elo and multimodal coverage.

Elo:GPT-5+18SWE:GPT-4.5 Orion+2.6%
GPT-4.5 OrionvsGLM-5.3Zhipu
Compare

Z.ai Aug 14 2026 post-train of the GLM-5.2 744B base. Coding-plan live; open weights promised after a two-week safety review (z.ai/blog/glm-5.3).

Elo:GLM-5.3+18SWE:GLM-5.3+5.4%
GPT-4.5 OrionvsClaude Sonnet 5Anthropic
Compare

Anthropic workhorse. Official $2/$10 per 1M tokens made permanent on Aug 10 2026.

Elo:Claude Sonnet 5+16SWE:Claude Sonnet 5+2.8%
GPT-4.5 OrionvsGemini 3 ProGoogle
Compare

Google frontier multimodal model with a multi-million-token context window.

Elo:Gemini 3 Pro+12SWE:Gemini 3 Pro+1.4%
GPT-4.5 OrionvsGPT-5.6 TerraOpenAI
Compare

OpenAI 5.6 mid tier. Official API $2/$12 per 1M after the Jul 30 2026 price cut.

Elo:GPT-5.6 Terra+8SWE:GPT-4.5 Orion+0.6%
GPT-4.5 OrionvsDeepSeek V4 ProDeepSeek
Compare

Open-weight-adjacent DeepSeek flagship. High reasoning density per dollar.

Elo:GPT-4.5 Orion+4SWE:DeepSeek V4 Pro+0.6%
GPT-4.5 OrionvsGemini 3.7 FlashGoogle
Compare

Google Aug 13 2026 workhorse. Official intro price $0.75/$3.75 per 1M through Dec 31 2026; 1,048,576-token context (Google blog).

Elo:GPT-4.5 Orion+10SWE:Gemini 3.7 Flash+1.4%
GPT-4.5 OrionvsKimi K3Moonshot
Compare

Moonshot AI frontier flagship reasoning and agent swarm model with 256k context and top-tier SWE-bench coding capability.

Elo:GPT-4.5 Orion+12SWE:Kimi K3+2.8%
GPT-4.5 OrionvsClaude Sonnet 4.5Anthropic
Compare

Workhorse Anthropic model: most of Opus coding quality at a mid-tier price.

Elo:GPT-4.5 Orion+16SWE:GPT-4.5 Orion+0.9%
GPT-4.5 OrionvsQwen 3 MaxAlibaba
Compare

Alibaba flagship. Strong math and multilingual code.

Elo:GPT-4.5 Orion+22SWE:GPT-4.5 Orion+3.2%
GPT-4.5 OrionvsMoonshotAI: Kimi K2.5Moonshot
Compare

Auto-discovered from OpenRouter (moonshotai/kimi-k2.5). Preview until a second source matches.

Elo:GPT-4.5 Orion+25SWE:MoonshotAI: Kimi K2.5+0.3%
GPT-4.5 OrionvsOpenAI: o1OpenAI
Compare

Auto-discovered from OpenRouter (openai/o1). Preview until a second source matches.

Elo:GPT-4.5 Orion+28SWE:GPT-4.5 Orion+22.1%
GPT-4.5 OrionvsGemini 3.6 FlashGoogle
Compare

Google Jul 21 workhorse. Now shares the 3.7 Flash introductory $0.75/$3.75 rate through Dec 31 2026.

Elo:GPT-4.5 Orion+34SWE:GPT-4.5 Orion+0.2%
GPT-4.5 OrionvsGemini 3 FlashGoogle
Compare

Fast Google frontier-adjacent model. Near-top official SWE-bench at a fraction of Opus price.

Elo:GPT-4.5 Orion+45SWE:Gemini 3 Flash+4.8%
GPT-4.5 OrionvsQwen QwQ 32BAlibaba
Compare

Alibaba specialized open reasoning model competing with frontier closed reasoning models.

Elo:GPT-4.5 Orion+45SWE:GPT-4.5 Orion+3.5%
GPT-4.5 OrionvsGLM-5.2Zhipu
Compare

Zhipu flagship. Strong Chinese/English coding and agents.

Elo:GPT-4.5 Orion+48SWE:GPT-4.5 Orion+1.7%
GPT-4.5 OrionvsGemini 2.0 Flash ThinkingGoogle
Compare

Google experimental reasoning model that visualizes thoughts in real-time.

Elo:GPT-4.5 Orion+50SWE:GPT-4.5 Orion+4.2%
GPT-4.5 OrionvsDeepSeek V4 FlashDeepSeek
Compare

DeepSeek Jul 31 2026 price-performance SKU. Public listings put it near $0.14/$0.28 per 1M tokens.

Elo:GPT-4.5 Orion+50SWE:DeepSeek V4 Flash+0.2%
GPT-4.5 OrionvsClaude Opus 4Anthropic
Compare

First Claude 4 Opus generation. Baseline for opus 4 vs opus 5.

Elo:GPT-4.5 Orion+50SWE:Claude Opus 4+1.5%
GPT-4.5 OrionvsGrok 4xAI
Compare

Previous xAI flagship.

Elo:GPT-4.5 Orion+52SWE:GPT-4.5 Orion+12.4%
GPT-4.5 OrionvsMiniMax M2.5MiniMax
Compare

MiniMax coding model. Tied near the top of official SWE-bench bash-only in Feb 2026.

Elo:GPT-4.5 Orion+62SWE:MiniMax M2.5+4.8%
GPT-4.5 OrionvsYi-Lightning01.AI
Compare

01.AI ultra-fast reasoning model delivering top LiveBench efficiency.

Elo:GPT-4.5 Orion+65SWE:GPT-4.5 Orion+7.6%
GPT-4.5 OrionvsZ.ai: GLM 5V TurboZhipu
Compare

Auto-discovered from OpenRouter (z-ai/glm-5v-turbo). Preview until a second source matches.

Elo:GPT-4.5 Orion+65SWE:GPT-4.5 Orion+5.8%
GPT-4.5 OrionvsSeed 2.1 TurboByteDance
Compare

ByteDance Seed 2.1 Turbo, listed on public model timelines as an Aug 10 2026 API drop.

Elo:GPT-4.5 Orion+68SWE:GPT-4.5 Orion+7.8%
GPT-4.5 OrionvsDoubao Pro 1.5ByteDance
Compare

ByteDance flagship enterprise model with ultra-low token cost and 128k context.

Elo:GPT-4.5 Orion+70SWE:GPT-4.5 Orion+8.9%
GPT-4.5 OrionvsLlama 4 MaverickMeta
Compare

Meta natively multimodal open-weight flagship.

Elo:GPT-4.5 Orion+72SWE:GPT-4.5 Orion+13.9%
GPT-4.5 OrionvsGPT-5.6 LunaOpenAI
Compare

OpenAI 5.6 fast/cheap tier. Official API $0.20/$1.20 per 1M after the Jul 30 80% Luna cut.

Elo:GPT-4.5 Orion+74SWE:GPT-4.5 Orion+9.2%
GPT-4.5 OrionvsMoonshotAI: Kimi K2 0711Moonshot
Compare

Auto-discovered from OpenRouter (moonshotai/kimi-k2). Preview until a second source matches.

Elo:GPT-4.5 Orion+75SWE:GPT-4.5 Orion+5.2%
GPT-4.5 OrionvsMistral Large 3Mistral
Compare

Mistral European flagship with strong function calling.

Elo:GPT-4.5 Orion+84SWE:GPT-4.5 Orion+15.6%
GPT-4.5 OrionvsClaude Sonnet 4Anthropic
Compare

First Sonnet 4 generation. Bridge between 3.5/3.7 and Sonnet 5.

Elo:GPT-4.5 Orion+85SWE:GPT-4.5 Orion+8.2%
GPT-4.5 OrionvsErnie 4.5 TurboBaidu
Compare

Baidu current multimodal enterprise foundation model with broad Chinese knowledge.

Elo:GPT-4.5 Orion+90SWE:GPT-4.5 Orion+14%
GPT-4.5 OrionvsQwen 2.5 PlusAlibaba
Compare

Alibaba balanced flagship API model with high-throughput general reasoning.

Elo:GPT-4.5 Orion+95SWE:GPT-4.5 Orion+11.8%
GPT-4.5 OrionvsOpenAI o1-miniOpenAI
Compare

OpenAI high-speed, cost-effective reasoning model optimized for STEM, math, and code generation.

Elo:GPT-4.5 Orion+95SWE:GPT-4.5 Orion+14.6%
GPT-4.5 OrionvsQwen3 235BAlibaba
Compare

Open-weight Qwen3 mixture-of-experts.

Elo:GPT-4.5 Orion+100SWE:GPT-4.5 Orion+11.6%
GPT-4.5 OrionvsClaude Haiku 4.5Anthropic
Compare

Anthropic cheap/fast Claude SKU. Official Claude Platform list price $1/$5 per 1M tokens (Anthropic Haiku page).

Elo:GPT-4.5 Orion+102SWE:GPT-4.5 Orion+12.8%
GPT-4.5 OrionvsYi-Large01.AI
Compare

01.AI full-scale dense model for complex instruction following.

Elo:GPT-4.5 Orion+110SWE:GPT-4.5 Orion+17.2%
GPT-4.5 OrionvsQwen 2.5 Coder 32BAlibaba
Compare

Alibaba dedicated open-weight code generation model with near-frontier SWE-bench Verified coding capability.

Elo:GPT-4.5 Orion+115SWE:GPT-4.5 Orion+5.8%
GPT-4.5 OrionvsQwen2.5 Coder 32B InstructAlibaba
Compare

Auto-discovered from OpenRouter (qwen/qwen-2.5-coder-32b-instruct). Preview until a second source matches.

Elo:GPT-4.5 Orion+115SWE:GPT-4.5 Orion+5.8%
GPT-4.5 OrionvsKimi Chat 1.5Moonshot
Compare

Moonshot ultra-long context model supporting up to 2 million tokens per request.

Elo:GPT-4.5 Orion+120SWE:GPT-4.5 Orion+20%
GPT-4.5 OrionvsLlama 4 ScoutMeta
Compare

Meta open-weight Llama 4 long-context sibling of Maverick. Common public API lists sit near $0.08–$0.30 / $0.30–$0.70 per 1M; we store a conservative hosted list until OpenRouter overwrites.

Elo:GPT-4.5 Orion+128SWE:GPT-4.5 Orion+18.6%
GPT-4.5 OrionvsGPT-5 miniOpenAI
Compare

Cost-efficient GPT-5 distill for high-volume agents.

Elo:GPT-4.5 Orion+130SWE:GPT-4.5 Orion+18.6%
GPT-4.5 OrionvsGrok 3xAI
Compare

Previous xAI generation before Grok 4. Kept for grok 3 vs grok 4.

Elo:GPT-4.5 Orion+135SWE:GPT-4.5 Orion+19.6%
GPT-4.5 OrionvsQwen3.8 27BAlibaba
Compare

Alibaba open-weight 27B drop dated Aug 14 2026. Dense enough to self-host; not a frontier MoE.

Elo:GPT-4.5 Orion+142SWE:GPT-4.5 Orion+12.2%
GPT-4.5 OrionvsLlama 3.1 405BMeta
Compare

Meta flagship open-weight 405B dense foundation model with 128k context window.

Elo:GPT-4.5 Orion+170SWE:GPT-4.5 Orion+12.6%
GPT-4.5 OrionvsDeepSeek Coder V2DeepSeek
Compare

DeepSeek open-weight Mixture-of-Experts coding model supporting 338 programming languages and 128k context.

Elo:GPT-4.5 Orion+175SWE:GPT-4.5 Orion+10.5%
GPT-4.5 OrionvsClaude 3.7 SonnetAnthropic
Compare

Hybrid-reasoning Sonnet from 2025. Kept for historical compare pages.

Elo:GPT-4.5 Orion+178SWE:GPT-4.5 Orion+0.7%
GPT-4.5 OrionvsDoubao Lite 1.5ByteDance
Compare

ByteDance high-speed lightweight model priced at sub-cent levels.

Elo:GPT-4.5 Orion+180SWE:GPT-4.5 Orion+25%
GPT-4.5 OrionvsDeepSeek R1DeepSeek
Compare

Open-weights reasoning model trained with large-scale RL.

Elo:GPT-4.5 Orion+182SWE:GPT-4.5 Orion+5.8%
GPT-4.5 OrionvsGemini 2.5 ProGoogle
Compare

Previous Google long-context flagship.

Elo:GPT-4.5 Orion+190SWE:GPT-4.5 Orion+7.2%
GPT-4.5 OrionvsCommand ACohere
Compare

Cohere enterprise RAG and tool-use model.

Elo:GPT-4.5 Orion+196SWE:GPT-4.5 Orion+28.4%
GPT-4.5 OrionvsGPT-4oOpenAI
Compare

Previous OpenAI flagship. Still a common compare baseline on legacy pages.

Elo:GPT-4.5 Orion+205SWE:GPT-4.5 Orion+16.2%
GPT-4.5 OrionvsCodestral 25.01Mistral
Compare

Mistral code-specialist model.

Elo:GPT-4.5 Orion+220SWE:GPT-4.5 Orion+19.2%
GPT-4.5 OrionvsDeepSeek V3DeepSeek
Compare

Prior DeepSeek flagship. Baseline for v3 vs v4.

Elo:GPT-4.5 Orion+230SWE:GPT-4.5 Orion+22.4%
GPT-4.5 OrionvsGemini 2.5 FlashGoogle
Compare

Previous Google speed workhorse.

Elo:GPT-4.5 Orion+245SWE:GPT-4.5 Orion+23%
GPT-4.5 OrionvsLlama 3.3 70BMeta
Compare

Previous Meta 70B open-weight workhorse.

Elo:GPT-4.5 Orion+255SWE:GPT-4.5 Orion+25.9%
GPT-4.5 OrionvsClaude 3.5 SonnetAnthropic
Compare

2024 workhorse. Still a high-intent compare against GPT-4o.

Elo:GPT-4.5 Orion+260SWE:GPT-4.5 Orion+22%
GPT-4.5 OrionvsGPT-4o miniOpenAI
Compare

Legacy small OpenAI model. Useful as a cheap baseline.

Elo:GPT-4.5 Orion+268SWE:GPT-4.5 Orion+29.8%
GPT-4.5 OrionvsGemini 1.5 ProGoogle
Compare

First million-token Gemini Pro. Baseline for 1.5 vs 2.5 vs 3.x Pro.

Elo:GPT-4.5 Orion+280SWE:GPT-4.5 Orion+33%
GPT-4.5 OrionvsGPT-4 TurboOpenAI
Compare

GPT-4 Turbo 128k. Historical flagship for gpt-4 turbo vs gpt-4o / gpt-5.

Elo:GPT-4.5 Orion+285SWE:GPT-4.5 Orion+37.8%
GPT-4.5 OrionvsClaude 3 OpusAnthropic
Compare

Original Claude 3 flagship. Kept so opus 3 vs later Opus and vs GPT-4o still resolve.

Elo:GPT-4.5 Orion+292SWE:GPT-4.5 Orion+32.6%
GPT-4.5 OrionvsLlama 3.1 70BMeta
Compare

Llama 3.1 70B instruct. Predecessor to 3.3 70B and Llama 4.

Elo:GPT-4.5 Orion+300SWE:GPT-4.5 Orion+30.8%
GPT-4.5 OrionvsClaude 3.5 HaikuAnthropic
Compare

Previous cheap Claude. Haiku 4.5 is the current $1/$5 SKU.

Elo:GPT-4.5 Orion+316SWE:GPT-4.5 Orion+34.8%
GPT-4.5 OrionvsGPT Image 2 (High)OpenAI
Compare

OpenAI flagship diffusion-transformer image synthesis model with supreme prompt adherence, realistic textures, and complex text composition.

GPT-4.5 OrionvsGPT Image 2 (Low / Fast)OpenAI
Compare

Fast distilled tier of GPT Image 2 designed for high-throughput interactive creative workflows at 70% lower price.

GPT-4.5 OrionvsGPT Image 1.5OpenAI
Compare

Previous OpenAI image generation flagship. High fidelity with proven enterprise reliability.

GPT-4.5 OrionvsDALL-E 3OpenAI
Compare

Legacy OpenAI image model benchmark baseline. Retained for historical comparisons.

GPT-4.5 OrionvsReve 2.1Reve
Compare

State-of-the-art cinematic image synthesis foundation model known for photorealistic lighting and aesthetic composition.

GPT-4.5 OrionvsNano Banana Pro (Gemini 3 Pro Image)Google
Compare

Google DeepMind frontier multimodal image generation flagship with Deep Research and complex multi-object spatial reasoning.

GPT-4.5 OrionvsNano Banana 2 (Gemini 3.1 Flash Image)Google
Compare

Google high-speed multimodal generative model delivering top Elo performance at half the latency and cost of Pro.

GPT-4.5 OrionvsNano Banana 2 LiteGoogle
Compare

Sub-1.5 second ultra-low latency tier for real-time applications and mobile game asset pipelines.

GPT-4.5 OrionvsFLUX.2 [max]Black Forest Labs
Compare

Black Forest Labs maximum-capacity flow-matching model with photoreal anatomy and leading typography fidelity.

GPT-4.5 OrionvsFLUX.2 [flex]Black Forest Labs
Compare

Flexible step-distilled variant of FLUX.2 offering 99% of Max quality with 45% faster generation speeds.

GPT-4.5 OrionvsFLUX.1.1 [pro]Black Forest Labs
Compare

First-generation professional API model from Black Forest Labs, renowned for 6x faster generation than original FLUX.1 Pro.

GPT-4.5 OrionvsFLUX.1 [dev]Black Forest Labs
Compare

Open-weights non-commercial base model with 12B parameters, serving as the foundation for the open-source fine-tuning ecosystem.

GPT-4.5 OrionvsFLUX.1 [schnell]Black Forest Labs
Compare

Apache 2.0 4-step distilled open weights model optimized for local inference and instant preview generation.

GPT-4.5 OrionvsIdeogram 4.0 (Quality)Ideogram
Compare

Industry-leading typography, graphic design, and in-image text layout model with precise kerning and complex banner generation.

GPT-4.5 OrionvsIdeogram 4.0 Open WeightsIdeogram
Compare

Open-weight release of Ideogram 4.0, bringing world-class text rendering to self-hosted enterprise infrastructure.

GPT-4.5 OrionvsRecraft V4.1 Utility ProRecraft
Compare

Specialized generative model for vector art, icon sets, illustrations, and commercial design assets with native brand color matching.

GPT-4.5 OrionvsRecraft V4.1 UtilityRecraft
Compare

High-speed utility tier of Recraft V4.1 tailored for rapid asset production at $0.035/image.

GPT-4.5 OrionvsKrea 2 LargeKrea
Compare

High-resolution real-time generation model tuned for artistic composition and dynamic concept art.

GPT-4.5 OrionvsKrea 2 Medium TurboKrea
Compare

Sub-2 second interactive generation engine delivering ultra-affordable $15/1k image generation.

GPT-4.5 OrionvsQwen Image 2.0 ProAlibaba
Compare

Alibaba multimodal image synthesis foundation model with strong bilingual Chinese/English typography and cultural asset fidelity.

GPT-4.5 OrionvsWan2.6 Text to ImageAlibaba
Compare

Alibaba high-efficiency open video/image unified transformer backbone.

GPT-4.5 OrionvsSeedream 5.0 ProByteDance
Compare

ByteDance flagship image generation model with high photorealism and fine facial structure rendering.

GPT-4.5 OrionvsSeedream 4.0ByteDance
Compare

High-value ByteDance image foundation model at $30/1k images.

GPT-4.5 OrionvsMidjourney v7Midjourney
Compare

Midjourney v7 premier creative image generation model with unparalleled stylistic nuances, coherent hands/anatomy, and cinematic grading.

GPT-4.5 OrionvsMidjourney v6.1Midjourney
Compare

Previous standard in aesthetic digital art generation, retained as a historical compare baseline.

GPT-4.5 OrionvsMAI-Image-2.5Microsoft AI
Compare

Microsoft AI proprietary foundation image model for Copilot Studio and enterprise creative workflows.

GPT-4.5 OrionvsMAI-Image-2.5-FlashMicrosoft AI
Compare

Cost-optimized Microsoft AI image model delivering sub-2 second responses at $20/1k images.

GPT-4.5 OrionvsHiDream-O1-Image-1.5HiDream
Compare

HiDream high-definition visual generator optimized for photorealism and accurate complex lighting.

GPT-4.5 OrionvsLuma UNI 1 MaxLuma Labs
Compare

Luma Labs universal 3D-aware image synthesis engine with spatial geometry consistency.