skip to content

conifer · models

Every model Conifer serves.

Each one measured and priced, with the ones that run on your own machine.

Fig. 01·the frontier

Price against quality221 models

Blended price per million tokens against measured score. Higher and further left is better.

Intelligence Index0204060$0.10$1$10blended price · $ per million tokens (log)Claude Fable 5.1 (max)Claude Opus 5 (max)Grok 4.6 (high)GLM-5.3 (max)Gemini 3.8 Flash (high)GLM-5.3-FlashQwen3.8-Flash-NextAgnes 2.5 Pro BetaLing 3.0 FlashNemotron 3.5 LightningQwen3.5 4BGranite 4.2 3BGemma 4 E4BLlama 3.1 8B
Intelligence and blended price for 221 models
ModelLabIntelligencePrice per million tokensPrice frontierOn ConiferRuns locally
Claude Fable 5Anthropic62.1$20noyesno
Claude Fable 5.1 (max)Anthropic65.7$20yesyesno
Claude 4.5 Haiku (Non-reasoning)Anthropic24.1$2noyesno
Claude Opus 4.8 (max)Anthropic57.3$10noyesno
Claude Opus 4.6 (Non-reasoning, high)Anthropic38.8$10noyesno
Claude Opus 4.7 (max)Anthropic55$10noyesno
Claude Opus 5 (max)Anthropic63.1$10yesyesno
Claude Sonnet 4.6 (Non-reasoning, high)Anthropic36.8$6noyesno
Claude Sonnet 5 (max)Anthropic55.3$4noyesno
Command ACohere7.5$4.4noyesno
DeepSeek R1 0528DeepSeek20.4$1.8noyesno
DeepSeek V3.1DeepSeek21$0.86noyesno
DeepSeek V3.1 TerminusDeepSeek31.4$1.9noyesno
DeepSeek V3.2DeepSeek32.8$0.32noyesno
DeepSeek V4 Flash 0731 (max)DeepSeek51.8$0.66noyesno
DeepSeek V4 Flash Vision (max)DeepSeek51.5$0.66noyesno
DeepSeek V4 Pro 0813 (max)DeepSeek53.2$2.0noyesno
Gemini 2.5 FlashGoogle20.3$0.85noyesno
Gemini 2.5 ProGoogle25.9$3.4noyesno
Gemini 3 Flash (Non-reasoning)Google27.9$1.1noyesno
Gemini 3.1 Flash-LiteGoogle25.6$0.56noyesno
Gemini 3.1 Pro PreviewGoogle47.7$4.5noyesno
Gemini 3.5 FlashGoogle52$3.4noyesno
Gemini 3.5 Flash-LiteGoogle37.4$0.85noyesno
Gemini 3.6 FlashGoogle51.6$1.5noyesno
Gemini 3.7 Flash (high)Google56$1.5noyesno
Gemma 4 26B A4BGoogle26.1$0.18noyesno
GLM-4.5-AirZ AI16.7$0.37noyesno
GLM-4.5VZ AI9$0.90noyesno
GLM-4.6Z AI29.3$0.96noyesno
GLM-4.6VZ AI16.9$0.45noyesno
GLM-4.7Z AI34.5$1noyesno
GLM-4.7-FlashZ AI23.3$0.15noyesno
GLM-5Z AI40.6$1.6noyesno
GLM-5.1Z AI41$2.0noyesno
GLM-5.2 (max)Z AI52.6$2.1noyesno
GLM-5.3 (max)Z AI59.5$2.1yesyesno
GLM-5.3-FlashZ AI57.5$0.24yesyesno
GPT-4.1OpenAI19.6$3.5noyesno
GPT-4.1 miniOpenAI14.8$0.70noyesno
GPT-4.1 nanoOpenAI9.6$0.17noyesno
GPT-4o (May)OpenAI8.4$7.5noyesno
GPT-4o (Aug)OpenAI9.4$4.4noyesno
GPT-4o (Nov)OpenAI11.1$4.4noyesno
GPT-4o miniOpenAI6.7$0.26noyesno
GPT-5 (high)OpenAI35.3$3.4noyesno
GPT-5 mini (high)OpenAI25.8$0.69noyesno
GPT-5 nano (high)OpenAI20.1$0.14noyesno
GPT-5.1 (high)OpenAI37.5$3.4noyesno
GPT-5.2 (xhigh)OpenAI43.3$4.8noyesno
GPT-5.4 (xhigh)OpenAI53.1$5.6noyesno
GPT-5.4 mini (xhigh)OpenAI40.9$1.7noyesno
GPT-5.4 nano (xhigh)OpenAI39.7$0.46noyesno
GPT-5.5 (xhigh)OpenAI56.3$11noyesno
GPT-5.6 Luna (max)OpenAI52.3$0.45noyesno
GPT-5.6 Sol (max)OpenAI60.9$8noyesno
GPT-5.6 Terra (max)OpenAI56.6$4.5noyesno
gpt-oss-120b (high)OpenAI24.1$0.26noyesno
gpt-oss-20b (high)OpenAI15.2$0.09noyesno
Granite 4.2 8BIBM19.6$0.11noyesno
Grok 4.3 (high)SpaceXAI37.9$1.6noyesno
Grok 4.5 (high)SpaceXAI55.8$3noyesno
Grok 4.6 (high)SpaceXAI60.9$3yesyesno
Hermes 3 - Llama-3.1 70BNous Research4.8$0.70noyesno
Hermes 4 405BNous Research8.8$1.5noyesno
Hermes 4 70BNous Research9.9$0.20noyesno
Hy3Tencent42.2$0.24noyesno
InklingThinking Machines42.3$1.8noyesno
Inkling SmallThinking Machines41.2$0.53noyesno
Kimi K2 0905Kimi24$1.1noyesno
Kimi K2.5Kimi36$1.2noyesno
Kimi K2.6Kimi45.1$1.7noyesno
Kimi K2.7 CodeKimi43$1.7noyesno
Kimi K3 (max)Kimi59.7$6noyesno
Ling 3.0 FlashInclusionAI37.8$0.11yesyesno
Llama 3.1 8BMeta7.4$0.03yesyesno
Llama 3.3 70BMeta9.3$0.67noyesno
Llama 4 MaverickMeta14.5$0.42noyesno
Llama 4 ScoutMeta10.3$0.30noyesno
MiMo-V2.5Xiaomi38$0.17noyesno
MiMo-V2.5-ProXiaomi42.9$0.54noyesno
MiniMax-M2MiniMax28.9$0.53noyesno
MiniMax-M2.1MiniMax32.1$0.53noyesno
MiniMax-M2.5MiniMax34.5$0.53noyesno
MiniMax-M2.7MiniMax38.9$0.53noyesno
MiniMax-M3MiniMax45.4$0.53noyesno
Ministral 3 14BMistral11.2$0.20noyesno
Ministral 3 3BMistral7.1$0.10noyesyes
Ministral 3 8BMistral9$0.15noyesno
Mistral Large 3Mistral15.9$0.75noyesno
Mistral Medium 3Mistral12.5$0.80noyesno
Mistral Medium 3.5Mistral30.4$3noyesno
Mistral Small 3Mistral6.7$0.15noyesno
Mistral Small 4Mistral19.7$0.26noyesno
Muse Glimmer (high)Meta35.1$0.64noyesno
Nemotron 3 NanoNVIDIA14.5$0.09noyesno
Nemotron 3 SuperNVIDIA25.7$0.35noyesno
Nemotron 3 UltraNVIDIA38.3$1.1noyesno
Nemotron 3.5 LightningNVIDIA23.6$0.11yesyesno
o1OpenAI23.9$26noyesno
o3OpenAI31.1$3.5noyesno
o3-miniOpenAI19.2$1.9noyesno
o4-mini (high)OpenAI26.1$1.9noyesno
Phi-4Microsoft4.6$0.22noyesno
Qwen2.5 72BAlibaba9.4$0.48noyesno
Qwen3 14BAlibaba10.4$1.3noyesno
Qwen3 235B A22B 2507Alibaba19.9$0.75noyesno
Qwen3 30B A3B 2507Alibaba14.6$0.75noyesno
Qwen3 30B A3B 2507 (Non-reasoning)Alibaba8.9$0.35noyesno
Qwen3 32BAlibaba11.4$0.28noyesno
Qwen3 Coder 30B A3BAlibaba13.6$0.90noyesno
Qwen3 Coder 480BAlibaba18.2$3noyesno
Qwen3 Coder NextAlibaba21.3$0.56noyesno
Qwen3 MaxAlibaba24.5$2.4noyesno
Qwen3 Next 80B A3B (Reasoning)Alibaba16.9$0.41noyesno
Qwen3 VL 235B A22BAlibaba14.4$0.70noyesno
Qwen3 VL 235B A22B (Reasoning)Alibaba20.9$1.3noyesno
Qwen3 VL 30B A3BAlibaba9.9$0.35noyesno
Qwen3.5 122B A10BAlibaba32.8$1.1noyesno
Qwen3.5 27BAlibaba34.6$0.82noyesyes
Qwen3.5 35B A3BAlibaba29.9$0.69noyesno
Qwen3.5 397B A17BAlibaba34.3$1.4noyesno
Qwen3.5 9BAlibaba21.8$0.15noyesyes
Qwen3.6 27BAlibaba37.7$1.4noyesyes
Qwen3.6 35B A3BAlibaba32.1$0.84noyesno
Qwen3.7 MaxAlibaba46.7$3.8noyesno
Qwen3.8 2.4T A95BAlibaba57.7$3noyesno
Qwen3.8 27B (xhigh)Alibaba52$1.1noyesyes
Qwen3.8-Flash-NextAlibaba55.8$0.23yesyesno
Qwen3.8 MaxAlibaba58.1$3noyesno
Step 3.7 FlashStepFun30.9$0.44noyesno
Mercury 2Inception21.9$0.38nonono
Qwen3.5 Omni PlusAlibaba31.3$1.5nonono
Nova 2.0 Omni (medium)Amazon21.3$0.85nonono
Qwen3.5 122B A10B (Non-reasoning)Alibaba28.2$1.1nonono
Gemma 4 12B (Non-reasoning)Google13.2$0.15nonono
Muse Spark 1.2 (xhigh)Meta56.8$2nonono
Apodex 1.1Apodex44$0.97nonono
Qwen3 Omni 30B A3BAlibaba4.8$0.43nonono
Granite 4.2 3BIBM14.3$0.05yesnono
Nova 2.0 Pro Preview (medium)Amazon22.1$3.4nonono
Granite 4.2 30BIBM23.7$0.28nonono
Mistral Small 4 (Non-reasoning)Mistral12.3$0.26nonono
Solar Pro 4Upstage41.6$0.53nonono
Nova 2.0 Omni (Non-reasoning)Amazon10.4$0.85nonono
Qwen3.5 9B (Non-reasoning)Alibaba20.6$0.19nonono
GPT-6 Astra (Non-reasoning)OpenAI55.3$20nonono
Hermes 4 70B (Non-reasoning)Nous Research6.7$0.20nonono
Nemotron 3 Nano (Non-reasoning)NVIDIA7.2$0.09nonono
Qwen3 Next 80B A3BAlibaba13.8$0.41nonono
Llama Nemotron Super 49B v1.5 (Non-reasoning)NVIDIA8.5$0.40nonono
NVIDIA Nemotron Nano 9B V2 (Non-reasoning)NVIDIA7.2$0.09nonono
GPT-6 Astra (max)OpenAI61.2$20nonono
Qwen3.5 4B (Non-reasoning)Alibaba16.1$0.06nonono
Qwen3.5 397B A17B (Non-reasoning)Alibaba32.7$1.4nonono
HyperNova 60B 2605 (high)Multiverse Computing18.3$0.07nonono
Nova MicroAmazon4.4$0.06nonono
Qwen3.8 27BAlibaba34.7$1.1nonoyes
Qwen3.6 27B (Non-reasoning)Alibaba31.3$1.4nonono
Nex-N2-ProNex AGI41.7$1nonono
Sarvam 105B (high)Sarvam11.9$0.07nonono
MiMo-V2.5-Pro (Non-reasoning)Xiaomi28.4$0.54nonono
Ring-flash-2.0InclusionAI8$0.25nonono
Apertus 70B InstructSwiss AI Initiative2$1.3nonono
Gemma 4 E4B (Non-reasoning)Google8.7$0.04nonono
GPT-5.3 Codex (xhigh)OpenAI45.5$4.8nonono
LongCat 2.0LongCat34$1.3nonono
Granite 4.0 H SmallIBM4.9$0.11nonono
Llama 3.2 11B (Vision)Meta3$0.34nonono
Nova 2.0 Lite (high)Amazon20.8$0.85nonono
Qwen3.5 4BAlibaba20.4$0.06yesnoyes
Qwen3.6 35B A3B (Non-reasoning)Alibaba24.6$0.84nonono
DeepSeek V4 Pro (Non-reasoning)DeepSeek31.9$0.54nonono
NVIDIA Nemotron Nano 12B v2 VLNVIDIA8.8$0.30nonono
Qwen3.5 Omni FlashAlibaba19.2$0.28nonono
Magistral Small 1.2Mistral11.5$0.75nonono
Gemma 4 26B A4B (Non-reasoning)Google20.4$0.20nonono
Llama 3.1 Nemotron 70BNVIDIA7.4$1.2nonono
Sarvam 30B (high)Sarvam6.4$0.05nonono
Nova 2.0 Lite (Non-reasoning)Amazon11.8$0.85nonono
GPT-5.6 Sol (Non-reasoning)OpenAI41.9$8nonono
Celeris-1Celeris12.4$0.33nonono
Granite 4.1 8BIBM6.4$0.06nonono
Apertus 8B InstructSwiss AI Initiative1$0.13nonono
Gemini 3.8 Flash (high)Google58.7$1.5yesnono
Nemotron 3 Nano Omni 30B A3BNVIDIA15$0.13nonono
Agnes 2.5 Pro AlphaSapiens AI39.7$0.56nonono
Olmo 3 7BAllen Institute for AI2.4$0.13nonono
Grok 4.3 (Non-reasoning)SpaceXAI25$1.6nonono
GPT-5.6 Terra (Non-reasoning)OpenAI34.6$4.5nonono
Nova 2.0 Pro Preview (Non-reasoning)Amazon14.4$3.4nonono
Claude 4.5 HaikuAnthropic29.9$2nonono
Qwen3.7 PlusAlibaba39.4$0.70nonono
NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)NVIDIA4.2$0.30nonono
DeepSeek V4 Flash (Non-reasoning)DeepSeek29.3$0.12nonono
ERNIE 4.5 300B A47BBaidu8.9$0.48nonono
Nova 2.0 Omni (low)Amazon16.7$0.85nonono
Trinity Large ThinkingArcee AI18.7$0.41nonono
Solar Pro 3Upstage14.5$0.26nonono
Qwen3 Omni 30B A3B (Reasoning)Alibaba9.5$0.43nonono
DeepSeek V4 Pro (max)DeepSeek45.3$0.54nonono
GPT-5.5 Instant (June 2026)OpenAI29.2$11nonono
Llama Nemotron UltraNVIDIA8.9$0.90nonono
Gemma 4 31B (Non-reasoning)Google22.3$0.21nonono
Hermes 4 405B (Non-reasoning)Nous Research8.6$1.5nonono
Claude Sonnet 5 (Non-reasoning)Anthropic42.6$4nonono
Gemma 4 E4BGoogle12.2$0.04yesnoyes
Reka Flash 3Reka AI3.7$0.35nonono
GPT-5.6 Luna (Non-reasoning)OpenAI26.8$0.45nonono
Llama Nemotron Super 49B v1.5NVIDIA12.4$0.40nonono
Nova PremierAmazon12.7$5nonono
GLM-5.2 (Non-reasoning)Z AI34.8$2.1nonono
Ring-2.6-1TInclusionAI31.7$0.85nonono
Qwen3.5 35B A3B (Non-reasoning)Alibaba24.3$0.69nonono
NVIDIA Nemotron Nano 9B V2NVIDIA8.7$0.07nonono
Claude Sonnet 4.6 (Non-reasoning, low)Anthropic35.1$6nonono
Agnes 2.5 Pro BetaSapiens AI49.1$0.15yesnono
Nova 2.0 Pro Preview (low)Amazon19.8$3.4nonono
Quasar 438B (max)Multiverse Computing43$0.90nonono
KAT-Coder-Pro V2KwaiKAT33.7$0.53nonono
Gemma 4 12BGoogle22.2$0.15nonoyes

02·release dates

83 records · 139 served models

Intelligence by release date

JulOct2025AprJulOct2026AprJul0204060Intelligence IndexClaude Fable 5.1 · 65.7

Claude Fable 5.1maxAnthropicreleased 2026-09-01intelligence 65.7on Conifer $9 in · $45 outhighest served score when released

highest served score to date one lab's best score, in release order

03·running cost

8 models · 60k in + 4k out per minute

Cost per hour of a steady coding workload

the meters start when this panel is on screen

  1. Gemini 3.7 Flash (high)Google$3.6/hour$3.6/hour · $0.75 in / $3.8 out per Mtok
  2. DeepSeek V4 Pro 0813 (max)DeepSeek$5.3/hour$5.3/hour · $1.3 in / $2.6 out per Mtok
  3. GLM-5.3 (max)Z AI$6.1/hour$6.1/hour · $1.4 in / $4.4 out per Mtok
  4. Qwen3.8 MaxAlibaba$8.6/hour$8.6/hour · $2 in / $6 out per Mtok
  5. Kimi K3 (max)Kimi$14/hour$14/hour · $3 in / $15 out per Mtok
  6. Grok 4.6 (high)SpaceXAI$17/hour$17/hour · $4 in / $12 out per Mtok
  7. GPT-5.6 Sol (max)OpenAI$19/hour$19/hour · $4 in / $20 out per Mtok
  8. Claude Fable 5.1 (max)Anthropic$43/hour$43/hour · $9 in / $45 out per Mtok

04·time to first token

Time to first token, best model per lab

Median time to first token; the reply then streams at each model's output speed.

11.49s

In one sentence, what is a Pareto frontier?

  1. DeepSeek V4 Pro 0813 (max)

    A Pareto frontier is the set of choices where nothing can be improved without making something else worse.

    first token at 1.9s
  2. GLM-5.3 (max)

    A Pareto frontier is the set of choices where nothing can be improved without making something else worse.

    first token at 2.0s
  3. Claude Opus 4.6 (Non-reasoning, high)

    A Pareto frontier is the set of choices where nothing can be improved without making something else worse.

    first token at 2.1s
  4. Qwen3.8 Max

    A Pareto frontier is the set of choices where nothing can be improved without making something else worse.

    first token at 2.5s
  5. Kimi K3 (max)

    A Pareto frontier is the set of choices where nothing can be improved without making something else worse.

    first token at 5.3s
  6. GPT-5.4 mini (xhigh)

    A Pareto frontier is the set of choices where nothing can be improved without making something else worse.

    first token at 7.6s
  7. Grok 4.5 (high)

    A Pareto frontier is the set of choices where nothing can be improved without making something else worse.

    first token at 10s
  8. Gemini 3.7 Flash (high)

    A Pareto frontier is the set of choices where nothing can be improved without making something else worse.

    first token at 11s

Claude Fable 5.1 (max), the slowest served model at 273s to first token, is left out. The fastest, Ministral 3 3B, takes 0.60s.

05·hallucination rate

Wrong answers instead of declining

Of 100 questions a model could not answer correctly, how many it answered anyway instead of declining.

GLM-5.3maxZ AIintelligence 59.5hallucinated 29.6%on Conifer $1.4 in · $4.4 out

06·labs

12 labs · 221 models

Price against intelligence, by lab

Intelligence Index against blended list price per million tokens, log scale, the same axes in every panel.

Anthropic12 · best 65.7$0.10$1$1003060OpenAI32 · best 61.2$0.10$1$1003060Google17 · best 58.7$0.10$1$1003060SpaceXAI4 · best 60.9$0.10$1$1003060Kimi5 · best 59.7$0.10$1$1003060Z AI12 · best 59.5$0.10$1$1003060Alibaba41 · best 58.1$0.10$1$1003060DeepSeek10 · best 53.2$0.10$1$1003060Meta7 · best 56.8$0.10$1$1003060MiniMax5 · best 45.4$0.10$1$1003060Mistral10 · best 30.4$0.10$1$1003060NVIDIA14 · best 38.3$0.10$1$1003060

Claude Fable 5.1maxAnthropicintelligence 65.7blended $20/Mtokon Conifer $9 in · $45 outserved by Conifer

07·output speed

The same paragraph at six output speeds

Each model types at its median measured output speed.

Gemini 3.5 Flash-Lite382 tok/s
0.4s
Gemini 3.7 Flash293 tok/s
0.5s
GPT-5.4134 tok/s
1.1s
Claude Fable 5.167 tok/s
2.2s
Claude Opus 557 tok/s
2.6s
Gemma 4 31B35 tok/s
4.3s

08·memory footprint

What fits on your machine

Pick a memory size and a model; the model needs its Q4_K_M file plus 0.6 GB for the runtime.

kept for the system and the context4.0 GBHermes 4 14B15B · 9.6 GB of 16 GB60% of the memory2.4 GB to spare

The next size up, Mistral Small 3.2 24B Instruct 2506, needs about 15 GB.

09·served models

153 served models

Every served model

Claude Fable 5.1maxAnthropicclosed65.781.667273s1M$9$452026-09-01
Claude Opus 5maxAnthropicclosed63.1785777s1M$5$252026-07-24
Claude Fable 5Anthropicclosed62.176.570105s1M$10$502026-06-09
GPT-5.6 SolmaxOpenAIclosed60.977.47799s1.1M$4$202026-07-09
Grok 4.6highSpaceXAIclosed60.976.86050s500k$4$122026-08-12
Kimi K3maxKimiopen59.776.2385.3s1M$3$152026-07-16
GLM-5.3maxZ AIopen59.574.8752.0s1M$1.4$4.42026-08-18
Qwen3.8 MaxAlibabaclosed58.171.8392.5s256k$2$62026-08-03
Qwen3.8 2.4T A95BAlibabaopen57.771.9402.6s262k$2$62026-08-12
GLM-5.3-FlashZ AIopen57.571.5471.7s1M$0.15$0.502026-08-26
Claude Opus 4.8maxAnthropicclosed57.374.36244s1M$5$252026-05-28
GPT-5.6 TerramaxOpenAIclosed56.676.7103231s1.1M$2$122026-07-09
GPT-5.5xhighOpenAIclosed56.374.98452s1.1M$5$302026-04-23
Gemini 3.7 FlashhighGoogleclosed5676.129311s1M$0.75$3.82026-08-13
Grok 4.5highSpaceXAIclosed55.872.45410s500k$4$122026-07-08
Qwen3.8-Flash-NextAlibabaopen55.873.1822.8s1M$0.15$0.472026-08-26
Claude Sonnet 5maxAnthropicclosed55.371.578178s1M$2$102026-06-30
Claude Opus 4.7maxAnthropicclosed5573.65218s1M$5$252026-04-16
DeepSeek V4 Pro 0813maxDeepSeekopen53.268.8601.9s1M$1.3$2.62026-08-13
GPT-5.4xhighOpenAIclosed53.171.1134115s1.1M$2.5$152026-03-05
GLM-5.2maxZ AIopen52.668.8691.6s1M$1.4$4.42026-06-16
GPT-5.6 LunamaxOpenAIclosed52.371.4120162s1.1M$0.20$1.22026-07-09
Gemini 3.5 FlashGoogleclosed5270.119615s1M$1.5$92026-05-19
Qwen3.8 27BxhighAlibabaopen5268.1404.2s262k$0.50$32026-08-14
DeepSeek V4 Flash 0731maxDeepSeekopen51.869.11401.2s1M$0.44$1.32026-07-31
Gemini 3.6 FlashGoogleclosed51.669.218216s1M$0.75$3.82026-07-21
DeepSeek V4 Flash VisionmaxDeepSeekclosed51.5651201.1s1M$0.44$1.32026-08-21
Gemini 3.1 Pro PreviewGoogleclosed47.768.811127s1M$2$122026-02-19
Qwen3.7 MaxAlibabaclosed46.7662042.3s1M$2.5$7.52026-05-19
MiniMax-M3MiniMaxopen45.458.6891.4s1M$0.30$1.22026-06-01
Kimi K2.6Kimiopen45.161.8412.5s262k$0.95$42026-04-20
GPT-5.2xhighOpenAIclosed43.3·72109s400k$3.5$282025-12-11
Kimi K2.7 CodeKimiopen4360.8393.0s262k$0.95$42026-06-12
MiMo-V2.5-ProXiaomiopen42.960.2354.1s1M$1$32026-04-22
InklingThinking Machinesopen42.352.1742.9s524k$1$4.02026-07-15
Hy3Tencentopen42.258.8942.8s262k$0.14$0.582026-07-06
Inkling SmallThinking Machinesopen41.252.91112.7s524k$0.50$1.22026-07-30
GLM-5.1Z AIopen4155.8501.8s203k$1.1$3.52026-04-07
GPT-5.4 minixhighOpenAIclosed40.956.11917.6s400k$0.75$4.52026-03-17
GLM-5Z AIopen40.6·661.4s203k$0.60$2.12026-02-11
GPT-5.4 nanoxhighOpenAIclosed39.756.11695.5s400k$0.20$1.32026-03-17
GLM-5-TurboZ AIclosed39.1···203k$1.2$42026-03-15
MiniMax-M2.7MiniMaxopen38.952.6741.5s197k$0.25$12026-03-18
Claude Opus 4.6 (Non-reasoning, high)Anthropicclosed38.8·362.1s1M$5$252026-02-05
Nemotron 3 UltraNVIDIAopen38.349.31642.7s262k$0.50$2.22026-06-04
MiMo-V2.5Xiaomiopen3856.8583.8s262k$0.40$22026-04-22
Grok 4.3highSpaceXAIclosed37.942.213519s1M$2.5$52026-04-30
Ling 3.0 FlashInclusionAIopen37.850.63302.6s131k$0.06$0.182026-08-04
Qwen3.6 27BAlibabaopen37.753.7533.6s262k$0.32$3.22026-04-22
GPT-5.1highOpenAIclosed37.549.48743s400k$2.5$202025-11-13
Gemini 3.5 Flash-LiteGoogleclosed37.449.33827.0s1M$0.30$2.52026-07-21
Claude Sonnet 4.6 (Non-reasoning, high)Anthropicclosed36.8·441.7s1M$3$152026-02-17
Kimi K2.5Kimiopen3646.8··262k$0.60$32026-01-27
GLM 5V TurboZ AIclosed35.3···205k$1.2$42026-04-01
GPT-5highOpenAIclosed35.337.88663s400k$2.5$202025-08-07
Muse GlimmerhighMetaopen35.1491090.80s131k$0.30$1.22026-08-10
Qwen3.5 27BAlibabaopen34.6·775.6s262k$0.26$2.62026-02-24
GLM-4.7Z AIopen34.545.3941.3s200k$0.60$2.22025-12-22
MiniMax-M2.5MiniMaxopen34.5·971.6s205k$0.30$1.22026-02-12
Qwen3.5 397B A17BAlibabaopen34.348.2892.2s262k$0.45$32026-02-16
DeepSeek V3.2DeepSeekopen32.844.2··164k$0.26$0.382025-12-01
Qwen3.5 122B A10BAlibabaopen32.845.71322.3s262k$0.29$2.42026-02-24
Qwen3 Max ThinkingAlibabaclosed32.5···256k$1.2$62026-01-26
MiniMax-M2.1MiniMaxopen32.1·941.8s205k$0.30$1.22025-12-23
Qwen3.6 35B A3BAlibabaopen32.141.91252.0s262k$0.10$0.952026-04-16
DeepSeek V3.1 TerminusDeepSeekopen31.443.5··131k$0.27$12025-09-22
o3OpenAIclosed31.1·1096.2s200k$3.5$142025-04-16
Step 3.7 FlashStepFunopen30.939.61032.7s262k$0.20$1.12026-05-29
Mistral Medium 3.5Mistralopen30.446.91322.4s262k$1.5$7.52026-04-29
Qwen3.5 35B A3BAlibabaopen29.9·1522.0s262k$0.14$12026-02-24
Gemma 4 31BGoogleopen29.743.4351.1s128k$0.40$0.602026-04-02
GLM-4.6Z AIopen29.345.8502.5s203k$0.50$22025-09-30
MiniMax-M2MiniMaxopen28.9·971.6s205k$0.30$1.22025-10-26
Gemini 3 Flash (Non-reasoning)Googleclosed27.9·1870.92s1M$0.50$32025-12-17
Gemma 4 26B A4BGoogleopen26.139.3··262k$0.07$0.342026-04-02
o4-minihighOpenAIclosed26.1·14523s200k$2$82025-04-16
Gemini 2.5 ProGoogleclosed25.933.311922s1M$1.3$102025-06-05
GPT-5 minihighOpenAIclosed25.815.610873s400k$0.45$3.62025-08-07
Nemotron 3 SuperNVIDIAopen25.737.71422.0s262k$0.09$0.402026-03-11
Gemini 3.1 Flash-LiteGoogleclosed25.634.72795.2s1M$0.25$1.52026-03-03
Qwen3 MaxAlibabaclosed24.5·432.4s256k$1.2$62025-09-23
Claude 4.5 Haiku (Non-reasoning)Anthropicclosed24.1·830.73s200k$1$52025-10-15
gpt-oss-120bhighOpenAIopen24.130.41500.85s131k$0.06$0.402025-08-05
Kimi K2 0905Kimiopen24·401.2s262k$0.60$2.52025-09-05
o1OpenAIclosed23.939.7··200k$7.5$302024-12-05
Nemotron 3.5 LightningNVIDIAopen23.626.82851.0s262k$0.08$0.202026-08-11
GLM-4.7-FlashZ AIopen23.3·831.1s203k$0.06$0.402026-01-19
Qwen3.5 9BAlibabaopen21.828.7812.0s262k$0.10$0.152026-03-02
Qwen3 Coder NextAlibabaopen21.336.21291.1s262k$0.20$1.52026-02-03
DeepSeek V3.1DeepSeekopen21···131k$3$4.52025-08-21
Qwen3 VL 235B A22B (Reasoning)Alibabaopen20.9·543.2s131k$0.98$4.02025-09-23
DeepSeek R1 0528DeepSeekopen20.4···164k$0.50$2.12025-05-28
Gemini 2.5 FlashGoogleclosed20.3·22119s1M$0.30$2.52025-05-20
GPT-5 nanohighOpenAIclosed20.1·14695s400k$0.03$0.202025-08-07
Qwen3 235B A22B 2507Alibabaopen19.922.1722.7s131k$0.30$32025-07-25
Mistral Small 4Mistralopen19.726.61650.82s262k$0.15$0.602026-03-16
GPT-4.1OpenAIclosed19.6·1620.91s1M$3.5$142025-04-14
Granite 4.2 8BIBMopen19.622.41440.62s131k$0.06$0.252026-08-25
o3-miniOpenAIclosed19.2·2045.4s200k$0.55$2.22025-01-31
Qwen3 Coder 480BAlibabaopen18.2·653.0s262k$1.5$7.52025-07-22
GLM-4.6VZ AIopen16.9·553.7s131k$0.30$0.902025-12-08
Qwen3 Next 80B A3B (Reasoning)Alibabaopen16.917.41872.3s262k$0.15$1.22025-09-11
GLM-4.5-AirZ AIopen16.7·832.6s131k$0.13$0.852025-07-28
Mistral Large 3Mistralopen15.920.1781.4s262k$0.50$1.52025-12-02
gpt-oss-20bhighOpenAIopen15.220.71340.89s131k$0.03$0.142025-08-05
GPT-4.1 miniOpenAIclosed14.820.2790.93s1M$0.70$2.82025-04-14
Qwen3 30B A3B 2507Alibabaopen14.612.11442.3s41k$0.12$0.502025-07-30
Llama 4 MaverickMetaopen14.516.3850.91s1M$0.20$0.802025-04-05
Nemotron 3 NanoNVIDIAopen14.514.42241.2s262k$0.05$0.202025-12-15
Qwen3 VL 235B A22BAlibabaopen14.4·522.7s262k$0.40$1.62025-09-23
Qwen3 Coder 30B A3BAlibabaopen13.6·882.6s160k$0.07$0.272025-07-31
Mistral Medium 3Mistralclosed12.5·1322.3s131k$0.40$22025-05-07
Qwen3 32BAlibabaopen11.415.31052.5s41k$0.08$0.282025-04-28
Ministral 3 14BMistralopen11.214.4950.88s262k$0.20$0.202025-12-02
GPT-4o (Nov)OpenAIclosed11.1·1171.1s128k$2.5$102024-11-20
Qwen3 14BAlibabaopen10.413.8622.8s41k$0.12$0.242025-04-28
Llama 4 ScoutMetaopen10.38.2900.82s328k$0.10$0.302025-04-05
Hermes 4 70BNous Researchopen9.9·821.4s131k$0.13$0.402025-08-27
Qwen3 VL 30B A3BAlibabaopen9.9·1132.2s262k$0.15$0.602025-10-03
GPT-4.1 nanoOpenAIclosed9.611.11260.73s1M$0.20$0.802025-04-14
GPT-4o (Aug)OpenAIclosed9.4·851.2s128k$2.5$102024-08-06
Qwen2.5 72BAlibabaopen9.4···33k$0.36$0.402024-09-19
Llama 3.3 70BMetaopen9.311.9851.7s131k$0.10$0.322024-12-06
GLM-4.5VZ AIopen9·682.4s66k$0.60$1.82025-08-11
Ministral 3 8BMistralopen99.71060.76s262k$0.15$0.152025-12-02
Qwen3 30B A3B 2507 (Non-reasoning)Alibabaopen8.9·1352.0s262k$0.05$0.192025-07-29
Hermes 4 405BNous Researchopen8.8·432.5s131k$1$32025-08-27
GPT-4o (May)OpenAIclosed8.424.2741.2s128k$8.8$262024-05-13
GPT-4o (ChatGPT)OpenAIclosed8.1···128k$4.3$172025-02-15
Command ACohereopen7.5·571.6s256k$2.5$102025-03-13
Gemma 3 27BGoogleopen7.410.1··131k$0.08$0.162025-03-12
Llama 3.1 8BMetaopen7.45.41420.82s16k$0.02$0.052024-07-23
Ministral 3 3BMistralopen7.14.82170.60s131k$0.10$0.102025-12-02
GPT-4o miniOpenAIclosed6.711.41290.84s128k$0.15$0.602024-07-18
Mistral Small 3Mistralopen6.7·1430.79s33k$0.05$0.082025-01-30
Gemma 3 12BGoogleopen5.55.8··131k$0.05$0.152025-03-12
Hermes 3 - Llama-3.1 70BNous Researchopen4.8·352.0s131k$0.70$0.702024-08-15
Phi-4Microsoftopen4.6·372.8s16k$0.07$0.142024-12-12
Gemma 3 4BGoogleopen12.7··131k$0.05$0.102025-03-12
codestral-2508mistral·····256k$0.30$0.90·
command-r-08-2024cohere·····128k$0.15$0.60·
command-r-plus-08-2024cohere·····128k$2.5$10·
command-r7b-12-2024cohere·····128k$0.04$0.15·
ernie-4.5-vl-424b-a47bnovita·····123k$0.42$1.3·
grok-build-0.1xai·····256k$1$2·
hermes-3-llama-3.1-405bdeepinfra·····131k$1$1·
llama-guard-4-12bdeepinfra·····164k$0.18$0.18·
mistral-nemonovita·····60k$0.04$0.17·
mythomax-l2-13bdeepinfra·····4k$0.40$0.40·
Seed 2.0 Codedeepinfra·····256k$0.50$3·
Seed 2.0 Minideepinfra·····256k$0.10$0.40·
Seed 2.0 Prodeepinfra·····256k$0.50$3·
wizardlm-2-8x22bnovita·····66k$0.62$0.62·

10·local catalog

26 models

Local models

Every model conifer models pull can install; on disk is the size of the Q4_K_M file.

Gemma 4 E2B ITGoogle4.6B3.1 GB128k2026-03-31reasoning · tools
Gemma 4 E4B ITGoogle7.5B5.0 GB128k2026-03-31reasoning · tools
Gemma 4 12B ITGoogle12B7.1 GB256k2026-06-03reasoning · tools
Gemma 4 31B ITGoogle31B18.3 GB256k2026-03-31reasoning · tools
Granite-Docling 258MIBM0.16B0.33 GB8k2025-09-17vision
Granite 4.0 Micro 3BIBM3.4B2.1 GB128k2025-10-02coding · reasoning · tools
Granite 4.1 3BIBM3.4B2.1 GB128k2026-04-16coding · reasoning · tools
Granite 4.0 H Tiny 7B A1BIBM6.9B · 1B active4.2 GB1M2025-10-02coding · MoE · reasoning · tools
Granite 4.0 H Small 32B A9BIBM32B · 9B active19.5 GB1M2025-10-02coding · MoE · reasoning · tools
LFM2.5 230MLiquid AI0.23B0.15 GB125k2026-06-25tools
LFM2.5 350MLiquid AI0.35B0.23 GB125k2026-03-25tools
LFM2-VL 1.6BLiquid AI1.2B0.70 GB125k2025-08-12tools · vision
LFM2.5 1.2B InstructLiquid AI1.2B0.73 GB125k2026-01-05tools
LFM2.5 1.2B ThinkingLiquid AI1.2B0.73 GB125k2026-01-20reasoning · tools
LFM2.5-VL 1.6BLiquid AI1.2B0.73 GB125k2026-01-05tools · vision
LFM2.5 8B A1BLiquid AI8.5B · 1B active5.2 GB125k2026-05-28MoE · reasoning · tools
Ministral 3 3B Instruct 2512Mistral AI3.4B2.1 GB256k2025-12-02tools
Mistral Small 3.2 24B Instruct 2506Mistral AI24B14.3 GB128k2025-06-20tools · vision
Hermes 4 14BNous Research15B9.0 GB40k2025-09-03coding · reasoning · tools
Qwen 3.5 0.8BAlibaba0.75B0.53 GB256k2026-03-01reasoning · tools
Qwen3-VL 4B InstructAlibaba4B2.5 GB256k2025-10-11tools · vision
Qwen 3.5 4BAlibaba4.2B2.7 GB256k2026-03-02coding · reasoning · tools
Qwen 3.5 9BAlibaba9B5.7 GB256k2026-02-28coding · reasoning · tools
Qwen 3.5 27BAlibaba27B16.7 GB256k2026-02-24coding · reasoning · tools
Qwen 3.6 27BAlibaba27B16.8 GB256k2026-04-22coding · reasoning · tools
Qwen 3.8 27BAlibaba27B17.1 GB128k2026-08-14coding · reasoning · tools