Intelligence des modèles d'IA

Fournisseur · 2026-09-28

kilo

82 modèles canoniques112 entrées au total (dérivés inclus)
ModèleEntrée / 1MSortie / 1MContexteFournisseursTags
IBM: Granite 4.0 Micro$0.017$0.112131K1—
Amazon: Nova Micro 1.0$0.035$0.140128K1tools
Inference.net: Schematron V2 Turbo$0.030$0.150128K1json
MythoMax 13B$0.080$0.1104K1json
Reka Edge$0.100$0.10016K1tools · json · vision
Tencent: Hy-MT2-1.8B$0.044$0.1778K1—
inclusionAI: Ling 3.0 Flash$0.060$0.180262K1tools · reasoning
inclusionAI: Ling 3.0 Flash Fin$0.060$0.180262K1tools · json · reasoning
Inference.net: Schematron V2 Small$0.050$0.230128K1json
inclusionAI: Ling 3.0 Flash VL$0.075$0.220262K1tools · json · reasoning · vision
Amazon: Nova Lite 1.0$0.060$0.240300K1tools · vision
Poolside: Laguna S 2.1$0.100$0.2001.05M1tools · reasoning
Poolside: Laguna XS 2.1$0.100$0.200262K1tools · reasoning
Reka Flash 3$0.100$0.20066K1json · reasoning
IBM: Granite 4.2 8B$0.060$0.250131K1tools · json · reasoning
Tencent: Hy-MT2-30B-A3B$0.074$0.2958K1json
Tencent: Hy-MT2-7B$0.074$0.2958K1json
ByteDance Seed: Seed 1.6 Flash$0.075$0.300262K1tools · json · reasoning · vision
Auto Small$0.050$0.400262K1tools · reasoning · vision
Seed 2.0 Mini$0.100$0.400262K1tools · json · reasoning · vision
PrismML: Ternary Bonsai 2 27B$0.075$0.500262K1tools · json · reasoning · vision
OpenAI: GPT Luna Latest$0.100$0.5001.05M1tools · json · reasoning · vision
Hy3$0.130$0.530262K1tools · json · reasoning · open-weights
Tencent: Hunyuan A13B Instruct$0.140$0.570131K1json · reasoning
Hy3 preview$0.180$0.600262K1tools · reasoning · open-weights
TheDrummer: UnslopNemo 12B$0.400$0.4001.02M1json
TheDrummer: Cydonia 24B V4.1$0.300$0.500131K1json
ReMM SLERP 13B$0.350$0.6506K1json
Trinity Large Thinking$0.250$0.800262K1tools · reasoning · open-weights
Venice: Uncensored$0.200$0.900128K1—
Mancer: Weaver (alpha)$0.400$0.7508K1—
TheDrummer: Skyfall 36B V2$0.550$0.80033K1json
Nous: Hermes 3 70B Instruct$0.700$0.700131K1json
Perceptron: Perceptron Mk1$0.150$1.5033K1json · reasoning · vision
Perceptron: Perceptron Mk1.5$0.150$1.5037K1tools · json · reasoning · vision
Inkling Small$0.450$1.20524K1tools · reasoning · vision · open-weights
Nous: Hermes 3 405B Instruct$1.00$1.00131K1json
AionLabs: Aion 3.5 Mini$0.700$1.40262K1tools · reasoning
AionLabs: Aion-3.0-Mini$0.700$1.40131K1tools · reasoning
Relace: Relace Apply 3$0.850$1.25256K1—
Seed 2.0 Lite$0.250$2.00262K1tools · json · reasoning · vision
ByteDance Seed: Seed 1.6$0.250$2.00262K1tools · json · reasoning · vision
Auto Efficient$0.325$1.951M1tools · reasoning · vision
Auto Balanced$0.325$1.951M1tools · reasoning · vision
AionLabs: Aion-2.0$0.800$1.60131K1tools · reasoning
AionLabs: Aion-RP 1.0 (8B)$0.800$1.6033K1—
Amazon: Nova 2 Lite$0.300$2.501M1tools · reasoning · vision
ByteDance Seed: Seed 2.1 Turbo$0.500$2.50262K1tools · json · reasoning · vision
Hy4 preview$0.834$2.501.05M1tools · json · reasoning · open-weights
Seed 2.0 Code$0.500$3.00262K1tools · json · reasoning · vision
Nous: Hermes 4 405B$1.00$3.00131K1reasoning
Amazon: Nova Pro 1.0$0.800$3.20300K1tools · vision
Relace: Relace Search$1.00$3.00256K1tools
Sakana Namazu$0.950$4.00262K1tools · json · reasoning · vision
Inkling$0.950$4.05524K1tools · reasoning · vision · open-weights
OpenAI: GPT Mini Latest$0.750$4.50400K1tools · json · reasoning · vision
Writer: Palmyra X5$0.600$6.001.04M1—
Magnum v4 72B$2.50$5.0033K1json
Sakana: Fugu Max$2.00$6.001M1tools · json · reasoning · vision
AionLabs: Aion-3.0$3.00$6.00131K1tools · reasoning
AionLabs: Aion 3.5$3.00$6.00262K1tools · reasoning
Pareto$2.50$7.50262K1tools · vision
OpenAI: GPT Sol Latest$2.00$10.001.05M1tools · json · reasoning · vision
OpenAI: GPT Terra Latest$2.00$12.001.05M1tools · json · reasoning · vision
Amazon: Nova Premier 1.0$2.50$12.501M1tools · vision
Fireworks: Ember-1$3.00$15.001.05M1tools · json · reasoning · vision
Auto Frontier$5.00$25.001M1tools · reasoning · vision
Sakana: Fugu Ultra v2$5.00$30.001M1tools · json · reasoning · vision
Fugu Ultra$5.00$30.001M1tools · json · reasoning · vision
OpenAI: GPT Astra Latest ($$$$)$10.00$50.001.05M1tools · json · reasoning · vision
Auto RouterInconnuInconnu2M1tools · reasoning · vision
Body Builder (beta)InconnuInconnu128K1—
Dots Studio: Dots3-Note Preview (free)InconnuInconnu512K1tools · json · reasoning · vision
inclusionAI: Ling 3.0 Flash Fin (free)InconnuInconnu262K1tools · reasoning
inclusionAI: Ling 3.0 Flash Sante (free)InconnuInconnu262K1tools · reasoning
LiquidAI: LFM2.5-2.6B (free)InconnuInconnu66K1tools · json · reasoning
OpenRouter Free Models RouterInconnuInconnu200K2tools · json · reasoning · vision
Pareto Code RouterInconnuInconnu200K1—
Poolside: Laguna S 2.1 (free)InconnuInconnu262K1tools · reasoning
Poolside: Laguna XS 2.1 (free)InconnuInconnu262K1tools · reasoning
Space Bunny Alpha (new)InconnuInconnu1M1tools · reasoning · vision
Thinking Machines: Inkling Small (free)InconnuInconnu1.05M1tools · reasoning · vision · open-weights
ByteDance: UI-TARS 7B dérivé$0.100$0.200128K1json · vision
Qwen: Qwen2.5 7B Instructdérivé$0.100$0.20033K1tools · json
Qwen: Qwen3.5-Flashdérivé$0.065$0.2601M1tools · json · reasoning · vision
Qwen: Qwen Plus 0728 (retires Oct 9)dérivé$0.260$0.7801M1tools · json
DeepSeek: DeepSeek V3.1dérivé$0.270$1.00164K1tools · json · reasoning
Google: Gemma 2 27Bdérivé$0.650$0.6508K1json
DeepSeek: DeepSeek V3 0324dérivé$0.290$1.14164K1tools · json
Qwen2.5 Coder 32B Instructdérivé$0.660$1.0033K1—
Cohere: Command A+dérivé$0.300$1.50192K1tools · json · reasoning · vision
Qwen: Qwen3.5 Plus 2026-02-15dérivé$0.260$1.561M1tools · json · reasoning · vision
DeepSeek: DeepSeek Pro Latestdérivé$0.128$1.961.05M1tools · json · reasoning
Qwen: Qwen3.5 Plus 2026-04-20dérivé$0.300$1.801M1tools · json · reasoning · vision
Qwen: Qwen3 VL 8B Thinking (retires Oct 9)dérivé$0.180$2.10131K1tools · json · reasoning · vision
OpenAI: GPT Audio Minidérivé$0.600$2.40128K1tools · json
OpenAI: GPT-3.5 Turbo (older v0613)dérivé$1.00$2.004K1tools · json
OpenAI: GPT-5 Image Minidérivé$2.50$2.00400K1json · reasoning · vision
OpenAI: GPT-3.5 Turbo 16kdérivé$3.00$4.0016K1tools · json
Mistral Large 2407dérivé$2.00$6.00131K1tools · json
Google: Gemini 2.5 Pro Preview 06-05dérivé$1.25$10.001.05M1tools · json · reasoning · vision
Z.ai: GLM 5.3 Primedérivé$2.80$8.801M1tools · reasoning
OpenAI: GPT Audiodérivé$2.50$10.00128K1tools · json
OpenAI: GPT-5.2 Chatdérivé$1.75$14.00128K1tools · json · vision
Perplexity: Sonar Pro Searchdérivé$3.00$15.00200K1json · reasoning · vision
OpenAI: GPT-5 Image ($$$$)dérivé$10.00$10.00400K1json · reasoning · vision
OpenAI: GPT-5.4 Image 2dérivé$8.00$15.00272K1json · reasoning · vision
Cohere: North Mini Code (free)dérivéInconnuInconnu256K1tools · reasoning
NVIDIA: Nemotron 3 Nano Omni (free)dérivéInconnuInconnu256K1tools · reasoning · vision · open-weights
NVIDIA: Nemotron 3.5 Content Safety (free)dérivéInconnuInconnu128K1reasoning · vision · open-weights
Qwen: Qwen3.8 27B (free)dérivéInconnuInconnu262K1tools · json · reasoning · vision · open-weights
StepFun: Step 3.7 Flash (free)dérivéInconnuInconnu262K1tools · reasoning · vision · open-weights

Frequently asked questions

How many AI models does kilo offer?

We track 82 canonical kilo models plus 30 community fine-tunes / derivatives (excluded from the main table). The list is recomputed daily.

Which kilo model is the cheapest?

IBM: Granite 4.0 Micro is currently the lowest-priced kilo model, at $0.017 per 1M input tokens and $0.112 per 1M output tokens. For the full apples-to-apples list, see /pricing/cheapest-llm-api.

Which kilo model has the largest context window?

Auto Router leads at 2M tokens. This is the total of prompt + completion.

Which kilo models support tool calling?

Multiple kilo models support tool calling, with Amazon: Nova Micro 1.0 being a popular pick. The capability column in the table above marks every model with kilo tool-calling support.

Which kilo models accept image input?

Reka Edge accepts image input. Other vision-capable kilo models are tagged 'vision' in the table above. See /capabilities/vision for a cross-vendor comparison.

What are the best alternatives to kilo?

Depends on the use case. For raw cost savings, look at /pricing/cheapest-llm-api. For agent-oriented workloads, /best/best-ai-model-for-agents. For long-document workflows, /best/best-long-context-llm.

How fresh is this kilo pricing data?

Daily. Our pipeline syncs every morning and rebuilds these pages on data change, so list-price moves and new model releases land within roughly 24 hours.

Dernière mise à jour :

Prices in USD per 1M tokens. Unknown means the provider does not publish per-token pricing.

Pricing and capabilities are refreshed daily and reconciled against each provider's official documentation. Always verify critical production decisions with the provider directly.