Datenquelle: models.dev. Anbieter können Preise und Verfügbarkeit ändern; prüft vor dem Einsatz die Angaben des Anbieters. models.dev
gpt-oss-20b · Amazon Bedrock
Modell-ID: amazon-bedrock/openai.gpt-oss-20b-1:0. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.3.
gpt-oss-120b · Amazon Bedrock
Modell-ID: amazon-bedrock/openai.gpt-oss-120b-1:0. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
gpt-oss-20b · Amazon Bedrock
Modell-ID: amazon-bedrock/openai.gpt-oss-20b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.3.
gpt-oss-120b · Amazon Bedrock
Modell-ID: amazon-bedrock/openai.gpt-oss-120b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
Claude Opus 4.1 (20250805) · Merge Gateway
Modell-ID: merge-gateway/anthropic/claude-opus-4-1-20250805. Kontextfenster: 200000 tokens. Eingabe / Ausgabe je Million Tokens: $15 / $75.
GPT-OSS 20B · Merge Gateway
Modell-ID: merge-gateway/openai/gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.04 / $0.2.
GPT-OSS 120B · Merge Gateway
Modell-ID: merge-gateway/openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.09 / $0.36.
Claude Opus 4.1 · Abacus
Modell-ID: abacus/claude-opus-4-1-20250805. Kontextfenster: 200000 tokens. Eingabe / Ausgabe je Million Tokens: $15 / $75.
GPT OSS 120B · Abacus
Modell-ID: abacus/openai/gpt-oss-120b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.08 / $0.44.
Claude Opus 4.1 (latest) · OpenRouter
Modell-ID: openrouter/anthropic/claude-opus-4.1. Kontextfenster: 200000 tokens. Eingabe / Ausgabe je Million Tokens: $15 / $75.
GPT OSS 20B · OpenRouter
Modell-ID: openrouter/openai/gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.03 / $0.13.
GPT OSS 120B · OpenRouter
Modell-ID: openrouter/openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
GPT OSS 20B · Neon
Modell-ID: neon/gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.3.
Claude Opus 4.1 (latest) · Neon
Modell-ID: neon/claude-opus-4-1. Kontextfenster: 200000 tokens. Eingabe / Ausgabe je Million Tokens: $15 / $75.
GPT OSS 120B · Neon
Modell-ID: neon/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
GPT OSS 120B · ai&
Modell-ID: aiand/openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
claude-opus-4-1-20250805 · 302.AI
Modell-ID: 302ai/claude-opus-4-1-20250805. Kontextfenster: 200000 tokens. Eingabe / Ausgabe je Million Tokens: $15 / $75.
GPT OSS 120B · Synthetic
Modell-ID: synthetic/hf:openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.1 / $0.1.
GPT OSS 120B · Cerebras
Modell-ID: cerebras/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.35 / $0.75.
GPT OSS 20B · Together AI
Modell-ID: togetherai/openai/gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.05 / $0.2.
GPT OSS 120B · Together AI
Modell-ID: togetherai/openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
GPT OSS 20B · Cloudflare Workers AI
Modell-ID: cloudflare-workers-ai/@cf/openai/gpt-oss-20b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $0.3.
GPT OSS 120B · Cloudflare Workers AI
Modell-ID: cloudflare-workers-ai/@cf/openai/gpt-oss-120b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.35 / $0.75.
Claude Opus 4.1 · ZenMux
Modell-ID: zenmux/anthropic/claude-opus-4.1. Kontextfenster: 200000 tokens. Eingabe / Ausgabe je Million Tokens: $15 / $75.
GPT OSS 20B · Cortecs
Modell-ID: cortecs/gpt-oss-20b. Kontextfenster: 131000 tokens. Eingabe / Ausgabe je Million Tokens: $0.045 / $0.167.
GPT OSS 120B · Cortecs
Modell-ID: cortecs/gpt-oss-120b. Kontextfenster: 131000 tokens. Eingabe / Ausgabe je Million Tokens: $0.089 / $0.446.
GPT OSS 20B · OCI Generative AI
Modell-ID: oci/openai.gpt-oss-20b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.3.
GPT OSS 120B · OCI Generative AI
Modell-ID: oci/openai.gpt-oss-120b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
gpt-oss-120b · Tinfoil
Modell-ID: tinfoil/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
GPT OSS 20B (Groq) · Eden AI
Modell-ID: edenai/groq/openai/gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.075 / $0.3.
GPT OSS 120B (Groq) · Eden AI
Modell-ID: edenai/groq/openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
GPT OSS 120B (Scaleway) · Eden AI
Modell-ID: edenai/scaleway/gpt-oss-120b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.1719 / $0.6876.
GPT OSS 120B (Nebius) · Eden AI
Modell-ID: edenai/nebius/openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
GPT OSS 20B (Cloudflare) · Eden AI
Modell-ID: edenai/cloudflare/@cf/openai/gpt-oss-20b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $0.3.
GPT OSS 120B (Cloudflare) · Eden AI
Modell-ID: edenai/cloudflare/@cf/openai/gpt-oss-120b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.35 / $0.75.
GPT OSS 20B (OVHcloud) · Eden AI
Modell-ID: edenai/ovhcloud/gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.05 / $0.18.
GPT OSS 120B (OVHcloud) · Eden AI
Modell-ID: edenai/ovhcloud/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.09 / $0.47.
GPT OSS 20B (FlexAI) · Eden AI
Modell-ID: edenai/flexai/gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.03 / $0.13.
GPT OSS 120B (FlexAI) · Eden AI
Modell-ID: edenai/flexai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.037 / $0.17.
GPT OSS 20B (Databricks, EU) · Eden AI
Modell-ID: edenai/databricks/databricks-gpt-oss-20b@eu. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.30002.
GPT OSS 120B (Databricks, EU) · Eden AI
Modell-ID: edenai/databricks/databricks-gpt-oss-120b@eu. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15001 / $0.59997.
GPT OSS 20B (Databricks) · Eden AI
Modell-ID: edenai/databricks/databricks-gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.30002.
GPT OSS 120B (Databricks) · Eden AI
Modell-ID: edenai/databricks/databricks-gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15001 / $0.59997.
GPT OSS 20B (Deep Infra) · Eden AI
Modell-ID: edenai/deepinfra/openai/gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.03 / $0.14.
GPT OSS 120B (Deep Infra) · Eden AI
Modell-ID: edenai/deepinfra/openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.037 / $0.17.
GPT OSS 120B (Fireworks AI) · Eden AI
Modell-ID: edenai/fireworks_ai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
GPT OSS 120B (Together AI) · Eden AI
Modell-ID: edenai/together_ai/openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
GPT OSS 120B (Cerebras) · Eden AI
Modell-ID: edenai/cerebras/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.35 / $0.75.
GPT OSS 120B (IONOS) · Eden AI
Modell-ID: edenai/ionos/openai/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.1719 / $0.7449.
GPT OSS 20B · LMStudio
Modell-ID: lmstudio/openai/gpt-oss-20b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
GPT-OSS-120B · Nvidia
Modell-ID: nvidia/openai/gpt-oss-120b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
DeepSeek V3.1 Terminus · NanoGPT
Modell-ID: nano-gpt/deepseek-ai/DeepSeek-V3.1-Terminus. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.25 / $0.7.
Mistral Devstral Small 2505 · NanoGPT
Modell-ID: nano-gpt/mistralai/devstral-small-2505. Kontextfenster: 32768 tokens. Eingabe / Ausgabe je Million Tokens: $0.06 / $0.06.
Llama 3.1 70B Dracarys 2 · NanoGPT
Modell-ID: nano-gpt/abacusai/Dracarys-72B-Instruct. Kontextfenster: 32768 tokens. Eingabe / Ausgabe je Million Tokens: $0.493 / $0.493.
Codestral 2508 · NanoGPT
Modell-ID: nano-gpt/mistralai/codestral-2508. Kontextfenster: 256000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $0.9.
Qwen/Qwen3-Coder-30B-A3B-Instruct · SiliconFlow (China)
Modell-ID: siliconflow-cn/Qwen/Qwen3-Coder-30B-A3B-Instruct. Kontextfenster: 262000 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.28.
Mistral: Codestral 2508 · Kilo Gateway
Modell-ID: kilo/mistralai/codestral-2508. Kontextfenster: 256000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $0.9.
Codestral 2508 · OpenRouter
Modell-ID: openrouter/mistralai/codestral-2508. Kontextfenster: 256000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $0.9.
Qwen/Qwen3-Coder-30B-A3B-Instruct · SiliconFlow
Modell-ID: siliconflow/Qwen/Qwen3-Coder-30B-A3B-Instruct. Kontextfenster: 262000 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.28.
GPT OSS 120B · DInference
Modell-ID: dinference/gpt-oss-120b. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.0675 / $0.27.
Qwen/Qwen3-Coder-480B-A35B-Instruct · SiliconFlow (China)
Modell-ID: siliconflow-cn/Qwen/Qwen3-Coder-480B-A35B-Instruct. Kontextfenster: 262000 tokens. Eingabe / Ausgabe je Million Tokens: $0.25 / $1.
Qwen3 Coder 30B A3B Instruct · Clarifai
Modell-ID: clarifai/qwen/qwenCoder/models/Qwen3-Coder-30B-A3B-Instruct. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.11458 / $0.74812.
Qwen3 30B A3B Thinking 2507 · Clarifai
Modell-ID: clarifai/qwen/qwenLM/models/Qwen3-30B-A3B-Thinking-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.36 / $1.3.
Qwen3 Coder 30B A3B Instruct · ModelScope
Modell-ID: modelscope/Qwen/Qwen3-Coder-30B-A3B-Instruct. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3 4B Instruct · Pioneer
Modell-ID: pioneer/Qwen/Qwen3-4B-Instruct-2507. Kontextfenster: 32768 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $0.2.
Qwen3 Coder 30B A3B Instruct · Helicone
Modell-ID: helicone/qwen3-coder-30b-a3b-instruct. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.09999999999999999 / $0.3.
Qwen 3 Coder 30B A3B Instruct · Vercel AI Gateway
Modell-ID: vercel/alibaba/qwen3-coder-30b-a3b. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
Veo 3.0 Fast Generate · Vercel AI Gateway
Modell-ID: vercel/google/veo-3.0-fast-generate-001. Kontextfenster: 0 tokens. Eingabe / Ausgabe je Million Tokens: — / —.
Qwen3-Coder 30B-A3B Instruct · Amazon Bedrock
Modell-ID: amazon-bedrock/qwen.qwen3-coder-30b-a3b-v1:0. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.15 / $0.6.
Qwen/Qwen3-Coder-480B-A35B-Instruct · SiliconFlow
Modell-ID: siliconflow/Qwen/Qwen3-Coder-480B-A35B-Instruct. Kontextfenster: 262000 tokens. Eingabe / Ausgabe je Million Tokens: $0.25 / $1.
Command A Vision · Cohere
Modell-ID: cohere/command-a-vision-07-2025. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $2.5 / $10.
Qwen/Qwen3-30B-A3B-Instruct-2507 · SiliconFlow (China)
Modell-ID: siliconflow-cn/Qwen/Qwen3-30B-A3B-Instruct-2507. Kontextfenster: 262000 tokens. Eingabe / Ausgabe je Million Tokens: $0.09 / $0.3.
Qwen3 Reranker 4B · evroc
Modell-ID: evroc/Qwen/Qwen3-Reranker-4B. Kontextfenster: 32000 tokens. Eingabe / Ausgabe je Million Tokens: $0.0575 / $0.
Qwen3 Embedding 8B · evroc
Modell-ID: evroc/Qwen/Qwen3-Embedding-8B. Kontextfenster: 40960 tokens. Eingabe / Ausgabe je Million Tokens: $0.115 / $0.115.
Codestral (Mistral AI) · LLM Gateway
Modell-ID: llmgateway-providers/mistral/codestral-2508. Kontextfenster: 256000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $0.9.
Qwen3 30B A3B Instruct 2507 · Clarifai
Modell-ID: clarifai/qwen/qwenLM/models/Qwen3-30B-A3B-Instruct-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $0.5.
Qwen3 30B A3B Instruct 2507 · ModelScope
Modell-ID: modelscope/Qwen/Qwen3-30B-A3B-Instruct-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3 30B A3B Thinking 2507 · ModelScope
Modell-ID: modelscope/Qwen/Qwen3-30B-A3B-Thinking-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Codestral · DevPass (LLM Gateway)
Modell-ID: llmgateway/codestral-2508. Kontextfenster: 256000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $0.9.
Qwen/Qwen3-30B-A3B-Instruct-2507 · SiliconFlow
Modell-ID: siliconflow/Qwen/Qwen3-30B-A3B-Instruct-2507. Kontextfenster: 262000 tokens. Eingabe / Ausgabe je Million Tokens: $0.09 / $0.3.
qwen3-235b-a22b-instruct-2507 · 302.AI
Modell-ID: 302ai/qwen3-235b-a22b-instruct-2507. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.29 / $1.143.
Codestral 2508 · Cortecs
Modell-ID: cortecs/codestral-2508. Kontextfenster: 256000 tokens. Eingabe / Ausgabe je Million Tokens: $0.368 / $1.103.
Qwen3 30B A3B 2507 · LMStudio
Modell-ID: lmstudio/qwen/qwen3-30b-a3b-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3 30B A3B Instruct 2507 · CoreWeave
Modell-ID: wandb/Qwen/Qwen3-30B-A3B-Instruct-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.1 / $0.3.
Qwen: Qwen3 30B A3B Instruct 2507 · Kilo Gateway
Modell-ID: kilo/qwen/qwen3-30b-a3b-instruct-2507. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.13 / $0.52.
Qwen3 30B A3B Instruct 2507 · OpenRouter
Modell-ID: openrouter/qwen/qwen3-30b-a3b-instruct-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.04815 / $0.19305.
GLM-4.5 · 302.AI
Modell-ID: 302ai/glm-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.286 / $1.142.
Qwen3 Coder Flash · NanoGPT
Modell-ID: nano-gpt/qwen/qwen3-coder-flash. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.5.
GLM 4.5 Air (Thinking) · NanoGPT
Modell-ID: nano-gpt/z-ai/GLM-4.5-Air:thinking. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.12 / $0.8.
GLM 4.5 (Thinking) · NanoGPT
Modell-ID: nano-gpt/z-ai/GLM-4.5:thinking. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.3.
GLM 4.5 · NanoGPT
Modell-ID: nano-gpt/z-ai/glm-4.5. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.3.
GLM 4.5 Air · NanoGPT
Modell-ID: nano-gpt/z-ai/GLM-4.5-Air. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.12 / $0.8.
Qwen3 Coder Flash · DigitalOcean
Modell-ID: digitalocean/qwen3-coder-flash. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.45 / $1.7.
Wan2.2-T2V-A14B · DigitalOcean
Modell-ID: digitalocean/wan2-2-t2v-a14b. Kontextfenster: 100 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $0.
zai-org/GLM-4.5-Air · SiliconFlow (China)
Modell-ID: siliconflow-cn/zai-org/GLM-4.5-Air. Kontextfenster: 131000 tokens. Eingabe / Ausgabe je Million Tokens: $0.14 / $0.86.
Qwen/Qwen3-235B-A22B-Thinking-2507 · SiliconFlow (China)
Modell-ID: siliconflow-cn/Qwen/Qwen3-235B-A22B-Thinking-2507. Kontextfenster: 262000 tokens. Eingabe / Ausgabe je Million Tokens: $0.13 / $0.6.
GLM-4.5-Air · Impossibl
Modell-ID: impossibl/zai/glm-4.5-air. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $1.1.
GLM-4.5 · Impossibl
Modell-ID: impossibl/zai/glm-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM-4.5 Air (EmberCloud) · LLM Gateway
Modell-ID: llmgateway-providers/embercloud/glm-4.5-air. Kontextfenster: 131000 tokens. Eingabe / Ausgabe je Million Tokens: $0.13 / $0.85.
GLM-4.5 (EmberCloud) · LLM Gateway
Modell-ID: llmgateway-providers/embercloud/glm-4.5. Kontextfenster: 131000 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
Qwen3 Coder Flash (Alibaba Cloud) · LLM Gateway
Modell-ID: llmgateway-providers/alibaba/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.5.
Qwen Flash (Alibaba Cloud) · LLM Gateway
Modell-ID: llmgateway-providers/alibaba/qwen-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.05 / $0.4.
GLM-4.5 Air (Z AI) · LLM Gateway
Modell-ID: llmgateway-providers/zai/glm-4.5-air. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $1.1.
GLM-4.5 X (Z AI) · LLM Gateway
Modell-ID: llmgateway-providers/zai/glm-4.5-x. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $2.2 / $8.9.
GLM-4.5 AirX (Z AI) · LLM Gateway
Modell-ID: llmgateway-providers/zai/glm-4.5-airx. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $1.1 / $4.5.
GLM-4.5 (Z AI) · LLM Gateway
Modell-ID: llmgateway-providers/zai/glm-4.5. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM-4.5-Air · OrcaRouter
Modell-ID: orcarouter/z-ai/glm-4.5-air. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $1.1.
GLM-4.5 · OrcaRouter
Modell-ID: orcarouter/z-ai/glm-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
Qwen3 Coder Flash · Alibaba (China)
Modell-ID: alibaba-cn/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.144 / $0.574.
Qwen Flash · Alibaba (China)
Modell-ID: alibaba-cn/qwen-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.022 / $0.216.
GLM-4.5 · ModelScope
Modell-ID: modelscope/ZhipuAI/GLM-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
GLM-4.5 · NovitaAI
Modell-ID: novita-ai/zai-org/glm-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM-4.5-Flash · UnoRouter
Modell-ID: unorouter/glm-4.5-flash:free. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3 Coder Flash · LLMTR
Modell-ID: llmtr/qwen/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.5.
Qwen Flash · LLMTR
Modell-ID: llmtr/qwen/qwen-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.05 / $0.4.
GLM-4.5 · Hugging Face
Modell-ID: huggingface/zai-org/GLM-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM-4.5-Air · Hugging Face
Modell-ID: huggingface/zai-org/GLM-4.5-Air. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.13 / $0.85.
Qwen3 Coder Flash · Alibaba
Modell-ID: alibaba/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.5.
Qwen Flash · Alibaba
Modell-ID: alibaba/qwen-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.05 / $0.4.
GLM 4.5 Air · Vercel AI Gateway
Modell-ID: vercel/zai/glm-4.5-air. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $1.1.
GLM 4.5 · Vercel AI Gateway
Modell-ID: vercel/zai/glm-4.5. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM-4.5-Air · DevPass (LLM Gateway)
Modell-ID: llmgateway/glm-4.5-air. Kontextfenster: 131000 tokens. Eingabe / Ausgabe je Million Tokens: $0.13 / $0.85.
Qwen3 Coder Flash · DevPass (LLM Gateway)
Modell-ID: llmgateway/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.5.
Qwen Flash · DevPass (LLM Gateway)
Modell-ID: llmgateway/qwen-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.05 / $0.4.
GLM-4.5 X · DevPass (LLM Gateway)
Modell-ID: llmgateway/glm-4.5-x. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $2.2 / $8.9.
GLM-4.5 AirX · DevPass (LLM Gateway)
Modell-ID: llmgateway/glm-4.5-airx. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $1.1 / $4.5.
GLM-4.5 · DevPass (LLM Gateway)
Modell-ID: llmgateway/glm-4.5. Kontextfenster: 131000 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM-4.5 · Zhipu AI
Modell-ID: zhipuai/glm-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM-4.5-Flash · Zhipu AI
Modell-ID: zhipuai/glm-4.5-flash. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
GLM-4.5-Air · Zhipu AI
Modell-ID: zhipuai/glm-4.5-air. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $1.1.
GLM 4.5 Flash · EmpirioLabs AI
Modell-ID: empiriolabs/glm-4-5-flash. Kontextfenster: 200000 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3 Coder Flash · Kilo Gateway
Modell-ID: kilo/qwen/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.195 / $0.975.
GLM-4.5-Air · Kilo Gateway
Modell-ID: kilo/z-ai/glm-4.5-air. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.13 / $0.85.
GLM-4.5 · Kilo Gateway
Modell-ID: kilo/z-ai/glm-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM 4.5 Air · submodel
Modell-ID: submodel/zai-org/GLM-4.5-Air. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.1 / $0.5.
GLM 4.5 FP8 · submodel
Modell-ID: submodel/zai-org/GLM-4.5-FP8. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $0.8.
Qwen3 Coder Flash · Merge Gateway
Modell-ID: merge-gateway/qwen/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.144 / $0.574.
Qwen Flash · Merge Gateway
Modell-ID: merge-gateway/qwen/qwen-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.022 / $0.216.
GLM-4.5 Air · Merge Gateway
Modell-ID: merge-gateway/zai/glm-4.5-air. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $1.1.
GLM-4.5 · Merge Gateway
Modell-ID: merge-gateway/zai/glm-4.5. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM-4.5 · Abacus
Modell-ID: abacus/zai-org/GLM-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
Qwen3 Coder Flash · OpenRouter
Modell-ID: openrouter/qwen/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.195 / $0.975.
GLM-4.5-Air · OpenRouter
Modell-ID: openrouter/z-ai/glm-4.5-air. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.13 / $0.85.
GLM-4.5 · OpenRouter
Modell-ID: openrouter/z-ai/glm-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
Qwen3 Coder Flash · Ofox
Modell-ID: ofox/qwen/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.5 / $2.5.
Qwen Flash · Ofox
Modell-ID: ofox/qwen/qwen-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.022 / $0.22.
Qwen3 Coder Flash · Ofox
Modell-ID: ofox/bailian/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.5 / $2.5.
Qwen Flash · Ofox
Modell-ID: ofox/bailian/qwen-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.022 / $0.22.
zai-org/GLM-4.5-Air · SiliconFlow
Modell-ID: siliconflow/zai-org/GLM-4.5-Air. Kontextfenster: 131000 tokens. Eingabe / Ausgabe je Million Tokens: $0.14 / $0.86.
Qwen/Qwen3-235B-A22B-Thinking-2507 · SiliconFlow
Modell-ID: siliconflow/Qwen/Qwen3-235B-A22B-Thinking-2507. Kontextfenster: 262000 tokens. Eingabe / Ausgabe je Million Tokens: $0.13 / $0.6.
GLM-4.5-Air · Z.AI
Modell-ID: zai/glm-4.5-air. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $1.1.
GLM-4.5-Flash · Z.AI
Modell-ID: zai/glm-4.5-flash. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
GLM-4.5 · Z.AI
Modell-ID: zai/glm-4.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.6 / $2.2.
GLM 4.5 Air · ZenMux
Modell-ID: zenmux/z-ai/glm-4.5-air. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.1165 / $0.2911.
GLM 4.5 · ZenMux
Modell-ID: zenmux/z-ai/glm-4.5. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.2911 / $1.1645.
qwen3-30b-a3b-instruct-2507 · Cortecs
Modell-ID: cortecs/qwen3-30b-a3b-instruct-2507. Kontextfenster: 262000 tokens. Eingabe / Ausgabe je Million Tokens: $0.099 / $0.299.
Qwen3 Coder Flash · Eden AI
Modell-ID: edenai/qwen/qwen3-coder-flash. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.5.
Phi 4 Multimodal · NanoGPT
Modell-ID: nano-gpt/phi-4-multimodal-instruct. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.11.
Phi 4 Mini · NanoGPT
Modell-ID: nano-gpt/phi-4-mini-instruct. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.17 / $0.68.
DeepSeek V3.1 · NanoGPT
Modell-ID: nano-gpt/deepseek-ai/DeepSeek-V3.1. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $0.7.
Shisa V2 Llama 3.3 70B · NanoGPT
Modell-ID: nano-gpt/shisa-ai/shisa-v2-llama3.3-70b. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.5 / $0.5.
Llama 3 70B abliterated · NanoGPT
Modell-ID: nano-gpt/failspy/Meta-Llama-3-70B-Instruct-abliterated-v3.5. Kontextfenster: 8192 tokens. Eingabe / Ausgabe je Million Tokens: $0.7 / $0.7.
EVA Llama 3.33 70B · NanoGPT
Modell-ID: nano-gpt/EVA-UNIT-01/EVA-LLaMA-3.33-70B-v0.0. Kontextfenster: 32768 tokens. Eingabe / Ausgabe je Million Tokens: $2.006 / $2.006.
EVA-Qwen2.5-32B-v0.2 · NanoGPT
Modell-ID: nano-gpt/EVA-UNIT-01/EVA-Qwen2.5-32B-v0.2. Kontextfenster: 16384 tokens. Eingabe / Ausgabe je Million Tokens: $0.799 / $0.799.
K2-Think · NanoGPT
Modell-ID: nano-gpt/LLM360/K2-Think. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0.17 / $0.68.
Seed 1.6 Flash (250715) (ByteDance) · LLM Gateway
Modell-ID: llmgateway-providers/bytedance/seed-1-6-flash-250715. Kontextfenster: 256000 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.3.
Phi 4 Multimodal · Nvidia
Modell-ID: nvidia/microsoft/phi-4-multimodal-instruct. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Seed 1.6 Flash (250715) · DevPass (LLM Gateway)
Modell-ID: llmgateway/seed-1-6-flash-250715. Kontextfenster: 256000 tokens. Eingabe / Ausgabe je Million Tokens: $0.07 / $0.3.
Qwen3 235B A22B Thinking 2507 (NovitaAI) · LLM Gateway
Modell-ID: llmgateway-providers/novita/qwen3-235b-a22b-thinking-2507. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $3.
Qwen3-235B-A22B-Thinking-2507 · ModelScope
Modell-ID: modelscope/Qwen/Qwen3-235B-A22B-Thinking-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3 235B A22b Thinking 2507 · NovitaAI
Modell-ID: novita-ai/qwen/qwen3-235b-a22b-thinking-2507. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $3.
Qwen3 235B A22B Instruct 2507 · Nebius Token Factory
Modell-ID: nebius/Qwen/Qwen3-235B-A22B-Instruct-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.2 / $0.6.
Qwen3 235B A22B Thinking · Helicone
Modell-ID: helicone/qwen3-235b-a22b-thinking. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $2.9000000000000004.
Qwen3-235B-A22B-Thinking-2507 · Hugging Face
Modell-ID: huggingface/Qwen/Qwen3-235B-A22B-Thinking-2507. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $3.
Llama 3.3 Nemotron Super 49B v1.5 · Nvidia
Modell-ID: nvidia/nvidia/llama-3.3-nemotron-super-49b-v1.5. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
sarvam-m · Nvidia
Modell-ID: nvidia/sarvamai/sarvam-m. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen: Qwen3 235B A22B Thinking 2507 · Kilo Gateway
Modell-ID: kilo/qwen/qwen3-235b-a22b-thinking-2507. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.23 / $2.3.
Qwen3 235B A22B Thinking 2507 · OpenRouter
Modell-ID: openrouter/qwen/qwen3-235b-a22b-thinking-2507. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.23 / $2.3.
llama-3_2-nemoretriever-300m-embed-v1 · Nvidia
Modell-ID: nvidia/nvidia/llama-3_2-nemoretriever-300m-embed-v1. Kontextfenster: 32768 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3 Coder Plus · NanoGPT
Modell-ID: nano-gpt/qwen/qwen3-coder-plus. Kontextfenster: 128000 tokens. Eingabe / Ausgabe je Million Tokens: $1 / $5.
Qwen3 Coder Plus (Alibaba Cloud) · LLM Gateway
Modell-ID: llmgateway-providers/alibaba/qwen3-coder-plus. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $1 / $5.
Qwen3 Coder Plus · Alibaba Coding Plan (China)
Modell-ID: alibaba-coding-plan-cn/qwen3-coder-plus. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3 Coder Plus · Alibaba (China)
Modell-ID: alibaba-cn/qwen3-coder-plus. Kontextfenster: 1048576 tokens. Eingabe / Ausgabe je Million Tokens: $0.574 / $2.296.
Qwen3 Coder 480B A35B Instruct · NovitaAI
Modell-ID: novita-ai/qwen/qwen3-coder-480b-a35b-instruct. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.38 / $1.55.
Qwen3 Coder 480B A35B Instruct Turbo · Helicone
Modell-ID: helicone/qwen3-coder. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.22 / $0.95.
Qwen3 Coder Plus · LLMTR
Modell-ID: llmtr/qwen/qwen3-coder-plus. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $1 / $5.
Qwen3-Coder-480B-A35B-Instruct · Hugging Face
Modell-ID: huggingface/Qwen/Qwen3-Coder-480B-A35B-Instruct. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $2 / $2.
Qwen3 Coder Plus · Alibaba
Modell-ID: alibaba/qwen3-coder-plus. Kontextfenster: 1048576 tokens. Eingabe / Ausgabe je Million Tokens: $1 / $5.
Qwen3 Coder 480B A35B Instruct · Nvidia
Modell-ID: nvidia/qwen/qwen3-coder-480b-a35b-instruct. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3 Coder Plus · Vercel AI Gateway
Modell-ID: vercel/alibaba/qwen3-coder-plus. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $1 / $5.
Qwen3 Coder Plus · DevPass (LLM Gateway)
Modell-ID: llmgateway/qwen3-coder-plus. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $1 / $5.
Qwen3 Coder · FastRouter
Modell-ID: fastrouter/qwen/qwen3-coder. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.2.
Qwen3 Coder 480B A35B Instruct Turbo · Deep Infra
Modell-ID: deepinfra/Qwen/Qwen3-Coder-480B-A35B-Instruct-Turbo. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.
Qwen3 Coder Plus · Kilo Gateway
Modell-ID: kilo/qwen/qwen3-coder-plus. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.65 / $3.25.
Qwen: Qwen3 Coder 480B A35B · Kilo Gateway
Modell-ID: kilo/qwen/qwen3-coder. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.975 / $4.875.
Qwen3 Coder Plus · Alibaba Coding Plan
Modell-ID: alibaba-coding-plan/qwen3-coder-plus. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0 / $0.
Qwen3-Coder 480B-A35B Instruct · Amazon Bedrock
Modell-ID: amazon-bedrock/qwen.qwen3-coder-480b-a35b-v1:0. Kontextfenster: 131072 tokens. Eingabe / Ausgabe je Million Tokens: $0.45 / $1.8.
Qwen3 Coder Plus · Merge Gateway
Modell-ID: merge-gateway/qwen/qwen3-coder-plus. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.574 / $2.294.
Qwen3 Coder Plus · OpenRouter
Modell-ID: openrouter/qwen/qwen3-coder-plus. Kontextfenster: 1000000 tokens. Eingabe / Ausgabe je Million Tokens: $0.65 / $3.25.
Qwen3 Coder 480B A35B · OpenRouter
Modell-ID: openrouter/qwen/qwen3-coder. Kontextfenster: 262144 tokens. Eingabe / Ausgabe je Million Tokens: $0.3 / $1.