Updated model defs

This commit is contained in:
Mario Zechner
2026-04-29 22:58:56 +02:00
parent bc668826ed
commit 84b3aa5efc

View File

@@ -2542,6 +2542,23 @@ export const MODELS = {
contextWindow: 272000, contextWindow: 272000,
maxTokens: 128000, maxTokens: 128000,
} satisfies Model<"azure-openai-responses">, } satisfies Model<"azure-openai-responses">,
"gpt-5.5-pro": {
id: "gpt-5.5-pro",
name: "GPT-5.5 Pro",
api: "azure-openai-responses",
provider: "azure-openai-responses",
baseUrl: "",
reasoning: true,
input: ["text", "image"],
cost: {
input: 30,
output: 180,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 1050000,
maxTokens: 128000,
} satisfies Model<"azure-openai-responses">,
"o1": { "o1": {
id: "o1", id: "o1",
name: "o1", name: "o1",
@@ -6538,6 +6555,23 @@ export const MODELS = {
contextWindow: 272000, contextWindow: 272000,
maxTokens: 128000, maxTokens: 128000,
} satisfies Model<"openai-responses">, } satisfies Model<"openai-responses">,
"gpt-5.5-pro": {
id: "gpt-5.5-pro",
name: "GPT-5.5 Pro",
api: "openai-responses",
provider: "openai",
baseUrl: "https://api.openai.com/v1",
reasoning: true,
input: ["text", "image"],
cost: {
input: 30,
output: 180,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 1050000,
maxTokens: 128000,
} satisfies Model<"openai-responses">,
"o1": { "o1": {
id: "o1", id: "o1",
name: "o1", name: "o1",
@@ -7392,23 +7426,6 @@ export const MODELS = {
contextWindow: 262144, contextWindow: 262144,
maxTokens: 65536, maxTokens: 65536,
} satisfies Model<"openai-completions">, } satisfies Model<"openai-completions">,
"ling-2.6-flash-free": {
id: "ling-2.6-flash-free",
name: "Ling 2.6 Flash Free",
api: "openai-completions",
provider: "opencode",
baseUrl: "https://opencode.ai/zen/v1",
reasoning: false,
input: ["text"],
cost: {
input: 0,
output: 0,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 262100,
maxTokens: 32800,
} satisfies Model<"openai-completions">,
"minimax-m2.5": { "minimax-m2.5": {
id: "minimax-m2.5", id: "minimax-m2.5",
name: "MiniMax M2.5", name: "MiniMax M2.5",
@@ -8553,7 +8570,7 @@ export const MODELS = {
cacheRead: 0.024999999999999998, cacheRead: 0.024999999999999998,
cacheWrite: 0.08333333333333334, cacheWrite: 0.08333333333333334,
}, },
contextWindow: 1000000, contextWindow: 1048576,
maxTokens: 8192, maxTokens: 8192,
} satisfies Model<"openai-completions">, } satisfies Model<"openai-completions">,
"google/gemini-2.0-flash-lite-001": { "google/gemini-2.0-flash-lite-001": {
@@ -8879,18 +8896,18 @@ export const MODELS = {
contextWindow: 262144, contextWindow: 262144,
maxTokens: 32768, maxTokens: 32768,
} satisfies Model<"openai-completions">, } satisfies Model<"openai-completions">,
"inclusionai/ling-2.6-flash:free": { "inclusionai/ling-2.6-flash": {
id: "inclusionai/ling-2.6-flash:free", id: "inclusionai/ling-2.6-flash",
name: "inclusionAI: Ling-2.6-flash (free)", name: "inclusionAI: Ling-2.6-flash",
api: "openai-completions", api: "openai-completions",
provider: "openrouter", provider: "openrouter",
baseUrl: "https://openrouter.ai/api/v1", baseUrl: "https://openrouter.ai/api/v1",
reasoning: false, reasoning: false,
input: ["text"], input: ["text"],
cost: { cost: {
input: 0, input: 0.08,
output: 0, output: 0.24,
cacheRead: 0, cacheRead: 0.016,
cacheWrite: 0, cacheWrite: 0,
}, },
contextWindow: 262144, contextWindow: 262144,
@@ -9348,12 +9365,12 @@ export const MODELS = {
input: ["text"], input: ["text"],
cost: { cost: {
input: 0.02, input: 0.02,
output: 0.04, output: 0.03,
cacheRead: 0, cacheRead: 0,
cacheWrite: 0, cacheWrite: 0,
}, },
contextWindow: 131072, contextWindow: 131072,
maxTokens: 16384, maxTokens: 4096,
} satisfies Model<"openai-completions">, } satisfies Model<"openai-completions">,
"mistralai/mistral-saba": { "mistralai/mistral-saba": {
id: "mistralai/mistral-saba", id: "mistralai/mistral-saba",
@@ -11599,23 +11616,6 @@ export const MODELS = {
contextWindow: 1000000, contextWindow: 1000000,
maxTokens: 65536, maxTokens: 65536,
} satisfies Model<"openai-completions">, } satisfies Model<"openai-completions">,
"qwen/qwq-32b": {
id: "qwen/qwq-32b",
name: "Qwen: QwQ 32B",
api: "openai-completions",
provider: "openrouter",
baseUrl: "https://openrouter.ai/api/v1",
reasoning: true,
input: ["text"],
cost: {
input: 0.15,
output: 0.58,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 131072,
maxTokens: 131072,
} satisfies Model<"openai-completions">,
"rekaai/reka-edge": { "rekaai/reka-edge": {
id: "rekaai/reka-edge", id: "rekaai/reka-edge",
name: "Reka Edge", name: "Reka Edge",
@@ -12470,20 +12470,20 @@ export const MODELS = {
} satisfies Model<"anthropic-messages">, } satisfies Model<"anthropic-messages">,
"alibaba/qwen3-235b-a22b-thinking": { "alibaba/qwen3-235b-a22b-thinking": {
id: "alibaba/qwen3-235b-a22b-thinking", id: "alibaba/qwen3-235b-a22b-thinking",
name: "Qwen3 235B A22B Thinking 2507", name: "Qwen3 VL 235B A22B Thinking",
api: "anthropic-messages", api: "anthropic-messages",
provider: "vercel-ai-gateway", provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh", baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true, reasoning: true,
input: ["text", "image"], input: ["text", "image"],
cost: { cost: {
input: 0.22999999999999998, input: 0.39999999999999997,
output: 2.3, output: 4,
cacheRead: 0.19999999999999998, cacheRead: 0,
cacheWrite: 0, cacheWrite: 0,
}, },
contextWindow: 262114, contextWindow: 131072,
maxTokens: 262114, maxTokens: 32768,
} satisfies Model<"anthropic-messages">, } satisfies Model<"anthropic-messages">,
"alibaba/qwen3-coder": { "alibaba/qwen3-coder": {
id: "alibaba/qwen3-coder", id: "alibaba/qwen3-coder",
@@ -12655,6 +12655,23 @@ export const MODELS = {
contextWindow: 1000000, contextWindow: 1000000,
maxTokens: 64000, maxTokens: 64000,
} satisfies Model<"anthropic-messages">, } satisfies Model<"anthropic-messages">,
"alibaba/qwen3.6-27b": {
id: "alibaba/qwen3.6-27b",
name: "Qwen 3.6 27B",
api: "anthropic-messages",
provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true,
input: ["text", "image"],
cost: {
input: 0.6,
output: 3.5999999999999996,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 256000,
maxTokens: 256000,
} satisfies Model<"anthropic-messages">,
"alibaba/qwen3.6-plus": { "alibaba/qwen3.6-plus": {
id: "alibaba/qwen3.6-plus", id: "alibaba/qwen3.6-plus",
name: "Qwen 3.6 Plus", name: "Qwen 3.6 Plus",
@@ -13035,16 +13052,16 @@ export const MODELS = {
api: "anthropic-messages", api: "anthropic-messages",
provider: "vercel-ai-gateway", provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh", baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true, reasoning: false,
input: ["text"], input: ["text"],
cost: { cost: {
input: 0.28, input: 0.62,
output: 0.42, output: 1.85,
cacheRead: 0.028, cacheRead: 0,
cacheWrite: 0, cacheWrite: 0,
}, },
contextWindow: 128000, contextWindow: 128000,
maxTokens: 64000, maxTokens: 8000,
} satisfies Model<"anthropic-messages">, } satisfies Model<"anthropic-messages">,
"deepseek/deepseek-v4-flash": { "deepseek/deepseek-v4-flash": {
id: "deepseek/deepseek-v4-flash", id: "deepseek/deepseek-v4-flash",
@@ -14882,6 +14899,40 @@ export const MODELS = {
contextWindow: 1000000, contextWindow: 1000000,
maxTokens: 128000, maxTokens: 128000,
} satisfies Model<"anthropic-messages">, } satisfies Model<"anthropic-messages">,
"xiaomi/mimo-v2.5": {
id: "xiaomi/mimo-v2.5",
name: "MiMo M2.5",
api: "anthropic-messages",
provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true,
input: ["text", "image"],
cost: {
input: 0.39999999999999997,
output: 2,
cacheRead: 0.08,
cacheWrite: 0,
},
contextWindow: 1050000,
maxTokens: 131100,
} satisfies Model<"anthropic-messages">,
"xiaomi/mimo-v2.5-pro": {
id: "xiaomi/mimo-v2.5-pro",
name: "MiMo V2.5 Pro",
api: "anthropic-messages",
provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true,
input: ["text", "image"],
cost: {
input: 1,
output: 3,
cacheRead: 0.19999999999999998,
cacheWrite: 0,
},
contextWindow: 1050000,
maxTokens: 131000,
} satisfies Model<"anthropic-messages">,
"zai/glm-4.5": { "zai/glm-4.5": {
id: "zai/glm-4.5", id: "zai/glm-4.5",
name: "GLM-4.5", name: "GLM-4.5",
@@ -15587,5 +15638,23 @@ export const MODELS = {
contextWindow: 200000, contextWindow: 200000,
maxTokens: 131072, maxTokens: 131072,
} satisfies Model<"openai-completions">, } satisfies Model<"openai-completions">,
"glm-5v-turbo": {
id: "glm-5v-turbo",
name: "glm-5v-turbo",
api: "openai-completions",
provider: "zai",
baseUrl: "https://api.z.ai/api/coding/paas/v4",
compat: {"supportsDeveloperRole":false,"thinkingFormat":"zai","zaiToolStream":true},
reasoning: true,
input: ["text", "image"],
cost: {
input: 0,
output: 0,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 200000,
maxTokens: 131072,
} satisfies Model<"openai-completions">,
}, },
} as const; } as const;