fix(ai): prune deprecated direct minimax models

This commit is contained in:
Mario Zechner
2026-03-25 22:44:17 +01:00
parent 14dedf8a9b
commit 6dc43d6dd1
12 changed files with 175 additions and 236 deletions

View File

@@ -804,6 +804,23 @@ export const MODELS = {
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"bedrock-converse-stream">,
"minimax.minimax-m2.5": {
id: "minimax.minimax-m2.5",
name: "MiniMax M2.5",
api: "bedrock-converse-stream",
provider: "amazon-bedrock",
baseUrl: "https://bedrock-runtime.us-east-1.amazonaws.com",
reasoning: true,
input: ["text"],
cost: {
input: 0.3,
output: 1.2,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 196608,
maxTokens: 98304,
} satisfies Model<"bedrock-converse-stream">,
"mistral.devstral-2-123b": {
id: "mistral.devstral-2-123b",
name: "Devstral 2 123B",
@@ -1042,6 +1059,23 @@ export const MODELS = {
contextWindow: 128000,
maxTokens: 4096,
} satisfies Model<"bedrock-converse-stream">,
"nvidia.nemotron-super-3-120b": {
id: "nvidia.nemotron-super-3-120b",
name: "NVIDIA Nemotron 3 Super 120B A12B",
api: "bedrock-converse-stream",
provider: "amazon-bedrock",
baseUrl: "https://bedrock-runtime.us-east-1.amazonaws.com",
reasoning: true,
input: ["text"],
cost: {
input: 0.15,
output: 0.65,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 262144,
maxTokens: 131072,
} satisfies Model<"bedrock-converse-stream">,
"openai.gpt-oss-120b-1:0": {
id: "openai.gpt-oss-120b-1:0",
name: "gpt-oss-120b",
@@ -1416,6 +1450,23 @@ export const MODELS = {
contextWindow: 200000,
maxTokens: 131072,
} satisfies Model<"bedrock-converse-stream">,
"zai.glm-5": {
id: "zai.glm-5",
name: "GLM-5",
api: "bedrock-converse-stream",
provider: "amazon-bedrock",
baseUrl: "https://bedrock-runtime.us-east-1.amazonaws.com",
reasoning: true,
input: ["text"],
cost: {
input: 1,
output: 3.2,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 202752,
maxTokens: 101376,
} satisfies Model<"bedrock-converse-stream">,
},
"anthropic": {
"claude-3-5-haiku-20241022": {
@@ -4498,91 +4549,6 @@ export const MODELS = {
} satisfies Model<"anthropic-messages">,
},
"minimax": {
"MiniMax-M2": {
id: "MiniMax-M2",
name: "MiniMax-M2",
api: "anthropic-messages",
provider: "minimax",
baseUrl: "https://api.minimax.io/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.3,
output: 1.2,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.1": {
id: "MiniMax-M2.1",
name: "MiniMax-M2.1",
api: "anthropic-messages",
provider: "minimax",
baseUrl: "https://api.minimax.io/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.3,
output: 1.2,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.1-highspeed": {
id: "MiniMax-M2.1-highspeed",
name: "MiniMax-M2.1-highspeed",
api: "anthropic-messages",
provider: "minimax",
baseUrl: "https://api.minimax.io/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.6,
output: 2.4,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.5": {
id: "MiniMax-M2.5",
name: "MiniMax-M2.5",
api: "anthropic-messages",
provider: "minimax",
baseUrl: "https://api.minimax.io/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.3,
output: 1.2,
cacheRead: 0.03,
cacheWrite: 0.375,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.5-highspeed": {
id: "MiniMax-M2.5-highspeed",
name: "MiniMax-M2.5-highspeed",
api: "anthropic-messages",
provider: "minimax",
baseUrl: "https://api.minimax.io/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.6,
output: 2.4,
cacheRead: 0.06,
cacheWrite: 0.375,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.7": {
id: "MiniMax-M2.7",
name: "MiniMax-M2.7",
@@ -4619,91 +4585,6 @@ export const MODELS = {
} satisfies Model<"anthropic-messages">,
},
"minimax-cn": {
"MiniMax-M2": {
id: "MiniMax-M2",
name: "MiniMax-M2",
api: "anthropic-messages",
provider: "minimax-cn",
baseUrl: "https://api.minimaxi.com/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.3,
output: 1.2,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.1": {
id: "MiniMax-M2.1",
name: "MiniMax-M2.1",
api: "anthropic-messages",
provider: "minimax-cn",
baseUrl: "https://api.minimaxi.com/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.3,
output: 1.2,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.1-highspeed": {
id: "MiniMax-M2.1-highspeed",
name: "MiniMax-M2.1-highspeed",
api: "anthropic-messages",
provider: "minimax-cn",
baseUrl: "https://api.minimaxi.com/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.6,
output: 2.4,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.5": {
id: "MiniMax-M2.5",
name: "MiniMax-M2.5",
api: "anthropic-messages",
provider: "minimax-cn",
baseUrl: "https://api.minimaxi.com/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.3,
output: 1.2,
cacheRead: 0.03,
cacheWrite: 0.375,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.5-highspeed": {
id: "MiniMax-M2.5-highspeed",
name: "MiniMax-M2.5-highspeed",
api: "anthropic-messages",
provider: "minimax-cn",
baseUrl: "https://api.minimaxi.com/anthropic",
reasoning: true,
input: ["text"],
cost: {
input: 0.6,
output: 2.4,
cacheRead: 0.06,
cacheWrite: 0.375,
},
contextWindow: 204800,
maxTokens: 131072,
} satisfies Model<"anthropic-messages">,
"MiniMax-M2.7": {
id: "MiniMax-M2.7",
name: "MiniMax-M2.7",
@@ -8295,13 +8176,13 @@ export const MODELS = {
reasoning: false,
input: ["text"],
cost: {
input: 0.55,
output: 2.2,
input: 0.5700000000000001,
output: 2.3,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 131000,
maxTokens: 4096,
contextWindow: 131072,
maxTokens: 131072,
} satisfies Model<"openai-completions">,
"moonshotai/kimi-k2-0905": {
id: "moonshotai/kimi-k2-0905",
@@ -8363,8 +8244,8 @@ export const MODELS = {
reasoning: false,
input: ["text"],
cost: {
input: 0.27,
output: 1,
input: 0.135,
output: 0.5,
cacheRead: 0,
cacheWrite: 0,
},
@@ -8450,7 +8331,7 @@ export const MODELS = {
cost: {
input: 0.09999999999999999,
output: 0.5,
cacheRead: 0.04,
cacheRead: 0.09999999999999999,
cacheWrite: 0,
},
contextWindow: 262144,
@@ -9542,7 +9423,7 @@ export const MODELS = {
cacheWrite: 0,
},
contextWindow: 32768,
maxTokens: 4096,
maxTokens: 32768,
} satisfies Model<"openai-completions">,
"qwen/qwen-max": {
id: "qwen/qwen-max",
@@ -10205,7 +10086,7 @@ export const MODELS = {
cacheWrite: 0,
},
contextWindow: 256000,
maxTokens: 4096,
maxTokens: 65536,
} satisfies Model<"openai-completions">,
"qwen/qwen3.5-flash-02-23": {
id: "qwen/qwen3.5-flash-02-23",
@@ -10258,6 +10139,23 @@ export const MODELS = {
contextWindow: 131072,
maxTokens: 131072,
} satisfies Model<"openai-completions">,
"reka/reka-edge": {
id: "reka/reka-edge",
name: "Reka Edge",
api: "openai-completions",
provider: "openrouter",
baseUrl: "https://openrouter.ai/api/v1",
reasoning: false,
input: ["text", "image"],
cost: {
input: 0.19999999999999998,
output: 0.19999999999999998,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 16384,
maxTokens: 16384,
} satisfies Model<"openai-completions">,
"relace/relace-search": {
id: "relace/relace-search",
name: "Relace: Relace Search",
@@ -10794,9 +10692,9 @@ export const MODELS = {
reasoning: true,
input: ["text"],
cost: {
input: 0.96,
output: 3.1999999999999997,
cacheRead: 0.192,
input: 1.2,
output: 4,
cacheRead: 0.24,
cacheWrite: 0,
},
contextWindow: 202752,
@@ -12802,8 +12700,8 @@ export const MODELS = {
reasoning: false,
input: ["text", "image"],
cost: {
input: 1,
output: 1,
input: 0,
output: 0,
cacheRead: 0,
cacheWrite: 0,
},
@@ -12819,8 +12717,8 @@ export const MODELS = {
reasoning: false,
input: ["text", "image"],
cost: {
input: 3,
output: 15,
input: 0,
output: 0,
cacheRead: 0,
cacheWrite: 0,
},
@@ -13014,6 +12912,23 @@ export const MODELS = {
contextWindow: 2000000,
maxTokens: 30000,
} satisfies Model<"anthropic-messages">,
"xai/grok-4.20-multi-agent": {
id: "xai/grok-4.20-multi-agent",
name: "Grok 4.20 Multi-Agent",
api: "anthropic-messages",
provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true,
input: ["text"],
cost: {
input: 2,
output: 6,
cacheRead: 0.19999999999999998,
cacheWrite: 0,
},
contextWindow: 2000000,
maxTokens: 2000000,
} satisfies Model<"anthropic-messages">,
"xai/grok-4.20-multi-agent-beta": {
id: "xai/grok-4.20-multi-agent-beta",
name: "Grok 4.20 Multi Agent Beta",
@@ -13031,6 +12946,23 @@ export const MODELS = {
contextWindow: 2000000,
maxTokens: 2000000,
} satisfies Model<"anthropic-messages">,
"xai/grok-4.20-non-reasoning": {
id: "xai/grok-4.20-non-reasoning",
name: "Grok 4.20 Non-Reasoning",
api: "anthropic-messages",
provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh",
reasoning: false,
input: ["text", "image"],
cost: {
input: 2,
output: 6,
cacheRead: 0.19999999999999998,
cacheWrite: 0,
},
contextWindow: 2000000,
maxTokens: 2000000,
} satisfies Model<"anthropic-messages">,
"xai/grok-4.20-non-reasoning-beta": {
id: "xai/grok-4.20-non-reasoning-beta",
name: "Grok 4.20 Beta Non-Reasoning",
@@ -13048,6 +12980,23 @@ export const MODELS = {
contextWindow: 2000000,
maxTokens: 2000000,
} satisfies Model<"anthropic-messages">,
"xai/grok-4.20-reasoning": {
id: "xai/grok-4.20-reasoning",
name: "Grok 4.20 Reasoning",
api: "anthropic-messages",
provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true,
input: ["text", "image"],
cost: {
input: 2,
output: 6,
cacheRead: 0.19999999999999998,
cacheWrite: 0,
},
contextWindow: 2000000,
maxTokens: 2000000,
} satisfies Model<"anthropic-messages">,
"xai/grok-4.20-reasoning-beta": {
id: "xai/grok-4.20-reasoning-beta",
name: "Grok 4.20 Beta Reasoning",