Align GPT-5.5 Codex capability handling (#3618)

* fix(ai): align gpt-5.5 codex capabilities

* chore(ai): update generated models

* fix(ai): apply gpt-5.5 priority pricing to api

---------

Co-authored-by: Mario Zechner <badlogicgames@gmail.com>
This commit is contained in:
Markus Ylisiurunen
2026-04-24 00:49:33 +03:00
committed by GitHub
parent 86ba08a2e3
commit ba8f1c228a
5 changed files with 273 additions and 137 deletions

View File

@@ -2491,6 +2491,23 @@ export const MODELS = {
contextWindow: 1050000,
maxTokens: 128000,
} satisfies Model<"azure-openai-responses">,
"gpt-5.5": {
id: "gpt-5.5",
name: "GPT-5.5",
api: "azure-openai-responses",
provider: "azure-openai-responses",
baseUrl: "",
reasoning: true,
input: ["text", "image"],
cost: {
input: 5,
output: 30,
cacheRead: 0.5,
cacheWrite: 0,
},
contextWindow: 1050000,
maxTokens: 130000,
} satisfies Model<"azure-openai-responses">,
"o1": {
id: "o1",
name: "o1",
@@ -3894,8 +3911,8 @@ export const MODELS = {
contextWindow: 131072,
maxTokens: 8192,
} satisfies Model<"google-generative-ai">,
"gemma-4-26b-it": {
id: "gemma-4-26b-it",
"gemma-4-26b-a4b-it": {
id: "gemma-4-26b-a4b-it",
name: "Gemma 4 26B",
api: "google-generative-ai",
provider: "google",
@@ -6233,6 +6250,23 @@ export const MODELS = {
contextWindow: 1050000,
maxTokens: 128000,
} satisfies Model<"openai-responses">,
"gpt-5.5": {
id: "gpt-5.5",
name: "GPT-5.5",
api: "openai-responses",
provider: "openai",
baseUrl: "https://api.openai.com/v1",
reasoning: true,
input: ["text", "image"],
cost: {
input: 5,
output: 30,
cacheRead: 0.5,
cacheWrite: 0,
},
contextWindow: 1050000,
maxTokens: 130000,
} satisfies Model<"openai-responses">,
"o1": {
id: "o1",
name: "o1",
@@ -7019,6 +7053,23 @@ export const MODELS = {
contextWindow: 1050000,
maxTokens: 128000,
} satisfies Model<"openai-responses">,
"hy3-preview-free": {
id: "hy3-preview-free",
name: "Hy3 preview Free",
api: "openai-completions",
provider: "opencode",
baseUrl: "https://opencode.ai/zen/v1",
reasoning: true,
input: ["text"],
cost: {
input: 0,
output: 0,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 256000,
maxTokens: 64000,
} satisfies Model<"openai-completions">,
"kimi-k2.5": {
id: "kimi-k2.5",
name: "Kimi K2.5",
@@ -7771,23 +7822,6 @@ export const MODELS = {
contextWindow: 131000,
maxTokens: 4096,
} satisfies Model<"openai-completions">,
"arcee-ai/trinity-large-preview:free": {
id: "arcee-ai/trinity-large-preview:free",
name: "Arcee AI: Trinity Large Preview (free)",
api: "openai-completions",
provider: "openrouter",
baseUrl: "https://openrouter.ai/api/v1",
reasoning: false,
input: ["text"],
cost: {
input: 0,
output: 0,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 131000,
maxTokens: 4096,
} satisfies Model<"openai-completions">,
"arcee-ai/trinity-large-thinking": {
id: "arcee-ai/trinity-large-thinking",
name: "Arcee AI: Trinity Large Thinking",
@@ -8109,7 +8143,7 @@ export const MODELS = {
cacheWrite: 0,
},
contextWindow: 131072,
maxTokens: 32768,
maxTokens: 65536,
} satisfies Model<"openai-completions">,
"deepseek/deepseek-v3.2-exp": {
id: "deepseek/deepseek-v3.2-exp",
@@ -8159,7 +8193,7 @@ export const MODELS = {
cacheRead: 0.024999999999999998,
cacheWrite: 0.08333333333333334,
},
contextWindow: 1000000,
contextWindow: 1048576,
maxTokens: 8192,
} satisfies Model<"openai-completions">,
"google/gemini-2.0-flash-lite-001": {
@@ -8358,13 +8392,13 @@ export const MODELS = {
reasoning: true,
input: ["text", "image"],
cost: {
input: 0.07,
output: 0.35,
cacheRead: 0.04,
input: 0.06,
output: 0.33,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 262144,
maxTokens: 262144,
maxTokens: 4096,
} satisfies Model<"openai-completions">,
"google/gemma-4-26b-a4b-it:free": {
id: "google/gemma-4-26b-a4b-it:free",
@@ -8394,7 +8428,7 @@ export const MODELS = {
cost: {
input: 0.13,
output: 0.38,
cacheRead: 0.019999999499999997,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 262144,
@@ -8434,6 +8468,23 @@ export const MODELS = {
contextWindow: 128000,
maxTokens: 50000,
} satisfies Model<"openai-completions">,
"inclusionai/ling-2.6-1t:free": {
id: "inclusionai/ling-2.6-1t:free",
name: "inclusionAI: Ling-2.6-1T (free)",
api: "openai-completions",
provider: "openrouter",
baseUrl: "https://openrouter.ai/api/v1",
reasoning: false,
input: ["text"],
cost: {
input: 0,
output: 0,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 262144,
maxTokens: 32768,
} satisfies Model<"openai-completions">,
"inclusionai/ling-2.6-flash:free": {
id: "inclusionai/ling-2.6-flash:free",
name: "inclusionAI: Ling-2.6-flash (free)",
@@ -8902,13 +8953,13 @@ export const MODELS = {
reasoning: false,
input: ["text"],
cost: {
input: 0.02,
output: 0.04,
input: 0.01,
output: 0.03,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 131072,
maxTokens: 16384,
maxTokens: 4096,
} satisfies Model<"openai-completions">,
"mistralai/mistral-saba": {
id: "mistralai/mistral-saba",
@@ -9123,13 +9174,13 @@ export const MODELS = {
reasoning: true,
input: ["text", "image"],
cost: {
input: 0.7999999999999999,
output: 3.5,
cacheRead: 0.19999999999999998,
input: 0.7448,
output: 4.655,
cacheRead: 0.1463,
cacheWrite: 0,
},
contextWindow: 262144,
maxTokens: 262144,
contextWindow: 256000,
maxTokens: 65536,
} satisfies Model<"openai-completions">,
"nex-agi/deepseek-v3.1-nex-n1": {
id: "nex-agi/deepseek-v3.1-nex-n1",
@@ -10466,13 +10517,13 @@ export const MODELS = {
reasoning: true,
input: ["text"],
cost: {
input: 0.13,
output: 0.6,
input: 0.14950000000000002,
output: 1.495,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 262144,
maxTokens: 262144,
contextWindow: 131072,
maxTokens: 4096,
} satisfies Model<"openai-completions">,
"qwen/qwen3-30b-a3b": {
id: "qwen/qwen3-30b-a3b",
@@ -11103,6 +11154,23 @@ export const MODELS = {
contextWindow: 262144,
maxTokens: 65536,
} satisfies Model<"openai-completions">,
"tencent/hy3-preview:free": {
id: "tencent/hy3-preview:free",
name: "Tencent: Hy3 preview (free)",
api: "openai-completions",
provider: "openrouter",
baseUrl: "https://openrouter.ai/api/v1",
reasoning: true,
input: ["text"],
cost: {
input: 0,
output: 0,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 262144,
maxTokens: 262144,
} satisfies Model<"openai-completions">,
"thedrummer/rocinante-12b": {
id: "thedrummer/rocinante-12b",
name: "TheDrummer: Rocinante 12B",
@@ -11933,7 +12001,7 @@ export const MODELS = {
input: 0.5,
output: 3,
cacheRead: 0.09999999999999999,
cacheWrite: 0,
cacheWrite: 0.625,
},
contextWindow: 1000000,
maxTokens: 64000,
@@ -14055,9 +14123,9 @@ export const MODELS = {
reasoning: true,
input: ["text"],
cost: {
input: 0.09,
output: 0.29,
cacheRead: 0.045,
input: 0.09999999999999999,
output: 0.3,
cacheRead: 0.01,
cacheWrite: 0,
},
contextWindow: 262144,
@@ -14274,15 +14342,15 @@ export const MODELS = {
provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true,
input: ["text", "image"],
input: ["text"],
cost: {
input: 1.4,
output: 4.4,
cacheRead: 0.26,
cacheWrite: 0,
},
contextWindow: 202752,
maxTokens: 202752,
contextWindow: 202800,
maxTokens: 64000,
} satisfies Model<"anthropic-messages">,
"zai/glm-5v-turbo": {
id: "zai/glm-5v-turbo",