fix(agent): simplify state API and update consumers fixes #2633

This commit is contained in:
Mario Zechner
2026-03-30 12:43:34 +02:00
parent 5e3852fc9c
commit cbe1a8b732
24 changed files with 829 additions and 1198 deletions

View File

@@ -2304,6 +2304,23 @@ export const MODELS = {
contextWindow: 400000,
maxTokens: 128000,
} satisfies Model<"azure-openai-responses">,
"gpt-5.3-chat-latest": {
id: "gpt-5.3-chat-latest",
name: "GPT-5.3 Chat (latest)",
api: "azure-openai-responses",
provider: "azure-openai-responses",
baseUrl: "",
reasoning: false,
input: ["text", "image"],
cost: {
input: 1.75,
output: 14,
cacheRead: 0.175,
cacheWrite: 0,
},
contextWindow: 128000,
maxTokens: 16384,
} satisfies Model<"azure-openai-responses">,
"gpt-5.3-codex": {
id: "gpt-5.3-codex",
name: "GPT-5.3 Codex",
@@ -5029,22 +5046,39 @@ export const MODELS = {
contextWindow: 128000,
maxTokens: 16384,
} satisfies Model<"mistral-conversations">,
"mistral-small-2603": {
id: "mistral-small-2603",
name: "Mistral Small 4",
api: "mistral-conversations",
provider: "mistral",
baseUrl: "https://api.mistral.ai",
reasoning: true,
input: ["text", "image"],
cost: {
input: 0.15,
output: 0.6,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 256000,
maxTokens: 256000,
} satisfies Model<"mistral-conversations">,
"mistral-small-latest": {
id: "mistral-small-latest",
name: "Mistral Small (latest)",
api: "mistral-conversations",
provider: "mistral",
baseUrl: "https://api.mistral.ai",
reasoning: false,
reasoning: true,
input: ["text", "image"],
cost: {
input: 0.1,
output: 0.3,
input: 0.15,
output: 0.6,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 128000,
maxTokens: 16384,
contextWindow: 256000,
maxTokens: 256000,
} satisfies Model<"mistral-conversations">,
"open-mistral-7b": {
id: "open-mistral-7b",
@@ -5575,6 +5609,23 @@ export const MODELS = {
contextWindow: 400000,
maxTokens: 128000,
} satisfies Model<"openai-responses">,
"gpt-5.3-chat-latest": {
id: "gpt-5.3-chat-latest",
name: "GPT-5.3 Chat (latest)",
api: "openai-responses",
provider: "openai",
baseUrl: "https://api.openai.com/v1",
reasoning: false,
input: ["text", "image"],
cost: {
input: 1.75,
output: 14,
cacheRead: 0.175,
cacheWrite: 0,
},
contextWindow: 128000,
maxTokens: 16384,
} satisfies Model<"openai-responses">,
"gpt-5.3-codex": {
id: "gpt-5.3-codex",
name: "GPT-5.3 Codex",
@@ -10779,12 +10830,12 @@ export const MODELS = {
reasoning: false,
input: ["text"],
cost: {
input: 0.071,
output: 0.463,
cacheRead: 0,
input: 0.22,
output: 0.88,
cacheRead: 0.11,
cacheWrite: 0,
},
contextWindow: 40960,
contextWindow: 32768,
maxTokens: 16384,
} satisfies Model<"anthropic-messages">,
"alibaba/qwen-3-30b": {
@@ -10813,13 +10864,13 @@ export const MODELS = {
reasoning: true,
input: ["text"],
cost: {
input: 0.29,
output: 0.59,
cacheRead: 0.145,
input: 0.16,
output: 0.64,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 131072,
maxTokens: 40960,
contextWindow: 128000,
maxTokens: 8192,
} satisfies Model<"anthropic-messages">,
"alibaba/qwen3-235b-a22b-thinking": {
id: "alibaba/qwen3-235b-a22b-thinking",
@@ -10847,13 +10898,13 @@ export const MODELS = {
reasoning: false,
input: ["text"],
cost: {
input: 0.39999999999999997,
output: 1.5999999999999999,
cacheRead: 0.022,
input: 1.5,
output: 7.5,
cacheRead: 0.3,
cacheWrite: 0,
},
contextWindow: 262144,
maxTokens: 66536,
maxTokens: 65536,
} satisfies Model<"anthropic-messages">,
"alibaba/qwen3-coder-30b-a3b": {
id: "alibaba/qwen3-coder-30b-a3b",
@@ -11323,13 +11374,13 @@ export const MODELS = {
reasoning: true,
input: ["text"],
cost: {
input: 0.5,
output: 1.5,
cacheRead: 0,
input: 0.56,
output: 1.68,
cacheRead: 0.28,
cacheWrite: 0,
},
contextWindow: 163840,
maxTokens: 16384,
maxTokens: 8192,
} satisfies Model<"anthropic-messages">,
"deepseek/deepseek-v3.1-terminus": {
id: "deepseek/deepseek-v3.1-terminus",
@@ -11601,7 +11652,7 @@ export const MODELS = {
cacheWrite: 0,
},
contextWindow: 128000,
maxTokens: 100000,
maxTokens: 8192,
} satisfies Model<"anthropic-messages">,
"meituan/longcat-flash-thinking": {
id: "meituan/longcat-flash-thinking",
@@ -11646,13 +11697,13 @@ export const MODELS = {
reasoning: false,
input: ["text"],
cost: {
input: 0.09999999999999999,
output: 0.09999999999999999,
cacheRead: 0.09999999999999999,
input: 0.22,
output: 0.22,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 128000,
maxTokens: 16384,
maxTokens: 8192,
} satisfies Model<"anthropic-messages">,
"meta/llama-3.2-11b": {
id: "meta/llama-3.2-11b",
@@ -11714,12 +11765,12 @@ export const MODELS = {
reasoning: false,
input: ["text", "image"],
cost: {
input: 0.24,
output: 0.9700000000000001,
input: 0.35,
output: 1.15,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 128000,
contextWindow: 524288,
maxTokens: 8192,
} satisfies Model<"anthropic-messages">,
"meta/llama-4-scout": {
@@ -12623,6 +12674,23 @@ export const MODELS = {
contextWindow: 1050000,
maxTokens: 128000,
} satisfies Model<"anthropic-messages">,
"openai/gpt-oss-120b": {
id: "openai/gpt-oss-120b",
name: "gpt-oss-120b",
api: "anthropic-messages",
provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true,
input: ["text"],
cost: {
input: 0.15,
output: 0.6,
cacheRead: 0,
cacheWrite: 0,
},
contextWindow: 128000,
maxTokens: 8192,
} satisfies Model<"anthropic-messages">,
"openai/gpt-oss-20b": {
id: "openai/gpt-oss-20b",
name: "gpt-oss-20b",
@@ -13108,9 +13176,9 @@ export const MODELS = {
reasoning: true,
input: ["text"],
cost: {
input: 0.09999999999999999,
output: 0.3,
cacheRead: 0.02,
input: 0.09,
output: 0.29,
cacheRead: 0.045,
cacheWrite: 0,
},
contextWindow: 262144,
@@ -13246,7 +13314,7 @@ export const MODELS = {
cost: {
input: 0.6,
output: 2.2,
cacheRead: 0,
cacheRead: 0.11,
cacheWrite: 0,
},
contextWindow: 200000,
@@ -13286,6 +13354,23 @@ export const MODELS = {
contextWindow: 200000,
maxTokens: 128000,
} satisfies Model<"anthropic-messages">,
"zai/glm-5": {
id: "zai/glm-5",
name: "GLM 5",
api: "anthropic-messages",
provider: "vercel-ai-gateway",
baseUrl: "https://ai-gateway.vercel.sh",
reasoning: true,
input: ["text"],
cost: {
input: 1,
output: 3.1999999999999997,
cacheRead: 0.19999999999999998,
cacheWrite: 0,
},
contextWindow: 202800,
maxTokens: 131100,
} satisfies Model<"anthropic-messages">,
"zai/glm-5-turbo": {
id: "zai/glm-5-turbo",
name: "GLM 5 Turbo",