fix(ai): stop defaulting max token request caps

closes #4675
This commit is contained in:
Mario Zechner
2026-05-19 11:49:44 +02:00
parent 5e8f0cf45e
commit 2787b601d7
6 changed files with 51 additions and 20 deletions

View File

@@ -4,6 +4,7 @@
### Fixed
- Fixed OpenAI-compatible `streamSimple()` requests to stop sending model-derived default output token caps, avoiding context-window reservation failures on servers such as vLLM while preserving explicit `maxTokens` and required Anthropic `max_tokens` handling ([#4675](https://github.com/earendil-works/pi/issues/4675)).
- Fixed OpenAI prompt cache keys to clamp session-derived values to the 64-character API limit across OpenAI Responses, Chat Completions, Codex Responses, and Azure OpenAI Responses ([#4720](https://github.com/earendil-works/pi/issues/4720)).
## [0.75.3] - 2026-05-18