| 52 | // V4 advertises a 384K maximum output, but the project convention caps most |
| 53 | // models to 20% of context unless the user explicitly overrides modelMaxTokens. |
| 54 | const addDeepSeekMaxTokensIfNeeded = ( |
| 55 | requestOptions: DeepSeekChatCompletionParams, |
| 56 | options: ApiHandlerOptions, |
| 57 | computedMaxTokens?: number, |
| 58 | ) => { |
| 59 | if (options.includeMaxTokens === true) { |
| 60 | requestOptions.max_completion_tokens = options.modelMaxTokens || computedMaxTokens |
| 61 | } |
| 62 | } |
| 63 | |
| 64 | export class DeepSeekHandler extends OpenAiHandler { |
| 65 | constructor(options: ApiHandlerOptions) { |