diff --git a/config.toml b/config.toml index b440b61..f535476 100644 --- a/config.toml +++ b/config.toml @@ -9,17 +9,17 @@ port = 8080 model_id = "z-ai/glm5" endpoint = "https://integrate.api.nvidia.com/v1" api_key = "env:SK_NV_API_KEY" - temperature = 0.0 - max_tokens = 4096 - timeout_secs = 120 + temperature = 1.0 + max_tokens = 8192 + timeout_secs = 600 [models.fast] model_id = "minimaxai/minimax-m2.5" endpoint = "https://integrate.api.nvidia.com/v1" api_key = "env:SK_NV_API_KEY" - temperature = 0.1 - max_tokens = 1024 - timeout_secs = 60 + temperature = 1.0 + max_tokens = 4096 + timeout_secs = 360 [mcp_servers] [mcp_servers.context7]