Local LLM
LM Studio
qwen3.5-9b
params:
context length: 16K
Gpu offload: 32
Cpu pool size: 10
Evaluation Batch Size: 2048
Physical Batch size: 128
Max concurrent Predictions: 2
VS Code
** Continue **
config.yaml
1 | name: Main Config |
qwen3.5-9b
params:
context length: 16K
Gpu offload: 32
Cpu pool size: 10
Evaluation Batch Size: 2048
Physical Batch size: 128
Max concurrent Predictions: 2
** Continue **
config.yaml
1 | name: Main Config |