Server: Don't ignore llama.cpp params (#8754)
* Don't ignore llama.cpp params * Add fallback for max_tokens
A
ardfork committed
978ba3d83d17b10fdf9807006048432b5b3769fc
Parent: ecf6b7f
Committed by GitHub <noreply@github.com>
on 8/4/2024, 6:16:23 PM