EXPLORE
dhruvhead/glm-5.2-sm120 MIRROR
blackwellglmllm-inferencemoenvfp4
Shell 0 0
dhruvhead/lws MIRROR
llm-inferencesig-apps
Go 0 0
dhruvhead/qwen38-27b-rtx3090 MIRROR
kv-cachellm-inferencelocal-llmquantizationqwen
Python 0 0
dhruvhead/GLM_proxy MIRROR
ai-codingai-modelai-toolsclaude-apiclaude-code
JavaScript 0 0
dhruvhead/dynamo MIRROR
diffusiondisaggregated-servingkubernetesllm-inferenceomni
Rust 0 0 4
flashinfer-ai/flashinfer MIRROR
FlashInfer: Kernel Library for LLM Serving
attentioncudadistributed-inferencegpujit
Python 0 0 188
nomic-ai/gpt4all MIRROR
GPT4All: Run Local LLMs on Any Device. Open-source and available for commercial use.
ai-chatllm-inference
C++ 0 0 92