SippAI inference, packed simply. A blazing-fast, zero-dependency WebGPU runtime to run GGUF models directly in the browser.…Rust★ 100aicppggufinferencellamacppllmlocal-airustn@noumena-labs++
shimmy⚡ Pure-Rust WebGPU inference engine — OpenAI-API compatible, GGUF native, runs on any GPU. No Python. No llama.cpp. Sin…Rust★ 5.7kapi-servercommand-line-tooldeveloper-toolsggufhuggingfacehuggingface-modelshuggingface-transformersinference-serverm@Michael-A-Kuykendall++