Local AI workstation — discover, run, chat, benchmark, and generate images from open-weight models. DFlash/DDTree speculative decoding, TurboQuant & TriAttention cache compression strategies, MLX + llama.cpp + vLLM + MTPLX backends.
desktop-apppythonmachine-learningtypescriptaiimage-generationmlxtaurihuggingfaceapple-siliconopenai-apicache-compressionllmstable-diffusionllama-cppvllmlocal-aiggufspeculative-decodingdflash
-
Updated
Aug 1, 2026 - Python