QI-Budget: Quality-aware inference budgeting via dynamic visual-token routing for efficient VLM reasoning.
mlx efficient-inference vision-language-model multimodal-reasoning scienceqa qwen2-5-vl visual-token
-
Updated
Aug 23, 2026 - Python