On a base M1 air, running local inference (non tool calling).
please share your setup
LM Studio Qwen 2.5 7B Instruct (Q4_K_M GGUF) with metal offloading
[dead]