在 M5 Pro 上用 LM Studio 執行 Qwen3.6 與 Qwen3.8
用 MLX 4-bit 在 Apple Silicon 本機執行兩個 Qwen 模型,並處理 unified memory、context length 與 thinking 設定。
主題 · 1 篇文章
本機模型、開發工具與實作紀錄。
1 篇文章
用 MLX 4-bit 在 Apple Silicon 本機執行兩個 Qwen 模型,並處理 unified memory、context length 與 thinking 設定。
目前沒有符合這個標籤的文章。