M3 Max 96GB 本地部署 Qwen3.6-35B-A3B:打造 SolidWorks 智能机械设计与企业知识库 AI 工作站
目前已经存在针对 Apple Silicon 优化的 MLX 量化版本,例如 Qwen3.6-35B-A3B-OptiQ-4bit,可以直接使用 MLX 运行,无需将模型转换成 GGUF。它采用 MoE(Mixture of Experts)架构,总参数规模约 35B,但每个 Token 实际激活的参数规模约为 3B,因此非常适合 Apple Silicon 本地推理。该版本针对 Apple Si
所有评论(0)