M5 Pro / 64GB 上用 oMLX 部署 Qwen3.8-27B-Uncensored,DFlash2 投机解码在代码任务上把 16.4 tok/s 拉到 30–45 tok/s。附完整 Profile 配置、acceptance 实测数据,以及一个反直觉的结论:draft 接受率取决于任务类型,而不是权重是否被 abliterate 过。
从研发视角重新理解产品经理、GMV 和产品指标:产品不是只提需求,研发也不只是写代码,真正重要的是共同看见用户价值和业务价值。
一次 OpenClaw 连接 OpenAI Codex OAuth 的代理排障记录:Node.js 原生 fetch、fetchWithSsrFGuard、环境变量代理与 DNS pinning。