DEV Community · Show DEV8/14 15:4558 分
将1.9GB MLX模型打包进macOS DMG
Bundling a 1.9GB MLX Model Inside a macOS DMG
Eidetic Works 开发本地优先的 macOS TTS 应用 Sovereign Voice,基于 MLX 运行 Qwen3-TTS。最初 DMG 仅 403MB,但首次启动需从 HuggingFace 下载 1.9GB 模型,实测等待 549 秒,导致用户流失。解决方案是在构建时直接将模型复制进应用包,DMG 增至 1.9GB,首次启动仅需本地复制约 10 秒,且完全离线。由于签名后 Resources 只读,首次启动将模型复制到可写目录并设置 HF_HOME 和 HF_HUB_OFFLINE=1。文章对比了优化前后指标,并指出下载进度条因 daemon 无结构化事件而失效。