【避坑】M5max+oMLX对比DGX Spark依然拉跨 接上期评论区反馈,M5 Max换成oMLX引擎+MLX专用模型重新测试。prefill衰减改善了,但根本问题没解决——苹果FP16算力只有DGX的1/5,长上下文prefill占95%时间,差距被无限放大。 实测端到端延迟:8K以内M5更快,16K开始DGX反超,128K时M5要2分钟而DGX只要45秒,256K差距6.7倍。 结论:Mac短上下文极快但长上下文拉跨,DGX短上下文不快长上下文不慢很均衡。最终方案——DGX做主智能体跑长任务,Mac做子智能体跑短线,两者互补。 #M5max #DGXspark #macbookpro #本地ai #智能体

作者:梦*******间

音乐:@梦*******间创作的原声

时长:21:35

评论数:77

点赞数:0.02万

分享数:25

收藏数:73

更新时间:2026年9月23日 22:36

全网热门