跳到正文

部署工程

把模型跑起来的工程实践:推理优化、显存与成本、Serving 架构与基础设施选型。

164条精选相关主题开源生态数据与训练端侧 AI

最新精选

第 161–164 条 · 共 164 条
6月15日周四
  1. Hugging Face:Blog(RSS)68

    Hugging Face 讲解如何用 Core ML 在 iPhone、iPad 和 Mac 上更快运行 Stable Diffusion

    Hugging Face 介绍 WWDC'23 后 Core ML 的新压缩优化,用 6-bit palettization 将 Stable Diffusion 权重从 16-bit 压到 6-bit,作者在 iPhone 13 上实测生成时间从 23.0s 降到 15.6s。

    推荐理由:原文给出 6-bit palettization 的原理、转换命令和实测速度对比,读者可照此在苹果设备上压缩并运行 Stable Diffusion。

1月24日周二
  1. Hugging Face:Blog(RSS)63

    Hugging Face Optimum 集成 ONNX Runtime 训练加速,提速 35% 以上

    Hugging Face 与 Microsoft ONNX Runtime 团队合作,在 Optimum 库中集成 ONNX Runtime 训练加速,为多种热门 Hugging Face 模型带来 35% 以上的训练提速。

    推荐理由:官方给出了具体加速数字和几行代码的迁移方式,读者可以据此评估是否在现有训练流程中启用 Optimum 加速。

5月10日周二
1月11日周二