运行生成式 AI (GenAI) 模型
使用 Genie、Qualcomm AI Runtime SDK 或开源运行时,在 Qualcomm Dragonwing IoT 设备上运行准备好的 GenAI 模型。
GenAI 模型经过准备并优化以供部署后,您可以在目标设备上运行该模型。Qualcomm 平台提供多种执行路径以满足不同需求,涵盖从高层抽象到低层控制。
下表总结了 GenAI 模型的执行方法。
Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
🚀 QLI Version 2.1 is now live ! Switch to new version to check out the latest content
使用 Genie、Qualcomm AI Runtime SDK 或开源运行时,在 Qualcomm Dragonwing IoT 设备上运行准备好的 GenAI 模型。
| 执行方法 | 详情 | 关键考虑因素 | |||
|---|---|---|---|---|---|
| Generative AI Inference Extensions (Genie) | Qualcomm 提供的框架,专为简化 LLM 和多模态模型等复杂 GenAI 模型的执行而设计。 | 处理跨 CPU、GPU 和 NPU 的多个二进制文件的编排、内存管理和硬件加速。 | 非常适合希望以最少集成工作实现即插即用部署的开发者。 | 针对 Qualcomm 硬件优化,提供低延迟和高能效。 | 最适合快速部署和生产就绪的应用。 |
| Qualcomm AI Runtime SDK (QAIRT) | 提供用于直接执行 QAIRT 二进制文件的低级 API。 | 为需要自定义执行流程或性能剖析的开发者提供细粒度的控制。 | 适用于对性能调优要求较高的高级用例。 | 针对 Qualcomm 硬件优化,提供低延迟和高能效。 | 最适合自定义工作流和性能剖析。 |
| 开源运行时 | 也可以使用开源运行时执行模型。 | 该方法适用于希望保持与现有开源生态系统兼容,同时利用 Qualcomm 优化的开发者。 | 开源运行时提供可移植性,但可能需要针对 Qualcomm 平台进行额外调优。 | 最适合研究或混合环境。 |
