Hugging Face Blog·· 2024-02-29AI 评分23
在 Intel Gaudi 2 AI 加速器上使用 Optimum Habana 运行 Llama 2 文本生成流水线
Text-Generation Pipeline on Intel® Gaudi® 2 AI Accelerator
AI 导读
Hugging Face 发布基于 Optimum Habana 的自定义流水线,支持在 Intel Gaudi 2 上运行 Llama 2 模型。该流水线提供端到端文本生成,兼容 LangChain 并支持 DeepSpeed 分布式推理。用户可通过 `optimum-habana` 仓库中的脚本或 Python 代码快速调用,实现高效的大语言模型部署。
来源:Hugging Face Blog · huggingface.co