跳到正文
原文
Hugging Face Blog·· 2024-02-29AI 评分23

在 Intel Gaudi 2 AI 加速器上使用 Optimum Habana 运行 Llama 2 文本生成流水线

Text-Generation Pipeline on Intel® Gaudi® 2 AI Accelerator

AI 导读

Hugging Face 发布基于 Optimum Habana 的自定义流水线,支持在 Intel Gaudi 2 上运行 Llama 2 模型。该流水线提供端到端文本生成,兼容 LangChain 并支持 DeepSpeed 分布式推理。用户可通过 `optimum-habana` 仓库中的脚本或 Python 代码快速调用,实现高效的大语言模型部署。

来源:Hugging Face Blog · huggingface.co