跳到正文
原文
Hugging Face Blog·· 2023-09-26AI 评分42

Llama 2 在 Amazon SageMaker 上的基准测试

Llama 2 on Amazon SageMaker a Benchmark

AI 导读

Hugging Face 对 Llama 2 在 Amazon SageMaker 上的 60 种部署配置进行了基准测试,评估了 7B、13B 和 70B 参数规模模型在不同 EC2 实例和负载下的延迟与吞吐量。测试涵盖 GPTQ 4-bit 量化技术,旨在为最具成本效益、最佳延迟和最佳吞吐量场景提供优化策略。

来源:Hugging Face Blog · huggingface.co