llm-engine简介

llm-engine是Scale AI开发的开源大语言模型微调和服务引擎,旨在简化LLM的定制化和部署过程。它提供了Python客户端库、CLI工具和Helm chart,可以在Scale的托管基础设施或自己的Kubernetes集群上运行模型推理和微调。

llm-engine logo

快速入门

  1. 安装llm-engine:
pip install scale-llm-engine
  1. 获取API密钥:

访问Scale Spellbook创建账号并获取API密钥。

  1. 设置环境变量:
export SCALE_API_KEY="[Your API key]"
  1. 使用Python客户端发送请求:
from llmengine import Completion

response = Completion.create(
    model="llama-2-7b",
    prompt="给我一个独特的煎饼店名字",
    max_new_tokens=100,
    temperature=0.2,
)

print(response.output.text)

核心功能

  • 开箱即用的API:支持部署和服务包括LLaMA、MPT、Falcon等在内的开源基础模型
  • 模型微调:可以使用自己的数据微调开源基础模型
  • 优化推理:提供用于流式响应和动态批处理的推理API
  • 开源集成:一键部署任何Hugging Face模型

学习资源

社区资源

llm-engine为开发者提供了强大而灵活的LLM定制化和部署工具,欢迎探索使用并为项目做出贡献!

文章链接:www.dongaigc.com/a/llm-engine-learning-resources

https://www.dongaigc.com/a/llm-engine-learning-resources

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐