
optimate
nebuly-ai
A collection of libraries to optimise AI model performances
AI 简介
OptiMate 是一个已进入维护终止阶段的开源 AI 模型性能优化工具集,提供模型推理加速、Kubernetes GPU 集群资源弹性调度及大语言模型高效微调与对齐等能力。其核心组件包括 Speedster(硬件感知推理优化)、Nos(GPU 集群动态资源分配)和 ChatLLaMA(轻量级 LLM 微调与 RLHF 对齐)。技术上支持多后端(CUDA、Triton 等),强调硬件适配性与成本效率。适用于需要降低 LLM 推理延迟、提升 GPU 利用率或控制微调开销的生产部署场景,但需注意项目已不再更新维护。
Python
Apache License 2.08.3k
Stars
620
Forks
89
Watchers
100
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分64.38
默认分支main