
text-embeddings-inference
huggingface
A blazing fast inference solution for text embeddings models
AI 简介
Text Embeddings Inference(TEI)是一个专为高性能文本嵌入模型推理优化的服务框架。它基于 Rust 实现,支持动态批处理、Flash Attention、Safetensors/ONNX 权重加载,并原生适配 NVIDIA GPU、AMD ROCm 及 Apple Silicon(Metal),显著降低延迟并提升吞吐量。支持主流开源嵌入模型(如 BGE、E5、GTE、JinaBERT、Qwen 系列等)及重排序器(re-ranker)和序列分类模型。适用于向量检索、语义搜索、RAG 系统、推荐引擎等需低延迟、高并发文本表征服务的生产场景。
Rust
Apache License 2.04.9k
Stars
411
Forks
41
Watchers
154
Issues
Star 增长
今日0
近 7 天0
近 30 天+24
综合评分62.24
默认分支main