tatsu-lab

stanford_alpaca

tatsu-lab

Code and documentation to train Stanford's Alpaca models, and generate the data.

AI 简介

Stanford Alpaca 是一个基于 LLaMA-7B 的指令微调语言模型项目,旨在构建轻量级、可复现的指令遵循能力。项目开源了52K条自生成的高质量指令数据、完整的数据合成流程(基于 Self-Instruct 方法改进)、模型微调代码及权重差分文件,支持从原始 LLaMA 权重高效恢复 Alpaca 模型。技术上采用监督微调(SFT),强调低成本复现与研究透明性。适用于自然语言处理领域的教学演示、指令微调方法研究、小规模指令数据集构建与基线模型对比实验,但仅限非商业研究用途。

Python
Apache License 2.0
30.3k
Stars
4k
Forks
337
Watchers
170
Issues

Star 增长

今日0
近 7 天0
近 30 天+7
综合评分70.7
默认分支main