ymcui

Chinese-BERT-wwm

ymcui

Pre-Training with Whole Word Masking for Chinese BERT(中文BERT-wwm系列模型)

AI 简介

这是一个面向中文自然语言处理的预训练语言模型系列,基于BERT架构并采用全词掩码(Whole Word Masking)策略进行优化训练。核心包括BERT-wwm、BERT-wwm-ext、RoBERTa-wwm-ext等变体,显著提升中文分词粒度下的语义建模能力;支持PyTorch与TensorFlow 2框架,可通过Hugging Face Transformers或PaddleHub便捷调用。项目由哈工大讯飞联合实验室(HFL)发布,适用于中文文本分类、命名实体识别、机器阅读理解等下游任务,尤其适合需兼顾精度与中文词汇边界的NLP研发场景。

Python
Apache License 2.0
10.2k
Stars
1.4k
Forks
136
Watchers
1
Issues

Star 增长

今日0
近 7 天0
近 30 天0
综合评分69.43
默认分支master