
GLM-V
zai-org
GLM-4.6V/4.5V/4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning
AI 简介
GLM-V 是一个开源的多模态大语言模型系列(GLM-4.6V/4.5V/4.1V),专注于提升视觉-语言联合推理能力。其核心特点包括基于强化学习的可扩展推理训练、长上下文理解、跨模态(图像/视频/文本)联合建模,以及面向复杂任务的思维链(Thinking)增强机制。模型支持图像理解、视频时序分析、图文生成与多步逻辑推理,在桌面智能助手、UI自动化、多模态代理等需要深度感知与决策的场景中表现突出。项目提供开源模型权重、API 接口及配套工具链,适用于研究与轻量级工业应用。
Python
Apache License 2.02.4k
Stars
175
Forks
15
Watchers
13
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分58.74
默认分支main