
AtlasVA
wangpan-ustc
暂无描述
AI 简介
AtlasVA 是一个无需教师监督的视觉技能记忆框架,专为视觉-语言模型(VLM)智能体设计。其核心通过三层视觉记忆(空间热力图、视觉示例、符号化文本技能)实现经验的视觉具身化存储,并基于交互轨迹自动演化危险与亲和力图谱,提供坐标感知的稠密视觉奖励塑形,从而在不依赖外部大语言模型监督的前提下统一感知、记忆与强化学习优化。适用于 Sokoban、FrozenLake、3D具身导航及机器人操作等空间密集型强化学习任务。
Python
73
Stars
4
Forks
60
Watchers
1
Issues
Star 增长
今日0
近 7 天0
近 30 天+1
综合评分36.2
默认分支main