jqtangust

Robust-U1

jqtangust

🚀🚀🚀 [ICML 2026] Official Implementation of Robust-U1: Can MLLMs Self-Recover Corrupted Visual Content for Robust Understanding?

AI 简介

Robust-U1 是一个面向鲁棒视觉理解的统一多模态大语言模型(MLLM),旨在让模型自主修复受损图像内容并在此基础上进行可信推理。其核心能力包括:端到端联合建模视觉退化过程与语义理解,支持像素级图像恢复与跨模态推理一体化;采用轻量级统一架构,避免传统黑盒对齐或纯文本补偿的局限性。适用于真实场景中存在噪声、模糊、遮挡、低分辨率等常见图像退化条件下的视觉问答、图文理解与故障诊断等任务。

Python
264
Stars
3
Forks
2
Watchers
0
Issues

Star 增长

今日0
近 7 天0
近 30 天0
综合评分38.81
默认分支main