Autoregressive visual models
PulseAugur coverage of Autoregressive visual models — every cluster mentioning Autoregressive visual models across labs, papers, and developer communities, ranked by signal.
-
New Gazer framework uses LLMs to correct visual model errors
Researchers have developed Gazer, a novel framework designed to improve autoregressive visual models (AVMs) by integrating feedback from multimodal large language models. This training-free approach addresses semantic e…
-
New AI frameworks tackle visual model errors and event camera data processing · 3 sources tracked
Researchers have introduced Gazer, a novel framework designed to improve autoregressive visual models (AVMs) by integrating feedback from multimodal large language models. Gazer operates in two stages: diagnosing semant…
-
New adapter boosts autoregressive model text rendering accuracy
Researchers have developed a Residual Decoder Adapter (RDA) to improve the text rendering capabilities of autoregressive visual models without retraining the entire system. The RDA works by refining the output of an exi…