Un nuevo marco para VLMs que rastrea cada paso y corrige sus fallos
CaVe‑VLM‑CoT propone un ciclo de cinco fases que extrae, recupera, resuelve, cita e verifica, logrando 87 % de precisión en ScienceQA y reduciendo alucinaciones en modelos visión‑texto.