PAPER RADAR
追踪视觉语言模型的新论文,提炼问题设定、方法亮点、实验结论与局限。
ARCHIVE
精选 VideoChat3、E-VQA、SynthDocBench 与 RxBrain:VLM 正在同时补齐高效视频感知、可验证证据、长文档诊断和视觉化规划。
用问题、方法、证据和边界四个层次快速拆解视觉语言模型论文,避免只记住模型名称和榜单数字。