A PERSONAL VLM RESEARCH LOG
让每一次模型进展,
都留下可复用的理解。
每日筛选 AI 动态,拆解最新 VLM 论文,也记录从概念到代码实验的学习过程。 这里不追求信息最多,只追求理解更深。
65篇公开记录最近更新 · 2026.09.23
THREE STREAMS
三个内容栏目
从当天的信息流,到论文方法,再回到长期知识体系。
LATEST ENTRIES
最近更新
VLM 论文速递 #032|审计基准、剪视觉 token
本期五篇:三篇在质疑评测本身,两篇在压缩视觉与权重的成本。
AI 日报 #032|Opus 5.5、GPT-6 双发布
同一天两家前沿实验室各自发布新模型:Anthropic 的 Opus 5.5 与 OpenAI 的 GPT-6 Sol/Luna。
VLM 论文速递 #031|视觉智能体、证据追踪
本期五篇:统一视觉智能体 MintAct、VLM 行为诊断 DiaVLo、机器人失败求助的证据审计。
AI 日报 #031|机器人安全、本地跑 125B
同一天里两个把前沿模型放进机器人身体的结果:RoboHarm 里越强的模型拒绝得越少;本地单卡跑起 125B。
VLM 论文速递 #030|主动取证、动作入模
本期五篇:证据该不该主动取、动作该怎么接进预测——前者被量化,后者被做成接口。
AI 日报 #030|广告追踪、剪映打通链路
OpenAI 广告收集器把站外浏览接回 ChatGPT 账号;剪映打通 AI 生成与多轨剪辑。