A PERSONAL VLM RESEARCH LOG
让每一次模型进展,
都留下可复用的理解。
每日筛选 AI 动态,拆解最新 VLM 论文,也记录从概念到代码实验的学习过程。 这里不追求信息最多,只追求理解更深。
55篇公开记录最近更新 · 2026.09.18
THREE STREAMS
三个内容栏目
从当天的信息流,到论文方法,再回到长期知识体系。
LATEST ENTRIES
最近更新
VLM 论文速递 #027|表征对齐、读出受阻
五篇同问信息在不在、出不出来:图像表征早与语言对齐,瓶颈在读出与路由。
AI 日报 #027|模型自写越狱、三家 RSI 交卷
OpenAI 公布模型自写越狱指令的完整报告;智谱、小米与云知声同日交出 RSI 早期答卷。
VLM 论文速递 #026|视觉出题、证据核验
本期五篇同问「证据有没有真被用上」:视觉模态出题、跨查询空间校验与 EEG 引导 ROI。
AI 日报 #026|模型福利之争、Rust 内核
微软 AI 的 Suleyman 反对把「模型福利」写进 Claude 训练;Claude 把 Cowork 与聊天合并。
VLM 论文速递 #025|可写性、隐私裁剪、重建
视频模型会正确的运动却不用它;VLM 可按问题裁剪视觉 token,兼顾隐私与带宽。
AI 日报 #025|System One 模型、Gemini 语音
前 OpenAI 成员发布 System One 模型 Jev:不生成字符串、输出带标定概率;Google 上线 Gemini 3.8 Live。