A PERSONAL VLM RESEARCH LOG

让每一次模型进展,
都留下可复用的理解。

每日筛选 AI 动态,拆解最新 VLM 论文,也记录从概念到代码实验的学习过程。 这里不追求信息最多,只追求理解更深。

55篇公开记录最近更新 · 2026.09.18

THREE STREAMS

三个内容栏目

从当天的信息流,到论文方法,再回到长期知识体系。

LATEST ENTRIES

最近更新

全部动态
  1. VLM 论文速递

    VLM 论文速递 #027|表征对齐、读出受阻

    五篇同问信息在不在、出不出来:图像表征早与语言对齐,瓶颈在读出与路由。

    • VLM
    • 多模态
    • 可解释性
  2. AI 日报

    AI 日报 #027|模型自写越狱、三家 RSI 交卷

    OpenAI 公布模型自写越狱指令的完整报告;智谱、小米与云知声同日交出 RSI 早期答卷。

    • AI 新闻
    • OpenAI
    • 对齐
  3. VLM 论文速递

    VLM 论文速递 #026|视觉出题、证据核验

    本期五篇同问「证据有没有真被用上」:视觉模态出题、跨查询空间校验与 EEG 引导 ROI。

    • VLM
    • 多模态
    • 长视频理解
  4. AI 日报

    AI 日报 #026|模型福利之争、Rust 内核

    微软 AI 的 Suleyman 反对把「模型福利」写进 Claude 训练;Claude 把 Cowork 与聊天合并。

    • AI 新闻
    • 模型福利
    • Mustafa Suleyman
  5. VLM 论文速递

    VLM 论文速递 #025|可写性、隐私裁剪、重建

    视频模型会正确的运动却不用它;VLM 可按问题裁剪视觉 token,兼顾隐私与带宽。

    • VLM
    • 多模态
    • 视频模型
  6. AI 日报

    AI 日报 #025|System One 模型、Gemini 语音

    前 OpenAI 成员发布 System One 模型 Jev:不生成字符串、输出带标定概率;Google 上线 Gemini 3.8 Live。

    • AI 新闻
    • TypeSafe AI
    • Jev