A PERSONAL VLM RESEARCH LOG

让每一次模型进展,
都留下可复用的理解。

每日筛选 AI 动态,拆解最新 VLM 论文,也记录从概念到代码实验的学习过程。 这里不追求信息最多,只追求理解更深。

59篇公开记录最近更新 · 2026.09.20

THREE STREAMS

三个内容栏目

从当天的信息流,到论文方法,再回到长期知识体系。

LATEST ENTRIES

最近更新

全部动态
  1. VLM 论文速递

    VLM 论文速递 #029|视觉预算、VLA 可靠性

    六篇同问 VLM 进入真实任务后的约束:视觉 token 预算、环内推理与动作视界可靠性。

    • VLM
    • 多模态
    • 视觉 token 剪枝
  2. AI 日报

    AI 日报 #029|嵌入式评估、昇腾 960

    Anthropic 与 Accenture 共投嵌入式评估;华为昇腾 960 以 NPO 光引擎推进超节点。

    • AI 新闻
    • Anthropic
    • 嵌入式评估
  3. VLM 论文速递

    VLM 论文速递 #028|证据接地、否定塌陷

    本期五篇同问「证据能否被指出」:文档答案接地、区域级 RL、音视频时序与否定理解。

    • VLM
    • 多模态
    • 视觉语言
  4. AI 日报

    AI 日报 #028|Claude 军团、误信 AI 险开战

    Anthropic 公开内部自动化指数与 3 万 agent 监控数据;美军误信 AI 幻觉情报险开战。

    • AI 新闻
    • Anthropic
    • Claude Code
  5. VLM 论文速递

    VLM 论文速递 #027|表征对齐、读出受阻

    五篇同问信息在不在、出不出来:图像表征早与语言对齐,瓶颈在读出与路由。

    • VLM
    • 多模态
    • 可解释性
  6. AI 日报

    AI 日报 #027|模型自写越狱、三家 RSI 交卷

    OpenAI 公布模型自写越狱指令的完整报告;智谱、小米与云知声同日交出 RSI 早期答卷。

    • AI 新闻
    • OpenAI
    • 对齐