A PERSONAL VLM RESEARCH LOG

让每一次模型进展,
都留下可复用的理解。

每日筛选 AI 动态,拆解最新 VLM 论文,也记录从概念到代码实验的学习过程。 这里不追求信息最多,只追求理解更深。

63篇公开记录最近更新 · 2026.09.22

THREE STREAMS

三个内容栏目

从当天的信息流,到论文方法,再回到长期知识体系。

LATEST ENTRIES

最近更新

全部动态
  1. VLM 论文速递

    VLM 论文速递 #031|视觉智能体、证据追踪

    本期五篇:统一视觉智能体 MintAct、VLM 行为诊断 DiaVLo、机器人失败求助的证据审计。

    • VLM
    • 多模态
    • 视觉智能体
  2. AI 日报

    AI 日报 #031|机器人安全、本地跑 125B

    同一天里两个把前沿模型放进机器人身体的结果:RoboHarm 里越强的模型拒绝得越少;本地单卡跑起 125B。

    • AI 新闻
    • RoboHarm
    • Robocurve
  3. VLM 论文速递

    VLM 论文速递 #030|主动取证、动作入模

    本期五篇:证据该不该主动取、动作该怎么接进预测——前者被量化,后者被做成接口。

    • VLM
    • 多模态
    • 具身智能
  4. AI 日报

    AI 日报 #030|广告追踪、剪映打通链路

    OpenAI 广告收集器把站外浏览接回 ChatGPT 账号;剪映打通 AI 生成与多轨剪辑。

    • AI 新闻
    • OpenAI
    • 广告收集器
  5. VLM 论文速递

    VLM 论文速递 #029|视觉预算、VLA 可靠性

    六篇同问 VLM 进入真实任务后的约束:视觉 token 预算、环内推理与动作视界可靠性。

    • VLM
    • 多模态
    • 视觉 token 剪枝
  6. AI 日报

    AI 日报 #029|嵌入式评估、昇腾 960

    Anthropic 与 Accenture 共投嵌入式评估;华为昇腾 960 以 NPO 光引擎推进超节点。

    • AI 新闻
    • Anthropic
    • 嵌入式评估