A PERSONAL VLM RESEARCH LOG

让每一次模型进展,
都留下可复用的理解。

每日筛选 AI 动态,拆解最新 VLM 论文,也记录从概念到代码实验的学习过程。 这里不追求信息最多,只追求理解更深。

67篇公开记录最近更新 · 2026.10.09

THREE STREAMS

三个内容栏目

从当天的信息流,到论文方法,再回到长期知识体系。

LATEST ENTRIES

最近更新

全部动态
  1. AI 日报

    AI 日报 #033|安全任务、GPT-6

    OpenAI披露两起AI助推的虚假信息行动,Anthropic启动面向关键基础设施与开源软件的网络安全计划。

    • AI 新闻
    • OpenAI
    • Anthropic
  2. VLM 论文速递

    VLM 论文速递 #033|流式视频、可靠验证

    本期聚焦流式视频感知、VLM自验证与多模态协同,摘要显示实时性和可靠性仍是两条硬约束。

    • VLM
    • 多模态学习
    • 视频理解
  3. VLM 论文速递

    VLM 论文速递 #032|审计基准、剪视觉 token

    本期五篇:三篇在质疑评测本身,两篇在压缩视觉与权重的成本。

    • VLM
    • 多模态
    • 视觉语言导航
  4. AI 日报

    AI 日报 #032|Opus 5.5、GPT-6 双发布

    同一天两家前沿实验室各自发布新模型:Anthropic 的 Opus 5.5 与 OpenAI 的 GPT-6 Sol/Luna。

    • AI 新闻
    • Claude Opus 5.5
    • Anthropic
  5. VLM 论文速递

    VLM 论文速递 #031|视觉智能体、证据追踪

    本期五篇:统一视觉智能体 MintAct、VLM 行为诊断 DiaVLo、机器人失败求助的证据审计。

    • VLM
    • 多模态
    • 视觉智能体
  6. AI 日报

    AI 日报 #031|机器人安全、本地跑 125B

    同一天里两个把前沿模型放进机器人身体的结果:RoboHarm 里越强的模型拒绝得越少;本地单卡跑起 125B。

    • AI 新闻
    • RoboHarm
    • Robocurve