A PERSONAL VLM RESEARCH LOG

让每一次模型进展,
都留下可复用的理解。

每日筛选 AI 动态,拆解最新 VLM 论文,也记录从概念到代码实验的学习过程。 这里不追求信息最多,只追求理解更深。

69篇公开记录最近更新 · 2026.10.10

THREE STREAMS

三个内容栏目

从当天的信息流,到论文方法,再回到长期知识体系。

LATEST ENTRIES

最近更新

全部动态
  1. AI 日报

    AI 日报 #034|GPT-6、AI 安全

    GPT-6 将交互推进到可生成界面,Anthropic 则把模型安全边界延伸到网络防御与高风险应用。

    • AI 新闻
    • GPT-6
    • AI 安全
  2. VLM 论文速递

    VLM 论文速递 #034|视频流、空间预测

    本期聚焦高速视频流、视觉世界建模与空间预测,论文共同指向有限观察预算下的可靠推理。

    • VLM
    • 多模态学习
    • 视频理解
  3. AI 日报

    AI 日报 #033|安全任务、GPT-6

    OpenAI披露两起AI助推的虚假信息行动,Anthropic启动面向关键基础设施与开源软件的网络安全计划。

    • AI 新闻
    • OpenAI
    • Anthropic
  4. VLM 论文速递

    VLM 论文速递 #033|流式视频、可靠验证

    本期聚焦流式视频感知、VLM自验证与多模态协同,摘要显示实时性和可靠性仍是两条硬约束。

    • VLM
    • 多模态学习
    • 视频理解
  5. VLM 论文速递

    VLM 论文速递 #032|审计基准、剪视觉 token

    本期五篇:三篇在质疑评测本身,两篇在压缩视觉与权重的成本。

    • VLM
    • 多模态
    • 视觉语言导航
  6. AI 日报

    AI 日报 #032|Opus 5.5、GPT-6 双发布

    同一天两家前沿实验室各自发布新模型:Anthropic 的 Opus 5.5 与 OpenAI 的 GPT-6 Sol/Luna。

    • AI 新闻
    • Claude Opus 5.5
    • Anthropic