A PERSONAL VLM RESEARCH LOG
让每一次模型进展,
都留下可复用的理解。
每日筛选 AI 动态,拆解最新 VLM 论文,也记录从概念到代码实验的学习过程。 这里不追求信息最多,只追求理解更深。
61篇公开记录最近更新 · 2026.09.21
THREE STREAMS
三个内容栏目
从当天的信息流,到论文方法,再回到长期知识体系。
LATEST ENTRIES
最近更新
VLM 论文速递 #030|主动取证、动作入模
本期五篇:证据该不该主动取、动作该怎么接进预测——前者被量化,后者被做成接口。
AI 日报 #030|广告追踪、剪映打通链路
OpenAI 广告收集器把站外浏览接回 ChatGPT 账号;剪映打通 AI 生成与多轨剪辑。
VLM 论文速递 #029|视觉预算、VLA 可靠性
六篇同问 VLM 进入真实任务后的约束:视觉 token 预算、环内推理与动作视界可靠性。
AI 日报 #029|嵌入式评估、昇腾 960
Anthropic 与 Accenture 共投嵌入式评估;华为昇腾 960 以 NPO 光引擎推进超节点。
VLM 论文速递 #028|证据接地、否定塌陷
本期五篇同问「证据能否被指出」:文档答案接地、区域级 RL、音视频时序与否定理解。
AI 日报 #028|Claude 军团、误信 AI 险开战
Anthropic 公开内部自动化指数与 3 万 agent 监控数据;美军误信 AI 幻觉情报险开战。