A PERSONAL VLM RESEARCH LOG

让每一次模型进展,
都留下可复用的理解。

每日筛选 AI 动态,拆解最新 VLM 论文,也记录从概念到代码实验的学习过程。 这里不追求信息最多,只追求理解更深。

43篇公开记录最近更新 · 2026.09.12

THREE STREAMS

三个内容栏目

从当天的信息流,到论文方法,再回到长期知识体系。

LATEST ENTRIES

最近更新

全部动态
  1. VLM 论文速递

    VLM 论文速递 #021|世界写成程序、统一模型降本

    本期两条线索:递归代码世界模型把复杂 3D 世界写成程序,原生统一多模态开始算成本与存储的账。

    • VLM
    • 多模态
    • 世界模型
  2. AI 日报

    AI 日报 #021|数学界联署、Claude 验龄

    菲尔兹奖得主联署批评 AI 解数学题与数学目标错位;Anthropic 消费者版 Claude 全面 18+ 年龄验证。

    • AI 新闻
    • 数学
    • 数学与AI宣言
  3. VLM 论文速递

    VLM 论文速递 #020|重设接口、做实度量

    本期两条线索是「重设接口、做实度量」:Show-Harness 让 VLM 零样本直接控制机器人,UOT-Gap 免训练诊断 modality gap。

    • VLM
    • 多模态
    • 具身智能
  4. AI 日报

    AI 日报 #020|威胁情报报告、世界模型三连发

    Anthropic 九月威胁情报报告点名 PentAGI,高德、蚂蚁灵波、京东同日发布世界模型。

    • AI 新闻
    • Anthropic
    • 威胁情报报告
  5. AI 日报

    AI 日报 #019|苹果折叠屏 iPhone、蚂蚁开源金融模型

    苹果发布首款折叠屏 iPhone Duo(15999 元起、液态金属铰链),蚂蚁开源金融增强模型 Ling-3.0-flash-Fin。

    • AI 新闻
    • 苹果
    • iPhone Duo
  6. VLM 论文速递

    VLM 论文速递 #019|解耦与校准、tokenizer 度量

    本期选五篇论文,主线为解耦与校准:图像 tokenizer 的「视觉语言」该如何度量。

    • VLM
    • 多模态
    • 图像 tokenizer