跳到主要内容

READ / QUESTION / REPRODUCE

带着问题读论文。

围绕 AI 工程与具身智能精选基础论文。卡片基于所链接版本的摘要整理,是阅读入口,不是全文精读报告或个人实验结论。

← 研究总览 · 稍后读

3 篇论文

RAG · 2020 · 摘要导读

Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks

生成模型如何利用外部知识?

论文方法
结合序列生成模型与稠密检索索引,比较整段生成共享检索内容和逐 token 使用不同内容的方式。
作者报告的证据
作者在开放域问答和生成任务中报告了相对基线的提升。
阅读边界
摘要中的结果限于论文任务与基线,不表示任意知识库接入后都能提高准确率。
展开阅读追问

阅读时检查:检索失败如何影响生成?知识来源能否追溯?

查看原始摘要与论文 ↗ · 关联实验计划 →

ReAct · 2022 · 摘要导读

ReAct: Synergizing Reasoning and Acting in Language Models

语言模型如何结合推理与环境交互?

论文方法
交替生成推理轨迹和任务动作,通过外部信息更新行动计划。
作者报告的证据
作者在问答、事实核查与交互决策基准上报告实验结果。
阅读边界
特定基准表现不等于真实工具调用可靠,也不能将生成的解释视为正确性的证明。
展开阅读追问

阅读时检查:动作失败如何恢复?是否与不使用工具的基线公平比较?

查看原始摘要与论文 ↗ · 关联实验计划 →

RT-2 · 2023 · 摘要导读

RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control

视觉语言知识如何用于机器人控制?

论文方法
将动作表示为文本 token,并用机器人轨迹和视觉语言任务共同微调。
作者报告的证据
作者报告了机器人评估中新对象与新指令相关的泛化能力。
阅读边界
不应据此推断对任意硬件或环境都能泛化;本站尚未复现该模型。
展开阅读追问

阅读时检查:动作表示、数据分布与执行系统分别承担什么作用?

查看原始摘要与论文 ↗ · 关联实验计划 →