实验 / 005

L1 / 上下文位置试验:提前停止的一轮

移动同一条事实,模型是否仍能找到答案?

尚无定论 ·

实验结果

GitHub ↗

01 / 问题

移动同一条事实,模型是否仍能找到答案?

方法

冻结 6 组资料、四条件、两次重复,预算 48;随机顺序但无重试,连续三次请求/协议失败停止。

结果

尝试 29 次:26 份正常响应符合预期,随后 3 次 HTTP 429;19 次未执行。

观察

返回样本中 20 份编号正确、6 份正确拒答;请求失败与模型答错分别记录。

结论

尚不足以估计上下文位置的影响;不将 26/26 当作完整实验成功率。

局限

固定短材料、样本少且相关、分组不平衡;不是长上下文基准或论文复现。

复现

Java 工程提供 92 项离线断言、完整请求计划及独立 audit.mjs。新实测需新目录与独立预算。

继续探索

继续探索

  1. 实验复盘

    把答案放在上下文中间,模型就会漏掉吗?一次提前停止的对照试验

    用 Java 固定 6 组虚构资料,对照开头、中间、末尾与无答案条件;公开 29 次请求、HTTP 429 和不能下的结论。

    12 分钟已发布
  2. 机制拆解

    KV Cache 拆解:多轮对话的历史,为什么还要再传一遍?

    从因果注意力推导 K/V 复用,用一个可计算的内存例子区分推理缓存、前缀缓存与聊天记录。

    10 分钟已发布
  3. 项目 / 002

    Java LLM 实践集

    五个 Java 8 Demo与TypeScript边界对照:请求、输出验收、事务式历史及可追溯实验。

    构建中
  4. 工程案例

    LLM 实验(二):先让对照成立,再谈上下文位置

    用 Java 8 实现成组对照与节流,完成 Agnes 3.0 的24次真实请求;公开逐项评分、服务端用量,并解释全对结果的边界。

    16 分钟已发布

← 返回目录