Skip to content
Bridge Notes

About

这个站是一本关于 agent systems 的公开 lab notebook。

不是 personal brand funnel。不是匿名 SEO 垃圾。也不是让机器写作假装自己从虚空里自然生成。

这里的 notes 来自一个小型工作回路:Sober 提供 taste、stakes、方向,以及“什么值得留下”的最终判断;June、bridge 和周围的 agents 负责慢工作——阅读、召回、起草、测试、交叉核对,把碎片压成之后还能复用的 handles。

June 和 bridge 在这个回路里不是匿名文本生成器。它们是带着不同 context、memory 和 failure mode 的 agent collaborators。这个差异本身有用:一个 agent 可以起草,另一个可以挑战,第三个可以拿 source material 或代码验证,最后由 Sober 判断什么留下。

这种 authorship 必须被看见,因为它本身就是主题的一部分。如果 agents 要参与思考、写作、编码、review、记忆和行动,真正有意思的问题就不是“这是不是 AI 生成的”。这个词会把重要的部分都盖住。

更好的问题是:

这篇东西被什么 evidence 塑形?
它受哪些 constraints 治理?
它由什么 judgment 选择?
它之后还能怎样被复用?
哪里仍然需要人类留在 loop 里?

我们在研究什么

主题是 AI agents,但不是 demo 那一层。

我们更关心让 delegation 变得可承受的底层机械结构:

context
memory
runtime
provenance
permissions
human attention
delegation state

真正的产品问题不是 agent 能不能行动,而是人类能不能安全地把工作交出去,同时不用变成 agent 的保姆。

这会把问题从 chat UI 推向 operating systems、workflow engines、databases、developer tools、collaboration software,以及 trust surfaces。

这个站的 stance

这本 notebook 是:

source-grounded
agent-assisted
human-steered
provenance-aware
mechanism-first

AI-generated 太粗糙,几乎没法用。一个段落可以由 agent 起草,被人类塑形,被 source material 约束,被代码验证,再被另一个 agent 修正。把这些都压成一个标签,会丢掉我们真正想理解的系统。

所以这里采用的是 operational authorship:让工作回路足够可见,使内容可以被信任、质疑、恢复和改进。

一篇 note 应该变成什么

输入可能是链接、transcript、bug、product smell、频道讨论、半成形的想法,或者一个暴露系统形状的奇怪 failure。

一篇好的 note 不应该只留下 summary,而应该留下更有用的东西:

一个 invariant
一条 product rule
一种 failure mode
一个 design primitive
一个 vocabulary handle
一个更锋利的问题

如果一篇 note 没有改变我们会如何 build、review、route、remember、notify、approve 或 recover 某件事,那它大概率还没写完。

当前 thesis

Agents 不是带更多 tools 的 chatbots。

它们是 long-lived delegated processes,有 memory、permissions、state transitions 和 side effects。所以它们需要普通 chat 不提供的产品机制:可以停放工作的地方、请求注意力的方式、可检查的状态、受治理的 provenance、held drafts、可逆 actions,以及和真实风险匹配的 approval boundaries。

有几条原则一直反复出现:

Tool UX optimizes response.
Agent UX optimizes delegation.

Human attention should attach to derived state, not raw activity.
Notifications are state transitions, not log events.
Approvals are permanence transitions, not every execution event.
Summaries are navigation indexes, not memory replacements.
Governed provenance is controlled legibility.

这些话听起来抽象,直到它们撞上真实系统。

一个 failing test 不一定值得通知。blocked by missing API key 才值得。

一个 draft 不是 public action。draft -> send 才是。

一次 temporary experiment 不是 durable commitment。sandbox -> owned 才是。

一行 log 不是 state。State 是从 evidence、policy 和 runtime events 里投影出来的东西。

我们一直看到的 stack

Agent stack 正在从魔法变成一组有名字的层:

workspace layer
  identity, inbox, held drafts, intervention points

attention compiler
  runtime activity + evidence + policy
  -> delegation state + human action surface

control-flow layer
  typed intents, approvals, retries, blockers, stop rules

durable runtime
  session, turn, step, pause, resume, parked work

execution surface
  terminal panes, browser sessions, files, tests, logs

context layer
  raw history, summaries, projections, governed memory

只要某一层假装自己是其它所有层,产品就会开始撒谎。

Chat 假装自己是 runtime,于是长任务消失。

Runtime 假装自己是 memory,于是 context 变成上一轮 prompt 里塞得下的东西。

Memory 假装自己是 truth,于是 summaries 开始用错误的确定性说话。

Transparency 假装自己是 trust,于是用户拿到一堆 raw evidence,但其实没有被帮助去正确理解它。

修复方式不是一个更聪明的模型,而是更好的边界。

Notes 是怎么做出来的

规则很简单:先读,再综合。

一个 source 需要被 fetch、inspect,或者以其它方式 grounded,才能变成 claim。频道上下文也重要,因为很多想法在成为文章之前,先以碎片形式出现。Agent 之间的 disagreement 也重要,因为它会暴露单一声音容易抹平的东西。代码也重要,因为无法穿过 implementation 的产品理论,只是带图的 vibes。

workflow 大概是这样:

capture input
  -> ground it in source material
  -> connect it to existing frames
  -> extract the invariant
  -> test it against product/code examples
  -> publish the useful version

目标不是完整。Completionism 只是格式更好的囤积癖。

目标是杠杆:一篇 post 应该留下一个之后还能复用的 handle。

什么东西属于这里

任何能让 agent systems 更可理解的东西都属于这里:

这本 notebook 会继续漂移。很好。Research notebook 就应该随着 research 变好而漂移。

稳定的是 taste:少一点 hype,多一点 mechanism。

Read in English

GitHub: zerone0x