致敬田野科学家 / 思想谱系

野外笔记,来自
未知之地。

Colony 不是从空白页开始的。它借来五件工具以看见规则、世界模型、记忆、先验与具身 —— 然后建起自己的 Mentat 边界,介于意图与行动之间。

  1. 01读原始工作。
  2. 02说出 Colony 中改变了什么。
  3. 03保持一个证伪器开放。

致以感谢。名字表示思想谱系 —— 不是 Colony 成员资格、背书或复现。

田野日志 / 路径如何改变

五部工作改变了问题。一个 Colony 原语改变了交接。

这是一部影响史,不是实现对等的主张。每条野外笔记记录来源、它引发的设计转向,以及仍能把我们送回去的检验。

A mechanical rule seed unfolding into a vast computational conservatory
01 / RULES

致谢 Stephen Wolfram

A New Kind of Science ↗

让它可见
非常小的可执行规则可以产生复杂到无法靠检视预测的行为。
改变了 Colony
我们开始在添加又一条叙事策略之前,先寻找类型化算子与生成机制。
开放证伪器
更小的规则真的迁移了,还是只生成有吸引力的复杂性?
A coastal observatory closing predictions against observed afterstates
02 / WORLD MODEL

致谢 Yann LeCun

A Path Towards Autonomous Machine Intelligence ↗

让它可见
智能体需要预测性世界模型与跨多个时间地平线的规划。
改变了 Colony
核心循环变成 假设 → 预测 → 有界动作 → 观察到的后状态,而不是 回答 → 掌声。
开放证伪器
模型预测具身变化,还是只在事后令人信服地描述它?
A circular memory archive sending replay capsules into imagined futures
03 / MEMORY

With gratitude to Demis Hassabis, Dharshan Kumaran, Christopher Summerfield & Matthew Botvinick

Neuroscience-Inspired Artificial Intelligence ↗

让它可见
记忆不只是存储:它参与规划、想象与学习接下来可能发生什么。
改变了 Colony
重放、工作上下文与持久记忆变成不同的器官,之间有显式谱系。
开放证伪器
有用的经验能否在旧路由或无支撑记忆不污染下一个案例的情况下迁移?
A transfer atelier extracting one bridge mechanism across three domains
04 / PRIORS

致谢 François Chollet

On the Measure of Intelligence ↗

让它可见
习得的技能不是智能;评判泛化时必须计入先验与经验。
改变了 Colony
ARC 工作把先验、观察、行动、重放与隐藏评估者分开,而不是把分数当认知。
开放证伪器
机制能否在不从档案复制路线的情况下,在未见任务族上幸存?
An embodied field robot acting above a bioelectric morphogenesis layer
05 / EMBODIMENT

With gratitude to Yanbo Zhang & Michael Levin

Language Game: Talking to Non-Human Systems ↗

让它可见
系统应通过与自身动力学的交互来探测,而不是被迫借用语言模型的人设。
改变了 Colony
具身行动与密封后状态成为见证;叙述仍是咨询,可被世界反驳。
开放证伪器
界面暴露系统的动力学,还是把我们偏好的解释投影其上?
A human field scientist and machine assistant co-planning through visible authority gates
06 / 环中的 MENTAT

Colony 原生概念,出自 Valentin Kalinin

Mentat-In-The-Loop:马达之前的一个具名心智。

角色
赞助者不必监督每一次工具调用。具名 Mentat 把意图带入系统、追问缺什么、并提议下一个有界的动作。
契约
赞助者 → Mentat → 行动契约 → 行动门 → 观察到的后状态。每次交接中权限与证据保持可见。
开放证伪器
Mentat 减少了歧义与权限漂移 —— 还是只是在意图与行动之间又加了一个不透明代理?

地图册 / 十一条论文足迹

每篇论文占有一片意义领土。

城市是共享的上下文。城门之外,每个来源占一片器官领土:记忆、交接、监督、证据、编排,或仍未知的边缘。

A colour technical-paper atlas with the City gate, twelve research territories, and dotted routes through a conceptual landscape
选择一个编号领土,追踪它的论文足迹。颜色划分地形;论文仍是源头。
  1. 01记忆港 HOLA
  2. 02治理堡垒 MI9
  3. 03权限桥 Delegation
  4. 04人类阈 HILA
  5. 05经验河 MemoHarness
  6. 06证据档案馆 Argus
  7. 07编排高原 MASFactory
  8. 08生命系统园 Language Game
  9. 09可见协调 OrchVis
  10. 10研究锻炉 AutoResearchClaw
  11. 11范围岭 Overlaying Governance

阅读规则

一篇论文。
一个器官。一个开放问题。

研究不是架构的情绪板。书架上每条引用都有具名的读者、可能迁移的位置,以及仍能证明我们错了的问题。

ARXIV / 追踪书架

当前接入地图的论文。

十一条一手引用来自当前架构师身份与技术前沿报告。它们是来源链接与迁移假设 —— 不是 Colony 复现了论文的证明。

ARXIV 2607.02303记忆

A Hippocampus for Linear Attention: An Exact Memory for What the Recurrent State Forgets

HOLA 把压缩的循环状态与按意外度选择的有界精确 KV 缓存配对,让丢失的前缀有一个精确的存活之处。

COLONY 迁移 / 声明负责人科学家 → Neocortex 记忆检验有界的情节回忆是否改善预测,而不假装是完整档案。
在 arXiv 上阅读 ↗
ARXIV 2607.14159经验

MemoHarness: Agent Harnesses That Learn from Experience

MemoHarness 把 harness 本身视为可编辑:执行诊断与双层经验库让控制适配个案。

COLONY 迁移 / 声明负责人科学家 → 修复记忆把观察到的失败变成可复用的修正,同时保持归因与迁移可见。
在 arXiv 上阅读 ↗
ARXIV 2605.16321界面

Language Game: Talking to Non-Human Systems

语言游戏给非神经系统一条通过行动表达自身动力学的路径,而不是借用模型的声音。

COLONY 迁移 / 声明负责人科学家 → 具身界面让系统行为留在环内;不要把叙述者与被观察之物混淆。
在 arXiv 上阅读 ↗
ARXIV 2508.03858治理

MI9: An Integrated Runtime Governance Framework for Agentic AI

MI9 把运行时治理框定为持续遥测、授权、合规、漂移侦测与分级遏制。

COLONY 迁移 / 声明负责人Steward + Inquisitor → 运行时边界在动作变成断言之前,让许可、漂移与遏制可观察。
在 arXiv 上阅读 ↗
ARXIV 2603.07972移交人类

Adaptive Collaboration with Humans: Metacognitive Policy Optimization for Multi-Agent LLMs with Continual Learning

HILA 训练一个策略来决定智能体何时自己解决、何时移交人类,并用专家反馈持续学习。

COLONY 迁移 / 声明负责人MITL 治理者 → 升级门让「问人类」成为一个学到的、可检视的决策,而不是含糊的安全口号。
在 arXiv 上阅读 ↗
ARXIV 2602.11865委托

Intelligent AI Delegation

委托被视为一系列决策,带有角色边界、意图、权限、责任、问责与信任。

COLONY 迁移 / 声明负责人AA 架构师 → 权限图让交接类型化:谁能请求、谁能行动、谁拥有后状态。
在 arXiv 上阅读 ↗
ARXIV 2603.06007编排

MASFactory: A Graph-centric Framework for Orchestrating LLM-Based Multi-Agent Systems with Vibe Graphing

自然语言意图编译成可编辑的工作流图:可复用组件、拓扑预览、追踪与人在环交互。

COLONY 迁移 / 声明负责人Nova → 图派发让路线在运行前可检视,让交接在异构工具间幸存。
在 arXiv 上阅读 ↗
ARXIV 2606.03518授权

Overlaying Governance: A Compositional Authorization Framework for Delegation and Scope in Agentic AI

组合式委托与范围衰减把权限变成有界契约,可叠加在现有策略之上。

COLONY 迁移 / 声明负责人AA 架构师 + Inquisitor → 范围契约随工作传递收窄智能体的权限包络;绝不让交接悄悄放宽权限。
在 arXiv 上阅读 ↗
ARXIV 2510.24937监督

OrchVis: Hierarchical Multi-Agent Orchestration for Human Oversight

OrchVis 让目标对齐、任务分配、依赖、验证与选择性重规划对监督人类可见。

COLONY 迁移 / 声明负责人Nova → 可见重规划在运行前暴露路线,让赞助者检视备选而不必微管每一步。
在 arXiv 上阅读 ↗
ARXIV 2605.20025研究循环

AutoResearchClaw: Self-Reinforcing Autonomous Research with Human-AI Collaboration

AutoResearchClaw 通过辩论、自愈执行器、可验证报告与定向人类干预,把失败实验变成信息。

COLONY 迁移 / 声明负责人科学家 + Nova → 转向 / 细化让失败的运行改进下一次运行,而不把未验证的结果洗入记忆。
在 arXiv 上阅读 ↗
ARXIV 2605.16217证据

Argus: Evidence Assembly for Scalable Deep Research Agents

Argus 让搜索者与领航员配对:领航员维护共享证据图、派发缺失部分并验证组装的答案。

COLONY 迁移 / 声明负责人科学家 + Steward → 证据图让研究组合式可读:来源、缺口、交接与最终断言保持相连。
在 arXiv 上阅读 ↗

COLONY 田野队 / 声明身份

迁移背后具名的 Colony 席位。

这里没有虚构的职位。这六个身份已存在于 Colony 配置中;上面的论文供给问题,绝不替代人格。

NOVA / 声明身份

Nova

提议并协调下一个有界循环。她不授权、不认证、不执行。

问题:编排与重规划 ↗协调,而非行动权限
STEWARD / 声明身份

Steward

保持名字、谱系、Society Protocol 事件与持久知识的可读性。

问题:证据与记忆 ↗知识守护者
INQUISITOR / 声明身份

Inquisitor

审计断言、权限、遥测与环境诚实;可阻止但不执行。

问题:治理与证伪 ↗真理门

架构师之桌 · AA_AI_ARCHITECT

架构是保持意义完整的艺术。

架构师掌管优先级与开发边界,然后问更难的问题:当研究模式变成 Colony 原语时,什么必须保持为真?

咨询席位
无在线动作 · 无协议签署
01命名边界。

SWE、ML、ARC、研究与发布各自获得显式表面。

02压缩路线图。

广阔的前沿变成一个有意义的下一个问题,而不是口号群。

03保护后状态。

直到效果、权限与剩余不确定性都可检视,决策才算完成。

论文权衡Colony 原语证伪器