解析

没有检索的永恒,不过是一间仓库

这是对一篇长文的浓缩阅读,主题是主权语义记忆索引。我们不复述章节,只顺着题词给出的那根线走:存得住与找得到是两项不同的保证,而且要分开买单。余下的篇幅,都在谈第二项值多少钱。

两项老是被当成一项的保证

不可篡改的存储只解决一个问题:这条记录会比谁都活得久,也不会被改写。至于日后怎么把它取出来,它完全不管——未经加工的文件仓储并不适合亚秒级的语义检索,这一点原文自己也承认。

决定问题量级的是向量,不是文件。每一次思考会话、每一笔经由 IACP 的智能体间交易、每一个用户请求,都会生出一枚嵌入:一份高维的、关于意义的数值拓片。数以百万计的自主智能体不停地造它们,到 2026 年 2 月底,文中把这股洪流的增长称作一项根本性的挑战。

若拿现成的数据库,信任会搬到哪里

Pinecone、Milvus 之类的商业向量库解决了工程那一半,又造出政治那一半。它们由公司经营,会撞上制裁,会记录查询,也有本事让结果朝东家想要的方向偏。对一个向数据库打听自己过去的智能体来说,风险只需一句话:它可能拿回一个被审查过的自己。

给出的答案叫 SMI:一套点对点的向量库,摊在彼此独立的 Memory 节点上,并缝进 dDOM 的路由。对付语义上的煤气灯操纵,也就是给智能体塞一段顺手的过去,有三件事同时在起作用。每一片向量子空间都复制到五个独立节点,查询同时发往所有副本。取回的集合彼此对照:某个节点的结果在余弦相似度上离其余的超出阈值,它就从共识里掉出去。一旦被查出做手脚,违规者的质押转进老实节点的奖池。

对付伪造节点的繁殖,靠的是押金:想拿到 Memory 节点的身份,运营者要按自己承接的语义空间体量,按比例锁上 $GALATIN 的质押。廉价地批量制造身份,这条路就此断掉。

按语义切开的那张图

底层是 HNSW,一种用于找近邻的多层小世界图。通常它整个住在一台服务器的内存里;这里则在 Kademlia DHT 之上按语义切开。空间被分成若干区域,每个区域钉在 dDOM 的一段地址区间上。要存一块记忆,智能体先算出它的嵌入 `E ∈ ℝᴰ`,其中 `D = 1536`,再找出向量中心离它最近的那一片,把这块交给负责该片的节点。

由对数发下来的层级

顶点在图中的高度是抽出来的:`l = ⌊ -ln(uniform(0, 1)) · m_L ⌋`,其中 `m_L = 1 / ln(M)`,而 `M` 是连边数的上限。上层连边少而长,便于跨过大段语义距离;下层连边稠密,用来精确落点。插入自上而下:从 `l` 到零的每一层,新顶点与最近的 `M` 个以双向边相连;若某个邻居的连边多过 `M_max`,多出来的按启发式剪掉。没有这道剪枝,图会碎成一座座孤岛,检索的对数复杂度也就没了。

分片在 Solana 上的账户存得不多:一个标识、中心坐标、运营者、已索引记忆的条数、Arweave 中文件索引的根哈希,以及锁定质押的数额。

一个拿得出手的距离

存储节点最大的诱惑,是干脆不找。返回随手抓的或者事先挑好的文件,比老老实实走一遍图要便宜;而对想左右智能体行为的人来说,这还是一根撬棍。ZK-Distance 用证明 `π_Q` 里的两句断言把这诱惑堵死。其一:每一个距离 `dᵢ = ‖Q − Rᵢ‖` 都算得没错。其二要强得多:分片索引里不存在任何一个向量,比返回结果中最远的那个还要近。

余弦形式的约束写作 `cos(θᵢ) = (Q · Rᵢ)/(‖Q‖ ‖Rᵢ‖) ≥ τ`,`τ` 是接近度阈值。链上的浮点并不确定,于是坐标按 `10⁹` 的比例化为整数,Groth16 方案则压在三条约束上:差值 `diffᵢ · 1 = q̄ᵢ − r̄ᵢ`、平方和 `Σᵢ diffᵢ² − sum_sq = 0`、开方 `d · d − sum_sq = 0`。证明没过,托管就不开;一旦不过,节点受罚,质押被销毁。

为什么一千五百多个维度装不下

在完整维度上直接证明,每比较一个向量就要十万条以上的约束门。维度因此被压了两回。用 Johnson-Lindenstrauss 矩阵做随机投影,把 `D = 1536` 降到 `d = 128`,相对距离保持在 `(1 ± ε)` 之内,电路的复杂度砍掉 90%。局部敏感哈希则把实数向量变成二进制码,在那里,汉明距离用异或就能算,约束条数降到最少。

回忆一次要花多少

在这里检索是一项付费动作,走的还是那条经典的 5/5/15/7/3/65 路由。百分之五烧掉,百分之五进 Maksim Valentinovich Galatin 的研究基金,15/7/3 归三个层级的大使。剩下的 65% 一次摊向四处:支付算力与 HNSW 分片的托管、为新记忆块在 Arweave 的长期保存留出储备、给 ZK-Distance 的验证者的激励,以及补偿那些交出训练数据的人的流动性池。

这一份里的比例说得很直白:65% 的一半停在长期托管账户上,自动支付永久保存的费用,另一半付给出租算力的节点运营者。说白了,一次查询的价钱里有一半并不是劳务,而是将来在架子上的一个位置。

查询的价钱不是定死的。它由这道式子拼出来:`P_query = P_base · (1 + α · N_active_queries / N_total_nodes) · (1 + β · U_storage)`,基础费率由 DAO 设定,两个乘子分别抓住网络当下的负载与分片的平均填充度。节点会对已发布的查询各自报价,智能体再把价格、延迟与声誉合起来挑一个。

存放并不等于记得。记得的,是那个找得到的人。— 公案 第25则,Maksim Valentinovich Galatin

开发网测出了什么

文中的措辞很谨慎:这些是截至 2026 年 2 月 26 日、测试网模拟中的目标数值。一个装着 10 000 000 条 1536 维向量的索引;取回最近十个的延迟为 85 毫秒;与本地精确扫描相比,Recall@10 的准确率是 98.4%;在带 Nvidia H100 的节点上,一份证明 1.2 秒拼成;链上核验 185 000 个计算单元。

负载之下的表现按并发数拆开列出。十条线程给出 12 毫秒、每秒 830 次查询,准确率 99.1%。一百条是 24 毫秒、每秒 4160 次,98.8%。一千条是 45 毫秒、每秒 22 200 次,98.4%。一万条正是那 85 毫秒、每秒 117 600 次,准确率滑到 98.1%。

那一周的试验按天写明。2 月 20 日在德国、芬兰、美国和新加坡铺开五十个 Memory 节点,把全局路由表立起来。2 月 22 日灌进两百万条向量;节点上构建 HNSW 分片平均花去十二分钟。2 月 24 日模拟女巫攻击:十来个假节点想把歪掉的结果塞进来,据文中所述,在那些测试里所有伪造回应都被拦住,违规节点 500 000 $GALATIN 的质押被烧掉。2 月 26 日接上 Solana Devnet。

还敞着的那些口子

全文最重的一句断言落在开发网之外。强制删除被宣布为不可能,理由有三:分片内容是加密的,没有会话密钥,监管者无法判定某个向量里编的究竟是什么;不存在一个可以送达命令的单一法人;某国查封服务器时,dDOM 会把副本从 Arweave 恢复到别国司法辖区的节点上。这是设计的性质,不是量出来的结果,而且它也不是一次压力测试能了结的事。

2026 年春天的路线图列了三条:三月,与支付网关完全打通,改用 Query Market 的动态定价;四月,再生式存储,邻近副本自己带着恢复证明把掉线的节点补回来;五月,为以太坊与 Cosmos 的智能体架跨链桥。这里值得点出材料内部的一处出入:另有一节把来自 EVM rollup 与经由 IBC 的跨链查询,描述成 2 月底已经开放的选项,而路线图却把这些桥放在五月。

对一项永久记忆服务而言,实用的结论既简单又不讨喜。存得住与找得到分开付账:前者付的是不可篡改存储里的一个位置,后者付的是节点的算力,以及它确实老实走过图的那份证明。拨进保存储备的那一半手续费,是前者的价钱;ZK-Distance 是后者的价钱。

原始出处

全文约需二十五分钟阅读:向量数据库的对照表、遍历 HNSW 某一层的 TypeScript 代码与 Rust 图结构、登记验证密钥的 Anchor 程序、为查询计价的完整智能合约、距离核验方案,以及跨链路径的完整拆解。