阿里开源 NeuG v0.2.0,在事务一致性之上统一图遍历、向量检索与全文检索:三种检索共用同一份数据,通过 Cypher 组合调用,代码以 Apache 2.0 协议开放,仓库地址为 github.com/alibaba/neug。
这个设计来自 Agent 应用检索需求的自然分化。私有文档、代码库、智能体的长期记忆、商品、工单、日志,各自适合的检索方式并不相同:关系明确的适合图遍历,语义模糊的适合向量,术语精确的适合全文。把它们分散在多套系统里,数据同步与口径一致性会不断产生成本。
把结构检索、语义检索与关键词检索收进同一存储与查询层之后,检索语句可以在一次图遍历中直接嵌入向量与全文条件,减少跨系统拼接与结果重排的复杂度,事务语义也更容易在这三类操作之间保持一致。
v0.2.0 的重点是规模化,即在事务基础上支撑统一检索的吞吐与一致性要求,让这项能力从原型走向生产可用。