Utopia 是一个 2026 年 8 月 27 日发布 v0.1 的开源项目(仓库 deeplethe/utopia,Apache-2.0 协议,GitHub 上 5.4k star、484 fork),由 DeepLethe 公司维护,项目自称「全球首个开源企业级世界模型」。它的核心不是更大的模型,而是把双时态知识图谱做进系统底层:每条事实同时记录「它在现实中何时为真」和「系统何时开始相信它」。对企业来说,这意味着 AI 的每个结论都能说清依据是什么、何时生效、由谁确认。
它解决什么问题
常见的知识库、向量数据库和知识图谱,记录的都只是「当下正确的知识」:事实变了就覆盖,查询时只能看到最新状态。Utopia 认为这不够。它要记录的是理解变化的全过程——一条事实什么时候被接受、后来为什么被修正、修正前系统基于它做过什么判断。
所以它的路线是:从知识治理出发,自底向上做到可信决策与仿真。项目方明确表示,不希望被当作某家商业情报平台的「开源替代」,而是一条不同的路。
双时态:两条时间线,而不是一条
双时态(bitemporal)是 Utopia 的底层机制,每条事实带两组时间:
- 有效时间:这条事实在现实世界中何时为真;
- 入账时间:系统在什么时候开始相信它。
修正一条事实时,系统不会覆盖旧记录,而是关闭旧版本、创建新版本并把两者链接起来。图里因此始终保留两条时间线:世界实际发生了什么,与系统逐步相信了什么。审核一段决策时,能取出它完整的过程和依据,而不是只看到一个结果。
部署:一个二进制加一个 Postgres
Utopia 的部署形态是「一个 Rust 二进制 + 一个 Postgres 数据库」:全文检索内嵌 Tantivy、向量存在 pgvector、任务队列就是一张数据库表,没有其他中间件。用 Docker Compose 一条命令即可启动,服务跑在本机 1516 端口。
它支持完全离线部署:聊天与向量化走任意 OpenAI 兼容端点(DeepSeek、Qwen、GLM、Ollama、vLLM 都行),整套系统可以跑在公司自有硬件、甚至与互联网隔绝的环境里。从源码本地开发需要 Rust 1.85+、Node 20+ 与 pnpm。
内置能力
- 导入:支持 PDF、DOCX、PPTX、XLSX、CSV、TSV、Markdown、HTML 等格式;网页、RSS、GitHub、Jira、Notion、WebDAV、S3 可定时同步。
- 检索与问答:全文检索(Tantivy)与向量检索(pgvector)用 RRF 融合,回答带行内引用,可跳回原文段落。
- Agent 与 MCP:内置 agent 可以搜文档、查时间轴上的实体事实、查询挂载的数据库,同一组只读工具通过 MCP 暴露。
- 本体冷启动:新建知识库自带 schema.org、W3C Org、PROV-O、FOAF、IOF Core 五个词表,新词出现后由人工确认再加入。
- 实体消歧:按「精确名称 → 向量相似 → 模型判断」三阶段去重,合并可撤销,低置信度进入人工复核队列。
- 推理与冲突:本体公理编译为规则做前向推导(默认关闭);冲突检测覆盖「新旧事实矛盾、破坏公理、基数冲突」三类。
- Ontology2SQL:可以直接用对话查询挂载的数据库(Postgres、MySQL、Trino/Iceberg/Delta、Databricks、Snowflake 等),该方法在 BIRD Mini-Dev 基准的 SQLite 与 PostgreSQL 上达到 SOTA。
- 决策账本:确认或拒绝事实、合并或回滚实体、重建图谱都会留下 append-only 记录,包含操作人、时间和对象当时的完整样子,记录的生命周期长于对象本身。
当前状态与升级注意事项
Utopia 目前还是 v0.1,数据库 schema 只向前演进、不提供回滚。升级前必须备份数据库和 data 目录,生产环境建议把镜像版本固定。部署到公网前需要先读 SECURITY.md。「决策智能」(把决策重放、叠加场景推理)仍在开发中,尚未落地。
Utopia 把「知识会过时、认知会更新」这件事建模进了系统——任何一条事实、任何一次决策,都能说清它基于什么、何时生效、由谁确认。对企业级 AI 落地来说,这种可追溯性比更聪明的问答更接近「可信」。