ONLINE
本地推理 + Hyphae Cloud。带租户级授权的新鲜知识。
HiveMind 运行时
HiveMind 是让小模型成为可信系统的运行时:确定性规则优先,受限的神经候选其次,独立验证贯穿始终。
架构
任务只走一条路径。每个边界只负责一件事,并且都不信任上一环节。
执行模式
同一条受治理的回路在不同隐私姿态下运行。凭据在运行时从系统钥匙串解析——绝不来自提示词、权重或配置文件。
本地推理 + Hyphae Cloud。带租户级授权的新鲜知识。
本地推理 + 经验证的离线缓存。无网络也能给出带证明的回答。
本地推理 + 本地或私有 Hyphae。数据不出机器。适合物理隔离(air-gap)。
不读也不写个人记忆。一场从设计上就不留痕迹的会话。
虚拟化上下文
MARS 不承诺无限上下文。它提供对持久记忆的可续跑访问:小工作集、迭代检索、显式引用与带检查点的任务状态。
16K
策略、任务状态、近期对话、top-k 证据、输出预留——一个有界步骤所需的一切。
32K
用于确实更宽的步骤,预算显式记账,绝无静默截断。
128K
完整物理容量,仅保留给审计。上下文质量以证据召回衡量——而不是宣传的 token 长度。
128K 是物理容量,不是理解力的承诺。长任务对已验证结论与来源 ID 做检查点——而不是让提示词永远膨胀。
教师通道
更大的 GPU 模型充当教师与升级服务。它们的输出与其他一切一样,要经过同一个验证器、同一道策略边界。
本地优先 API
后端只绑定 127.0.0.1,遵循稳定的 OpenAPI 3.1 契约。任何专业前端都通过这八个端点集成——面向用户的消息支持英文与西班牙文。
/v1/health 本地运行时的存活状态 /v1/runtime 运行时身份:工件 SHA-256、姿态、语言 /v1/knowledge/inspect 入库前预览文档——摘要、大小、警告 /v1/knowledge/commit 将文档写入本地知识平面 /v1/knowledge/sources 已提交来源清单,含内容摘要 /v1/knowledge/sources/{digest} 删除一个确切的内容寻址来源 /v1/chat 受治理提问 → 裁决、回答、来源、通道、回执 ID /v1/receipts/{id} 获取任意响应的规范回执 设计上仅限回环:外部来源一律拒绝,契约中绝不出现机密,验证被拒时返回类型化错误——而不是一次幻觉。