Skip to content

第二大脑商业架构技术文档 v1.0

本文档定义「Molore」从免费工具向商业化平台演进的技术架构,不涉及具体代码实现。


一、架构总览

1.1 核心定位

第二大脑从"个人工具"升级为"认知基础设施平台",用户为模型调用云端存储付费,平台赚取模型差价和存储服务费。

1.2 商业公式

平台收入 = 外部模型调用量 × (平台售价 − 采购成本) + 存储会员数 × 9.9元
         = 外部模型调用量 × 采购成本 × 1倍利润率 + 存储会员数 × 9.9元

模型调用:纯预付费,无月费门槛,充多少用多少。
云端存储:独立订阅,9.9元/月,与模型调用完全解绑。

1.3 两大收费支柱

支柱模式单价门槛目标用户
模型调用费按量计费(input/output tokens)原API价格 × 2无月费,充值即用所有使用外部模型的用户
存储会员固定月费9.9元/月独立订阅需要云端存储的个人用户
企业套餐按席位 + 按量协商定价团队/企业用户

1.4 免费策略

免费项目的
本地模型(Ollama)调用降低入门门槛,用户可先体验再付费
用户自接API吸引开发者/高级用户,形成生态
基础功能(笔记、剪藏、搜索)保留核心工具属性,防止用户流失
外部模型调用(余额充足时)不需要任何订阅或月费,充10块钱就能用Claude

二、LLM模型控制台架构

2.1 模型分层体系

控制台将模型分为三层,UI上按此分层展示:

┌─────────────────────────────────────────────┐
│  🏠 本地模型(免费)                          │
│  Ollama / Llama 3.1、Qwen 2.5、Nomic Embed   │
│  → 调用不扣费,走用户本地硬件                 │
├─────────────────────────────────────────────┤
│  🌐 系统接入模型(按量收费,2倍API费)         │
│  DeepSeek、Kimi、通义千问、智谱GLM、Claude、   │
│  GPT-4、Gemini 等                            │
│  → 平台统采统付,用户按调用量付费             │
├─────────────────────────────────────────────┤
│  🔑 用户自有模型(免费)                       │
│  用户填入自己的 API Key,直接调用厂商          │
│  → 平台不中转、不计费、不承担成本             │
└─────────────────────────────────────────────┘

2.2 管理员模型配置后台

管理员通过后台控制:

  • 系统接入哪些外部模型:打勾即上架,用户可见可选
  • 每个模型的显示名称、描述、推荐场景
  • 默认路由策略:管理员设定各场景优先路由到哪个模型
  • 系统兜底模型:当用户余额不足或路由失败时的回退模型
  • 功能开关(预留)
    • 是否允许未充值用户使用外部模型(可设为"必须充值"或"赠送试用额度")
    • 是否强制要求订阅才能使用某类模型(未来可扩展会员专享模型)
    • 充值门槛(最低充值金额、赠送策略)
    • 这些开关当前保持开放状态,后续根据运营数据灵活调整

2.3 用户模型选择交互

用户在每个AI调用入口均可见模型选择器:

  • 全局默认模型(设置中选定)
  • 单次覆盖(当前对话/任务临时切换)
  • 余额实时显示(调用前告知本次预估费用)
  • 费用透明:显示 "本次调用约消耗 X 元"

2.4 智能路由与手动选择并存

保留现有智能路由能力,但增加计费感知

  • 自动路由:系统按内容特征选择最便宜的够用模型(帮用户省钱)
  • 手动选择:用户可强制指定模型(如"我就要用Claude")
  • 成本保护:用户可设置单次调用上限(如"超过0.5元拒绝执行")

三、定价体系与收费标准

3.1 模型调用定价原则

统一定价公式

用户支付单价 = 平台向厂商采购单价 × 2

平台利润率 = 100%(即成本占售价50%)。

3.2 主流模型参考定价(基于2026年6月市场价)

模型平台采购价(元/千tokens)用户售价(元/千tokens)利润率
inputoutputinput
DeepSeek V4 Flash0.0010.0020.002
DeepSeek V4 Pro0.0030.0060.006
通义千问 Qwen-Turbo0.0020.0100.005
智谱 GLM-4-Flash0.0010.0010.002
智谱 GLM-40.0050.0050.010
Kimi K2.60.0070.0280.014
Claude 3.5 Sonnet0.0220.1080.044
GPT-4o0.0180.0720.036

注:实际运营中,美元模型按实时汇率换算;国产模型按官方人民币定价。价格随市场浮动,后台支持动态调整。

3.3 计费单位与粒度

  • 计费单位:人民币,精确到分(0.01元)
  • 计费粒度:每次API调用完成后,按实际 input_tokens + output_tokens 结算
  • 结算周期:实时扣减账户余额,余额不足时拒绝调用(或降级到免费模型)
  • 最低消费:无最低消费,用多少扣多少

3.4 充值与账户体系

  • 用户账户设 LLM余额(独立于订阅体系)
  • 支持支付宝/微信充值,最低充值 10 元
  • 余额永不过期
  • 支持开具发票
  • 管理员后台可查看平台模型采购总成本 vs 用户付费总收入

四、收费系统设计

4.1 新增计费实体

在现有 Plan / Subscription / Payment 基础上,新增:

实体用途
LLMModel系统接入的模型列表、采购单价、用户售价、是否上架
LLMUsageRecord每次调用的用量记录(用户、模型、input tokens、output tokens、费用)
UserBalance用户 LLM 余额账户(充值、消费、退款)
ModelProviderAccount平台向各厂商采购的API Key和额度管理
StorageQuota用户存储配额(云端 vs 本地)

4.2 计费流程(外部模型调用)

1. 用户发起AI调用

2. 系统判断用户选择的模型类型
      ├─ 本地模型 → 直接调用,不计费
      ├─ 用户自有API → 直接调用,不计费
      └─ 系统接入模型 → 进入计费流程

3. 检查用户LLM余额(余额 ≥ 预估费用?)
      ├─ 余额不足 → 提示充值 / 降级到免费模型
      └─ 余额充足 → 继续

4. 平台以自身API Key向厂商发起调用

5. 厂商返回结果 + 实际用量(tokens)

6. 系统按用户售价计算费用,实时扣减余额

7. 写入 LLMUsageRecord(供用户对账)

4.3 存储收费设计

维度免费用户存储会员(9.9元/月)
云端存储❌ 不提供✅ 提供网盘式存储
存储容量仅本地10GB 起步
多端同步
数据备份本地自行备份平台自动备份
向量数据库存储本地ChromaDB云端托管
时间胶囊云端封存

存储与模型调用完全解绑

  • 不买存储会员 → 照样可以充钱调用外部模型
  • 不充钱调模型 → 照样可以买9.9元存储会员存东西到云端
  • 两者无依赖关系,各自独立付费

4.4 与现有订阅体系的关系

取消"Pro会员"作为模型调用门槛。模型调用采用纯预付费制,与订阅体系分离:

体系定位付费方式说明
模型调用使用系统接入的外部模型充值余额,按量扣费无需任何订阅,充10元就能用
存储会员云端存储 + 多端同步9.9元/月订阅独立购买,不影响模型调用
企业套餐多账号协作 + 企业管理按席位协商未来扩展

现有 Plan / Subscription 表仅用于存储会员订阅(9.9元/月),LLM余额独立管理模型调用费用。两者账单分离,用户可单独充值模型余额,也可单独订阅存储会员。


五、企业多账号交互联动架构

本节仅做架构设计,暂不进入开发排期。

5.1 企业空间(Enterprise Space)

在现有 Tenant(租户)基础上,引入 Organization(组织) 实体:

Organization
├── Owner(组织创建者,唯一)
├── Admins(管理员,可管理成员和账单)
├── Members(普通成员)
└── Shared Resources
    ├── Shared Knowledge Units(组织共享知识单元)
    ├── Shared Graph(组织共享知识图谱子图)
    ├── Shared Capsules(组织共享时间胶囊)
    └── Shared LLM Budget(组织共享模型调用预算)

5.2 多账号交互联动场景

场景描述联动机制
知识共振成员A的笔记与成员B的笔记发生概念碰撞系统自动检测跨成员概念相似度,推送碰撞提醒
认知互补成员A的盲区恰好是成员B的强项基于思维指纹的互补匹配,推荐跨成员对话
群体决策团队做决策时汇总多人认知镜像多成员的偏差检测、决策审计结果聚合呈现
组织记忆离职成员的知识不流失成员知识自动沉淀到组织共享知识库
预算管控企业统一支付模型调用费组织共享LLM Budget,管理员设成员配额

5.3 数据隔离与共享策略

  • 个人数据:默认仅自己可见,成员可选择共享到组织
  • 组织数据:所有成员可见,Owner可设读写权限
  • 碰撞检测范围:可选「仅自己」「组织内」「全网」(全网需匿名化)
  • AI上下文隔离:组织内的AI助手可选择性纳入组织共享知识作为上下文

5.4 企业计费模式

模式说明
席位费按成员数收取固定月费(如 49元/人/月)
共享预算组织统一充值LLM余额,所有成员共用
用量分摊月底按各成员实际用量分摊账单
私有化部署企业自有服务器部署,平台收授权费

六、菜单间碰撞、交互、联动与模型选择

6.1 核心设计理念

每个需要AI能力的入口,都必须让用户选择用哪个模型。 这是商业化的核心触点——模型选择即付费入口。

6.2 现有菜单的AI能力盘点与模型接入点

一级菜单二级功能是否需要AI模型选择接入点
📥 采集笔记创作✅ 写作辅助、标签提取编辑器底部模型选择器
剪藏✅ 自动摘要、标签剪藏后处理模型选择
RSS✅ 文章摘要RSS阅读页模型选择
批量导入✅ 内容分类导入后批量处理模型选择
🔗 知识图谱可视化
关系搜索✅ 语义搜索搜索框模型选择
路径发现✅ 智能路径路径分析模型选择
💡 涌现工作室联想✅ 跨域联想联想面板模型选择
碰撞核心AI功能碰撞台强制模型选择
杂交✅ 概念融合杂交面板模型选择
画布✅ AI辅助创作画布工具栏模型选择
🎯 注意力管家深度工作❌(计时器)
注意力分析✅ 行为洞察分析报告生成模型选择
⏳ 时间胶囊封存
对话✅ 与过去自己对话对话界面模型选择
广场✅ AI生成挑战广场内容模型选择
🧠 认知镜像偏差检测✅ 思维分析检测模型选择
周报告✅ 报告生成报告生成模型选择
决策审计✅ 审计分析审计模型选择
未来模拟✅ 情景推演模拟模型选择
🛡️ 反脆弱知识库来源追溯✅ 可信度评估评估模型选择
验证中心✅ 事实核查核查模型选择
🎮 姜胡说每日复盘✅ AI复盘复盘模型选择
进化轨迹❌(展示)
相关度检查✅ 关联分析检查模型选择

6.3 统一模型选择器组件设计

所有AI调用入口共用一套模型选择器

┌─────────────────────────────────────────────┐
│  🤖 当前模型:[下拉选择]  [余额:¥12.50]      │
│                                              │
│  ├─ 🏠 本地模型                              │
│  │   ○ Llama 3.1(免费)                     │
│  │   ○ Qwen 2.5(免费)                      │
│  │                                            │
│  ├─ 🌐 系统模型(按量计费)                   │
│  │   ○ DeepSeek V4 Pro(快/省) ¥0.012/千tok │
│  │   ○ Kimi K2.6(长文) ¥0.056/千tok        │
│  │   ○ Claude 3.5 Sonnet(代码) ¥0.216/千tok│
│  │   ○ GPT-4o(通用) ¥0.144/千tok           │
│  │                                            │
│  └─ 🔑 我的模型(已接入X个)                  │
│      ○ 我的 OpenAI Key                       │
│      ○ 我的 Claude Key                       │
│      [+ 接入新模型]                          │
└─────────────────────────────────────────────┘

6.4 菜单间联动与碰撞的模型选择策略

场景 A:涌现工作室 → 知识图谱联动

用户在碰撞台产生一个新洞见后,可选择:

  1. 注卡 → 进入知识库(使用轻量模型自动分类打标签)
  2. 可视化 → 进入知识图谱查看碰撞产生的网络新边(无需模型)
  3. 深度推导 → 使用强推理模型(Claude/GPT-4)进一步展开推导

模型选择策略:每个动作让用户选择模型,默认推荐最便宜的够用模型。

场景 B:认知镜像 → 时间胶囊联动

用户查看认知周报告后,系统推荐:

  1. 封存为时间胶囊 → 将本周认知状态封存(无需模型)
  2. 让未来的我审判 → 使用模型生成"未来的你会怎么看现在的你"
  3. 生成改进建议 → 使用模型基于报告生成下周行动建议

模型选择策略:后两个动作弹出模型选择器,推荐中等价位模型。

场景 C:反脆弱知识库 → 采集联动

用户收藏一篇文章到稍后读,系统提供:

  1. 快速摘要 → DeepSeek Flash(最便宜,够用)
  2. 深度批判性阅读 → Claude/GPT-4(高阶分析,贵但值)
  3. 提取关键概念入Wiki → Qwen/GLM(中文好,中价)

模型选择策略:根据用户选择的处理深度,匹配不同价位的模型。

6.5 商业化联动设计

联动路径免费体验付费转化点
本地模型完成基础任务可用用户觉得慢/不够好 → 引导充值使用外部模型
每次碰撞/联想产生结果显示结果结果下方显示"本次使用 Claude,消耗 ¥0.32"
每日复盘基础复盘深度复盘(含思维缝隙详细分析)需用强模型
存储达到本地容量上限提示清理引导购买9.9元存储会员(不影响模型调用
余额不足弹窗提示一键充值(最低10元起)/ 降级到本地模型
新用户首次使用外部模型赠送3元试用额度用完后引导充值

七、数据模型扩展(概要)

在现有数据模型基础上,需扩展以下核心实体:

7.1 LLM模型管理

  • LLMModel:模型元数据、采购单价、用户售价、上下架状态
  • ModelProviderAccount:平台向厂商采购的账户配置(API Key、余额、额度)
  • UserCustomModel:用户自己接入的模型配置(API Key加密存储)

7.2 计费与用量

  • UserBalance:用户LLM余额账户
  • LLMUsageRecord:每次调用的用量明细(用于对账和数据分析)
  • BalanceTransaction:余额变动流水(充值、消费、退款、赠送)
  • StorageQuota / StorageUsage:存储配额与用量追踪

7.3 企业组织

  • Organization:企业组织基本信息
  • OrganizationMember:组织成员关系与角色
  • SharedResource:组织共享资源(知识、图谱、预算)
  • OrganizationBudget:组织共享LLM预算与成员配额

八、实施路线图

Phase 1:模型控制台 + 按量计费(MVP,4周)

  1. 管理员后台:模型上下架、定价配置、功能开关预留
  2. 用户模型选择器:全局 + 单次覆盖,显示预估费用
  3. 计费中间件:调用拦截 → 余额检查 → 用量记录 → 实时扣费
  4. 充值系统:支付宝/微信充值(最低10元)、余额查询、对账单
  5. 新用户赠送3元试用额度,降低首次付费门槛
  6. 本地模型保持免费,外部模型充值即用、无需订阅

Phase 2:存储会员(2周)

  1. 存储配额体系:免费用户仅本地,会员启用云端
  2. 9.9元订阅流程:与现有Plan/Subscription体系整合
  3. 存储与模型调用账单分离,各自独立管理
  4. 多端同步:笔记、知识单元、向量数据库云端同步
  5. 数据迁移工具:本地数据一键上云

Phase 3:菜单间模型选择全覆盖(2周)

  1. 统一模型选择器组件:所有AI调用入口接入
  2. 各模块模型选择器埋点:编辑器、碰撞台、对话、分析等
  3. 智能推荐:系统根据任务类型推荐最便宜的够用模型
  4. 成本教育:用户选择高价模型时提示"预计费用较高"
  5. 余额不足时统一拦截:弹充值窗口,不阻断用户体验(可降级本地模型)

Phase 4:企业版架构设计(仅设计,不开发)

  1. 组织数据模型设计
  2. 多成员交互联动场景PRD
  3. 企业计费模式定价(席位费 + 共享LLM预算)
  4. 待Phase 1-3稳定后启动开发

九、关键风险与应对

风险应对策略
用户觉得模型调用太贵① 智能路由默认选最便宜够用模型 ② 提供用量预估 ③ 赠送新用户3元试用额度
平台模型采购成本波动① 后台支持动态调价 ② 与厂商签长约锁价 ③ 多厂商分散风险
用户自接API绕过收费① 不禁止,作为生态策略 ② 自接模型体验不如系统优化过的(无路由、无缓存)③ 引导高级用户因便利性选择系统模型
存储成本高于9.9元收入① 设存储上限(如10GB)② 超额部分按量收费 ③ 压缩/冷存策略
用户混淆"充值"和"订阅"① UI明确区分"模型余额"和"存储会员" ② 两处入口独立 ③ 账单分开显示
企业版需求不确定先设计不开发,通过付费用户访谈验证需求

十、一句话总结

本地模型免费拉新,外部模型充值即用按量赚差价(无月费门槛),存储会员独立收月费,企业版预留架构——让每一分钱都花在用户自己选择的模型上。

基于 AGPL-3.0 协议发布。