第二大脑商业架构技术文档 v1.0
本文档定义「Molore」从免费工具向商业化平台演进的技术架构,不涉及具体代码实现。
一、架构总览
1.1 核心定位
第二大脑从"个人工具"升级为"认知基础设施平台",用户为模型调用和云端存储付费,平台赚取模型差价和存储服务费。
1.2 商业公式
平台收入 = 外部模型调用量 × (平台售价 − 采购成本) + 存储会员数 × 9.9元
= 外部模型调用量 × 采购成本 × 1倍利润率 + 存储会员数 × 9.9元
模型调用:纯预付费,无月费门槛,充多少用多少。
云端存储:独立订阅,9.9元/月,与模型调用完全解绑。1.3 两大收费支柱
| 支柱 | 模式 | 单价 | 门槛 | 目标用户 |
|---|---|---|---|---|
| 模型调用费 | 按量计费(input/output tokens) | 原API价格 × 2 | 无月费,充值即用 | 所有使用外部模型的用户 |
| 存储会员 | 固定月费 | 9.9元/月 | 独立订阅 | 需要云端存储的个人用户 |
| 企业套餐 | 按席位 + 按量 | 协商定价 | — | 团队/企业用户 |
1.4 免费策略
| 免费项 | 目的 |
|---|---|
| 本地模型(Ollama)调用 | 降低入门门槛,用户可先体验再付费 |
| 用户自接API | 吸引开发者/高级用户,形成生态 |
| 基础功能(笔记、剪藏、搜索) | 保留核心工具属性,防止用户流失 |
| 外部模型调用(余额充足时) | 不需要任何订阅或月费,充10块钱就能用Claude |
二、LLM模型控制台架构
2.1 模型分层体系
控制台将模型分为三层,UI上按此分层展示:
┌─────────────────────────────────────────────┐
│ 🏠 本地模型(免费) │
│ Ollama / Llama 3.1、Qwen 2.5、Nomic Embed │
│ → 调用不扣费,走用户本地硬件 │
├─────────────────────────────────────────────┤
│ 🌐 系统接入模型(按量收费,2倍API费) │
│ DeepSeek、Kimi、通义千问、智谱GLM、Claude、 │
│ GPT-4、Gemini 等 │
│ → 平台统采统付,用户按调用量付费 │
├─────────────────────────────────────────────┤
│ 🔑 用户自有模型(免费) │
│ 用户填入自己的 API Key,直接调用厂商 │
│ → 平台不中转、不计费、不承担成本 │
└─────────────────────────────────────────────┘2.2 管理员模型配置后台
管理员通过后台控制:
- 系统接入哪些外部模型:打勾即上架,用户可见可选
- 每个模型的显示名称、描述、推荐场景
- 默认路由策略:管理员设定各场景优先路由到哪个模型
- 系统兜底模型:当用户余额不足或路由失败时的回退模型
- 功能开关(预留):
- 是否允许未充值用户使用外部模型(可设为"必须充值"或"赠送试用额度")
- 是否强制要求订阅才能使用某类模型(未来可扩展会员专享模型)
- 充值门槛(最低充值金额、赠送策略)
- 这些开关当前保持开放状态,后续根据运营数据灵活调整
2.3 用户模型选择交互
用户在每个AI调用入口均可见模型选择器:
- 全局默认模型(设置中选定)
- 单次覆盖(当前对话/任务临时切换)
- 余额实时显示(调用前告知本次预估费用)
- 费用透明:显示 "本次调用约消耗 X 元"
2.4 智能路由与手动选择并存
保留现有智能路由能力,但增加计费感知:
- 自动路由:系统按内容特征选择最便宜的够用模型(帮用户省钱)
- 手动选择:用户可强制指定模型(如"我就要用Claude")
- 成本保护:用户可设置单次调用上限(如"超过0.5元拒绝执行")
三、定价体系与收费标准
3.1 模型调用定价原则
统一定价公式:
用户支付单价 = 平台向厂商采购单价 × 2平台利润率 = 100%(即成本占售价50%)。
3.2 主流模型参考定价(基于2026年6月市场价)
| 模型 | 平台采购价(元/千tokens) | 用户售价(元/千tokens) | 利润率 |
|---|---|---|---|
| input | output | input | |
| DeepSeek V4 Flash | 0.001 | 0.002 | 0.002 |
| DeepSeek V4 Pro | 0.003 | 0.006 | 0.006 |
| 通义千问 Qwen-Turbo | 0.002 | 0.010 | 0.005 |
| 智谱 GLM-4-Flash | 0.001 | 0.001 | 0.002 |
| 智谱 GLM-4 | 0.005 | 0.005 | 0.010 |
| Kimi K2.6 | 0.007 | 0.028 | 0.014 |
| Claude 3.5 Sonnet | 0.022 | 0.108 | 0.044 |
| GPT-4o | 0.018 | 0.072 | 0.036 |
注:实际运营中,美元模型按实时汇率换算;国产模型按官方人民币定价。价格随市场浮动,后台支持动态调整。
3.3 计费单位与粒度
- 计费单位:人民币,精确到分(0.01元)
- 计费粒度:每次API调用完成后,按实际 input_tokens + output_tokens 结算
- 结算周期:实时扣减账户余额,余额不足时拒绝调用(或降级到免费模型)
- 最低消费:无最低消费,用多少扣多少
3.4 充值与账户体系
- 用户账户设 LLM余额(独立于订阅体系)
- 支持支付宝/微信充值,最低充值 10 元
- 余额永不过期
- 支持开具发票
- 管理员后台可查看平台模型采购总成本 vs 用户付费总收入
四、收费系统设计
4.1 新增计费实体
在现有 Plan / Subscription / Payment 基础上,新增:
| 实体 | 用途 |
|---|---|
| LLMModel | 系统接入的模型列表、采购单价、用户售价、是否上架 |
| LLMUsageRecord | 每次调用的用量记录(用户、模型、input tokens、output tokens、费用) |
| UserBalance | 用户 LLM 余额账户(充值、消费、退款) |
| ModelProviderAccount | 平台向各厂商采购的API Key和额度管理 |
| StorageQuota | 用户存储配额(云端 vs 本地) |
4.2 计费流程(外部模型调用)
1. 用户发起AI调用
↓
2. 系统判断用户选择的模型类型
├─ 本地模型 → 直接调用,不计费
├─ 用户自有API → 直接调用,不计费
└─ 系统接入模型 → 进入计费流程
↓
3. 检查用户LLM余额(余额 ≥ 预估费用?)
├─ 余额不足 → 提示充值 / 降级到免费模型
└─ 余额充足 → 继续
↓
4. 平台以自身API Key向厂商发起调用
↓
5. 厂商返回结果 + 实际用量(tokens)
↓
6. 系统按用户售价计算费用,实时扣减余额
↓
7. 写入 LLMUsageRecord(供用户对账)4.3 存储收费设计
| 维度 | 免费用户 | 存储会员(9.9元/月) |
|---|---|---|
| 云端存储 | ❌ 不提供 | ✅ 提供网盘式存储 |
| 存储容量 | 仅本地 | 10GB 起步 |
| 多端同步 | ❌ | ✅ |
| 数据备份 | 本地自行备份 | 平台自动备份 |
| 向量数据库存储 | 本地ChromaDB | 云端托管 |
| 时间胶囊云端封存 | ❌ | ✅ |
存储与模型调用完全解绑:
- 不买存储会员 → 照样可以充钱调用外部模型
- 不充钱调模型 → 照样可以买9.9元存储会员存东西到云端
- 两者无依赖关系,各自独立付费
4.4 与现有订阅体系的关系
取消"Pro会员"作为模型调用门槛。模型调用采用纯预付费制,与订阅体系分离:
| 体系 | 定位 | 付费方式 | 说明 |
|---|---|---|---|
| 模型调用 | 使用系统接入的外部模型 | 充值余额,按量扣费 | 无需任何订阅,充10元就能用 |
| 存储会员 | 云端存储 + 多端同步 | 9.9元/月订阅 | 独立购买,不影响模型调用 |
| 企业套餐 | 多账号协作 + 企业管理 | 按席位协商 | 未来扩展 |
现有 Plan / Subscription 表仅用于存储会员订阅(9.9元/月),LLM余额独立管理模型调用费用。两者账单分离,用户可单独充值模型余额,也可单独订阅存储会员。
五、企业多账号交互联动架构
本节仅做架构设计,暂不进入开发排期。
5.1 企业空间(Enterprise Space)
在现有 Tenant(租户)基础上,引入 Organization(组织) 实体:
Organization
├── Owner(组织创建者,唯一)
├── Admins(管理员,可管理成员和账单)
├── Members(普通成员)
└── Shared Resources
├── Shared Knowledge Units(组织共享知识单元)
├── Shared Graph(组织共享知识图谱子图)
├── Shared Capsules(组织共享时间胶囊)
└── Shared LLM Budget(组织共享模型调用预算)5.2 多账号交互联动场景
| 场景 | 描述 | 联动机制 |
|---|---|---|
| 知识共振 | 成员A的笔记与成员B的笔记发生概念碰撞 | 系统自动检测跨成员概念相似度,推送碰撞提醒 |
| 认知互补 | 成员A的盲区恰好是成员B的强项 | 基于思维指纹的互补匹配,推荐跨成员对话 |
| 群体决策 | 团队做决策时汇总多人认知镜像 | 多成员的偏差检测、决策审计结果聚合呈现 |
| 组织记忆 | 离职成员的知识不流失 | 成员知识自动沉淀到组织共享知识库 |
| 预算管控 | 企业统一支付模型调用费 | 组织共享LLM Budget,管理员设成员配额 |
5.3 数据隔离与共享策略
- 个人数据:默认仅自己可见,成员可选择共享到组织
- 组织数据:所有成员可见,Owner可设读写权限
- 碰撞检测范围:可选「仅自己」「组织内」「全网」(全网需匿名化)
- AI上下文隔离:组织内的AI助手可选择性纳入组织共享知识作为上下文
5.4 企业计费模式
| 模式 | 说明 |
|---|---|
| 席位费 | 按成员数收取固定月费(如 49元/人/月) |
| 共享预算 | 组织统一充值LLM余额,所有成员共用 |
| 用量分摊 | 月底按各成员实际用量分摊账单 |
| 私有化部署 | 企业自有服务器部署,平台收授权费 |
六、菜单间碰撞、交互、联动与模型选择
6.1 核心设计理念
每个需要AI能力的入口,都必须让用户选择用哪个模型。 这是商业化的核心触点——模型选择即付费入口。
6.2 现有菜单的AI能力盘点与模型接入点
| 一级菜单 | 二级功能 | 是否需要AI | 模型选择接入点 |
|---|---|---|---|
| 📥 采集 | 笔记创作 | ✅ 写作辅助、标签提取 | 编辑器底部模型选择器 |
| 剪藏 | ✅ 自动摘要、标签 | 剪藏后处理模型选择 | |
| RSS | ✅ 文章摘要 | RSS阅读页模型选择 | |
| 批量导入 | ✅ 内容分类 | 导入后批量处理模型选择 | |
| 🔗 知识图谱 | 可视化 | ❌ | — |
| 关系搜索 | ✅ 语义搜索 | 搜索框模型选择 | |
| 路径发现 | ✅ 智能路径 | 路径分析模型选择 | |
| 💡 涌现工作室 | 联想 | ✅ 跨域联想 | 联想面板模型选择 |
| 碰撞 | ✅ 核心AI功能 | 碰撞台强制模型选择 | |
| 杂交 | ✅ 概念融合 | 杂交面板模型选择 | |
| 画布 | ✅ AI辅助创作 | 画布工具栏模型选择 | |
| 🎯 注意力管家 | 深度工作 | ❌(计时器) | — |
| 注意力分析 | ✅ 行为洞察 | 分析报告生成模型选择 | |
| ⏳ 时间胶囊 | 封存 | ❌ | — |
| 对话 | ✅ 与过去自己对话 | 对话界面模型选择 | |
| 广场 | ✅ AI生成挑战 | 广场内容模型选择 | |
| 🧠 认知镜像 | 偏差检测 | ✅ 思维分析 | 检测模型选择 |
| 周报告 | ✅ 报告生成 | 报告生成模型选择 | |
| 决策审计 | ✅ 审计分析 | 审计模型选择 | |
| 未来模拟 | ✅ 情景推演 | 模拟模型选择 | |
| 🛡️ 反脆弱知识库 | 来源追溯 | ✅ 可信度评估 | 评估模型选择 |
| 验证中心 | ✅ 事实核查 | 核查模型选择 | |
| 🎮 姜胡说 | 每日复盘 | ✅ AI复盘 | 复盘模型选择 |
| 进化轨迹 | ❌(展示) | — | |
| 相关度检查 | ✅ 关联分析 | 检查模型选择 |
6.3 统一模型选择器组件设计
所有AI调用入口共用一套模型选择器:
┌─────────────────────────────────────────────┐
│ 🤖 当前模型:[下拉选择] [余额:¥12.50] │
│ │
│ ├─ 🏠 本地模型 │
│ │ ○ Llama 3.1(免费) │
│ │ ○ Qwen 2.5(免费) │
│ │ │
│ ├─ 🌐 系统模型(按量计费) │
│ │ ○ DeepSeek V4 Pro(快/省) ¥0.012/千tok │
│ │ ○ Kimi K2.6(长文) ¥0.056/千tok │
│ │ ○ Claude 3.5 Sonnet(代码) ¥0.216/千tok│
│ │ ○ GPT-4o(通用) ¥0.144/千tok │
│ │ │
│ └─ 🔑 我的模型(已接入X个) │
│ ○ 我的 OpenAI Key │
│ ○ 我的 Claude Key │
│ [+ 接入新模型] │
└─────────────────────────────────────────────┘6.4 菜单间联动与碰撞的模型选择策略
场景 A:涌现工作室 → 知识图谱联动
用户在碰撞台产生一个新洞见后,可选择:
- 注卡 → 进入知识库(使用轻量模型自动分类打标签)
- 可视化 → 进入知识图谱查看碰撞产生的网络新边(无需模型)
- 深度推导 → 使用强推理模型(Claude/GPT-4)进一步展开推导
模型选择策略:每个动作让用户选择模型,默认推荐最便宜的够用模型。
场景 B:认知镜像 → 时间胶囊联动
用户查看认知周报告后,系统推荐:
- 封存为时间胶囊 → 将本周认知状态封存(无需模型)
- 让未来的我审判 → 使用模型生成"未来的你会怎么看现在的你"
- 生成改进建议 → 使用模型基于报告生成下周行动建议
模型选择策略:后两个动作弹出模型选择器,推荐中等价位模型。
场景 C:反脆弱知识库 → 采集联动
用户收藏一篇文章到稍后读,系统提供:
- 快速摘要 → DeepSeek Flash(最便宜,够用)
- 深度批判性阅读 → Claude/GPT-4(高阶分析,贵但值)
- 提取关键概念入Wiki → Qwen/GLM(中文好,中价)
模型选择策略:根据用户选择的处理深度,匹配不同价位的模型。
6.5 商业化联动设计
| 联动路径 | 免费体验 | 付费转化点 |
|---|---|---|
| 本地模型完成基础任务 | 可用 | 用户觉得慢/不够好 → 引导充值使用外部模型 |
| 每次碰撞/联想产生结果 | 显示结果 | 结果下方显示"本次使用 Claude,消耗 ¥0.32" |
| 每日复盘 | 基础复盘 | 深度复盘(含思维缝隙详细分析)需用强模型 |
| 存储达到本地容量上限 | 提示清理 | 引导购买9.9元存储会员(不影响模型调用) |
| 余额不足 | 弹窗提示 | 一键充值(最低10元起)/ 降级到本地模型 |
| 新用户首次使用外部模型 | 赠送3元试用额度 | 用完后引导充值 |
七、数据模型扩展(概要)
在现有数据模型基础上,需扩展以下核心实体:
7.1 LLM模型管理
- LLMModel:模型元数据、采购单价、用户售价、上下架状态
- ModelProviderAccount:平台向厂商采购的账户配置(API Key、余额、额度)
- UserCustomModel:用户自己接入的模型配置(API Key加密存储)
7.2 计费与用量
- UserBalance:用户LLM余额账户
- LLMUsageRecord:每次调用的用量明细(用于对账和数据分析)
- BalanceTransaction:余额变动流水(充值、消费、退款、赠送)
- StorageQuota / StorageUsage:存储配额与用量追踪
7.3 企业组织
- Organization:企业组织基本信息
- OrganizationMember:组织成员关系与角色
- SharedResource:组织共享资源(知识、图谱、预算)
- OrganizationBudget:组织共享LLM预算与成员配额
八、实施路线图
Phase 1:模型控制台 + 按量计费(MVP,4周)
- 管理员后台:模型上下架、定价配置、功能开关预留
- 用户模型选择器:全局 + 单次覆盖,显示预估费用
- 计费中间件:调用拦截 → 余额检查 → 用量记录 → 实时扣费
- 充值系统:支付宝/微信充值(最低10元)、余额查询、对账单
- 新用户赠送3元试用额度,降低首次付费门槛
- 本地模型保持免费,外部模型充值即用、无需订阅
Phase 2:存储会员(2周)
- 存储配额体系:免费用户仅本地,会员启用云端
- 9.9元订阅流程:与现有Plan/Subscription体系整合
- 存储与模型调用账单分离,各自独立管理
- 多端同步:笔记、知识单元、向量数据库云端同步
- 数据迁移工具:本地数据一键上云
Phase 3:菜单间模型选择全覆盖(2周)
- 统一模型选择器组件:所有AI调用入口接入
- 各模块模型选择器埋点:编辑器、碰撞台、对话、分析等
- 智能推荐:系统根据任务类型推荐最便宜的够用模型
- 成本教育:用户选择高价模型时提示"预计费用较高"
- 余额不足时统一拦截:弹充值窗口,不阻断用户体验(可降级本地模型)
Phase 4:企业版架构设计(仅设计,不开发)
- 组织数据模型设计
- 多成员交互联动场景PRD
- 企业计费模式定价(席位费 + 共享LLM预算)
- 待Phase 1-3稳定后启动开发
九、关键风险与应对
| 风险 | 应对策略 |
|---|---|
| 用户觉得模型调用太贵 | ① 智能路由默认选最便宜够用模型 ② 提供用量预估 ③ 赠送新用户3元试用额度 |
| 平台模型采购成本波动 | ① 后台支持动态调价 ② 与厂商签长约锁价 ③ 多厂商分散风险 |
| 用户自接API绕过收费 | ① 不禁止,作为生态策略 ② 自接模型体验不如系统优化过的(无路由、无缓存)③ 引导高级用户因便利性选择系统模型 |
| 存储成本高于9.9元收入 | ① 设存储上限(如10GB)② 超额部分按量收费 ③ 压缩/冷存策略 |
| 用户混淆"充值"和"订阅" | ① UI明确区分"模型余额"和"存储会员" ② 两处入口独立 ③ 账单分开显示 |
| 企业版需求不确定 | 先设计不开发,通过付费用户访谈验证需求 |
十、一句话总结
本地模型免费拉新,外部模型充值即用按量赚差价(无月费门槛),存储会员独立收月费,企业版预留架构——让每一分钱都花在用户自己选择的模型上。