MarxSphere

MarxSphere 开源合规披露

本文档按开源合规要求,对本项目的运行方式、风险边界、模型依赖、商业 API 使用等进行完整披露。


1. 运行入口、依赖、配置、样例与部署

运行入口

模式 命令 说明
开发 npm run dev 前端 Vite (5173) + 后端 Fastify (4173)
生产 npm run build && npm start 编译后单进程服务 (4173)
桌面端 npm run build:desktop Electron + NSIS 安装包
MCP 服务 npm run mcp 标准 I/O MCP Server
测试 npm test 154 项单元测试
数据库 npm run db:setup 迁移 + 种子数据

依赖说明

样例输入输出

部署说明

  1. cp .env.example .env 并填入 API keys
  2. docker compose up -d(PostgreSQL + pgvector)
  3. npm install && npm run db:setup
  4. npm run build && npm start

2. 风险提示(重要)

模型幻觉

数据缺失

接口异常

业务边界


3. 依据、置信度与人工确认

引用溯源

置信度

人工确认机制


4. 商业 API 使用披露(重要)

本系统依赖多家商业 API,开源运行需要您自行购买/配置密钥:

API 用途 默认配置 费用假设
LLM(DeepSeek / 阿里云 MaaS / OpenAI 兼容) 推理/生成/评测 LLM_BASE_URL + LLM_API_KEY 按 token 计费,费用因模型而异
Embedding(阿里云 MaaS 等) 向量化 EMBEDDING_BASE_URL + EMBEDDING_API_KEY 按 token 计费
Rerank(qwen3-rerank 等) 重排 RERANK_BASE_URL 按调用计费
Sciverse(可选) 外部学术检索 SCIVERSE_API_TOKEN 按查询配额

调用环节

可替代性与锁定风险


5. 闭源模型使用披露

模型 类型 使用范围 原因
qwen-plus / deepseek-v4-flash 闭源 推理/实体抽取/综合回答 中文领域效果、成本、速度平衡
qwen3-rerank 闭源 检索重排 与检索流水线配合的领域效果
text-embedding-v4 闭源 向量化 中文语义理解效果好

替代方案

对可复现性的影响


6. Agent 框架说明

7. 工具与平台接入

8. 知识增强


11. 数据、知识库与上下文增强(数据治理)

11.1 数据来源、授权与边界

数据类型 来源 更新时间 授权 适用边界
用户导入文献 使用者自行上传(PDF/MD/TXT) 上传即处理 使用者自有版权材料;系统不提供盗版文献 仅用于个人/机构科研检索
演示/示例数据 脚本生成(scripts/问卷演示数据*.csv,seed=42) 随代码版本 随机模拟,无真实个人信息 仅用于功能演示,不构成真实调查数据
评测金标集 内部构建(data/gold_*.json 随代码版本 内部语料,不构成领域基准 仅用于内部评测对比
外部检索结果 Sciverse / CORE / OpenAlex 实时查询 各平台 API 条款 引用须自行核验版权与可引用性
政策资料 gov.cn 官方接口 实时/每 6 小时同步 政府公开信息 仅作研究参考,非官方解读

适用边界声明:本系统是科研辅助工具,知识库内容取决于用户导入;未入库领域可能检索不到或回答不准确;检索结果受第三方 API 数据质量影响。

11.2 知识库构建、检索与错误处理

11.3 用户数据、脱敏与删除

个人信息/敏感信息声明

11.4 上下文、记忆与状态管理(Agent)

9. 多模态能力

10. 运行验证

截图

评测指标


声明

本项目按 AGPL v3 + 商业授权双许可开源(保留 Logo、衍生开源、商用需授权,见 LICENSE)。本项目输出的所有研究结论、问卷设计、分析结果仅供科研参考,使用者须对最终成果负责。