设计了五个界面的平台架构——Web应用程序、项目工作空间、管理仪表板、RAG微服务和本地FAISS服务。
构建了统一的多提供商聊天层,支持在OpenAI、Claude、Gemini、Grok和Perplexity之间通过单个对话线程进行流式SSE响应。
交付了能力系统——由Perplexity驱动的带有引用的网页搜索、深度研究会话、RAG上下文注入的图像生成、文件上传+RAG索引,以及Nexum Five解决方案代理。
实现了拆分模式和GrouPT——并排双窗格比较和结构化多AI讨论,具有辩论、头脑风暴和分析模式。
推出了具有HTML/JSX/TSX实时预览、版本历史、对话链接、社交功能和社区市场的工件系统。
设计了工作流引擎(解决方案),具有多步骤自动执行、进度条、可共享链接和无需身份验证的访客执行。
构建了结合TipTap文档编辑器、Fortune Sheet电子表格编辑器和工件代码编辑器的项目协作工作空间——所有这些都基于项目文件的RAG。
设计了双存储RAG架构——本地FAISS用于每次对话和每个GPT知识,具有磁盘支持的索引,以及用于项目规模工作负载的远程Milvus支持的微服务。
实现了结合向量相似性、BM25关键词匹配和新近性评分的混合检索,使用IndexTag范围搜索进行个性化。
推出了具有用户管理、市场监管、每个提供商/模型/用户成本分析、手动信用调整、定价配置和完整审计日志的管理仪表板。集成了AWS Cognito身份验证,具有5级RBAC和基于信用的LemonSqueezy计费系统。
将五个领先的AI提供商统一在一个基于信用的界面下,增加了具有基础RAG的协作项目工作空间,并引入了多AI功能,如拆分模式比较和GrouPT小组讨论,这是单个提供商无法原生提供的。
MicrocosmWorks 在 NexumFive 中实现了一个标准化信用系统,其中每个 AI 提供商的 token 成本都映射到一个在管理员定价配置中维护的通用信用值。当用户在对话中途切换 OpenAI、Claude、Gemini、Grok 或 Perplexity 时,后端根据每个模型的成本乘数计算信用消耗。管理员仪表板提供按提供商和按模型的成本分析,用于精确的利润跟踪。
MicrocosmWorks 设计了双 RAG 系统,使本地的 FAISS 处理会话级别和 GPT 级别的知识,并使用磁盘支持的索引实现快速的单用户检索,而远程的由 Milvus 支持的微服务则处理需要跨大型文件集合进行跨文档搜索的项目规模工作负载。混合检索结合了向量相似度、BM25 关键词匹配和新近度评分,并通过 IndexTag 范围内的搜索确保了每个用户数据内的个性化。
GrouPT 是 MicrocosmWorks 实现结构化多 AI 讨论的产品,其中多个 AI 模型以预设角色参与对话。用户可以配置辩论、头脑风暴或分析模式,系统通过流式 SSE 编排来自选定模型(OpenAI、Claude、Gemini、Grok、Perplexity)的序列响应。每个模型都会收到完整的对话上下文及其角色指令,从而能够对同一 prompt 下模型的优势进行比较分析。
MicrocosmWorks 构建了 Projects 工作区,结合了用于文档编辑的 TipTap、用于电子表格的 Fortune Sheet 以及一个工件代码编辑器。所有项目文件都会通过一个在保存时处理文档的 BullMQ 嵌入管道,自动索引到 Milvus RAG 层。当用户在项目上下文中查询 AI 时,检索范围将限定在该项目的已索引文件内,从而使响应基于团队的实际文档和数据。
MicrocosmWorks 在 NexumFive 中发布了一个完整的市场系统,包含社区发布的 GPTs(具有专业指令和知识的自定义 AI 角色)、Workflows(具有自动执行功能的多步骤自动化流程)和 Artifacts(具有实时预览功能的可重用 HTML/JSX 组件)。用户通过无代码构建器构建自定义 GPTs,该构建器用于配置系统提示、通过 FAISS 索引的附加知识文件、可用工具以及模型偏好。