Guessor 项目设计报告 PUBLIC EDITION // BETA 1
面向普通消费者的桌面 Agent 软件:公开精简版,包含产品定位、设计理念、三个核心模块与版本范围。
文档说明
文档版本:Beta 1(公开精简版)
最后更新:2026 年 9 月
品牌归属:Nexabox 旗下 AI 品牌,与牵引力工作室合作(官网 nexabox.de,QQ 群 621482061)
说明:本文由内部完整设计报告精简而成。为保证可读性与信息节奏,完整版中仍在验证与打磨的部分没有收录在公开版本中; 已公开的内容也会随版本迭代调整,均不构成对外承诺。
精简范围
| 范围 | 内容 |
|---|---|
| 本版本公开 | 产品定位与目标、核心设计理念、用户群体与使用场景、三个核心模块的用户视角定义、成果生成能力、权限与安全的用户可见部分、版本范围与路线 |
| 本版本未收录 | Agent 内部运行机制与上下文处理、模板底层的装配与复用细节、生成器的实现约束与自动修复策略、工作台权限分级的技术细节与危险调用清单、数据存储 / 接口 / 日志 / 错误处理等工程规范、后续版本中尚未验证的规划项 |
未被收录不代表不存在。它们属于产品正在打磨的部分,会在能力稳定、表达清晰之后再进入公开文档。
一、项目概述
1.1 一句话定义
Guessor 是 Nexabox 旗下的 AI 品牌,与 牵引力工作室合作 推出的 面向普通消费者的桌面 Agent 软件:用户通过 模板 把可复用的能力交给 Agent, 通过 应用空间 让它长期管理一个项目,通过 工作台 让它直接操作电脑完成即时任务。
1.2 三个核心模块
| 模块 | 用户语言 | 用户理解 | 解决的问题 |
|---|---|---|---|
| 模板 | 「让 Agent 学会一件事」 | 一套可复用的能力、规则和知识 | 能力复用:不想每次重复交代 |
| 应用空间 | 「我的项目」 | 一个长期存在的项目环境 | 长期项目:让 Agent 持续在一个上下文里工作 |
| 工作台 | 「让它现在替我做这件事」 | 立即执行任务的临时工作区 | 即时任务:让 Agent 直接操作电脑 |
模板 = 给 Agent 能力
应用空间 = 给 Agent 长期项目
工作台 = 给 Agent 一双手
1.3 明确不做什么(反模式清单)
以下内容在产品中不出现,也不在后续开发中引入:
- 不新增与「模板 / 应用空间 / 工作台」并列的第四个核心模块。
- 不做 Agent 开发平台:不暴露编排、节点连线、多角色协作配置。
- 不做可视化工作流编辑器:用户不需要画流程图来让 Agent 干活。
- 不做多智能体平台:用户视角始终只有「一个 Agent 在帮自己」。
- 不做 Skill 管理器:产品层面不出现 Skill、Prompt、Tool 等术语。
- 不做企业级 Agent 管理:不做组织 / 审批流 / 权限矩阵后台。
- 不做通用渲染框架:动态应用固定一条路线,报告固定一条路线。
以上限制只针对用户界面与用户认知层。底层实现中的技术概念只出现在代码、日志与内部文档中。
1.4 支撑功能(不是核心模块)
设置、模型配置、更新、帮助、日志查看属于支撑功能,在导航中放在次级位置, 不作为与三大模块并列的入口,避免用户在认知上把它们当成第四个模块。
二、产品背景与目标
2.1 背景问题
现有 AI 产品对普通消费者存在四类明显断点:
| 断点 | 具体表现 | 后果 |
|---|---|---|
| 能力无法沉淀 | 每次对话都要重新交代角色、规则、格式、偏好 | 用户重复劳动,结果不稳定 |
| 会话无法延续 | 聊天窗口一关,上下文与产物散落,没有「项目」概念 | 无法长期做一件事 |
| 只能「说」不能「做」 | 输出停留在文字,无法操作本机文件、程序、浏览器 | 用户还要自己搬运和执行 |
| 结果无法展示 | 做完的成果只能复制文本 | 无法演示、汇报、交付 |
2.2 产品目标
主目标:让没有技术背景的用户,可以在 5 分钟内让 Agent 具备一项可复用能力, 并在一个长期项目里持续协作,最终拿到一个能展示、能运行、能交付的成果。
- 能力可复用:创建或导入模板后,后续任务中 Agent 的表现明显稳定且符合预期。
- 项目可延续:第二天打开应用空间,Agent 依然知道项目是什么、做到哪一步、下一步做什么。
- 操作可执行:Agent 能在用户授权下真实创建、修改、运行本机文件与程序。
- 成果可交付:项目能一键生成可运行的动态应用或可分享的报告。
2.3 成功指标
| 指标 | 说明 | 目标值 |
|---|---|---|
| 首次成功时间 | 新用户从打开软件到完成第一个任务的时长 | ≤ 10 分钟 |
| 模板复用率 | 使用过模板的用户占比 | ≥ 50% |
| 空间回访率 | 创建空间后 7 天内再次打开的用户占比 | ≥ 40% |
| 生成成功率 | 一键生成应用或报告的成功率 | ≥ 85%(含自动修复后) |
| 任务完成率 | 工作台任务被用户判定为「完成」的比例 | ≥ 70% |
2.4 设计边界(非目标)
- 不追求「什么都能做」的通用 Agent 平台。
- 不追求多人协作、团队空间、云端同步(Beta 1 为单机本地)。
- 不追求覆盖全部操作系统能力,只覆盖普通消费者高频场景:文件、Python、程序运行、浏览器、文档处理。
三、产品定位
3.1 定位公式
Guessor = 可复用的 Agent 能力(模板)
+ 长期存在的项目环境(应用空间)
+ 真实操作电脑的执行能力(工作台)
3.2 与相邻产品形态的区别
| 对比对象 | 它的核心 | Guessor 的差异 |
|---|---|---|
| AI 聊天机器人 | 一问一答,会话结束即丢失 | 有项目、有文件、有记忆、能执行 |
| Agent 开发框架 | 给开发者搭 Agent | 面向消费者,用户只看到三个模块 |
| 工作流平台 | 用户画流程、配节点 | 用自然语言交代目标,Agent 自己决定怎么做 |
| 云 IDE / 代码工具 | 面向开发者的编辑器 | 内容区是给所有人看的项目空间,不只是代码 |
| 自动化脚本工具 | 需要用户会配置 | 执行由对话驱动,用户只需确认 |
3.3 用户价值链条
拥有能力(模板)
↓
进入项目(应用空间)
↓
持续工作(对话 + 文件 + 记忆)
↓
直接执行(工作台 + 工具)
↓
生成成果(动态应用 / 报告)
产品所有界面、文案、流程都必须服务于这条价值链条,任何偏离这条链条的功能都应被削减。
四、核心设计理念
4.1 用户语言优先
用户看到的词必须是日常词汇:模板、项目、文件、对话、运行、预览、导出、报告。 禁止出现在界面上的词:Skill、Tool、MCP、Prompt、Embedding、Agent Loop、Context Window、Runtime、Function Calling、Token。
4.2 一切围绕「项目」而不是「对话」
对话是手段,项目是主体。判断一个设计是否合理,用这条标准:
如果用户关掉软件再打开,他能不能一眼看到「我的项目现在是什么状态」?不能满足这条的设计,一律重做。
4.3 能力一次配置,长期复用
模板是能力的载体。用户配置一次,之后所有项目、所有会话都可以调用,不需要重复解释规则。
4.4 能看见的执行
Agent 在做任何实际动作(创建文件、运行命令、启动服务、修改系统)时,界面必须实时展示:
- 正在做什么(动作 + 目标)
- 结果是什么(成功 / 失败 / 摘要)
- 失败了会怎么处理(重试 / 修复 / 请你决定)
用户不应该面对一个「转圈但不知道在干什么」的黑盒。
4.5 渐进披露
- 默认视图只显示最重要的三件事:项目内容、对话、结果。
- 高级信息(执行日志、环境配置、模型选择、文件历史)藏在「详情 / 更多」里。
- 普通用户不需要打开任何高级面板就能完成主流程。
4.6 本地优先与可解释
- 项目文件存放在用户本机,用户能直接打开文件夹查看。
- 模板是纯文本,用户可以自己打开读、自己改、自己备份。
- Agent 的记忆与摘要以 Markdown 形式落盘,用户可以查看和纠正。
4.7 危险操作必须有人在场
默认策略是「读自由、写确认、危险必问」。用户随时可以把某个动作升级为「以后都允许」, 也可以随时撤销授权。
五、用户群体与场景
5.1 用户画像
| 画像 | 描述 | 主要诉求 |
|---|---|---|
| 学生 | 会写一点代码,但不想研究 Agent 技术 | 让 Agent 按固定方式长期整理一门课的资料 |
| 非技术岗职场人 | 会用表格、演示文稿、聊天工具,不会写代码 | 把一堆文件整理成一份汇报,并直接操作本机文件 |
| 独立开发者 | 会写代码,想要效率和长期项目环境 | 在项目里长期改代码、跑程序、生成可演示的 Demo |
| 内容创作者 | 关注一致性与产出量 | 固定写作风格与流程,长期更新一个内容项目 |
5.2 用户共同特征
- 不会(也不愿)学习 Agent 技术概念。
- 希望用自然语言表达目标,而不是配置参数。
- 对「能不能直接看到结果」极其敏感。
- 对「它动了我电脑上的东西」有天然警惕,需要清晰的确认与撤销。
5.3 六个核心场景
| # | 场景 | 用到的模块 | 产出 |
|---|---|---|---|
| S1 | 用模板完成一项任务 | 模板 + 工作台 | 本机文件(如演示文稿) |
| S2 | 创建一个长期项目空间 | 应用空间 | 结构化项目 + 对话记录 |
| S3 | 在空间中持续修改项目 | 应用空间 | 迭代后的项目 |
| S4 | 把项目生成动态应用 | 应用空间(生成能力) | 可运行的本地网页应用 |
| S5 | 把项目生成报告 | 应用空间(生成能力) | 单个 HTML 文件 |
| S6 | 用工作台操作电脑 | 工作台 | 整理好的本机文件 + 操作记录 |
场景之间的组合关系是:模板是横切能力,应用空间与工作台是两个不同的工作场地,工作台可以为空间服务。
5.4 非目标用户
- 需要复杂多智能体编排的团队。
- 需要企业级权限、审计、合规后台的组织。
- 希望把本产品当成 Agent 开发框架使用的工程师。
这类用户可以使用底层能力,但产品不为他们的高级诉求扩展界面。
六、三个核心模块
6.1 模板:让 Agent 学会一件事
对用户来说,模板就是「一份事先写好的工作说明书」。把它交给 Agent,它就知道这类事情该怎么做、按什么规则做、输出成什么样。
| 内容类型 | 用户视角 | 举例 |
|---|---|---|
| 角色与身份 | 「它是谁」 | 你是一位资深演示文稿设计师 |
| 工作方式 | 「它怎么做」 | 先确认受众,再定大纲,最后逐页填充 |
| 规则与约束 | 「什么必须 / 什么不许」 | 每页不超过 6 行,不要使用渐变色 |
| 输出格式 | 「结果长什么样」 | 输出大纲 + 逐页要点 |
| 领域知识 | 「它需要知道的事」 | 配色规范、常见图表选型 |
| 检查清单 | 「做完要自检」 | 检查空页、错别字、超长文本 |
| 示例与初始文件 | 「照着这个来」 | 一份样张、一个初始目录结构 |
首发内置示例模板方向:Python 开发、演示文稿制作、写作、数据分析、学习、网站开发。
使用入口:模板列表的「使用」按钮;应用空间输入框上方的模板标签;工作台输入框上方的模板标签。
界面约束:只有「模板」一个词,只有新建、导入、编辑、使用四个操作概念; 不要求用户填写参数、触发条件等技术字段。
没有模板也能使用全部三个模块。模板是增强能力,不是前置条件。
6.2 应用空间:我的项目
应用空间的核心不是「聊天」,而是「长期项目」。用户可以在这里创建一个项目,然后长期与 Agent 协作,直到项目结束。
| 组成 | 作用 | 用户在哪里看到 |
|---|---|---|
| 项目内容 | 目标、状态、进度、最近变更摘要 | 空间首页 + 状态面板 |
| 项目文件 | 真实的产物与目录结构 | 内容区(主视图) |
| Agent 对话 | 跨多次会话的沟通与操作记录 | 右侧对话区 |
| 持续操作 | 谁在什么时候改了什么 | 执行轨迹(可展开) |
空间首页要回答的问题
打开项目先看到什么,是产品「不是聊天窗口」的最直接证据:
- 这个项目要做什么(目标)
- 现在做到哪一步(进度与状态)
- 建议的下一步是什么(可直接点击继续)
- 最近改了什么、有哪些文件
空间内页
左到右依次是文件树与内容预览、Agent 对话区,底部是一个横跨全宽的输入框;顶部固定「生成」与设置入口。
项目状态与生命周期
| 状态 | 用户感知 |
|---|---|
| 进行中 | 首页显示进度与下一步,正常协作 |
| 已暂停 | 长时间未打开后自动标记,打开即恢复 |
| 已完成 | Agent 输出收尾总结,并建议生成报告 |
| 已归档 | 默认列表隐藏,需要主动筛选才可见 |
| 已删除 | 进入回收站,保留 30 天,可恢复 |
文件与撤销
- 项目文件统一放在空间自己的目录里,用户可以直接用系统文件管理器打开查看。
- 元数据、记忆与历史单独存放,不干扰用户的文件视图。
- 每一轮回复涉及的文件改动合并为一个快照,用于「撤销这一轮做的事」。
- 删除进入回收目录,不做物理删除。
6.3 工作台:现在替我做这件事
工作台是 Agent 的即时工作环境:一次任务的场地,而不是长期项目。
| 应用空间 | 工作台 | |
|---|---|---|
| 时间尺度 | 长期(天 / 周 / 月) | 即时(一次任务) |
| 主体 | 项目 | 任务 |
| 记忆 | 长期记忆 + 项目状态 | 仅本次会话 |
| 产出 | 项目文件、动态应用、报告 | 任务结果(文件 / 操作 / 结论) |
| 失败代价 | 需要谨慎,改动要可撤销 | 可丢弃,重来即可 |
一句话区分:应用空间是「把它做完」,工作台是「把它做了」。
能力范围
- 文件操作:读取、整理、转换、批量重命名
- Python 执行:数据处理、脚本、计算
- 程序运行:调用本机命令行工具、运行脚本
- 浏览器操作:打开页面、抓取公开信息、填写表单
- 文件处理:PDF、表格、文档、图片、压缩包
- 自动化操作:批处理与重复性工作
- 系统环境操作:环境变量、进程查看(需要较高权限等级)
三条设计重点
- 每一环都可见:用户能看到调用的动作、作用的位置、结果如何。
- 每一环都可中断:用户可以随时停止,已完成的动作保留并记录。
- 每一环都可追溯:所有执行写入操作记录,能回答「它到底改了哪些文件」。
空状态引导
新用户第一次进入时展示可直接点击的示例任务:整理一个文件夹、把多个文件合并成一份、分析一个表格、查找并整理资料。点击只填入输入框,不自动执行。
七、成果生成
7.1 定位
「生成」不是第四个模块,而是应用空间的一种输出能力: 根据当前项目生成一个可展示、可使用的成果。
动态应用 = 可以运行、可以交互的页面应用
报告 = 完整、可分享的单文件页面
7.2 选择指南
| 用户想问的问题 | 选动态应用 | 选报告 |
|---|---|---|
| 我想点按钮、填表单、看到实时结果 | 是 | 否 |
| 我想把成果讲清楚、发给别人看 | 否 | 是 |
| 我想随时改数据、看变化 | 是 | 否 |
| 我只想生成一次,之后当文件保存 | 否 | 是 |
| 我需要它离线也能打开 | 否 | 是 |
| 我需要它调用 Python 算东西 | 是 | 否 |
界面上一句话总结:要能操作,选动态应用;要能展示,选报告。
7.3 共同流程
点击生成 → 选择类型(动态应用 / 报告)
→ 分析当前项目(文件、状态、已确认的决定)
→ 给出内容计划(先给用户看,可调整)
→ 用户确认 → 生成文件 → 校验
→ 预览 → 用户可以继续让它修改
「内容计划」是给用户看的中间步骤,而不是让用户配置参数。例如它会说明打算做哪几个页面、数据来自哪里、预计生成多少文件。
7.4 与项目的关系
- 生成物独立存放,不放进用户的项目文件里,避免污染项目内容。
- 生成物可以读取项目文件,但只读引用。
- 每次重新生成产生新版本,用户可以在预览页切换查看。
- 生成能力必须校验后再交付:宁可多花几秒,也不要让用户看到打不开的结果。
八、权限与安全
8.1 权限模型
权限判断同时考虑三件事:目录范围(读 / 写)、能力类型(文件 / Python / 命令 / 浏览器 / 系统)、动作风险等级(低 / 中 / 高)。
8.2 授权粒度
| 粒度 | 有效期 |
|---|---|
| 允许一次 | 仅当前动作 |
| 本次会话都允许 | 会话结束后失效 |
| 本项目都允许 | 项目存在期间有效 |
| 始终允许 | 永久,可在设置中随时撤销 |
8.3 默认策略
| 能力 | 应用空间内 | 工作台内 |
|---|---|---|
| 读取项目文件 | 允许 | 允许(需先指定目录) |
| 写入项目文件 | 允许(可在空间设置关闭) | 需要确认 |
| 删除文件 | 需要确认 | 需要确认 |
| 访问项目目录之外 | 需要确认 | 需要确认 |
| 运行 Python | 允许(限定项目内) | 按风险等级 |
| 执行命令行 / 系统级操作 | 需要确认 | 需要确认 |
| 浏览器读取 / 交互 | 允许 / 需要确认 | 允许 / 需要确认 |
8.4 撤销与恢复
| 场景 | 恢复方式 |
|---|---|
| Agent 改了文件 | 回复气泡内的「撤销这些修改」 |
| Agent 删了文件 | 空间内的回收目录恢复 |
| Agent 移动了文件 | 撤销时按快照移动回原位置 |
| 不可逆操作 | 执行前必须确认,确认卡片明确标注「这一步不能撤销」 |
| 误删项目 | 回收站保留 30 天 |
8.5 用户可见的安全表达
安全机制必须用日常语言表达,而不是把技术术语丢给用户:
| 内部概念 | 界面文案 |
|---|---|
| 权限提升 | 允许 Agent 访问这个文件夹 |
| 白名单 / 黑名单 | 允许 / 禁止的程序(收在高级设置) |
| 审计日志 | 操作记录 |
| 越权拦截 | 这个操作超出了你允许的范围 |
| 回滚 | 撤销这次修改 |
权限确认只回答三个问题:它想做什么、影响是什么、能不能撤销。
九、版本范围与路线
9.1 Beta 1 目标
用最小功能集合验证核心假设:普通用户能否通过「模板 → 应用空间 → 工作台 → 生成成果」 这条链路,真实完成一件对自己有价值的事?
9.2 Beta 1 主要能力
| 模块 | 能力 |
|---|---|
| 基础 | 本地服务启动与健康检查、模型配置、单机本地运行 |
| 模板 | 列表 / 详情 / 新建 / 编辑 / 删除、导入文本模板、启用停用、用于项目或临时任务 |
| 应用空间 | 创建 / 列表 / 打开 / 重命名 / 删除(回收站)、文件读写与预览、项目状态、项目记忆、变更记录与撤销 |
| 对话 | 流式输出、执行轨迹、确认卡片(允许一次 / 会话 / 拒绝) |
| 工作台 | 即时会话、文件工具、Python 执行、权限与确认流程、操作记录 |
| 生成 | 生成动态应用(启动 / 停止 / 日志 / 自动修复)、生成报告(预览 / 导出单文件) |
| 安全 | 路径校验、删除进回收、写前快照、权限确认 |
9.3 Beta 1 暂不包含
- 账号体系与云同步
- 团队协作与权限管理后台
- 模板市场与分享链接
- 插件 / 扩展体系
- 定时与自动化任务
- 多设备协同
9.4 后续规划(概要)
| 阶段 | 方向 |
|---|---|
| v1.1 | 成果的排版与主题、项目复制与导出、临时任务历史回放、长任务完成提醒 |
| v1.2 | 模板分享、项目内全文检索、更强的浏览器交互、报告导出优化 |
| v2.0(谨慎评估) | 账号与可选云同步、项目跨设备、定时任务;均需以不破坏现有三个模块的简单性为前提 |
规划原则:任何新功能都必须能归入模板 / 应用空间 / 工作台三者之一,或属于支撑功能。
9.5 一句话的最终产品形态
用户打开 Guessor
→ 让它学会一件事(模板)
→ 建一个项目,长期和它一起做(应用空间)
→ 需要动电脑时让它直接动手(工作台)
→ 最后拿到一个能运行的应用,或一份能分享的报告
十、相关链接
- Nexabox 工作室官网(nexabox.de)
- Guessor 官网页(AI)
- 项目中心
- 文档中心
- GitHub
- 联系我们
- Nexabox 研发群:QQ 群号 621482061(QQ 搜索群号即可加入)