ARTICLE · 1078620
创业日记:把数据交给 AI,让它做成能分享、持续更新的报表

附 Hermes 数据助手搭建提示词。
我们这个四人小作坊,正在折腾一个数字助手,叫 TopoWorks。
在我的个人使用场景里,这套环境已经能自动生成数据报表页面,并持续自动更新,打开链接就能看。
公司这边目前先用它收集官网相关数据、生成日报,再发到企业微信。我还没来得及把 Web 访问权限配置好,所以暂时没有推进到公司的业务分析报表这一层。两边进度不同,不能混成一回事。
我想分享的,是它背后的搭建思路,以及一份可以交给 AI 执行的环境搭建提示词。
搭好以后,我希望怎么用?
直接把数据文件交给 Hermes,或者告诉它你想分析什么:
这是一份渠道数据,帮我看看各渠道的投入和效果。先核对字段与统计口径,再做成一个能在内部分享的网页报表。以后按确认的频率更新,有需要再通过 webhook 把摘要和链接发到群里。
接下来,希望由 Hermes 理解需求、核对不确定的地方,完成清洗入库、编写查询 SQL、制作页面、验证结果,最后给你一个可以打开和内部分享的链接。
你交代材料和分析思路,它交付可用的报表,而不是只给一段 SQL 或一份需要你自己运行的代码。
这份报表还应留下数据来源、SQL、生成脚本和更新规则。确认好数据来源与频率后,由 Hermes 配置调度,持续更新同一个地址,成为常态化报表;需要通知时,再接 webhook 自动推送摘要和链接。
如果数据靠人工上传,就在收到新文件后更新;有获授权的数据库或 API,才可以按计划取数。页面能持续访问,不等于数据已经自动刷新,内部分享也需要接收者具备相应的网络访问条件和权限。
这是下面提示词希望搭建并验证的使用方式,具体数据源和业务口径仍需在使用时确认。
为什么要给 AI 配个工位?
比如,你希望 AI 根据一份表格做报表。它可能已经会分析数据、写处理脚本、生成网页,但要把这件事真正接下来,还需要读取文件、执行代码、保存结果,以及发布网页的条件。
缺少这些条件,你就得把代码复制出去运行,把结果搬回来,再找地方放页面。它负责出主意,你负责跑腿。
所以我们的思路是:把工具和持久工作环境配给 Agent,让它能直接执行,并把成果留下来。
这套东西怎么工作?
我们的基础组合是 Hermes、Hindsight 长期记忆、Hermes 专用 PostgreSQL、文件目录和独立 Nginx,分工并不复杂:
Hermes 接任务、用工具: 连接模型,通过 Web UI 或已配置的消息渠道接收需求,读材料,编写并运行处理脚本。 Hindsight 帮助找回背景: 保存适合长期复用的业务背景、偏好和已确认决定,供后续会话检索。记忆可能过时,仍需核对当前文档;它也不代替保存数据与处理结果的数据库。 PostgreSQL 是 Hermes 自己的数据中心: 专门给它读写,承接用户上传的图片、文件经识别、提取和清洗后的数据,也保存第三方数据、分析中间结果与交付成果。原始图片、文件保留在文件空间,库内记录来源和关联。它有自己的库,才能把接收、清洗、入库、分析到交付这条链路接起来。 Web 是交付中心: 把 Agent 做出的东西变成团队能打开、能使用的成果,包括报表、查询页面和简单的内部应用。独立服务持续提供访问,聊天结束,成果仍然在。 文件空间保留工作材料: 保存原始输入、脚本、规则和生成文件,支持后续追溯与更新。
再准备一份 WEB_ENV.md,把资源位置、使用方法和权限边界告诉 Agent。它就知道该在哪里干活、把东西交到哪里,而不是每次重新问你。
整条路径可以理解为:数据来源 → 可复用的连接器 → Hermes 处理 → 自有数据中心 → Web 交付中心。
这里要分清两类库:Hermes 自有库可读写,外部业务库只读。
用户上传图片、表格,Hermes 提取并清洗后写进自己的库;第三方 API 数据也可以持续存进来。需要分析已有产品的数据时,则由业务库管理员单独创建只读账号,授权 Hermes 查询必要的表和字段。需要保存的处理结果写回 Hermes 自有库,不改动源业务库。
只有外部查询权限,它可以取数;有了自己的数据库,它才有地方持续整理、积累和交付数据。Hindsight 则另管长期记忆,三者职责不能混在一起。
下一批材料来了,可以复用已有规则更新。流程稳定以后,再按需要配置定时任务。固定计算由脚本执行,没必要每次让模型重新想一遍。
这些是通用工作环境的分工,不是把用途限定成报表。第一版静态 Web 就能交付报表和一些浏览器内运行的小工具;需要登录、提交表单或修改共享数据的内部应用,还要补上对应后端与权限。数据库也不会让 AI 自动理解业务,字段含义和交付要求仍然需要确认。
下面要搭的,就是这套工作条件。先拿样本跑通,再决定让它接你的哪件活。
接过一次的数据源,要留下连接器
还有一层值得专门留下来:第三方 API 和自有业务库的只读查询,接通以后,不要只留在当次会话里。
把取数脚本、参数、返回字段、权限范围和更新方式整理好,就是这个工作台里可以反复调用的数据连接器。凭据单独保存,连接器只记录如何引用。
比如某个平台的 API,第一次要处理授权、分页和限流;自己业务库里的查询,第一次要确认表关系、字段含义和只读范围。这些弄明白、验证过,就保存成明确的调用入口,并写进连接器目录。
以后做另一张报表,Hermes 先查有哪些现成连接器,传入日期等参数取数,不必再研究一遍怎么接。定时任务也可以调用同一个入口。
这里说的“标准”,是约定好输入什么、返回什么、失败怎么报,不是把一段 SQL 随手存下来就算完成。数据源连接器负责稳定取数,某张报表专属的计算口径另外保存。
这样每接一个数据源,留下的就不只是一张报表,还有下一次工作能直接使用的工具。
先把环境搭好,业务可以后面再说
下面这份提示词,提炼自我们的搭建方式,是一个待实测的通用版本,不是一键安装器。
把它交给能读写文件、执行终端命令的 AI,由它帮助部署 Hermes,再接上长期记忆和工作环境。已有 Hermes 的,就检查并补齐,不另起一套。负责搭建的 AI 和搭好后干活的 Hermes,可以是两个不同的工具。
你需要有一台允许部署的电脑、NAS 或服务器,以及可用的模型服务配置。Hermes 和 Hindsight 所需的模型访问由搭建过程核实,不默认一个服务的配置会自动适用于另一个。Web 的目录权限、端口、域名和访问方式,要结合自己的环境处理;AI 没有相应权限时,这部分需要你配合。以后接第三方数据,也需要你完成对应授权。
先在本机或私有网络跑通即可。无需一上来就准备公网域名,也不必先接我们用的那些数据平台。
复制这段,让 AI 开始搭
请帮我搭建一套以 Hermes 为执行入口、Hindsight 为长期记忆的 AI 工作台,配备 Hermes 自有的可读写 PostgreSQL 数据库、持久工作区和独立 Web 服务。已有组件先检查复用,缺少的再部署。目标:用户提供数据文件或分析思路后,Hermes 能理解需求、核对字段与口径,完成清洗入库、编写 SQL、生成并验证网页,交付可内部分享的固定链接,而不是要求用户自行执行生成的代码。保存数据来源、SQL、脚本和更新规则,支持配置常态化报表及可选 webhook 推送。先搭通用环境,不预设具体业务,不建设多租户 SaaS。一、先检查现有条件检查当前系统、Agent 的运行方式、文件和命令权限、Docker/Compose 是否可用、已有数据库与 Web 服务,以及端口和目录占用。只读取必要信息,不输出密钥或完整环境变量。优先复用合适的已有资源。确实缺少信息时,集中询问:部署位置、允许操作的目录、Web 访问方式及必要授权。没有明确部署目标时,不自行修改远程机器。如果你只能聊天而不能执行,请明确说明,并交付配置文件和操作步骤,不声称已完成部署。二、准备以下基础能力1. Hermes Agent 与交互入口先查阅 Hermes 官方安装文档及所选 Web UI 项目的维护说明,核实当前兼容版本、镜像来源和主机架构。区分 Hermes 核心与第三方 Web UI,不把旧示例标签当作当前版本。优先在合适的环境用 Docker Compose 部署,固定实际使用的版本;已有实例不擅自替换。接通用户选择的模型服务,提供可用的 Web UI 或终端交互入口。缺少模型授权时,指导用户在本地私有配置中填写,不要求把密钥粘进聊天。持久化 Hermes 配置、会话、Skills 和调度状态。验证一次真实模型回复、工作区文件读写和简单命令执行。第三方消息渠道后续按需接入。2. Hindsight 长期记忆查阅 Hindsight 官方部署说明及当前 Hermes 的 Hindsight 集成说明,选择兼容版本,配置服务、持久存储和它实际需要的模型服务。优先使用 Hermes 支持的原生集成;若当前版本不支持,说明缺口,不只启动一个孤立服务就报完成。采用独立记忆存储和明确的 memory bank,凭据私有保存,服务默认只在内部网络访问。配置 Hermes 实际使用的服务地址、bank 和读写入口,并记录触发写入与检索的方式。记忆用于找回背景、偏好和已确认决定,不充当业务明细库。不默认保存所有对话,不存密钥;记录来源,提供纠正与删除方法,冲突时核对当前权威文档。单团队共享 bank 不等于成员隔离,明确谁能读写,不混入原有个人记忆。3. 持久工作区为输入材料、脚本、处理规则、日志和备份设置清晰目录;与网页发布目录分开。Agent 状态和必要配置也要持久化,不能只放在临时容器里。4. Hermes 自有数据中心与外部业务库接入为 Hermes 单独准备 PostgreSQL 数据库和专用应用角色。该角色在自己的库或指定 schema 内具备建表、查询和写入等必要权限,用于保存上传材料清洗后的数据、第三方同步数据、中间结果和交付数据;不授予超级用户或其他库的访问权限。这个库不是现有产品的业务数据库,也不是 Hindsight 记忆库,三者分别配置连接与凭据,不混用。输入可来自图片、PDF、表格等文件、外部数据库连接和第三方 API。先建立输入目录、来源记录和接入约定,具体解析工具与连接器按真实需求配置,不预先安装所有集成。图片识别结果须核对,原始文件单独保留,结构化记录关联来源。接入已有产品的业务数据库时,由其管理员单独创建只读账号,仅开放获准的表、字段或视图。Hermes 不使用业务库写账号;不能为处理数据在源库建表或修改记录。需要落地的清洗与分析结果写入 Hermes 自有库。外部来源按业务需要选择同步入自有库或按需查询,不复制未授权数据。持续同步记录批次、增量位置与错误,支持去重和重跑。连接字符串和 API 凭据私有配置。将已接通并验证的 API 获取流程、业务库只读查询沉淀为可复用连接器,而不是一次性脚本。先用简单脚本或模块实现,不强制建设连接器平台。每个连接器有固定名称和调用入口,说明输入参数、返回字段及业务含义、授权范围、数据时间与错误格式。SQL 使用参数化查询;按数据源需要处理分页、限流、超时、有限重试及增量位置。凭据只引用私有配置,不随连接器代码保存。建立 CONNECTORS.md,登记用途、入口、参数示例、输出约定、配置引用、维护版本和最近验证状态,让 Hermes 在取数前查找并复用。报表专属计算与通用取数逻辑分开;新建连接器前先检查已有能力。凭据通过环境配置或私有凭据文件提供,不写入文章、Git、网页或日志。Hermes 自有库、外部业务库只读连接与长期记忆连接分别标注。5. 执行环境准备持久 Python 虚拟环境和数据库驱动,记录依赖版本。业务依赖不要污染 Agent 自身运行环境。已有工具能用就复用,不为这个任务重建 Agent。6. Web 交付中心用于发布报表、查询页面及简单内部应用。第一版优先使用独立 Nginx 提供静态 HTML、CSS、JavaScript 和公开给页面使用的 JSON,可承载报表和无需服务端写入的浏览器工具。Agent 写发布目录,Nginx 只读访问;浏览器不直接连接数据库。若具体应用需要登录、表单提交、共享数据写入或实时查询,再实现相应后端 API、服务端权限与持久化,不能把静态托管当作完整动态应用环境。业务写操作需要明确授权。采用 releases/<版本>/ 和 current 指针。新版本检查通过后再切换,失败保留旧版;维护一个列出已交付报表与内部工具的首页。明确 Agent 内部验证地址和用户实际访问地址,不能把容器内部地址当成用户可访问链接。默认只供本机或私有访问。需要公网、登录或动态 API 时,另列所需配置,不假定已经具备。7. 持续执行保存每份报表的数据来源、已确认口径、SQL、生成脚本和更新规则。用户确认更新频率、时区与数据授权后,由 Hermes 配置现有调度机制,自动取数、处理、发布到同一地址并记录结果。基础搭建时验证调度能力,不创建没有业务需求的长期任务。人工上传文件的报表在收到新文件后更新,不承诺自动获取尚未上传的数据;明确实际使用的触发机制。支持按需配置 webhook,向指定渠道推送摘要、数据日期、更新状态和报表链接。先确认目标与发送内容,webhook 地址作为凭据私有保存;未经发送授权不试发。记录投递结果,设置有限重试并避免重复通知,推送不绕过报表访问权限。Hermes、长期记忆及业务数据分别保留持久状态,备份范围覆盖三者。不要把已有个人实例的记忆、授权或调度任务直接复制到新工作台。三、把环境教给 Agent生成 WEB_ENV.md,写明 Hermes 入口、实际路径、Hermes 自有库读写连接、外部业务库只读连接及各自用途、Python 入口、Hindsight 集成方式与 bank、记忆使用规则、CONNECTORS.md 连接器目录、发布步骤、访问地址、验证方法、权限边界及尚未具备的能力。通过当前 Agent 支持的项目说明、启动指引或 Skill 入口,让它在处理数据和网页任务前读取这份文档。若无法自动配置入口,明确告诉我每次如何加载,不能假装已接入。在说明中约定:- 新数据保留来源与导入批次;业务字段记录含义、单位和计算口径。- 未明确的业务口径先确认,不自行猜测;新增、重复、更新分别处理,重复执行不重复灌入数据。- 稳定处理逻辑保存为脚本,确认过的规则留下来,便于下次复用。- 发布目录只放允许被访问的页面和数据,不放原始私密材料、凭据、备份或日志。- 页面呈现的数据文本安全转义;任务失败如实报告,不发布虚假结果。四、用小样本验收先验证长期记忆:通过 Hermes 存入一条无敏感信息的测试约定,在不复用原会话上下文的新会话中检索,检查调用记录确认结果确实来自 Hindsight。再验证更正与删除;若处理为异步,等待完成后复查。服务健康不等于 Agent 已接入,读回成功也不等于所有场景都会自动回忆。清理测试记忆。用明确标注的合成数据建一个独立演示:接收文件、清洗并导入 Hermes 自有库,保存处理脚本,生成一个汇总页面,发布到固定地址。核实 Hermes 的自有库建表与读写权限。若接入外部业务库,检查只读角色的有效权限,确认只能查询获准范围;不要通过写入真实业务数据来试权限。尚未提供业务库授权时,标注未接入,不影响自有库与演示验收。为演示建立一个文件导入连接器,登记并从新任务中按说明再次调用,验证可以复用。若有获授权的 API 或业务库连接,再用小范围数据验证对应连接器的参数、输出和错误处理;未提供授权的连接器只记为待接入。再加入一批包含新增、重复和变化记录的数据,检查导入结果、汇总数字和页面更新。验证上一版页面可以回退,并说明页面回退不等于数据库回退。检查数据、文件和发布目录的持久化配置,确认 Web 服务独立于 Agent 会话。若重启测试会影响现有工作,先说明影响并取得确认;没有实际测试的项目标为未验证。为演示数据完成一次备份和隔离恢复检查,不覆盖原库。验证页面和数据文件可访问,并请我确认用户侧链接是否打开正常,以及预期内部读者能否在授权范围内访问。区分仅本机可用地址与真正可内部分享的地址。沿用同一报表地址完成一次更新,核对页面结果与数据库查询一致。检查调度配置并对演示流程执行一次测试,将手动成功、定时触发成功、通知投递成功分别记录。若需要等待计划触发才能确认,保留待验证状态。未提供 webhook 时交付配置方法,不宣称推送已经跑通。五、交付并结束交付实际创建的配置、组件版本、Hermes 使用入口、长期记忆接入与跨会话验证结果、环境说明、启动与停止方法、备份恢复步骤、演示地址,以及已通过和未通过的检查。在已授权的独立目录内推进,不逐条询问普通文件创建。涉及覆盖现有数据、重启已有服务、扩大权限或开放公网时,再明确说明并确认。不要擅自授予 Agent 主机管理员权限、Docker socket 或数据库超级用户权限。部署用的管理权限,与 Agent 日常工作权限要分开。基础环境验证完后,告诉我如何提供第一份真实材料和业务需求;不要自行添加业务功能。
搭好之后,拿自己的材料试
比如给它一份已经脱敏的表格,再说:
先检查这份数据,跟我确认字段含义和统计口径。然后完成清洗入库,编写 SQL、制作并验证网页报表,给我一个可以内部分享的链接。保存处理规则和脚本,以后收到同类文件就沿用这个地址更新。如果已有可持续读取的数据源,再跟我确认定时更新频率和 webhook 推送方式。
第一轮先看看它能不能把数据弄对、把结果交出来;第二轮再看看,它能不能接着上次的工作往下做。
这份提示词没有承诺一个全能数字员工。它先给 Agent 准备一套可以干活的条件。
至于交给它什么工作,可以从你手头那件每周都得重复的小事开始。
工位配好了。
别光跟它聊,给它点活试试。