夜雨聆风学习资料网

ARTICLE · 1034179

我把金山文档搬进了 DSH

我把金山文档搬进了 DSH
这段时间我一直在折腾 DSH。
折腾到后来,我越来越觉得,真正影响我每天使用 AI 体验的,已经不完全是模型到底强不强了。GPT、DeepSeek、Kimi、GLM、Qwen,大家都在不断变强,模型之间当然还是有差距,但到了具体工作的时候,很多时候真正让我觉得麻烦的,反而是那些看起来特别琐碎的事情。
比如文件到底在哪里。
我的大量案件材料、法律文书、团队资料,都放在金山文档里,而 Agent 在 DSH 里面。以前我在 DSH 里处理一个案件,聊到一半需要看材料,就要另外打开一个网页进入金山文档,或者干脆再打开 WPS,找到文件以后看一遍,如果还要让 AI 分析,就再下载、上传,或者回来告诉它“你去某某文件夹里面找某某文件”。
这个过程单独看好像也没有多麻烦,但一天重复很多次以后,就会非常明显地感觉到,AI 虽然已经进入 Agent 时代了,可我们的工作界面其实还是割裂的
所以我很早就有一个想法:既然我每天绝大多数工作都离不开金山文档,那能不能干脆把金山文档直接搬进 DSH?
最近,这件事情终于基本做出来了。
01
右边就是我的金山文档
现在打开 DSH,右边就是我的金山文档。
我可以直接在那里看自己的文件夹、最近访问、星标、共享文件,也可以直接搜索,不需要再打开另外一个网页,也不用在几个软件之间来回切换。表面上看,这只是少开了一个窗口,但真的用起来以后,我觉得这种变化比想象中大得多,因为文档第一次不再是 DSH 外面的东西,而是真的变成了这个工作区的一部分
02
不做预览器,直接用原来的编辑器
而且我一直不太想做一个所谓的“预览器”。
因为金山文档本身已经有很好用的网页版编辑器,我为什么还要自己重新做一个功能残缺的 Word 预览界面?
所以现在点击文件以后,实际上是直接把金山文档自己的网页版能力嵌进了 DSH。也就是说,我不是只能在这里看一眼文档,而是可以直接使用金山文档原来的编辑能力,Word、表格这些文件都可以继续按照原来的方式打开和修改。
这个体验其实很符合我一开始想象中的样子。
我在中间和 Agent 讨论一个案件,右边就是正在看的文档;发现哪里要改,可以直接改;看到某一段有问题,可以马上问 AI;AI 给出意见以后,我又可以回到右边的原文继续修改,整个过程不需要再离开 DSH
以前 DSH 和 WPS 是两个软件,现在它们开始有点像一个工作台里的两个区域了。
03
引用:把“去哪里找”变成“就在这里”
但真正让我觉得这个插件开始“有用了”的,其实还不是把 WPS 放进侧边栏,而是后来把“引用”这件事情做通了
以前如果我想让 Agent 看一份金山文档里的文件,我可能会说:
以前
“去 XX 文件夹里面找一下 XX 文件。”如果文件多一点,还要继续解释目录、项目名称、文件名称,有时候甚至要描述“就是上次那个版本”。
这些自然语言其实都只是为了告诉 AI:我到底在说哪个文件
现在不需要了。
现在
我在右边看到一份文件,直接点一下引用,它就进入当前对话,Agent 拿到的是一个明确的文件对象,而不是一段关于“这个文件在哪里”的描述。
这个功能做完以后,我自己第一次用的时候其实挺开心,因为它看起来只是少说了一句话,但本质上是把“人告诉 AI 去哪里找东西”这件事,变成了“人直接把工作对象交给 AI”
而且这还顺带解决了一个我以前没有特别注意的问题,就是 Token。
如果每次都要用自然语言描述路径、文件名和上下文,这些东西其实都会进入对话,占掉上下文。文件多的时候,这种消耗并不小,而直接引用以后,“这个文件”就是这个文件,不需要再花一段话解释它是谁。
04
文本模式:只把那一段交给它
后来我又往前走了一步。
因为很多时候,我其实并不需要把整份文档交给 AI。比如:
一份几十页的合同,我可能只是想讨论其中一个条款;
一份判决书,我可能只是觉得其中某一段说理很值得拿出来分析;
一份重整计划,我也可能只是想让 AI 看某一小段表述有没有问题。
所以我给它保留了一个文本模式
在这个模式里,可以直接看到抽取出来的正文,而且文字本身也可以直接引用。
现在如果我看到某一段内容有问题,就可以直接选中那一段,把它扔给 AI,然后问:“这一段放在破产程序里有没有风险?”或者“这段说理和我们这个案件有什么区别?”
这个体验对我来说特别自然,因为它已经不像以前那样是“复制一段文字,粘贴进去,再补一句这是哪里来的”,而更像是在工作台上看到一段内容,顺手指给旁边的 Agent 看
05
我想要的不是插件,是工作台
做到这里以后,我才慢慢意识到,我真正想要的其实并不是一个“金山文档插件”。
如果只是让 Agent 读取金山文档,技术上并没有那么复杂,kdocs-cli 本身已经可以做很多事情,Agent 也可以通过命令去读取文件。
但我一直觉得,只让 AI 能看见文件是不够的。
我自己也必须看得见。
我需要知道 Agent 正在看哪一份材料,需要随时回到原文核对,需要在 AI 给出意见以后直接修改,也需要在我自己看到某一处内容的时候马上把它交给 AI。
对法律工作尤其是这样。
很多时候真正重要的不是 AI 给出的结论,而是这个结论到底建立在哪一份材料、哪一句话、哪一个条款上。
不是一个单纯聊天框,也不是一个后台运行的 Agent,而是人、AI 和文件都待在同一个地方
我能看到 Agent 在处理什么,Agent 也能拿到我正在看的材料,文件不是在另外一个软件里孤零零地放着,而是真的进入了当前案件的工作环境。
这也是我为什么一直在折腾 DSH。
我现在已经很少把它看成一个 DeepSeek 聊天客户端了。
对我来说,它更像是一个可以慢慢搭起来的 Harness,模型只是其中一部分,真正让我感兴趣的是,能不能把下面这些东西一点一点接起来:
文档AgentSkill案件上下文任务日历
金山文档只是第一块,但它对我来说又是非常重要的一块,因为我每天真正工作的内容,大多数最终还是落在文件里。
如果 Agent 一直待在聊天框里,而文档始终待在另外一个软件里,那么所谓的AI 工作流,其实始终缺了一截
现在至少在我自己的 DSH 里,这一截已经接上了一点。
我打开一个案件,可以在右边直接找到文件,打开,修改,看到某个问题就引用给 AI;如果只想讨论其中一句话,也可以直接把那一句话交给它。
这种感觉其实很难用“多了几个功能”去形容。
更像是原来几个彼此分开的东西,终于开始慢慢长到了一起。
· · ·
后面我还会继续折腾。
任务、日历、案件本身的工作逻辑,我都希望慢慢接进去。
我最终想要的并不是一个插件很多、看起来很复杂的 AI 软件,而是有一天我打开一个案件的时候,文件在那里,任务在那里,日程在那里,Agent 也在那里,我不需要再想应该先打开哪个软件、把什么东西搬到哪里,只需要继续处理这个案子。
这也是我最近做完这个插件以后最开心的一点。
它当然还很早期,还有很多地方可以继续改,但至少现在,我不用再把金山文档当成 DSH 外面的另一个世界了。
它真的搬进来了。
项 目 已 开 源
vansonffff / dsh-kdocs-sidebar
如果你也在用 DSH,而且大量工作文件都放在金山文档里,可以自己试试看。
至少对我来说,这一步虽然不算什么很大的技术创新,但它确实让 DSH 开始更像一个我每天愿意真正打开来工作的地方。
— 完 —

相关学习资料