夜雨聆风学习资料网

ARTICLE · 1018220

科睿唯安又要出AI工具了

科睿唯安又要出AI工具了

读完需要

5
分钟

速读仅需 2 分钟

Clarivate宣布将发布DeepR,计划把文献发现、全文阅读与AI理解收进同一环境,减少跳转。优点是扎根原文、对图书馆友好、出版商中立;但全文覆盖程度、AI能力与防幻觉、与已有产品的关系还都未知。#人工智能 #Clarivate #科睿唯安 #LeapSpace #WebofScience

9月10日Clarivate宣布,"今年晚些时候"将发布一个新产品,叫做DeepR,文末还留了邮箱wospwg@clarivate.com,招募机构加入产品工作组一起共建。一个还在喊人进来一起打磨的产品,所有"优点"目前都只是发布方自己的设想、或者说计划,不是结论。下面分两头讲,一头是它想解决什么、凭什么说得通,另一头是公告里没填上的坑。

1

它想解决的问题

做文献调研的人大多有过这种经历。先在文摘库里搜出一批文章,点开记录,再跳转到出版商网站或者图书馆,下载PDF,回到一堆浏览器标签里慢慢读。判断一篇论文值不值得细看,往往要在数据库记录、PDF和网页之间反复横跳。DeepR想做的第一件事,就是把"先找文献、再读全文、顺便用AI帮着理解"这几步收进Web of Science一个环境里。

第一版计划给出三样东西。一个内嵌的PDF和HTML全文阅读器,能直接打开有权限的论文。一个叫Document Assistant的AI文档助手。一组相关性摘要,帮研究者快速判断哪些文章值得深读。Clarivate在声明里写了一段话,说AI工具应当帮研究者更深入地钻进学术内容,而不是把他们推远,还说AI生成的内容要扎根在正在看的论文上,保持透明。这段话可以当作它的设计原则,确实和很多"丢一段话进去、吐一段摘要出来"的通用工具看上去不太一样,原文留在视线里,你随时能去核对。

对图书馆来说,它有个实在的卖点。DeepR不要求学校另起一个平台,也不增加新的实施负担,直接长在机构已经购买的Web of Science访问权限上。首发的全文覆盖,一部分来自机构自己的ProQuest订阅,一部分来自开放获取内容。等于把已经花钱买来的内容,推到discovery的旁边。Clarivate的算盘很清楚,这能提升已购资源的使用率,也帮图书馆向学校证明这笔钱花得值。

还有一点值得说。DeepR强调自己是一个出版商中立的环境。文献发现这件事,卡在某一家出版商的工具里总让人不舒服,WoS这个横跨多家出版商的入口,对学者和图书馆都有吸引力。

2

现在说说可能的"坑"

公告里的设想挺好,但有几处关键问题它没回答。这些设想本身站得住,还有三块地方没填上,全文覆盖、AI可靠性,以及和已有产品的关系。

2.1

全文覆盖取决于你学校订了什么

首发能读到的全文,只来自机构的ProQuest订阅和开放获取。这句话的潜台词要拆开看。如果你的学校没有订ProQuest,或者你想看的期刊捏在Elsevier、Springer、Wiley手里,DeepR就看不到全文,只能停在你的Web of Science元数据上。换句话说,它好不好用,很大程度上看你所在机构那份ProQuest合同是怎么签的。对一个全球产品来说,这个起点其实挺窄的。

2.2

AI到底有多能干,没讲清

Document Assistant能做哪些事,问答、提取方法、梳理参考文献,还是只是生成一段概览?摘要会不会漏掉关键结论,引用能不能逐句回溯到原文?"扎根于论文"是个原则,但没说怎么防幻觉、怎么保证不出错。这些恰恰是学者最在意、也最容易被坑的地方。目前我们连一次真实测评都看不到,只能等发布以后看。

2.3

相关性摘要可能反过来收窄视野

帮人快速筛文章是好事,可一旦AI替你决定"哪些值得读",偏见也就埋进去了。文献调研里最值钱的,常常是一次没计划到的意外发现。一个把低相关度文章悄悄压下去的排序,长期看也许会让人错过本该撞见的东西。用AI给文献做分类整理的工具都有这个问题,DeepR并不特殊,可公告里一句没提。

2.4

它来晚了,而且定位有点模糊

在它之前,Elicit, Scite, Consensus, ResearchRabbit, Semantic Scholar早就在做类似的事,还有爱思唯尔推出的LeapSpace,除了基于自家的2000万条全文数据Sciencedirect和近 1 亿条文摘数据Scopus,还签约了Emerald, OUP, BMJ, SAGE, IOP等多家出版商的全文内容,是目前已知最全的科研AI平台。DeepR目前能讲清楚的差异化,主要是"WoS加ProQuest同屋檐下"加上所谓"出版商中立"。核心AI能力是不是更强,内容能覆盖多少,现在都是未知数。

另一桩让人犯糊涂的是和既有产品的重叠。Clarivate本来就有Web of Science Research Assistant,一个基于核心合集数据的AI研究助手。现在DeepR又加一层全文和文档AI,两者将来怎么分工,普通用户会不会被绕晕,得等发布看清。

2.5

该问但还没人答的两个问题

价格。对图书馆是免费附加,还是按模块另行收费,公告只字未提。"不增加新平台"不等于不收费。但按照科睿唯安的一贯作风,不另行收费的可能性微乎其微。

数据安全。AI读的是受版权保护的全文,这些内容在调用过程里怎么处理,会不会进入模型训练,公告同样没说。对机构采购来说,这两件事比"体验更顺滑"更要紧。

当然,现在一切都还为时尚早。一个还在招募共建伙伴、第一版说是"今年晚些时候"才发布的产品。需要等它真正上线以后,再拿真实论文去试。到时候看它读得到多少全文、助手答得准不准,比现在读十遍公告都有用。

相关链接:

https://clarivate.com/academia-government/blog/bringing-evidence-into-focus-with-web-of-science-deepr/ 

版权声明:本公众号所有内容遵循CC BY-NC协议

内容声明:所有文章均为个人学习随笔,仅做学习交流使用,不代表任何立场。

相关学习资料

返回首页浏览学习资料