我真的很喜欢阅读《 Sci-Hub为什么会赢》。 关键点之一是,与机构访问期刊文章相关的用户体验可能非常糟糕。 那不是真正的新闻,但这是一个很好的提醒,因为我一直在思考电子书。 对于电子书,当前的目标似乎是追求一种体验,该体验并不会比使用期刊文章差。
最好的情况
因此,在Sci-Hub的那篇文章中,希瑟斯(Heathers)阐述了通过Sci-Hub获得某些东西要比机构访问容易得多。 当然,我最初的下意识反应是考虑机构访问的最佳情况如何(以及现在)。
希瑟斯(Heathers)在谈论获得已知物品的机会,他的例子确实费力。 从期刊级搜索开始会带来很多麻烦。 许多机构提供了两种方法,它们将变得容易得多。
1. Google学术搜索
大多数大学图书馆都在链接解析器知识库中跟踪其馆藏/访问权利/无论您想称其为什么。 通常,可以将其推送给Google Scholar,许多图书馆都可以这样做。 如果您在校园里,将自动看到从GS到图书馆全文的链接。 如果您不在校园,则必须在GS设置中添加这些链接。 基本上,您搜索文章标题,获得解析器菜单,单击全文,然后阅读文章。 您无需复制和粘贴DOI。
2.发现工具
许多大学图书馆都有发现工具,通常来自Ex Libris / ProQuest或EBSCO。 这在大多数已知项目搜索中也将起作用。 像GS一样,它利用发布商的大量数据,因此您只需输入文章标题即可获得文章的结果。 您甚至可能会获得直接的全文链接,而跳过解析器菜单步骤。
失败的许多机会
如果这些方法始终有效地工作,那不是很好吗? 让我列出这些失败的方法的不完整列表。
- 所需文章不在发现工具中(如果文章较旧,则更有可能)。
- Google学术搜索将错误的日期传递给解析器,导致死胡同(令人惊讶地很常见)。
- 发现选项中的任何一个都会将任何数量的不正确的信息传递给解析器,从而导致死胡同。
- 发现信息和预期的全文本源具有来自不同版本(打印与在线)的元数据,元数据不同,导致死胡同。
- 代理服务器缺少全文本站点的配置,否则发生其他代理异常。
- 全文站点是仅在期刊或期刊级别而非文章级别链接的众多站点之一。 用户必须重复搜索。
- 我们可以通过数据库访问期刊,而该数据库实际上并不具有根据作者协议而复制所有内容的权利,因此我们实际上没有此特定文章。
- 如果研究人员使用了我们的发现工具,则很可能会告诉他们,当OA版本可用时,我们将无权访问。
- 代理服务器+发布者平台+浏览器问题+ PDF阅读器出现了一些完美风暴。
- 与此相关的任何服务器都有糟糕的一天。
实际上,有很多方法可以解决这个问题。 我知道,因为在过去6年中的某个时候,我已经收到了所有报告。 这些问题都不是特别罕见的。
该怎么办?
导致上述大多数问题的有两个关键问题。 一是我们正在处理许多不同的系统。 我们拥有庞大的发布者,聚合者和发现提供者网络,它们通过软件和标准紧密地联系在一起。 另一个问题是,付费墙背后隐藏着太多的内容。 Sci-Hub(非法)通过将几乎所有内容都放在一个没有任何收费墙的单一系统中来解决这两个问题。
因此,如果有一个法律可以去的地方那就太好了:1)收录每篇期刊文章,2)没有收费壁垒。
从理论上讲,没有OA就可以实现。 像Netflix或Spotify一样,第三方可以与发布商敲定协议,以在一个界面中提供所有内容。 当然,公司已经在尝试它了,它永远不会完成。 EBSCOhost,Gale和ProQuest都提供了庞大的汇总数据库,但是这些数据库容易遭到禁运和发行商独占(实际上类似于消费者流媒体服务)。
当我说情况必须公开时,情况就更进一步了。 为了100%地工作,以避免元数据问题并提供适当的版本,这样的系统确实需要索引元数据并存储全文本身。 如果没有,那么最好的办法就是将用户发送到托管在其他地方的PDF,这种复杂的方法可以解决中断,文件丢失等问题。至少现在有这样一种尝试,但这对于1science来说还处于初期。
在此之前,我想图书馆可以致力于改进将这些内容整合在一起的软件和标准。 特别是,我认为图书馆系统需要做得更好,以使用户获得OA文章(尤其是在混合期刊中),并在链接失败时提供简单而明显的替代方法。
还有电子书?
是的,我首先想到的是,我们中许多人在思考电子书只是想让它们与期刊一样好。 为什么? 因为它们经常差得远得多。 电子书会受到DRM,大量登录信息,糟糕的阅读软件和不良元数据的影响。 很多时候,我希望电子书访问能够像期刊文章访问一样容易,但这只会将图书提升到一个仍然很麻烦的系统水平。 (叹)