人工智能时代的开放遗产
人工智能时代的开放遗产 Creative Commons
Creative Commons
Publisher
Aug 19, 2026 at 6:30 PM UTC · 5 分钟阅读

文化遗产机构 (CHIs),如博物馆、图书馆和档案馆,承担着提供馆藏遗产获取途径的重要公益使命。它们的使命基于广泛的公众获取和深入的人文参与、充满活力的文化公地的存在,以及将遗产作为共享资源来享受。CHIs 意识到,作为我们身份的体现,遗产有助于定义我们共同的人性,并且提供获取遗产会产生诸多益处为社会带来诸多益处。因此,CHIs 作为蕴含在知识与文化中的可信信息的守护者,在发展和保护公地以及实现造福人类的利用方面发挥着至关重要的作用。
AI——主要的颠覆者
近期生成式人工智能 (AI) 的兴起对 CHIs 产生了巨大影响,尤其是当它们管理的馆藏内容被用于 AI 开发的获取和使用时。一个关键问题集中在:使用开放许可和公有领域的文化遗产材料作为 AI 开发的数据时,应遵循哪些条件、规范和预期。例如 AI4Culture、Hugging Face 的 BigLAM、Harvard 的 Institutional Books、Authors’ Alliance 的 The Public Interest Corpus,以及未来可能出现的 European Books Data Commons 中提供的开放数据集。这引发了围绕谁可以获取和重用这些数据,以及出于何种目的的讨论。凭借其背后的托管职责,遗产馆藏通常能产生多样化、高质量、具语境化且精心策划的数据集。虽然纳入遗产馆藏数据有望产生更好、更有代表性的 AI 系统,但 CHIs 面临着许多挑战,包括:
- 基础设施挑战,这威胁到开放基础设施和开放生态系统的经济可持续性,包括:
- 商业 AI 实践与公地的价值观和规范不一致,包括:
-
- 缺乏透明度和归属(如 Oulu Löyly 活动的工作组 May the Source be with You 所探讨的)、去语境化(如文化权利领域特别报告员 Alexandra Xanthaki 的报告 Artificial intelligence and creativity 中所述),以及由于 AI 模型和系统的不透明性导致的出处溯源丢失;
- 缺乏关于内容如何被重用的信息和理解,无论是用于训练、推理还是搜索;或者内容是否被模型记忆或在训练后保留(如 CC 博客文章 From Signals to Infrastructure: Strengthening the Commons for the AI Era 中所述);
- 内容被进一步封闭到专有系统中(正如 X/Twitter 上的学术研究 所发生的那样)。
从表面上看,这指向了商业 AI 开发的实践与 CHIs 提供开放获取的承诺,以及基于公地的互惠预期和对支撑公地遗产共享的社会契约的尊重之间的冲突。这揭示了信任正在被缓慢侵蚀。而这一切都发生在版权以及 CC 许可和工具的应用面临高度法律不确定性的背景下。
CHIs 对在公地共享表现得更加犹豫
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
