As Artificial Intelligence (AI) becomes more widely adopted, both as a tool for research across the disciplines and as a potential aid to enhancing the creation and dissemination of digital collections as data, it raises new questions about the methods of collections delivery and the ethics of responsible reuse – particularly with respect to large language models.
Historically, collecting institutions have not been good at gathering reuse metrics or monitoring reuse cases, with the exception of some workflows to avoid copyright infringement or policies against practices with high potential for reputational damage (i.e. not loaning to an unethical partner). The digital environment, and the open licences often associated with collections as data, suggests that more careful examination of the ethics of reuse is needed.
Through presentations and discussions, this session will aim to provide insight into how institutions are assessing use of collections as data and how AI impacts the parameters of that use.
Participants will share:
a. How institutions are tracking and encouraging reuse of collections as data: What kinds of metrics do we expect or want to track?
b. How institutions are writing terms of use, with respect to collections-as-data: Who are the stakeholders involved in crafting these terms? What are the expectations implied in these terms around reuse/reusability?
c. In the group discussion/outcome: What informs an institution’s stance on AI use of collections, as data?
//
A medida que la Inteligencia Artificial (IA) está siendo más ampliamente adoptada como herramienta para la investigación en todas las disciplinas como apoyo para mejorar la creación y difusión de colecciones digitales como datos, surgen nuevas preguntas sobre los métodos de entrega de las colecciones y la ética en cuanto a la reutilización responsable, particularmente con respecto a los grandes modelos de lenguaje.
Históricamente, las instituciones encargadas en la gestión de datos no han sido muy eficientes recopilando o monitorizando métricas de casos de reutilización, a excepción de algunos flujos de trabajo cuyo fin es evitar infracciones sobre derechos de autor o políticas en contra ciertas prácticas con alto potencial de daño hacia su reputación (es decir, no prestando a un socio poco ético). El entorno digital y de las licencias abiertas, a menudo asociadas a colecciones como datos, sugieren que es necesario un examen más cuidadoso en cuanto a la ética de la reutilización.
A través de diversas presentaciones y discusiones, esta sesión tendrá como objetivo proporcionar información sobre cómo las instituciones están evaluando el uso de colecciones como datos y cómo la Inteligencia Artificial afecta a los parámetros de este uso.
Las personas participantes hablarán de:
a. Como las instituciones están haciendo el seguimiento y fomentando la reutilización de las colecciones como datos. ¿Qué tipo de métricas esperamos o queremos usar?
b. Como están redactando las instituciones los términos de uso con respecto a las colecciones como datos.
¿Quiénes son las partes involucradas en la elaboración de estos términos? ¿Cuáles son las expectativas implícitas en estos términos en torno a la reutilización/reusabilidad?
c. En la discusión/resultado del grupo -> ¿Qué influye en una institución sobre qué postura adoptar en materia de Inteligencia Artificial sobre el uso de colecciones como datos?