Skip navigation

Реєстрація каталогів дослідницьких результатів EOSC Nodes у EOSC EU Node

Документ Registration of EOSC Research Product Catalogues in the EOSC EU Node, v3.1 описує, як каталоги дослідницьких результатів окремих EOSC Nodes підключаються до EOSC EU Node Resource Catalogue, щоб публікації, дослідницькі дані та дослідницьке програмне забезпечення стали доступними для пошуку в масштабі всієї EOSC Federation. EEN Resource Catalogue агрегує їхні метадані, а користувачі отримують доступ через EOSC Resource Hub та відкриті API.

https://zenodo.org/records/17513272

chrome_33VNJ3cbat

Про що цей документ?

Головне завдання — встановити спільні правила, за якими репозитарії та агрегатори EOSC Nodes можуть передавати метадані дослідницьких результатів до федеративного каталогу. Йдеться не про перенесення самих даних чи публікацій до EOSC EU Node, а про регулярне машинне збирання їхніх стандартизованих метаданих.

EOSC EU Node Resource Catalogue, який у документі також названо EOSC Knowledge Graph, є спільним індексом ресурсів федерації. Його модель охоплює Services, Data Sources, Research Products, Tools, Training Material та Interoperability Guidelines і пов'язує їх з EOSC Nodes та організаціями-контрибуторами.

chrome_qg7ogFZcKJ

Рис. 1. Модель даних EOSC EU Node Resource Catalogue.
Джерело: оригінальний Fig. 2 документа, p. 4.

Що вважається Research Product Catalogue?

Документ розрізняє два основні типи таких каталогів:

  • repositories — репозитарії, що забезпечують публікацію, збереження, пошук і доступ до результатів досліджень;
  • aggregators — системи, які збирають, гармонізують та індексують метадані з кількох репозитаріїв або інших агрегаторів.

Як приклади репозитаріїв наведені CERN Open Data Portal та Zenodo, а як приклад агрегатора — фінський research.fi. Один EOSC Node може мати декілька Research Product Catalogues.

Через них до EOSC передаються метадані чотирьох основних груп результатів: publications, research data, research software та other research products. Сам дослідницький продукт залишається у вихідному репозитарії, а EEN зберігає інформацію про джерело запису та EOSC Node, з яким воно пов'язане. Один продукт може бути отриманий із кількох каталогів і тому мати зв'язок із кількома вузлами.

Як відбувається інтеграція?

Логіка процесу показана на основній схемі документа:

Repository / Aggregator → Research Product Catalogue → interoperability compliance → registration → validation → harvesting → EEN Resource Catalogue.

Після підключення EEN регулярно збирає, гармонізує та індексує метадані. Крім каталогів EOSC Nodes, Resource Catalogue використовує так звані backbone data sources, серед яких OpenAIRE Graph, Software Heritage, data.europa.eu та CORDIS.

chrome_iStBm3YIdg

Рис. 2. Включення каталогів дослідницьких результатів EOSC Node та їхніх research products до EOSC EU Node Resource Catalogue. Джерело: оригінальний Fig. 3 документа, p. 5

Мінімальний технічний контракт

Для сумісності з EEN Research Product Catalogue має виконати дві ключові вимоги:

  1. підтримувати OAI-PMH;
  2. надавати метадані відповідно до визначеного профілю DataCite/OpenAIRE.

Для harvesting рекомендований пакет від 100 до 500 записів за запит із використанням resumptionToken. Для агрегаторів передбачене збереження provenance: у метаданих має залишатися інформація про первинне джерело, з якого отримано запис.

Це важливо для федеративної моделі: EOSC має знати не лише що являє собою ресурс, а й звідки походить його опис і через який Node він представлений.

Контроль якості метаданих

EEN не обмежується harvesting. Після отримання записів застосовуються мінімальні критерії якості.

Для кожного research product потрібен хоча б один підтримуваний PID — наприклад DOI, Handle, ArXiv, PubMed або SoftwareHeritageID. Для публікацій обов'язковими є title, creators/authors, description/abstract та publishing date; для datasets — title, creators/authors і publishing date; для software — title та publishing date.

Автори підкреслюють, що це початковий мінімум. У майбутньому критерії можуть розширюватися, зокрема з урахуванням FAIRness metadata and content.

Що це означає для репозитарію та центру компетенції?

Для FAIR Data Competence Center документ важливий тим, що поєднує курацію окремого дослідницького об'єкта з готовністю інфраструктури до федерації.

FAIR-опис dataset є необхідним, але цього недостатньо. Репозитарій має:

  • надавати записи машинним способом;
  • використовувати стабільні PID;
  • підтримувати стандартизований metadata profile;
  • коректно описувати authors, organizations, funding та relations;
  • зберігати provenance;
  • забезпечувати достатню повноту метаданих.

Показово, що серед платформ, які реалізують OpenAIRE Guidelines, у документі прямо названо Dataverse, поряд із DSpace, InvenioRDM та EPrints.

Для DataverseUA це дає конкретний маршрут: локальна публікація набору даних → якісний metadata record → OAI-PMH/OpenAIRE-compatible representation → Research Product Catalogue → harvesting у EEN Resource Catalogue → виявлення через EOSC Resource Hub.

ChatGPT Image 3 вер. 2026 р., 23_05_46

Рис. 3. Два канали включення ресурсів EOSC Node до EOSC EU Node Resource Catalogue: Research Product Catalogue та Service Catalogue. Складено за Fig. 3 настанов Registration of EOSC Research Product Catalogues in the EOSC EU Node, v3.1, та Registration of EOSC Service Catalogues in the EOSC EU Node, v5.1.