Фінський пілотний вузол EOSC: як національна інфраструктура відкритої науки стає частиною Європейської федерації
25.05.2026
https://research.csc.fi/eosc-the-finnish-candidate-node/
Сторінка EOSC Finland Pilot Node на сайті CSC — IT Center for Science є добрим прикладом того, як країна може пояснювати участь у Європейській хмарі відкритої науки не через загальні декларації, а через конкретні сервіси для дослідників, провайдерів даних і менеджерів дослідницьких даних. Фінська нода подана не як окремий новий портал, а як точка входу до вже наявної національної екосистеми: сервісів CSC, Fairdata, Research.fi, Etsin, каталогів сервісів, інструментів доступу, документації та підтримки користувачів. На головній сторінці користувач одразу бачить практичні входи: знайти сервіси, почати користування ними, перейти до інструкцій, знайти наукові результати, знайти datasets або переглянути каталог інструментів.
Це важливий комунікаційний хід. Фінська нода не починає з пояснення складної європейської архітектури, а показує, що EOSC має дати досліднику на практиці: доступ до сервісів, даних, інструкцій, інструментів і підтримки. У цьому проявляється сучасне розуміння EOSC: це не “одна велика хмара” і не централізований репозитарій, а федерація існуючих і нових цифрових ресурсів, які мають працювати за узгодженими правилами.
Окрема сторінка CSC пояснює, що EOSC є ініціативою ЄС для цифрової трансформації досліджень, заснованою на принципах Open Science і FAIR. У березні 2025 року EOSC увійшла у фазу build-up, під час якої тринадцять candidate nodes мають бути розвинені та взаємопов’язані для спільного використання й управління науковими даними, знаннями та ресурсами; фінська національна нода названа однією з таких candidate nodes і однією з майбутніх точок входу до EOSC Federation.
Термінологію тут важливо пояснювати обережно. У документах EOSC поняття Candidate EOSC Node означає не “слабку” або “умовну” ноду, а організацію чи консорціум, який пройшов enrolment, був позитивно оцінений Tripartite Governance і відповідає мінімальним юридичним, організаційним та технічним вимогам, але залишатиметься у статусі Candidate Node до переходу EOSC Federation в операційну стадію. Меморандум EOSC також уточнює, що в інтеримній фазі для стислості часто використовується термін “EOSC Node”, хоча формально йдеться про candidate nodes; тому назва Pilot Node у фінському випадку виглядає як комунікаційне рішення, яке підкреслює практичну готовність і зрілість першої хвилі порівняно з новими хвилями підключення. (EOSC Association)
Найсильніша сторона фінського прикладу — розділення аудиторій. Є окрема сторінка для дослідників, окрема сторінка для провайдерів сервісів і data managers, окрема сторінка з поясненням EOSC Federation, окрема сторінка про MyAccessID і окрема сторінка Dataset-as-a-Service. Така структура показує, що національна нода має бути зрозумілою не лише адміністраторам, а й кінцевим користувачам: дослідникам, кураторам даних, інженерам сервісів, операторам репозитаріїв і керівникам проєктів.
Сторінка EOSC Finland – Tools for service providers and data managers показує, що національна нода — це не тільки каталог сервісів для користувача, а й інфраструктура підтримки тих, хто готує дані та сервіси до федерації. На цій сторінці зібрано посилання на Fairdata services, Research Data Management Competence Center, вимоги до trusted repositories, рекомендації щодо метаданих, PID Forum Finland, DataCite Finland, ORCID in Finland, registry схем метаданих і crosswalks, національний словниковий сервіс Finto, EOSC AAI Architecture, машинно-дієвий каталог сервісів та EOSC Finland Forum.
Окрему увагу привертає концепція Dataset-as-a-Service. Вона спрямована на публікацію метаданих про datasets, які знаходяться поруч із HPC-сервісами або в середовищах CSC. Мета — зробити великі цінні набори даних видимими для дослідників, посилити зв’язок між research data management і HPC, підтримати управління даними під час активного дослідження, пов’язати datasets з документацією та інструментами, а також підтримати відповідальний AI і управління ресурсами. Для data providers сервіс дає підтримку у плануванні data sharing, можливість публікувати use copies поза репозитаріями з посиланням на master data, видимість dataset, описаний lifecycle і terms of use; для data users — можливість знайти великі datasets, які раніше були “in the dark”, краще відстеження походження даних, рекомендовані інструменти й підтримку цитування.
Це особливо важливий урок. Не всі великі дані обов’язково мають бути фізично перенесені в один репозитарій. Частина datasets може залишатися у HPC, хмарному або лабораторному середовищі, але через метадані, умови доступу, опис життєвого циклу, зв’язок із master data, інструментами аналізу й цитуванням вони стають видимими та придатними для повторного використання. Для України це може бути перспективним напрямом: Dataset-as-a-Service для DataverseUA, інституційних сховищ, ЦККНО, обчислювальних середовищ і тематичних цифрових інфраструктур.
Важливо, що фінська модель включає не лише опис сервісів, а й механізм доступу до обчислювальних ресурсів. CSC-проєкти, які підпадають під політику free-of-charge use, можуть подаватися на додаткові ресурси — Billing Units і збільшення квот; обсяг Billing Units потрібно оцінювати на період 3–6 місяців, а отримані ресурси можна використовувати в усіх сервісах, що споживають Billing Units. Процес збільшення квот залежить від сервісу, а заявки розрізняються за розміром: small applications обробляються одразу, medium applications у середньому розглядаються протягом 1–3 днів, а large requests розглядаються кожні три тижні Resource Allocation Group; великі заявки оцінюються за науковою ефективністю та якістю, з урахуванням національної наукової політики і пріоритетів уряду Фінляндії.
Цей елемент є принциповим. Нода не лише “показує” сервіси, а вводить правила доступу до ресурсів, квоти, процедури розгляду заявок, відповідальність, апеляцію і зв’язок із науковими пріоритетами держави. Саме тут видно відмінність зрілої цифрової інфраструктури від інформаційного порталу: сервіс має не лише опис, а й правила користування, механізм виділення ресурсів, підтримку, моніторинг і управління навантаженням.
Ще один сильний елемент — service catalogue. Фінська сторінка дозволяє переглядати сервіси across nodes і розрізняє open access, restricted access, EU node та Finnish node. У каталозі представлені сервіси для даних, зберігання, передачі, хмарних обчислень, sensitive data, програмного забезпечення, FAIR-публікації та дослідницької інформації.
Головний урок фінської ноди полягає в тому, що EOSC — це не повтор старої моделі “центрального вузла”, де всі ресурси підпорядковані одній платформі. Це федерація довірених учасників, які зберігають автономію, але погоджуються на спільні правила: FAIR, AAI, каталоги, метадані, PID, сервісне управління, підтримку користувачів, моніторинг, прозорі умови доступу і правила виділення ресурсів. Така довіра створюється не як довіра до однієї корпорації або одного центру контролю, а як довіра до спільної інфраструктури загального блага.
Для НАН України цей приклад важливий ще й тому, що майбутню ноду не можна звужувати до схеми “федерація репозитаріїв + CRIS-система на кшталт РІТ НОД + централізований харвестер метаданих”. Репозитарії, CRIS/RIS-компоненти, агрегатори та харвестери є необхідними елементами, але вони не вичерпують функцію ноди. Нода має бути сервісно-організаційною інфраструктурою: вона повинна поєднувати репозитарії, DOI/PID, метадані, AAI, каталог сервісів, helpdesk, monitoring, onboarding провайдерів, правила доступу до обчислювальних і даних ресурсів, навчання, data stewardship, тематичні workflow та use cases. Тобто йдеться не лише про “збір метаданих”, а про керовану систему, яка дозволяє досліднику знайти ресурс, отримати доступ, використати сервіс, опублікувати результат і забезпечити його повторне використання.
Саме таку логіку варто покласти в основу формування ноди НАН України. DataverseUA, РІТ НОД, інституційні ресурси, ЦККНО, хмарні й обчислювальні сервіси ІТФ, тематичні цифрові інфраструктури та навчальні програми Центру компетенції мають розглядатися не як окремі “вітрини”, а як компоненти спільної сервісної екосистеми. Її цінність буде визначатися не кількістю підключених сайтів, а тим, чи зможе український дослідник пройти повний маршрут відкритої науки: підготувати дані, описати їх, отримати ідентифікатор, знайти або надати сервіс, використати обчислювальний чи аналітичний ресурс, отримати підтримку, опублікувати результат і зробити його видимим для європейської федерації EOSC.
Ресурси CSC для free-of-charge use
| Група ресурсів | Сервіси / ресурси | Що надається | Умови / обмеження |
|---|---|---|---|
| HPC-обчислення | Puhti, Mahti | Високопродуктивні обчислення для академічних досліджень, навчання та пов’язаних з ними use cases | Використання обмежується Billing Units і квотами проєкту; додаткові ресурси подаються через MyCSC |
| Notebook-середовище | Noppe | Інтерактивні notebook-середовища для навчання, аналізу даних і дослідницьких сценаріїв | Для курсів і MOOC можуть діяти окремі умови або розгляд case-by-case |
| Об’єктне сховище | Allas | Зберігання, передача й спільне використання великих даних | Типова стартова квота — 10 TiB; збільшення до 50 TiB — середня заявка, до 200 TiB — велика заявка |
| Хмарні ресурси | cPouta, ePouta | Віртуальні машини, cores, memory, storage, floating IPs; ePouta — для ізольованіших середовищ | Типові базові квоти: 8 instances, 8 cores, 32 GiB memory, 2 floating IPs, 1 TiB storage |
| Container / platform services | Rahti | OpenShift-проєкти, pods, containers, storage для розгортання застосунків | Типові квоти: 5 OpenShift projects per user, 20 pods per project, 2 virtual cores per pod/container, 8 GiB memory per pod/container |
| Database / backup services | Pukki | Бази даних, backup, volume reservation | Типові квоти: 5 database instances, 1000 manual backups, 20 000 MB memory usage, 50 GiB volume reservation |
| Software / analysis tools | Chipster, частково інші інструменти | Інструменти для аналізу даних, зокрема біоінформатики та data analysis workflows | Доступ залежить від типу проєкту й умов CSC |
| Sensitive data services | Sensitive Data Connect, Sensitive Data Desktop | Робота з чутливими даними у контрольованому середовищі | Доступ регулюється окремими умовами для sensitive data |
| Fairdata services | IDA, Qvain, Metax, Etsin | Зберігання, опис, публікація і пошук дослідницьких даних | Доступні за певних умов для користувачів фінських ЗВО, державних дослідницьких інститутів і їхніх колабораторів; Fairdata PAS потребує окремого контракту |
Пакети додаткових Billing Units
| Тип заявки | Обсяг ресурсів | Як розглядається |
|---|---|---|
| Small resource application | 60 000 CPU BU; 10 000 GPU BU; 30 000 Cloud BU; 30 000 Storage BU | Обробляється одразу після подання заявки, але всі заявки моніторяться |
| Medium resource application | до 600 000 CPU BU; до 100 000 GPU BU; до 300 000 Cloud BU; до 300 000 Storage BU | У середньому розглядається протягом 1–3 днів Resource Officer |
| Large resource application | до 6 000 000 CPU BU; до 1 000 000 GPU BU; до 3 000 000 Cloud BU; до 3 000 000 Storage BU | Розглядається Resource Allocation Group приблизно кожні три тижні; оцінюється наукова якість і ефективність |