Скріншот візуалізації фрагмента набору даних H01 в браузері.
1 червня команда вчених з Гарвардського університету і фахівці компанії Google виклали у відкритий доступ набір даних про невелику ділянку кори головного мозку людини. Набір, що отримав назву H01, складається з 1,4-петабайтного тривимірного зображення фрагмента неокортексу, виконаного з роздільною здатністю 4 нанометри і детально описаного, і супроводжується науковою публікацією «Коннектомне дослідження петамасштабного фрагмента кори головного мозку людини» (A connectomic study of a petascale fragment of human cerebral). Набір містить відомості про десятки тисяч нервових клітин, ста тридцяти мільйонів синапсів, а також про субклеткові структури.
Раніше, в січні, Google виклав у відкритий доступ виконаний у співпраці з Janelia Research Campus коннектом плодової мушки. Нинішня робота - ще один крок на шляху до конектого людини. Крок скромний (опублікована модель відображає всього близько одного кубічного міліметра мозку), але по-своєму грандіозний: на поточний момент H01 - це найбільший і докладний анотований набір даних, що описує зразок мозкової тканини.
Історія датасета H01 почалося з того, що в лікарню в Бостоні надійшла 45-річна пацієнтка з епілепсією, якій видалили частину кори головного мозку. Вчені досліджували отриманий зразок (дослідження показало, що віддалена частина була здоровою) і за допомогою мікротому розділили його на 5292 зрізи, товщина кожного з яких склала, в середньому, 33 нанометри. Потім дослідники за допомогою електронного мікроскопа відсканували кожен зріз і отримали 225 млн акціонерних зображень. А фахівці з Google, у свою чергу, об'єднали плоскі зображення в 3D. Незважаючи на те, що в цілому якість зображень була чудовою, для перетворення їх на тривимірну модель необхідно було подолати деякі проблеми: артефакти візуалізації, загублені зрізи, зміна параметрів мікроскопа, фізичне розтягнення і стиснення тканини при виготовленні зрізів і скануванні. Для цього в Google використовували зафарбовують нейронні мережі (flood-filling network, FFNs), запущені на тисячах TPU платформи Google Cloud.
З отриманою в результаті тривимірною моделлю можна ознайомитися за посиланням за допомогою звичайного браузера.
Ймовірно, набір даних H01, як і опубліковані раніше роботи з мозку дрозофіли, послужить матеріалом для досліджень з широкого кола тем і напрямків, від нейрофізіології до штучного інтелекту. А творці цього набору даних вже націлені на опис більш великих фрагментів мозку. Правда, на цьому шляху є деякі перешкоди, зокрема - передбачуваний розмір даних: якщо дані по одному кубічному міліметру кори займають майже півтора петабайти, то скільки займе опис клітин і міжклітинних зв'язків всього мозку? Мозок миші, говориться в блозі Google AI, здатний генерувати дані обсягом в ексабайт - такі обсяги дорого зберігати, ними складно оперувати, і ці проблеми ще вимагатимуть вирішення.















