구글·메타, AI학습용 바이오 데이터 구축 나선다[글로벌AI브리핑]
[파이낸셜뉴스] 구글 딥마인드와 메타, 구글 계열 인공지능(AI) 신약개발 기업 아이소모픽랩스가 대규모 인공지능(AI) 학습용 바이오 데이터 구축에 나선다.
바이오산업에서는 AI가 신약개발이나 질병치료에 효과적으로 활용될 수 있지만, 정작 AI가 학습할 만한 방대한 데이터가 부족한 점이 병목으로 작용해 왔는데, 구글과 메타가 직접 데이터 생성에 나서기로 한 것이다.
7일(현지시간) IT전문매체 더버지 보도에 따르면 구글·메타·아이소모픽랩스는 마크 저커버그 메타 최고경영자(CEO)와 프리실라 챈이 설립한 비영리 연구기관 바이오허브(Biohub)의 '가상 생물학(Virtual Biology Initiative)' 프로젝트에 3억달러(약 4000억원)를 투자해 AI 학습용 생물학 데이터 구축에 나서기로 했다.
'가상 생물학' 프로젝트의 목표는 AI가 실제 세포의 움직임을 이해하고 예측할 수 있도록 대규모 생물학 데이터를 구축하는 것이다.
기존에 축적된 유전자 정보와 연구 결과를 모으는 동시에, 질병 연구에 활용할 수 있는 '가상 세포'를 만들어 연구자들이 모든 가능성을 일일이 시험하는 대신 컴퓨터 안에서 세포의 반응을 먼저 시뮬레이션할 수 있도록 한다는 것이다.
이를 통해 세포의 반응을 예측하고 다양한 치료법을 시험할 수 있는 AI 모델을 만들어 신약 후보를 찾는 데 걸리는 시간과 비용을 대폭 줄이는 것이 목표다.
그동안 생명과학 분야에는 챗GPT 같은 생성형AI가 학습할 수 있는 방대한 데이터가 부족하다는 점이 AI 활용의 걸림돌로 지적돼 왔다.
신약개발은 후보물질을 실제 세포나 동물 등에 투입하면서 수많은 실험을 반복하는 과정이 필요해 많은 시간이 걸린다. AI를 실험에 투입하면 실험시간을 줄일 수 있지만, 실제 세포가 특정 약물이나 환경 변화에 어떻게 반응하는지를 동일한 방식으로 측정한 데이터가 부족해 최고수준의 AI모델 조차 바이오 분야를 학습하지 못해 정작 신약개발에 직접 투입하기 어려웠다.
구글과 메타는 바이오산업의 이같은 벙목을 해소하고 AI를 신약개발에 활용할 수 있도록 가상세포 실험을 통해 새로운 데이터를 대량 생산하고 이를 AI 학습에 활용하는 구조를 만들겠다는 것이다.
이번 프로젝트에 대해 바이오허브는 "통상 수십 년이 걸릴 것으로 예상되는 데이터 구축 작업을 5년으로 압축하고, 약 1년 안에 첫 데이터셋을 만들며 5년 안에 정확한 예측 모델을 구축하는 것을 목표로 하고 있다"며 신약개발과 바이오 연구의 속도가 대폭 단축될 것으로 기대했다.
[email protected] 이구순 기자




