fbpx
AI models need more data about biology, and OpenAI is paying to create it

파산한 바이오테크의 데이터, 의료 AI의 ‘보물창고’ 될까

오픈AI 재단이 파산한 바이오테크 기업의 신약 개발 데이터를 확보해 AI 학습에 활용하는 프로젝트를 지원한다.

지난해 임상시험 분야를 전문으로 하는 정책 분석가 룩산드라 테슬로(Ruxandra Teslo)는 의료 AI의 성능을 획기적으로 높일 한 가지 아이디어를 내놨다. 파산한 바이오테크 기업이 남긴 데이터를 AI 학습에 활용하자는 것이다.

테슬로는 “파산 절차에서 이들 기업의 자산을 입찰로 확보하면 규제 당국에 제출한 상세 자료부터 제조 전략, 안전성 데이터까지 통상 영업비밀로 취급되는 귀중한 정보를 손에 넣을 수 있다”고 말했다. 그녀는 “바이오테크의 ‘잃어버린 아카이브(lost archive)’와도 같은 이 자료들을 AI 학습에 활용하면 복잡하고 불투명한 의약품 승인 절차를 헤쳐 나가는 데 도움을 주는 강력한 AI 도구를 개발할 수 있다”는 덧붙였다.

지난 9월 15일 오픈AI의 비영리 모기업인 오픈AI 재단(OpenAI Foundation)이 이 아이디어에 자금을 지원하기로 했다. 재단이 새롭게 추진하는 ‘건강을 위한 공공 데이터(Public Data for Health)’ 프로젝트의 일환이다. 고품질 과학 데이터세트 구축에 자금을 지원해 AI가 의학 분야에서 획기적인 성과를 낼 수 있는 기반을 마련하는 것이 목표다.

이 구상의 전제는 간단하다. AI가 질병 치료에서 의미 있는 돌파구를 마련하려면 지금보다 훨씬 많은 정보를 학습할 수 있어야 한다는 것이다. 장수 연구 기업 알토스 랩스(Altos Labs)에서 컴퓨팅 부문 부사장을 지낸 모건 레빈(Morgan Levine)은 “AI를 생물학 분야에 성공적으로 활용하는 데 데이터가 가장 큰 걸림돌이라는 점을 모두가 인식하고 있다”고 말했다. 

MIT 테크놀로지 리뷰와 함께, 미래를 앞서가세요 !!
한달에 커피 2잔값으로 즐기기
온라인 멤버
지면 매거진 멤버
(온라인+지면) 프리미엄 멤버

유료회원 플랜 보기 회원이면 로그인하기 회원가입

회원 가입 후 유료 구독 신청을 하세요 !!