한의학 고전 이론과 현대 생명과학을 AI 전문가 11명이 팀으로 붙여서 설명하는 시스템
한의학 고전 이론과 현대 생명과학을 AI 전문가 11명이 팀으로 붙여서 설명하는 시스템
중국 광저우중의약대학 등 연구진이 범용 대형언어모델 DeepSeek V3.2를 뇌로 삼아, 11명의 가상 전문가 에이전트가 협업하며 한약 처방의 작용 기전을 분석하는 DeepTCM1.0을 만들었다. 계지탕이라는 대표적 고전 처방을 사례로 삼아 검증했고, 단일 언어모델보다 통계적으로 유의하게 높은 평가 점수를 받았다. 별도의 데이터베이스 구축이나 모델 재학습 없이 프롬프트 설계만으로 작동한다는 점이 특징이다.
METAL MEDIA 해설 도표
한의학 고전 이론과 현대 생명과학을 AI 전문가 11명이 팀으로 붙여서 설명하는 시스템
- 01기존의 데이터마이닝, 네트워크약리학, 분자도킹 같은 방법들은 한의학 고전 이론과 현대 과학을 깊이 통합하지 못했고, 범용 AI에 직접 질문하는 방식은 한의학 이론에 대한 이해 부족과 환각(사실이 아닌 답변 생성) 문제가 있었다
- 02연구진은 최고과학자, 채용담당, 고정 전문가 7인, 동적 전문가 4인, 비평가, 보고서 통합가 등 총 11개 에이전트로 구성된 3단계 협업 구조를 설계했다. 1단계는 과제를 나누고 팀을 꾸리는 단계, 2단계는 전문가들이 독립 분석, 통합·심화, 최적화의 3라운드에 걸쳐 토론하며 비평가의 검증을 받는 단계, 3단계는 결론을 정리해 최종 보고서를 만드는 단계다
- 03계지탕을 사례로 적용해 '영위불화(영양과 방어 기능의 부조화)'라는 고전 개념과 현대의 신경-면역-대사 조절 네트워크를 연결하는 등 3가지 새로운 기전 가설을 제시했다
- 04독립적인 4개 대형언어모델 평가자가 5개 익명 보고서를 각 5회씩 반복 평가해 총 100회 채점한 결과, 평가자 내 신뢰도(반복 채점 시 일관성)는 0.789~0.867, 평가자 간 신뢰도는 0.868로 매우 높았고, 그룹 간 차이 분석(F=66.969, P<0.001)과 다중 에이전트 그룹과 단일 언어모델 그룹 비교(U=191.00, P<0.001, 효과크기 r=0.5403)에서 DeepTCM1.0이 단일 모델보다 확연히 우수함을 확인했다
- 05레이더 차트 상 DeepTCM1.0은 모든 평가 항목에서 4.8~5.0점의 거의 만점에 가까운 점수와 가장 높은 채점 일관성을 보였으며, 추가 데이터베이스 구축이나 모델 재학습 없이 가볍게 배포 가능하고 재현성이 높다는 실용적 장점을 지닌다
무엇을 했나
- 기존의 데이터마이닝, 네트워크약리학, 분자도킹 같은 방법들은 한의학 고전 이론과 현대 과학을 깊이 통합하지 못했고, 범용 AI에 직접 질문하는 방식은 한의학 이론에 대한 이해 부족과 환각(사실이 아닌 답변 생성) 문제가 있었다
- 연구진은 최고과학자, 채용담당, 고정 전문가 7인, 동적 전문가 4인, 비평가, 보고서 통합가 등 총 11개 에이전트로 구성된 3단계 협업 구조를 설계했다. 1단계는 과제를 나누고 팀을 꾸리는 단계, 2단계는 전문가들이 독립 분석, 통합·심화, 최적화의 3라운드에 걸쳐 토론하며 비평가의 검증을 받는 단계, 3단계는 결론을 정리해 최종 보고서를 만드는 단계다
- 계지탕을 사례로 적용해 '영위불화(영양과 방어 기능의 부조화)'라는 고전 개념과 현대의 신경-면역-대사 조절 네트워크를 연결하는 등 3가지 새로운 기전 가설을 제시했다
- 독립적인 4개 대형언어모델 평가자가 5개 익명 보고서를 각 5회씩 반복 평가해 총 100회 채점한 결과, 평가자 내 신뢰도(반복 채점 시 일관성)는 0.789~0.867, 평가자 간 신뢰도는 0.868로 매우 높았고, 그룹 간 차이 분석(F=66.969, P<0.001)과 다중 에이전트 그룹과 단일 언어모델 그룹 비교(U=191.00, P<0.001, 효과크기 r=0.5403)에서 DeepTCM1.0이 단일 모델보다 확연히 우수함을 확인했다
- 레이더 차트 상 DeepTCM1.0은 모든 평가 항목에서 4.8~5.0점의 거의 만점에 가까운 점수와 가장 높은 채점 일관성을 보였으며, 추가 데이터베이스 구축이나 모델 재학습 없이 가볍게 배포 가능하고 재현성이 높다는 실용적 장점을 지닌다
왜 중요한가
한의학처럼 방대한 고전 문헌과 현대 생명과학 데이터를 동시에 다뤄야 하는 분야에서, 범용 언어모델을 재학습 없이 여러 전문가 역할로 나눠 협업시키는 방식이 실제로 신뢰할 만한 분석 결과를 낼 수 있음을 보여준다. 특정 도메인 데이터셋이나 미세조정 없이도 전문 분야 지식 통합과 환각 감소가 가능하다는 점은 다른 복잡한 전통 지식 체계나 학제간 연구에도 적용될 수 있는 실용적 방법론을 제시한다.
이 논문의 용어
- 대형언어모델(LLM) · 방대한 텍스트로 학습해 자연어를 이해하고 생성하는 AI 모델, 예: GPT, DeepSeek
- 환각(hallucination) · AI가 사실이 아니거나 근거 없는 내용을 그럴듯하게 생성하는 현상
- 네트워크약리학 · 약물 성분-표적 단백질-생물학적 경로의 관계망을 분석해 약효 기전을 밝히는 연구 방법
- 급내상관계수(ICC) · 같은 평가자가 반복 채점했을 때 결과가 얼마나 일관되는지를 나타내는 통계 지표
- 영위불화 · 한의학에서 몸을 보호하는 방어 기능(위기)과 영양을 공급하는 기능(영기)의 균형이 깨진 상태를 뜻하는 고전 병리 개념
최신 논문
- AI 코딩 에이전트에게 과학 소프트웨어 수리를 시켜보니, 절반도 제대로 못 고쳤다AI 코딩 에이전트에게 과학 소프트웨어 수리를 시켜보니, 절반도 제대로 못 고쳤다
- 논문 속 시연이 아니라 실제 서비스에 넣을 수 있는 희소 어텐션 만들기논문 속 시연이 아니라 실제 서비스에 넣을 수 있는 희소 어텐션 만들기
- 고객상담 AI 상담원이 규정을 '한 번의 행동'이 아니라 '전체 절차'로 지키게 만드는 방법고객상담 AI 상담원이 규정을 '한 번의 행동'이 아니라 '전체 절차'로 지키게 만드는 방법
- 로봇 팔에게 사람의 시연 없이 새 일 시키기, 말 잘하는 AI가 대신 가르친다로봇 팔에게 사람의 시연 없이 새 일 시키기, 말 잘하는 AI가 대신 가르친다
- 에이전트 학습용 환경을 새로 만드는 대신, 기존 환경에 '패치 부품'을 씌워 그 에이전트의 약점에 맞게 바꾸는 방법에이전트 학습용 환경을 새로 만드는 대신, 기존 환경에 '패치 부품'을 씌워 그 에이전트의 약점에 맞게 바꾸는 방법
- AI 모델을 '소유'하지 못한 조직은 안전 통제도 절반밖에 못 한다AI 모델을 '소유'하지 못한 조직은 안전 통제도 절반밖에 못 한다
- AI가 선생님 모델을 따라 배우다가, 정답에 다가가는 '좋은 생각'까지 억누르는 문제를 잡아낸다AI가 선생님 모델을 따라 배우다가, 정답에 다가가는 '좋은 생각'까지 억누르는 문제를 잡아낸다
- AI가 특정 사람 말투를 흉내내도록 시켜봤더니, 결국 AI 자신의 말투에서 못 벗어난다AI가 특정 사람 말투를 흉내내도록 시켜봤더니, 결국 AI 자신의 말투에서 못 벗어난다