고장 시점 예측하는 AI에게 '과거 비슷한 사례'를 보여주면 예측이 좋아진다
고장 시점 예측하는 AI에게 '과거 비슷한 사례'를 보여주면 예측이 좋아진다
이 연구는 항공기 엔진 같은 장비가 앞으로 얼마나 더 쓸 수 있는지(잔존 유효 수명, RUL)를 이미지와 텍스트를 함께 이해하는 멀티모달 AI(MLLM)로 예측하는 방법을 다룬다. 핵심 아이디어는 예측할 장비의 센서 흐름과 비슷한 과거 고장 사례들을 검색해서 비교 그래프로 만들어 AI에게 함께 보여주는 것이다. 항공기 엔진 열화 데이터인 C-MAPSS의 FD001 세트로 실험한 결과, 무작위로 사례를 보여줄 때보다 비슷한 사례를 검색해서 보여줄 때 예측 오차가 줄고 결과가 더 안정적이었다.
METAL MEDIA 해설 도표
고장 시점 예측하는 AI에게 '과거 비슷한 사례'를 보여주면 예측이 좋아진다
- 01센서 시계열 구간을 LSTM 기반 인코더로 벡터화하고, 테스트 장비의 최근 구간과 가장 비슷한 과거 정상/고장 구간들을 벡터 검색으로 찾아낸다.
- 02검색된 과거 궤적과 테스트 장비의 궤적을 하나의 비교 그래프 이미지로 만들고, 이를 구조화된 프롬프트에 넣어 Gemini 계열 멀티모달 AI 3종(Flash-Lite, Flash, Pro)에게 RUL 수치와 설명 텍스트를 함께 요청한다.
- 03같은 프롬프트 구조를 유지한 채 '무작위로 과거 사례 선택(MLLM+Random)'과 '검색 기반 사례 선택(MLLM+RAG)' 두 방식을 10회 반복 실험으로 비교했다.
- 04세 모델 모두에서 검색 기반 방식이 무작위 방식보다 예측 오차가 낮고 결과 편차도 작았으며, 특히 성능이 높은 모델(Pro)일수록 검색된 정보를 더 잘 활용해 이득이 컸다.
- 05다만 가장 좋은 검색 기반 설정도 기존의 전용 딥러닝 예측 모델보다는 아직 정확도가 떨어졌고, 평가는 C-MAPSS 중 가장 단순한 FD001 하나에 국한됐다.
무엇을 했나
- 센서 시계열 구간을 LSTM 기반 인코더로 벡터화하고, 테스트 장비의 최근 구간과 가장 비슷한 과거 정상/고장 구간들을 벡터 검색으로 찾아낸다.
- 검색된 과거 궤적과 테스트 장비의 궤적을 하나의 비교 그래프 이미지로 만들고, 이를 구조화된 프롬프트에 넣어 Gemini 계열 멀티모달 AI 3종(Flash-Lite, Flash, Pro)에게 RUL 수치와 설명 텍스트를 함께 요청한다.
- 같은 프롬프트 구조를 유지한 채 '무작위로 과거 사례 선택(MLLM+Random)'과 '검색 기반 사례 선택(MLLM+RAG)' 두 방식을 10회 반복 실험으로 비교했다.
- 세 모델 모두에서 검색 기반 방식이 무작위 방식보다 예측 오차가 낮고 결과 편차도 작았으며, 특히 성능이 높은 모델(Pro)일수록 검색된 정보를 더 잘 활용해 이득이 컸다.
- 다만 가장 좋은 검색 기반 설정도 기존의 전용 딥러닝 예측 모델보다는 아직 정확도가 떨어졌고, 평가는 C-MAPSS 중 가장 단순한 FD001 하나에 국한됐다.

| Module | Input | Transformation | Output |
|---|---|---|---|
| Segment encoder | Normalized sliding-window segment | Encode with an LSTM autoencoder. | Fixed-dimensional embedding. |
| Retrieval memory builder | Training segments and RUL labels | Sample by RUL bin and index embeddings. | Balanced vector database. |
| Query retriever | Last observed test segment | Encode query and perform k-nearest-neighbor search. | Top-k historical references. |
| Trajectory comparison builder | Query trajectory and retrieved references | Align trajectories and generate a multisensor plot. | Trajectory-comparison image. |
| Prompt composer | Comparison image and task instructions | Insert visual evidence into a structured prompt. | Multimodal prompt for RUL estimation. |

| Aspect | Configuration |
|---|---|
| Input window length | L=30 cycles |
| Input variables | Selected sensor features |
| Encoder type | LSTM encoder |
| Number of recurrent layers | 1 |
| Embedding layer | Linear projection |
| Embedding dimension | d=64 |
| Hidden dimension | 128 |
| Decoder type | Feed-forward head |
| Training objective | Final-step reconstruction |
| Loss function | Mean squared error |
| Optimizer | AdamW |
| Training epochs | 200 |
| Batch size | 128 |
| Learning rate | 10−3 |
| Weight decay | 10−5 |
| Embedding normalization | L2 normalization |

| Baselines | Gemini RAG | |||||
|---|---|---|---|---|---|---|
| Metric | Mean | Random predictor | LSTM (?, ?) | Flash-Lite | Flash | Pro |
| RMSE | 41.98 ± 0.00 | 57.19 ± 2.49 | 14.54 | 43.12 ± 2.72 | 32.85 ± 3.30 | 22.69 ± 1.44 |
| MAE | 36.07 ± 0.00 | 47.53 ± 2.66 | – | 32.91 ± 2.19 | 22.47 ± 1.99 | 17.91 ± 1.24 |
| R2 | -0.021 ± 0.000 | -0.897 ± 0.165 | – | -0.080 ± 0.135 | 0.370 ± 0.125 | 0.701 ± 0.037 |
| PHM’08 Score | 20302 ± 0 | 181531 ± 74903 | 322.44 | 127441 ± 66610 | 27712 ± 15830 | 1488 ± 323 |

왜 중요한가
정비 현장에서는 예측 수치뿐 아니라 '왜 그런 판단을 내렸는지'에 대한 설명도 중요한데, 이 방식은 숫자 예측과 함께 사람이 이해할 수 있는 설명 텍스트를 같이 내놓는다는 점에서 실무 적용 가능성을 보여준다. 또한 범용 언어 AI를 특정 도메인에 억지로 재학습시키지 않고도, 검색으로 관련 사례만 붙여주면 성능이 개선된다는 점은 다른 산업 설비 진단 문제에도 적용해볼 만한 방향을 제시한다.

이 논문의 용어
- RUL(잔존 유효 수명) · 장비나 부품이 고장 나기까지 남은 시간, 정비 계획 수립에 쓰이는 핵심 지표
- MLLM(멀티모달 대형언어모델) · 이미지, 텍스트 등 여러 형태의 입력을 함께 이해하고 답할 수 있는 AI 모델
- RAG(검색증강생성) · AI가 답을 만들기 전에 관련 자료를 먼저 찾아서 참고하게 하는 기법
- C-MAPSS / FD001 · 항공기 터보팬 엔진의 열화 과정을 시뮬레이션한 대표적인 고장 예측 벤치마크 데이터셋, FD001은 그중 가장 단순한 조건의 부분집합
- LSTM 인코더 · 시간에 따라 변하는 센서 데이터를 하나의 압축된 숫자 벡터로 요약하는 신경망 구조

최신 논문
- AI 코딩 에이전트에게 과학 소프트웨어 수리를 시켜보니, 절반도 제대로 못 고쳤다AI 코딩 에이전트에게 과학 소프트웨어 수리를 시켜보니, 절반도 제대로 못 고쳤다
- 논문 속 시연이 아니라 실제 서비스에 넣을 수 있는 희소 어텐션 만들기논문 속 시연이 아니라 실제 서비스에 넣을 수 있는 희소 어텐션 만들기
- 고객상담 AI 상담원이 규정을 '한 번의 행동'이 아니라 '전체 절차'로 지키게 만드는 방법고객상담 AI 상담원이 규정을 '한 번의 행동'이 아니라 '전체 절차'로 지키게 만드는 방법
- 로봇 팔에게 사람의 시연 없이 새 일 시키기, 말 잘하는 AI가 대신 가르친다로봇 팔에게 사람의 시연 없이 새 일 시키기, 말 잘하는 AI가 대신 가르친다
- 에이전트 학습용 환경을 새로 만드는 대신, 기존 환경에 '패치 부품'을 씌워 그 에이전트의 약점에 맞게 바꾸는 방법에이전트 학습용 환경을 새로 만드는 대신, 기존 환경에 '패치 부품'을 씌워 그 에이전트의 약점에 맞게 바꾸는 방법
- AI 모델을 '소유'하지 못한 조직은 안전 통제도 절반밖에 못 한다AI 모델을 '소유'하지 못한 조직은 안전 통제도 절반밖에 못 한다
- AI가 선생님 모델을 따라 배우다가, 정답에 다가가는 '좋은 생각'까지 억누르는 문제를 잡아낸다AI가 선생님 모델을 따라 배우다가, 정답에 다가가는 '좋은 생각'까지 억누르는 문제를 잡아낸다
- AI가 특정 사람 말투를 흉내내도록 시켜봤더니, 결국 AI 자신의 말투에서 못 벗어난다AI가 특정 사람 말투를 흉내내도록 시켜봤더니, 결국 AI 자신의 말투에서 못 벗어난다
METAL MEDIA 최신 기사
그림 출처: Valeriu Dimidov et al., arXiv:2608.19218, arxiv-nonexclusive