자율주행차 라이다가 못 본 빈 공간을 0.1초 만에 채우는 방법
자율주행차 라이다가 못 본 빈 공간을 0.1초 만에 채우는 방법
자율주행차의 라이다 센서는 가려지거나 멀리 있는 물체를 성글게 찍기 때문에 주변 3D 장면에 구멍이 생긴다. RapidLiDAR는 이 빈 공간을 메우는 시작점 자체를 데이터로부터 학습해, 무작위 노이즈나 고정된 흔들림에 의존하던 기존 방식보다 크게 뚫린 영역도 잘 채운다. SemanticKITTI와 KITTI-360 실험에서 기존 최고 성능과 맞먹는 품질을 유지하면서 한 장면을 0.1초에 완성해 가장 빠른 기존 방법보다 2.3배 빨랐다.
METAL MEDIA 해설 도표
자율주행차 라이다가 못 본 빈 공간을 0.1초 만에 채우는 방법
- 01라이다로 찍은 듬성듬성한 점들을 입력받아 빈틈까지 채운 촘촘한 3D 장면을 한 번의 순전파로 만들어내는 RapidLiDAR를 제안했다.
- 02점마다 얼마나, 어느 방향으로 이동시킬지를 예측하는 적응형 초기화 모듈을 도입해 가려진 영역 주변에서는 더 멀리 퍼지고 이미 촘촘한 영역에서는 조금만 움직이게 했다.
- 033D 복셀 특징과 2D 조감도(BEV) 특징을 여러 해상도로 뽑아, 점들을 격자 탐색 없이 참조해 위치를 다시 다듬는 다중 스케일 재구성 모듈을 추가했다.
- 04점 주변 이웃을 일일이 찾는 기존 연산(최원점 샘플링, k-최근접 이웃 탐색)을 복셀·BEV 기반 특징 추출로 대체해 속도를 높이고 입력 해상도가 달라져도 그대로 동작하게 했다.
- 05SemanticKITTI와 KITTI-360 실험에서 기존 최고 방법과 대등한 완성 품질을 보이면서, 자동차용 라이다의 초당 10회 촬영 속도에 맞춰 한 장면을 0.1초에 완성했다.
무엇을 했나
- 라이다로 찍은 듬성듬성한 점들을 입력받아 빈틈까지 채운 촘촘한 3D 장면을 한 번의 순전파로 만들어내는 RapidLiDAR를 제안했다.
- 점마다 얼마나, 어느 방향으로 이동시킬지를 예측하는 적응형 초기화 모듈을 도입해 가려진 영역 주변에서는 더 멀리 퍼지고 이미 촘촘한 영역에서는 조금만 움직이게 했다.
- 3D 복셀 특징과 2D 조감도(BEV) 특징을 여러 해상도로 뽑아, 점들을 격자 탐색 없이 참조해 위치를 다시 다듬는 다중 스케일 재구성 모듈을 추가했다.
- 점 주변 이웃을 일일이 찾는 기존 연산(최원점 샘플링, k-최근접 이웃 탐색)을 복셀·BEV 기반 특징 추출로 대체해 속도를 높이고 입력 해상도가 달라져도 그대로 동작하게 했다.
- SemanticKITTI와 KITTI-360 실험에서 기존 최고 방법과 대등한 완성 품질을 보이면서, 자동차용 라이다의 초당 10회 촬영 속도에 맞춰 한 장면을 0.1초에 완성했다.
![Figure 1: Initialization matters. Top row: each method’s initialization; bottom row: the corresponding refined output. The highlighted box marks a large unobserved region. (a) LiDiff [19] starts from Gaussian noise that carries no information about the scene; (b) LiNeXt [6] perturbs the input with a fixed noise variance, so its points stay near the observed surface and never reach across the gap; (c) Our adaptive module learns data-dependent displacements that populate the region from the surrounding geometry, and this coverage is preserved in both the coarse initialization and the final refined result.](https://media.metallab.ai/papers/2608.16490/f0.png)
| SemanticKITTI | KITTI-360 | |||||
|---|---|---|---|---|---|---|
| Method | CD ↓ | JSD 3D ↓ | JSD BEV ↓ | CD ↓ | JSD 3D ↓ | JSD BEV ↓ |
| LMSCNet | 0.641 | – | 0.431 | 0.979 | – | 0.496 |
| LODE | 1.029 | – | 0.451 | 1.565 | – | 0.483 |
| MID | 0.503 | – | 0.470 | 0.637 | – | 0.476 |
| PVD | 1.256 | – | 0.498 | – | – | – |
| LiDiff | 0.434 | 0.564 | 0.444 | 0.564 | – | 0.459 |
| LiDPM | 0.446 | 0.532 | 0.440 | – | – | – |
| ScoreLiDAR | 0.406 | – | 0.425 | 0.472 | – | 0.444 |
| LiFlow | 0.309 | – | 0.416 | – | – | – |
| LiNeXt | 0.214 | 0.494 | 0.336 | 0.217 | 0.508 | 0.355 |
| Ours | 0.206 | 0.475 | 0.332 | 0.211 | 0.492 | 0.338 |
| LiDiff† | 0.376 | 0.573 | 0.416 | 0.517 | – | 0.446 |
| ScoreLiDAR† | 0.342 | – | 0.399 | 0.452 | – | 0.437 |
| LiDPM† | 0.376 | 0.542 | 0.403 | – | – | – |
| LiNeXt† | 0.149 | 0.481 | 0.331 | 0.149 | 0.499 | 0.339 |
| Ours† | 0.138 | 0.478 | 0.330 | 0.140 | 0.490 | 0.336 |

| Method | CD ↓ | Param (M) ↓ | Time (s) ↓ |
|---|---|---|---|
| LiDiff | 0.434 | 32.67 | 30.1 |
| ScoreLiDAR | 0.406 | 32.67 | 7.1 |
| LiNeXt | 0.214 | 1.99 | 0.23 |
| Ours | 0.206 | 11.8 | 0.10 |
| Method | CD ↓ | JSD 3D ↓ | JSD BEV ↓ |
|---|---|---|---|
| Ours | 0.206 | 0.475 | 0.332 |
| Ours w/o AIM | 0.218 | 0.488 | 0.345 |
| Ours w/o MSRM | 0.215 | 0.494 | 0.342 |

| Smax | CD ↓ |
|---|---|
| 50 | 0.2594 |
| 70 | 0.2592 |
| 100 | 0.2589 |
| η (m) | CD ↓ | Param (M) | Time (s) ↓ |
|---|---|---|---|
| 0.5 | 0.214 | 10.0 | 0.07 |
| 0.4 | 0.210 | 11.6 | 0.09 |
| 0.3 | 0.206 | 11.8 | 0.10 |
| 0.2 | 0.208 | 11.9 | 0.14 |
왜 중요한가
라이다 장면 완성이 실시간으로 돌아가야 자율주행차가 실제로 활용할 수 있는데, 기존 확산 모델 기반 방법은 느리고 고정 노이즈 방식은 센서가 바뀔 때마다 손으로 다시 조정해야 했다. 이 연구는 그 두 문제를 동시에 줄여 실제 차량에 탑재 가능한 속도의 장면 완성에 한 걸음 다가섰다.
이 논문의 용어
- 라이다 장면 완성(LiDAR scene completion) · 센서가 못 본 빈 공간까지 채워서 완전한 3D 장면을 만드는 작업
- 확산 모델(diffusion model) · 무작위 노이즈를 여러 단계에 걸쳐 서서히 원하는 결과로 바꾸는 생성 모델, 단계가 많아 느리다
- 조감도(BEV, Bird's-Eye-View) · 3D 장면을 위에서 내려다본 2D 격자 형태로 표현한 것
- 복셀(voxel) · 3D 공간을 작은 정육면체 칸으로 나눈 단위, 픽셀의 3차원 버전
- 챔퍼 거리(Chamfer Distance) · 두 점 집합 사이의 거리를 재는 지표로, 예측한 점들과 정답 점들이 서로 얼마나 가까운지 측정한다
최신 논문
- AI 코딩 에이전트에게 과학 소프트웨어 수리를 시켜보니, 절반도 제대로 못 고쳤다AI 코딩 에이전트에게 과학 소프트웨어 수리를 시켜보니, 절반도 제대로 못 고쳤다
- 논문 속 시연이 아니라 실제 서비스에 넣을 수 있는 희소 어텐션 만들기논문 속 시연이 아니라 실제 서비스에 넣을 수 있는 희소 어텐션 만들기
- 고객상담 AI 상담원이 규정을 '한 번의 행동'이 아니라 '전체 절차'로 지키게 만드는 방법고객상담 AI 상담원이 규정을 '한 번의 행동'이 아니라 '전체 절차'로 지키게 만드는 방법
- 로봇 팔에게 사람의 시연 없이 새 일 시키기, 말 잘하는 AI가 대신 가르친다로봇 팔에게 사람의 시연 없이 새 일 시키기, 말 잘하는 AI가 대신 가르친다
- 에이전트 학습용 환경을 새로 만드는 대신, 기존 환경에 '패치 부품'을 씌워 그 에이전트의 약점에 맞게 바꾸는 방법에이전트 학습용 환경을 새로 만드는 대신, 기존 환경에 '패치 부품'을 씌워 그 에이전트의 약점에 맞게 바꾸는 방법
- AI 모델을 '소유'하지 못한 조직은 안전 통제도 절반밖에 못 한다AI 모델을 '소유'하지 못한 조직은 안전 통제도 절반밖에 못 한다
- AI가 선생님 모델을 따라 배우다가, 정답에 다가가는 '좋은 생각'까지 억누르는 문제를 잡아낸다AI가 선생님 모델을 따라 배우다가, 정답에 다가가는 '좋은 생각'까지 억누르는 문제를 잡아낸다
- AI가 특정 사람 말투를 흉내내도록 시켜봤더니, 결국 AI 자신의 말투에서 못 벗어난다AI가 특정 사람 말투를 흉내내도록 시켜봤더니, 결국 AI 자신의 말투에서 못 벗어난다
METAL MEDIA 최신 기사
그림 출처: Azhar Hussian et al., arXiv:2608.16490, cc-by-nc-sa-4.0