아무 지시 없이 혼자 글을 계속 쓰게 한 AI, 몇백 단어마다 화제를 확 바꿔주면 더 놀랍고 더 연결감 있게 느껴진다
아무 지시 없이 혼자 글을 계속 쓰게 한 AI, 몇백 단어마다 화제를 확 바꿔주면 더 놀랍고 더 연결감 있게 느껴진다
연구자는 언어모델에게 과제나 지시 없이 문장 하나만 던지고 계속 이어쓰게 하는 실험을 24가지 조건으로 나눠 분석했다. 그 결과 핵심 효과는 두 가지, 즉 같은 말 반복을 억제하는 장치와 몇백 토큰마다 새로운 주제를 강제로 끼워넣는 장치에서 대부분 나왔고, 특히 주제 전환이 평가상 '놀라움'과 '연결감' 점수를 크게 끌어올렸다. 동시에 평가에 쓰인 AI 심사자가 실험자가 끼워넣은 문장을 모델이 쓴 것으로 착각하거나, 모델이 예전에 쓴 내용을 재탕한 것을 새롭다고 오판하는 등 평가 도구 자체의 허점도 발견해 보정했다.
METAL MEDIA 해설 도표
아무 지시 없이 혼자 글을 계속 쓰게 한 AI, 몇백 단어마다 화제를 확 바꿔주면 더 놀랍고 더 연결감 있게 느껴진다
- 01기반 언어모델(사전학습만 된, 별도 지시 훈련을 받지 않은 모델) 세 개에 아무 과제 없이 문장 하나만 주고 4500토큰 분량을 강제로 계속 쓰게 했다
- 02반복을 억제하는 장치(habituation)와 몇백 토큰마다 새 주제 문장을 몰래 끼워넣는 장치(interruption)를 조합해 24가지 조건에서 비교했고, 주제 전환 쪽이 놀라움 점수를 1.2~1.4점, 연결감 점수를 0.8점 더 올렸다
- 03이어쓰기를 유도하는 연결어는 오히려 해가 됐고, 단순 문단 나누기는 새 글에서는 효과가 없었으며, 문맥을 초기화해도 유지한 것과 비슷하거나 더 나은 결과가 나왔다
- 04AI 심사자가 실험자가 끼워넣은 문장을 모델의 것으로 채점하거나, 고정된 문장 돌려쓰기 때문에 모델이 심사자가 못 보는 앞부분을 재활용한 걸 새롭다고 오판하는 현상을 발견해 창(window) 단위가 아닌 문서 전체 단위 평가 등으로 보정했다
- 05검증 가능한 문제(온라인 빈 패킹)에 같은 개입을 적용하자 유효하고 서로 다른 후보 해법의 수는 3~4배 늘었지만 최고 성능 자체는 좋아지지 않았다
무엇을 했나
- 기반 언어모델(사전학습만 된, 별도 지시 훈련을 받지 않은 모델) 세 개에 아무 과제 없이 문장 하나만 주고 4500토큰 분량을 강제로 계속 쓰게 했다
- 반복을 억제하는 장치(habituation)와 몇백 토큰마다 새 주제 문장을 몰래 끼워넣는 장치(interruption)를 조합해 24가지 조건에서 비교했고, 주제 전환 쪽이 놀라움 점수를 1.2~1.4점, 연결감 점수를 0.8점 더 올렸다
- 이어쓰기를 유도하는 연결어는 오히려 해가 됐고, 단순 문단 나누기는 새 글에서는 효과가 없었으며, 문맥을 초기화해도 유지한 것과 비슷하거나 더 나은 결과가 나왔다
- AI 심사자가 실험자가 끼워넣은 문장을 모델의 것으로 채점하거나, 고정된 문장 돌려쓰기 때문에 모델이 심사자가 못 보는 앞부분을 재활용한 걸 새롭다고 오판하는 현상을 발견해 창(window) 단위가 아닌 문서 전체 단위 평가 등으로 보정했다
- 검증 가능한 문제(온라인 빈 패킹)에 같은 개입을 적용하자 유효하고 서로 다른 후보 해법의 수는 3~4배 늘었지만 최고 성능 자체는 좋아지지 않았다



| arm | habituation | interruption |
|---|---|---|
| bare | off | none: continuous generation, EOS masked |
| bare + habituation | on | none |
| habituation, EOS allowed | on | none; the model may emit end-of-text and start a new document |
| habituation 1.3 | on (stronger) | none |
| interruption, no habituation | off | neutral subject change every 150 or 300 tokens, context preserved |
| habituation + interruption 150 | on | neutral subject change every 150 tokens, context preserved |
| salience only | on | none; salience events mark review windows |
| DREAM scaffold | on | full scaffold: salience, in-loop judge, kick, reseed with forgetting, re-encounter |
| content: re-encounter / premise / own past | on | every 150 tokens: a return-to-the-premise stitch / the premise itself / a window of the stream’s own past (≥400 tokens back) |
| salience: re-encounter | on | the stitch injected on each salience event, no judge gate |
| period 75 / 300 / 600 / 900 | on | neutral subject change at other periods (900 also with the stitch) |
| sham break 300 | on | a paragraph break (“\n\n”) every 300 tokens, nothing else |
| sham continuity 300 | on | “And so, as before,” every 300 tokens: a boundary that asks for continuity |
| reset + subject change 300 | on | neutral subject change every 300 tokens on a reset context (premise + injected sentence only) |
| reset + break 300 | on | a paragraph break every 300 tokens on a reset context |
| judge-gated 150 | on | the neutral change every 150 tokens unless Opus reads the last 128 tokens as a find (surprise and coherence ≥5), which is left to run |



| Qwen3-30B-A3B | Qwen3-8B | OLMo-2-13B | |||||||
|---|---|---|---|---|---|---|---|---|---|
| arm | S | C | H | S | C | H | S | C | H |
| bare | 0.45 | 0.30 | 2.52 | 0.43 | 0.40 | 3.88 | 1.28 | 0.93 | 3.03 |
| bare + habituation | 1.58 | 1.28 | 4.45 | 1.37 | 1.00 | 4.35 | 1.96 | 1.26 | 3.99 |
| habituation + interruption 150 | 3.02 | 3.68 | 6.12 | 2.76 | 3.17 | 5.15 | 2.77 | 2.87 | 4.05 |
| DREAM scaffold | 2.70 | 1.85 | 6.02 | 2.70 | 2.35 | 5.38 | 3.60 | 2.23 | 6.23 |



왜 중요한가
긴 글을 AI가 자동으로 평가하는 방식이 널리 쓰이는데, 이 논문은 그 평가 방식이 놓치는 함정 세 가지를 구체적으로 짚어내고 고치는 절차를 제시한다. 또한 창의성처럼 보이는 효과가 사실은 복잡한 장치가 아니라 아주 단순한 개입 하나에서 온다는 점을 보여줘, AI 글쓰기 도구나 아이디어 생성기를 설계할 때 무엇이 진짜 중요한지 가늠하게 해준다.



이 논문의 용어
- habituation(습관화) · 최근에 쓴 단어가 반복되지 않도록 확률을 깎는 장치
- interruption(끼어들기) · 몇백 토큰마다 새로운 주제 문장을 몰래 끼워넣어 화제를 바꾸는 조작
- 기반 언어모델(base language model) · 지시를 따르도록 별도 훈련되지 않은, 다음 단어 예측만 하는 원본 모델
- 판정 창(judged window) · AI 심사자가 점수를 매기기 위해 잘라서 보는 생성된 텍스트의 일부 구간
- 온라인 빈 패킹(online bin packing) · 물건이 하나씩 들어올 때마다 즉시 상자에 배치해야 하는, 정답을 검증기로 확인할 수 있는 최적화 문제
최신 논문
- AI 코딩 에이전트에게 과학 소프트웨어 수리를 시켜보니, 절반도 제대로 못 고쳤다AI 코딩 에이전트에게 과학 소프트웨어 수리를 시켜보니, 절반도 제대로 못 고쳤다
- 논문 속 시연이 아니라 실제 서비스에 넣을 수 있는 희소 어텐션 만들기논문 속 시연이 아니라 실제 서비스에 넣을 수 있는 희소 어텐션 만들기
- 고객상담 AI 상담원이 규정을 '한 번의 행동'이 아니라 '전체 절차'로 지키게 만드는 방법고객상담 AI 상담원이 규정을 '한 번의 행동'이 아니라 '전체 절차'로 지키게 만드는 방법
- 로봇 팔에게 사람의 시연 없이 새 일 시키기, 말 잘하는 AI가 대신 가르친다로봇 팔에게 사람의 시연 없이 새 일 시키기, 말 잘하는 AI가 대신 가르친다
- 에이전트 학습용 환경을 새로 만드는 대신, 기존 환경에 '패치 부품'을 씌워 그 에이전트의 약점에 맞게 바꾸는 방법에이전트 학습용 환경을 새로 만드는 대신, 기존 환경에 '패치 부품'을 씌워 그 에이전트의 약점에 맞게 바꾸는 방법
- AI 모델을 '소유'하지 못한 조직은 안전 통제도 절반밖에 못 한다AI 모델을 '소유'하지 못한 조직은 안전 통제도 절반밖에 못 한다
- AI가 선생님 모델을 따라 배우다가, 정답에 다가가는 '좋은 생각'까지 억누르는 문제를 잡아낸다AI가 선생님 모델을 따라 배우다가, 정답에 다가가는 '좋은 생각'까지 억누르는 문제를 잡아낸다
- AI가 특정 사람 말투를 흉내내도록 시켜봤더니, 결국 AI 자신의 말투에서 못 벗어난다AI가 특정 사람 말투를 흉내내도록 시켜봤더니, 결국 AI 자신의 말투에서 못 벗어난다
METAL MEDIA 최신 기사
그림 출처: Roberto I. Ono Filho et al., arXiv:2608.19893, CC BY 4.0