문제해결.zip작업실준비 중문제 접수
스크랩← 스크랩

똑똑한 것과 기억하는 것은 다르다

Anthropic 발표 (2026-05-06, 영문)원문 보기 →

AI는 대화창을 닫으면 다 잊는다. 어제 같이 고친 파일도 오늘은 모른다. 그래서 매일 같은 설명을 다시 하고, 같은 실수를 다시 보고, 같은 돈이 다시 든다. Anthropic 직원이 지난여름 런던 행사에서 이렇게 말했다. 새 모델이 아무리 좋아져도 우리 회사에서 무슨 일을 어떻게 해야 하는지는 모른 채 온다고. 똑똑한 것과 아는 것은 다르다.

그래서 Anthropic은 4월에 기억을 넣었다. AI가 일하면서 스스로 메모를 남기고 다음에 꺼내 보는 방식이다. 메모는 그냥 파일이라 사람이 열어 읽을 수 있다. 그런데 메모는 쌓일수록 문제가 생긴다. 같은 내용이 두 번 적히고, 옛 정보와 새 정보가 같이 남고, 이미 틀린 메모가 그대로 있다. 책상 위에 메모지가 쌓이면 어느 게 최신인지 모르는 것과 같다.

5월에 붙인 답이 '드리밍'이다. 사람이 자는 동안 하루를 되감아 남길 것을 고르듯, AI가 일하지 않는 시간에 지난 대화록과 메모를 다시 읽고 새 메모장을 만든다. 겹치는 건 합친다. 낡은 건 새 값으로 바꾼다. 여러 번 되풀이된 실수는 규칙으로 올린다. 원래 메모장은 손대지 않는다. 사람이 새 메모장을 보고 마음에 안 들면 버리면 된다. 법률 AI 회사 Harvey는 이걸 켜고 일 완료율이 여섯 배쯤 올랐다고 한다. Anthropic 쪽 사람은 이렇게 표현했다. AI가 미래의 자기에게 더 나은 메모를 남기는 법을 배우는 중이라고.

석 달 뒤 개발자들의 반응이 기사로 실렸다. 반대가 아니라 조건이었다. 틀린 답은 그 대화에서 끝나지만, 틀린 메모는 이후 수천 번의 대화에 영향을 준다. 그러니 메모마다 어디서 왔는지, 무슨 근거인지, 언제까지 믿을지가 붙어 있어야 한다. 사람이 검토한다지만 양이 많아지면 도장만 찍게 된다. 대화록에는 AI가 쓰지 않은 말, 남이 넣은 말도 섞여 있다. 그걸 그대로 규칙으로 올리면 안 된다. 작은 실험 하나도 같은 쪽을 가리킨다. 깔끔하게 요약한 메모만 준 AI가 메모 없는 AI보다 못했다. 요약이 근거 없는 확신을 줬다.

인사이트

똑똑한 것과 기억하는 것은 다른 일이다. 기억은 저절로 생기지 않는다. 그리고 기억에서 힘든 쪽은 남기는 게 아니라 정리하는 쪽이다. 겹치는 걸 합치고, 낡은 걸 버리고, 되풀이된 실수를 규칙으로 올리는 일. Anthropic은 그 일에 '잠'이라는 이름을 붙였다. 사람도 마찬가지다. 메모는 쌓이는데 다시 읽는 시간이 없으면 그건 기억이 아니라 더미다.

정리를 기계에 맡기면 남는 일은 검토다. 틀린 기억 하나가 수천 번 되풀이되기 때문이다. 메모마다 어디서 왔고 언제까지 믿을지를 적어 두는 것. 그건 AI에게만 필요한 습관이 아닌 것 같다.

확인한 것
  1. 기사Harvey는 드리밍을 켜자 일 완료율이 약 6배 올랐다

    확인Anthropic 발표문의 문장 그대로다. Harvey가 자체 테스트에서 잰 것이고, 무엇을 몇 건 놓고 쟀는지는 없다. 발표한 쪽이 파는 쪽이라는 것도 적어 둔다

    Anthropic 발표 (2026-05-06)

  2. 기사AI가 자는 동안 기억을 정리한다

    확인이름이 그렇다는 것이지 자는 건 아니다. 사람이 따로 돌리는 작업이다. 기존 메모장 하나와 지난 대화록 최대 100개를 읽어 새 메모장을 하나 더 만든다. 원본은 손대지 않는다. 몇 분에서 몇 시간 걸리고 요금은 따로 든다. 아직 연구 미리보기라 신청해야 쓸 수 있다. 9월 14일자 변경 기록까지 살아 있는 기능이다. 8월 1일에도 지원 모델이 늘었다

    Claude 플랫폼 문서 'Dreams'

  3. 기사틀린 답은 그 대화에서 끝나지만 틀린 메모는 이후 수천 번의 대화에 영향을 준다

    확인기사에 실린 실무자의 말이다. 세 사람이 나오는데 다 자기 회사를 가진 개발자다. 반대가 아니라 조건을 붙였다. 메모마다 출처·근거·유효기간을 달 것, 되돌릴 수 있을 것, 대화록에 섞인 남의 말을 그대로 규칙으로 올리지 말 것

    The New Stack (2026-08-12)

  4. 기사요약한 메모만 준 AI가 메모 없는 AI보다 못했다

    확인실험 하나뿐이다. AI 하나, 프로젝트 하나, 질문 20개. 5점 만점에 요약만 2.65, 메모 없음 3.30, 날것 기록 4.55, 둘 다 4.95. 채점은 프로젝트 책임자가 눈 가리지 않고 했다. 글쓴이도 보편 법칙이 아니라 실험 방법을 나누는 것이라 적었다. 데이터는 공개돼 있다

    ClawSouls 블로그 (2026-02-27, 한국어판)

2026.09.16에 확인했습니다.

함께 본 것
원문 보기 →클로드 매니지드 에이전트의 새 기능: 드리밍·아웃컴·멀티에이전트 · Anthropic 발표 (2026-05-06, 영문)