yozm.tech
피드로 돌아가기
arXiv (cs.LG)HOTAI 재작성

MARCH: Scaling Recurrent Memory with Content-Routed State Anchors

트랜스포머(Transformer) 모델은 긴 컨텍스트 처리 능력이 뛰어나지만, 학습 시 막대한 연산 비용과 추론 시 메모리 사용량 증가라는 한계가 있었습니다. 최근 발표된 MARCH(Memory-Anchor Routing across Context History)는 재귀 신경망(Recurrent Neural Network)의 효율성에 트랜스포머의 장점을 결합해, 고정된 크기의 메모리 제약을 넘어 장기 기억 성능을 크게 향상시켰습니다. 이 새로운 아키텍처는 효율적인 장문 처리의 새로운 가능성을 제시합니다.

7시간 전·2026.08.14·읽기 1·Ming Zhang, Kaisen Yang, Shu Yu, Ermo Hua, Ning Ding, Xia Hu, Bowen Zhou, Chaochao Lu, Youbang Sun

대규모 언어모델(LLM)의 핵심인 트랜스포머(Transformer) 아키텍처는 긴 컨텍스트(long-context)를 처리하는 데 탁월한 성능을 보이지만, 그 대가로 학습 시에는 컨텍스트 길이에 비례해 제곱으로 증가하는 막대한 연산 비용을, 추론(inference) 시에는 키-값 캐시(key-value cache)가 선형적으로 늘어나는 메모리 비효율성을 안고 있습니다. 반면 재귀 신경망(Recurrent Neural Network) 기반 모델은 고정된 크기의 상태(fixed-size state)로 전체 기록을 압축하여 효율적인 디코딩(decoding)이 가능하지만, 이전 정보가 새로운 정보에 덮어씌워지면서 장기 기억(long-range memory) 성능이 저하되는 문제가 있었습니다.

최근 공개된 연구 논문에서 소개된 MARCH(Memory-Anchor Routing across Context History)는 이러한 두 아키텍처의 장점을 결합한 새로운 접근 방식입니다. MARCH는 주기적으로 누적된 재귀 상태 체크포인트(recurrent-state checkpoints)를 '상태 앵커(state anchors)'로 캐시하고, 각 앵커에 내용 기반의 압축된 '앵커 키(anchor key)'를 연결합니다. 이를 통해 MARCH는 컨텍스트 길이가 증가함에 따라 확장 가능한 메모리 뱅크(memory bank)를 유지할 수 있으며, 이는 과거 정보의 해상도(historical resolution)와 메모리 비용 사이에서 조절 가능한 균형점을 제공합니다. 각 토큰(token) 처리 시, MARCH는 앵커 쿼리(anchor query)를 생성하여 인과적으로 사용 가능한 모든 상태 앵커에 어텐션(attention)을 적용하고, 현재 상태와 모든 과거 앵커를 어텐션 방식으로 집계하여 최종 출력을 계산합니다.

표준 사전 학습(pretraining) 이후, MARCH는 상식 추론(commonsense reasoning), LongBench, 인컨텍스트 검색(in-context retrieval) 등 다양한 벤치마크에서 기존의 여러 선형 어텐션(linear attention) 변형 모델들을 일관되게 능가하는 성능을 보였습니다. 이는 내용 기반으로 라우팅되는 상태 캐싱(content-routed state caching) 방식이 재귀 모델의 고유한 연산 경로를 유지하면서도 장기 기억 능력을 크게 강화할 수 있음을 입증합니다. MARCH는 트랜스포머의 고질적인 연산 및 메모리 비효율성 문제를 해결하면서도 장문 처리 성능을 유지하거나 개선할 수 있는 새로운 길을 열어, 향후 대규모 언어모델 개발에 중요한 영향을 미칠 것으로 기대됩니다.

1인 창업자를 위한 기회 분석
AI 분석 · 참고용이며 검증이 필요합니다
3/10
약한 신호
3점인가

기술적으로 흥미롭지만, 1인 창업자가 직접 모델을 개발하고 상용화하기에는 기술적 난이도와 자원 요구사항이 높습니다.

문제 / 미충족 수요

기존 트랜스포머 모델은 긴 컨텍스트 처리 시 막대한 연산 비용과 메모리 비효율성 문제를 겪으며, 재귀 모델은 장기 기억 성능이 부족합니다.

한국 시장
국내 미진출 — 기회한국어 장문 처리 및 요약, 질의응답 시장은 꾸준히 성장하고 있으나, 아직 MARCH와 같은 효율적인 아키텍처를 활용한 서비스는 미미합니다.
수익 모델

API 종량제, B2B SaaS 구독 · 돈 내는 주체: 장문 텍스트 처리 및 분석이 필요한 기업 고객 (예: 법률 사무소, 리서치 기관, 언론사)

1인 실현 가능성
2/5

핵심 기술인 MARCH 아키텍처 구현 및 최적화에 상당한 ML 전문 지식과 컴퓨팅 자원이 필요하며, 1인이 상용 서비스 수준으로 개발하기는 어렵습니다.

진입 지점 (Wedge)

MARCH 아키텍처를 활용하여 특정 도메인(예: 법률, 의료)의 장문 텍스트 요약 및 질의응답에 특화된 경량화된 언어 모델 API를 제공합니다.

이번 주 첫 실험

MARCH 논문 구현체를 분석하고, 공개 데이터셋으로 소규모 테스트를 진행하여 성능 및 효율성 개선 가능성을 검증합니다.

Original source
이 글은 arXiv (cs.LG)의 기사를 yozm.tech가 한국어로 재작성한 버전입니다.
원문 보기