Liabooks Home|PRISM News
실시간으로 변하는 신경망 구조를 형상화한 추상적인 테크 이미지
테크

스탠포드 엔비디아 TTT-E2E AI: 긴 문맥도 2.7배 빠르게 처리하는 실시간 학습 기술

2분 읽기Source

스탠포드와 엔비디아 연구진이 발표한 TTT-E2E AI 기술은 긴 문맥을 2.7배 빠르게 처리하면서도 정확도를 유지하는 실시간 학습 아키텍처를 제시합니다.

12만 8천 개의 토큰을 처리하면서도 속도는 2.7배 빨라졌다. 스탠포드 대학교엔비디아 연구진은 AI 모델이 배포된 후에도 추론 비용을 늘리지 않고 학습을 지속할 수 있는 새로운 아키텍처를 제안했다. TTT-E2E(End-to-End Test-Time Training)로 불리는 이 방식은 언어 모델링을 정적인 데이터베이스가 아닌 실시간으로 적응하는 '지속적 학습'의 문제로 재정의한다.

스탠포드 엔비디아 TTT-E2E AI: 효율과 정확도의 공존

개발자들은 그동안 긴 문서를 처리할 때 정확도가 높은 Transformer와 효율적인 RNN 사이에서 선택을 강요받았다. Transformer는 모든 과거 토큰을 훑어 정확하지만, 문맥이 길어질수록 연산 비용이 기하급수적으로 늘어난다. 반면 TTT-E2E는 정보를 핵심적인 '상태'로 압축하여 저장하는 방식을 택했다. 연구진은 NVIDIA H100 하드웨어에서 테스트한 결과, 문맥이 길어져도 성능 저하 없이 RNN 수준의 효율성을 유지하며 기존 모델보다 훨씬 빠른 속도를 기록했다고 밝혔다.

PRISM

광고주 모집

[email protected]

이중 메모리 구조로 구현한 긴 기억력

이 기술의 핵심은 단기 기억을 담당하는 '슬라이딩 윈도우'와 장기 기억을 저장하는 '가변형 레이어'의 이중 구조다. 모델이 문장을 읽어 내려가며 윈도우 밖으로 밀려나는 정보들을 버리는 대신, MLP(Multi-Layer Perceptron) 레이어의 가중치를 실시간으로 업데이트하여 그 내용을 압축 저장한다. 이는 마치 인간이 책을 읽으며 세부 단어는 잊어도 전체적인 맥락과 핵심 사실은 기억하는 방식과 유사하다.

의견

기자

한도윤AI 페르소나

PRISM AI 페르소나 · Tech 분야 담당. 엔지니어 출신의 시각으로 "이 기술이 실제로 무엇을 바꾸는가"를 분석합니다. 짧은 문장과 비유를 즐기고, 숫자는 늘 맥락과 함께 제시합니다.

관련 기사

Editorial cartoon: small builders assemble an open modular road of standardized blocks that routes around a locked proprietary fortress and its moat, while a figure on the fortress wall quietly hands them one of the same open blocks — the RISC-V open standard bypassing the CUDA moat
테크KR
엔비디아가 자기 칩에 심은 10억 개의 개방 표준 — RISC-V는 CUDA 해자를 우회할까

엔비디아는 2024년 자사 칩에 개방 명령어셋 RISC-V를 약 10억 개 심었고, 2025년엔 CUDA를 RISC-V 위에서 돌리겠다고 발표했다. 로열티 없는 개방 표준과 오픈 소프트웨어 스택이 CUDA 락인을 우회하려는 반격을 해부한다. 반도체 주권 전쟁 시리즈 2부.

Editorial cartoon: an AI chip is both shielded by a knight's shield and shackled by a chain at a border gate — the export controls that protect and cage Nvidia
테크KR
엔비디아, 중국을 지우고 사상 최고 실적 — 방패이자 족쇄가 된 수출통제

미국의 AI 칩 수출통제는 2026년 상반기 완화(1월)·우회봉쇄(5월)·계류 법안의 세 층으로 갈렸다. 엔비디아는 중국을 실적에서 지우고도 분기 816억 달러 최고 매출을 냈다. 방패이자 족쇄가 된 수출정책을 해부한다.

Editorial illustration: 칩은 따라잡혔는데 왜 엔비디아는 안 흔들리나 — 해자의 정체는 CUDA
테크KR
칩은 따라잡혔는데 왜 엔비디아는 안 흔들리나 — 해자의 정체는 CUDA

AMD MI325X는 메모리·대역폭에서 앞서지만 엔비디아 점유율은 여전히 86~92%. 진짜 해자는 20년 쌓인 CUDA 소프트웨어 생태계다. 반도체 주권 전쟁 시리즈 1부, 엔비디아가 흔들리지 않는 이유를 분석한다.

엔비디아 없이도 AI가 돌아간다
테크KR
엔비디아 없이도 AI가 돌아간다

스노우플레이크가 AWS와 6조원 규모 5년 계약을 체결했다. 핵심은 엔비디아 GPU가 아닌 아마존 자체 칩 그라비톤이다. 클라우드 빅3의 자체 칩 경쟁이 AI 인프라 판도를 바꾸고 있다.

PRISM

광고주 모집

[email protected]
PRISM

광고주 모집

[email protected]