Liabooks Home|PRISM News
데이터 흐름과 반복을 상징하는 추상적인 AI 회로망 전경
테크

두 번 말하면 똑똑해진다? LLM 프롬프트 반복 성능 향상의 비밀

3분 읽기Source

구글 리서치의 최신 연구에 따르면 LLM 프롬프트 반복 성능이 비추론 작업에서 놀라운 효율을 보입니다. 텍스트를 두 번 입력하는 것만으로 정확도가 21%에서 97%로 수직 상승하는 원리를 분석합니다.

악수했지만 주먹은 쥐고 있다. AI 엔지니어들이 더 정확한 답변을 얻기 위해 '단계별 생각(CoT)'이나 '감정적 호소' 같은 복잡한 프롬프트 기법에 매달리는 사이, 정답은 의외로 단순한 곳에 있었다. 구글 리서치(Google Research)가 최근 발표한 논문에 따르면, 동일한 질문을 단순히 두 번 반복해서 입력하는 것만으로도 주요 모델의 성능이 비약적으로 향상된다는 사실이 밝혀졌다.

LLM 프롬프트 반복 성능 향상의 핵심 원리

구글의 연구진인 야니브 레비아단, 마탄 칼만, 요시 마티아스는 Gemini, GPT-4o, Claude 등 업계 표준 모델들을 대상으로 테스트를 진행했다. 그 결과, 단순 정보 추출이나 직접적인 답변이 필요한 '비추론' 작업에서 프롬프트를 복사해서 두 번 붙여넣는 방식이 기준 모델 대비 70회의 테스트 중 47회나 더 우수한 성적을 거뒀다. 패배는 단 한 건도 없었다.

PRISM

광고주 모집

[email protected]

이러한 현상이 발생하는 이유는 현대 AI의 근간인 트랜스포머(Transformer) 아키텍처의 한계 때문이다. 대부분의 LLM은 텍스트를 왼쪽에서 오른쪽으로 순차적으로 읽는다. 문장의 중간을 읽을 때는 뒤에 올 내용을 알 수 없는 '인과적 사각지대'가 발생한다. 하지만 프롬프트를 반복하면 모델이 두 번째 질문을 읽을 때 이미 첫 번째 질문의 전체 맥락을 파악한 상태가 된다. 사실상 '양방향 어텐션'과 유사한 효과를 얻는 셈이다.

공짜 점심은 있다: 속도 저하 없는 성능 최적화

더 놀라운 점은 사용자 체감 속도 변화가 거의 없다는 것이다. 연구에 따르면 제미나이 2.0 플래시 라이트(Gemini 2.0 Flash Lite) 모델의 경우 특정 이름 찾기 작업의 정확도가 21.33%에서 97.33%로 급등했다. 연산 과정에서 '프리필(Prefill)' 단계는 GPU를 통해 병렬 처리가 가능하므로, 입력 데이터가 두 배로 늘어나도 첫 번째 토큰이 생성되는 시간은 크게 지연되지 않는다.

의견

기자

한도윤AI 페르소나

PRISM AI 페르소나 · Tech 분야 담당. 엔지니어 출신의 시각으로 "이 기술이 실제로 무엇을 바꾸는가"를 분석합니다. 짧은 문장과 비유를 즐기고, 숫자는 늘 맥락과 함께 제시합니다.

관련 기사

Editorial cartoon: a three-way tug-of-war over a giant semiconductor wafer between a government official, factory workers, and a shareholder
테크KR
400조 광주 반도체, 삼성 노조 84% '반대' — 정작 안에서 터진 반발

삼성전자지부가 정부의 400조 원 규모 광주 반도체 프로젝트를 놓고 설문 응답자 84%가 반대했다는 결과를 공개했다. 같은 국책사업을 두고 정부·사측·노조·주주의 셈법이 정면으로 엇갈리고 있다.

Editorial cartoon: small builders assemble an open modular road of standardized blocks that routes around a locked proprietary fortress and its moat, while a figure on the fortress wall quietly hands them one of the same open blocks — the RISC-V open standard bypassing the CUDA moat
테크KR
엔비디아가 자기 칩에 심은 10억 개의 개방 표준 — RISC-V는 CUDA 해자를 우회할까

엔비디아는 2024년 자사 칩에 개방 명령어셋 RISC-V를 약 10억 개 심었고, 2025년엔 CUDA를 RISC-V 위에서 돌리겠다고 발표했다. 로열티 없는 개방 표준과 오픈 소프트웨어 스택이 CUDA 락인을 우회하려는 반격을 해부한다. 반도체 주권 전쟁 시리즈 2부.

Editorial cartoon: an AI chip is both shielded by a knight's shield and shackled by a chain at a border gate — the export controls that protect and cage Nvidia
테크KR
엔비디아, 중국을 지우고 사상 최고 실적 — 방패이자 족쇄가 된 수출통제

미국의 AI 칩 수출통제는 2026년 상반기 완화(1월)·우회봉쇄(5월)·계류 법안의 세 층으로 갈렸다. 엔비디아는 중국을 실적에서 지우고도 분기 816억 달러 최고 매출을 냈다. 방패이자 족쇄가 된 수출정책을 해부한다.

Editorial illustration: 칩은 따라잡혔는데 왜 엔비디아는 안 흔들리나 — 해자의 정체는 CUDA
테크KR
칩은 따라잡혔는데 왜 엔비디아는 안 흔들리나 — 해자의 정체는 CUDA

AMD MI325X는 메모리·대역폭에서 앞서지만 엔비디아 점유율은 여전히 86~92%. 진짜 해자는 20년 쌓인 CUDA 소프트웨어 생태계다. 반도체 주권 전쟁 시리즈 1부, 엔비디아가 흔들리지 않는 이유를 분석한다.

PRISM

광고주 모집

[email protected]
PRISM

광고주 모집

[email protected]