엔드투엔드 지연
End-to-End Latency
질문을 보낸 순간부터 답을 전부 받기까지 걸리는 전체 시간을 뜻하는 말.
쉽게 말하면
엔드투엔드 지연은 요청을 보낸 순간부터 원하는 결과를 완전히 다 받기까지 걸리는 전체 시간을 말해요. 식당에서 주문을 넣고, 주방에서 조리하고, 서빙까지 마쳐서 음식이 내 앞에 놓이는 순간까지의 시간 전체를 재는 것과 비슷해요. 중간에 주방이 아무리 빨라도 서빙이 늦으면 손님 입장에서 체감하는 시간은 길어지죠.
AI 서비스에서는 이 시간이 여러 단계로 쪼개져요. 질문이 서버(또는 기기)에 도착해 처리를 시작하는 데 걸리는 시간, 답을 만들어내는 시간, 만든 답을 화면까지 전달하는 시간이 차례로 더해지거든요. 그래서 어느 한 단계만 빨라졌다고 전체가 빨라지는 건 아니고, 처음부터 끝까지 이어지는 전 과정을 통으로 재야 사용자가 실제로 느끼는 속도를 알 수 있어요.
특히 폰이나 노트북에서 AI 모델을 직접 돌릴 때는 이 시간이 더 중요해져요. 인터넷 서버를 거치지 않고 기기 안에서 처리를 끝내야 하니, 같은 모델이라도 어떤 압축 방식을 쓰고 어떤 실행 프로그램에 올렸는지에 따라 엔드투엔드 지연이 크게 달라지기 때문이에요.
기사에서 이렇게 나와요
직접 해보기
챗봇 앱에 아무 질문이나 넣고, 전송 버튼을 누른 순간부터 답변이 완전히 멈출 때까지 시간을 재보세요. 같은 질문을 짧게 줄이거나 길게 늘려서 다시 재보면, 요청 길이와 답 길이가 전체 시간에 어떻게 영향을 주는지 감을 잡을 수 있어요.
함께 볼 용어
이 용어가 나온 기사
- Liquid AI, 온디바이스 벤치마크 Pipette 오픈소스 공개AI · 2026.08.25
- 딥시크 V4-프로 정식 출시, 추론 강도 3단계로 조절AI · 2026.08.14
- 아티피셜 애널리시스, 내 데이터로 AI 모델 채점하는 Optima 출시AI · 2026.08.16
- 딥시크 V4 프로 GA 벤치마크 유출, 오픈소스 최상위권 근접AI · 2026.08.13
- 데이터브릭스, 기업 문서 추론 벤치마크 'OfficeQA Pro V2' 공개AI · 2026.08.12
- 앨런AI, 안전벤치마크 BBQ가 실은 추론력 측정임을 밝혀AI · 2026.09.02
