METAL for iPhone

AI 뉴스, 이제 앱에서 읽으세요.

METAL 앱을 다운로드하고 매일 새로운 AI 기사를 만나보세요.

App Store에서 다운로드

iPhone용 앱 · 무료 다운로드

iPhone의 App Store에서도 ‘메탈 AI 매거진’을 검색할 수 있습니다.

METAL

DeepSeek-V4-Flash-0731, 긴 컨텍스트서 작업 멈춤 현상 보고

OpenCode 연동 로컬 구동 중 10만 토큰 넘으면 생성 중단…재개 명령으로 복구 가능

DeepSeek-V4-Flash-0731, 긴 컨텍스트서 작업 멈춤 현상 보고

이미지: METAL

요약

  • 레딧 이용자가 DeepSeek-V4-Flash-0731을 로컬 환경에서 구동하며 100K+ 토큰 컨텍스트에서 생성이 멈추는 현상을 보고했다
  • OpenCode에서 'resume' 명령을 입력하면 정상적으로 작업을 이어간다고 밝혔다
  • 원인이 모델 자체인지, 추론 엔진이나 OpenCode 쪽 문제인지는 확인되지 않았다
대상 모델
DeepSeek-V4-Flash-0731
실행 환경
Unsloth Studio Q8_K_XL GGUF + OpenCode
증상
약 100K 토큰 이상 컨텍스트에서 생성 중단
임시 대응
'resume' 명령 입력 시 정상 재개
보고 출처
r/LocalLLaMA 커뮤니티 게시글

긴 작업 중 갑자기 멈춘다는 보고

한 레딧 이용자가 r/LocalLLaMA에 DeepSeek-V4-Flash-0731을 로컬에서 구동하다 겪은 현상을 공유했다. Unsloth Studio에서 배포한 Q8_K_XL GGUF 버전을 OpenCode와 연동해 장시간 에이전틱 코딩 작업을 진행하던 중, 컨텍스트가 약 10만 토큰을 넘어서면 모델이 작업 도중 별다른 오류 메시지 없이 생성을 멈추는 현상이 발생했다고 밝혔다.

작성자는 이 현상이 매번 일어나지는 않지만 반복적으로 관찰됐다고 전했다. 패턴은 "컨텍스트 10만 토큰 이상 도달 → 생성 중단 → resume 입력 → 정상 작업 재개 → 다시 컨텍스트 증가 → 재중단"의 순서로 나타난다고 설명했다.

원인은 아직 불명확

작성자는 "resume 명령을 입력하면 즉시 정상 작동하기 때문에 모델이 완전히 멈추거나 크래시한 것 같지는 않다"고 밝혔다. 다만 이 문제가 모델 자체, llama.cpp 등 추론 엔진, 컨텍스트 처리 방식, 프롬프트 캐싱, 툴 호출, 혹은 OpenCode 자체 중 어디에서 비롯된 것인지는 특정하지 못했다고 전했다. 서버에서 tmux 세션을 통해 OpenCode를 직접 실행하는 구성이라는 점도 함께 언급했다.

이 사례는 아직 커뮤니티 차원의 개별 보고에 그치며, 딥시크(DeepSeek)나 Unsloth 측의 공식 확인은 없는 것으로 알려졌다. 동일 증상을 겪은 다른 이용자가 있는지는 추가 확인이 필요하다.

김현국

METAL 발행인 · 아카이브저널 발행인 · 이라선 운영

매거진·서점·교육을 오래 해 온 편집자예요. 라이프스타일 매거진 <아카이브저널>을 발행하고, 아트 서점 <이라선>을 운영했으며, 라이카 아카데미에서 디렉터로 사진 교육 프로그램을 만들고 이끌었어요. 그 시선으로 전 세계 AI 소식을 독자에게 전하는 메탈(METAL) 매거진 편집장입니다.

이 에디터의 기사 더 보기 →

공유

댓글