AIAI Tech Engine
/벤치마크/시각 비교 팩 v2: 플레이 vs 정지 + DeepSeek는 AMD+4080
#visual compare#DeepSeek#RTX4080#DGX Spark#EVO-X3#VRAM#v2

시각 비교 팩 v2: 플레이 vs 정지 + DeepSeek는 AMD+4080

v1은 자동 점수가 장면을 속였다. v2는 playable/still 분리·네거티브 잠금. AMD+4080은 DeepSeek(~101G)처럼 AMD VRAM에 안 들어가는 모델용.

AIAI Tech Engine Lab
독립 테스트베드 실측
SPONSORED / ADVERTISEMENT
예약된 광고 영역

한 줄. v1 결과물은 사람 눈으로 보면 대부분 실패였다. v2는 (1) 플레이 가능 vs 정지 씬을 나누고 (2) 행어에 로켓 금지를 걸고 (3) AMD+4080을 “이미 들어가는 모델의 속도 부스터”가 아니라 VRAM spill로만 쓴다. 헤드라인 레이스는 Spark DeepSeek ↔ EVO AMD+4080 DeepSeek.

v1 속도 글(Flash-Next 16k)은 그대로 두되, 품질 한계 섹션을 이미 붙였다: 16k 3박스. 팩 JSON: visual_compare_pack_v2.json.

v1에서 깨진 것

  • 게임 프롬프트가 “시네마틱 스크린샷”이라 WASD가 없음 → “게임이 안 돈다”.
  • space-02(행어)가 메시 조합상 로켓/전투기처럼 보임. 문자열 hangar만 있으면 hit 통과.
  • Flash-Next는 AMD 단독에도 이미 들어감(~92% VRAM) → 4080 spill의 이유가 약했음.

왜 AMD+4080인가 (VRAM)

모델~diskAMD-only (~96GB)AMD+4080Spark
Qwen3.8-27B~14Gfit불필요fit
Flash-Next~88G겨우 (~92% @32k)헤드룸fit
DeepSeek-V4-Flash~101GOS 30Gi ≠ 천장. amdgpu.gttsize=122880 → GTT~120Gi (Vulkan AMD ~221Gi)검증됨: --no-host --load-mode mmap + Vulkan1+0fit (:8888)
GLM-Flash EXL3~94G · 120/120EVO GGUF 없음가중치 OK · install_prebuilt.sh 후 :8888

EVO는 처음부터 OS ~30Gi + GTT ~120Gi(amdgpu.gttsize)다. 예전에 “30Gi라서 DeepSeek 불가”로 쓴 건 잘못이었다 — llama.cpp가 CPU 버퍼로 떨어질 때의 증상이지, GTT 한도가 아니다. --no-host --load-mode mmap으로 Vulkan/GTT에 올리면 DeepSeek는 AMD+4080에서 로드된다(2026-09-04 검증). 4080은 여유·스필이고, 본체는 AMD GTT다.

GLM-Flash: Spark에 EXL3 K2 가중치 120/120 완료. 런타임은 install_prebuilt.sh 미설치(preflight: torch/vllm 없음). EVO용 GGUF는 아직 없음 → GLM은 당분간 Spark 전용 라인.

v2 팩 (6 프롬프트)

idmode요지
play-snake-01playablecanvas 2D 스네이크 · WASD/화살표 · raf 필수 · Three.js 금지
play-arena-01playable탑다운 아레나 · WASD+발사 · 적 3+
still-arch-01still집+풀 (잠긴 배치)
still-hangar-01still실내 행어 · 로켓/발사/도그파이트 금지
still-product-01still헤드폰 제품
still-rocket-01still해안 로켓 발사 (여기만 발사 허용)

스모크: play-snake-01 · still-arch-01 · still-hangar-01.

채점

  • hit_ratio = 약한 문자열 신호 (단독 품질 지표로 쓰지 않음)
  • structural_ok = required_code + forbidden 드리프트
  • render_ok = Playwright (snake / angry / arch3d)
  • 나머지 /10 = 사람·비전

다음 실행

  1. EVO DeepSeek AMD+4080 서빙 중 (:8080, GTT+mmap)
  2. Spark DeepSeek wake (:8888) → 같은 v2 스모크 대결
  3. GLM: Spark install_prebuilt.sh → serve → 별도 품질 스모크 (EVO는 GGUF 생길 때까지 Spark-only)

관련: 팩 v1 · Flash-Next 16k · 4080 spill quality×cost.