모델 축소 · CPU offload · swapping 필요
RTX PRO 6000
96GB LOCAL AI
SHOWCASE
이미지·언어·음악을 한 장의 GPU에서 직접 실행한 결과
32GB는 줄여야 했고,
96GB는 그대로 올렸다.
현재 파이프라인 단일 GPU 직접 적재
- FLUX.2-dev
- 70.8 GiB
- Qwen3.6-35B-A3B
- 66.226 GiB
- Qwen3-Coder-Next FP8
- 78.150 GiB
LOCAL MEASURED속도 배수가 아니라 동일 정밀도·현재 파이프라인의 직접 적재 여부를 비교합니다.
32B 생성 모델과
언어 인코더를 함께 상주시킨다.
- PEAK VRAM
- 70.8 GiB
- EXAMPLES
- 34.352–42.327 s
- RTX 5090 32GB
- DIRECT LOAD: NO
빛을 줄일수록, 디테일은 더 중요해진다.
LOCAL MEASURED
- TIME
- 34.352 s
- PEAK
- 69,522 MiB

- TIME
- 36.284 s
- PEAK
- 69,522 MiB
거대한 공간과 작은 표면을 같은 모델로.
LOCAL MEASURED
- TIME
- 42.327 s
- PEAK
- 71,570 MiB

- TIME
- 40.309 s
- PEAK
- 69,746 MiB
중요한 것은 생성량이 아니라
우리의 룩을 학습하는 능력.
반복 가능한 색·재질·촬영 문법
캐릭터와 스타일의 일관성
세트·건축·무대의 고유 분위기
캠페인별 조명과 반사 규칙
현재 슬라이드는 공개 FLUX.2 학습 절차의 가능 범위이며, 사내 데이터 학습 성과를 주장하지 않습니다.
FLUX.2 LORA GUIDE ↗하나의 로컬 모델,
여섯 개의 업무 표면.
속도와 품질 평가는 같은 숫자가 아니다.
LOCAL MEASURED- OUTPUT
- 608 tokens
- INFERENCE
- 33.187 s
- PEAK
- 66.226 GiB
- OUTPUT
- 4,096 tokens
- INFERENCE
- 422.478 s
- PEAK
- 75.844 GiB
Continuation: 7.747 tok/s · peak 78.150 GiB
한국어 가사에서
한 곡 전체를 로컬로.
- SONG
- 85.60 s
- GENERATE
- 765.703 s
- PEAK VRAM
- 47.23 GiB
후처리 재개 수 초 별도
- SONG
- 72.40 s
- GENERATE
- 652.984 s
- PEAK VRAM
- 46.59 GiB
- SONG
- 88.08 s
- GENERATE
- 818.953 s
- PEAK VRAM
- 47.28 GiB
BF16 · NO QUANT · NO CPU OFFLOAD
LOCAL PEAK 46.59–47.28 GiB · RTX 5090 32GB DIRECT LOAD: NOOFFICIAL 4+ SESSIONS: 80GB+ RECOMMENDEDYUE GITHUB ↗한 모델이 아니라
용도별 공급망으로 설계한다.
기존 기획에서 복원한 구분: 음악 · 효과음/환경음 · 목소리/더빙 · 영상 동기화
대표 네 장면만, 클릭할 때만 재생.
LOCAL MEASURED · WAN2.2영상은 가능 범위의 보조 증거입니다. 사운드·립싱크 동시 생성 사례는 포함하지 않았습니다.
기다림을 숨기지 않고,
실측으로 계획한다.
IMAGE · QUIET BLACK34.352 SECONDSLOCAL MEASURED동일 카드의 상대속도 주장이 아니라 각 워크플로의 실제 기록입니다. 영상 속도는 비교에서 제외했습니다.
숫자마다
출처의 경계를 표시한다.
이 워크스테이션에서 생성·계측
제작사가 공개한 별도 환경의 근거
로컬 GPU 성능과 무관한 공급망 후보
확인 전에는 수치·성과를 주장하지 않음
83B 통합 멀티모달을
NF4 4비트로 한 장에 올린다.
- PEAK VRAM
- 58,356–60,820 MiB
- PER IMAGE
- 71.5–73.6 s
- RTX 5090 32GB
- DIRECT LOAD: NO
LOCAL MEASURED가중치 48.26 GB(디스크) · 상주 46,676 MiB · 배치 최대 피크 60,820 MiB(59.4 GiB) · 콜드 스타트(모델 로드 포함) 98.7–98.8 s · 25 스텝 · guidance 6.0 · RTX 5090 32GB DIRECT LOAD: NO
OFFICIAL MODEL CARD ↗여섯 장 모두 통과, 흠은 각 카드 아래에.
LOCAL MEASURED
- TIME
- 98.8 s
- PEAK
- 58,612 MiB
콜드 스타트 포함

- TIME
- 71.7 s
- PEAK
- 58,580 MiB
인물 5인 각각 다른 실루엣, 원경 관중 붕괴 없음, 십자 무대 구조 정확
털과 실크, 같은 모델로.
LOCAL MEASURED
- TIME
- 73.5 s
- PEAK
- 60,628 MiB
가드헤어와 로제트 무늬 해상, 눈 결정 정지. 앞발 하나가 다소 크게 렌더링

- TIME
- 73.5 s
- PEAK
- 58,580 MiB
실크 광택과 피부 질감 양호. 요청한 볼륨감 있는 치마와 반투명 리본은 약하게 반영
짙은 흑백과 안개 콘크리트, 그리고 초대하지 않은 소품.
LOCAL MEASURED
- TIME
- 73.5 s
- PEAK
- 58,612 MiB
계조와 질감 우수. 다만 '소프트박스 조명' 서술을 화면 안 실제 소프트박스로 렌더링

- TIME
- 73.6 s
- PEAK
- 58,356 MiB
수직선 정확, 콘크리트 결 해상. 요청하지 않은 유리돔이 상부에 추가됨
짧은 영문은 맞고, 한글은 한 글자가 남았다.
LIMITS · HONEST QA
짧은 영문 라벨 `AURORA 96`을 정확히 렌더링
프롬프트에 없는 열쇠가 화면에 추가됨
- TIME
- 73.6 s
- PEAK
- 58,580 MiB

요청 `스튜디오 리얼라이브` → 출력 `스튜디소 리얼라이브`. 10자 중 1자 오류(오→소). 영문 `AI CREATIVE UNIT`은 정확
비교 — 동일 과제에서 FLUX.2-dev(2026-07-14)는 `스튜디디 리열라이브`로 2자 오류. 오류는 줄었으나 정확 렌더링에는 여전히 미달
콜드 스타트 포함
- TIME
- 98.7 s
- PEAK
- 58,452 MiB
안다고 그리는 것과, 맞게 그리는 것은 다르다.
LIMITS · HONEST QA
라벨 4개 중 3개 오타(Eveporation·Croptication·Hclegetion), 제목과 본문은 판독 불가. 화살표 순서도 강수와 집수가 뒤바뀜
시사점 — LLM 백본이라 내용을 추론해 그린다는 주장은 이 시험에서 재현되지 않음. 짧은 문구는 정확하지만 긴 문장·다중 라벨에서는 무너짐
- TIME
- 71.5 s
- PEAK
- 58,548 MiB

N서울타워를 격자 마스트·전망대까지 식별 가능하게 렌더링. 그러나 남산이 한강 변에 붙어 있는 것으로 배치돼 실제 지리와 다르고, 좌측 능선에 타워가 하나 더 복제됨
비교 — 동일 계열 과제에서 Wan2.2(2026-07-14)는 남산타워를 광저우타워풍으로 렌더링해 실패. 랜드마크 식별은 통과, 공간 배치는 미달
- TIME
- 73.5 s
- PEAK
- 58,516 MiB
무엇이 나올지 예측하려면
이 네 가지 습관부터 본다.
촬영 장비를 서술하면 그것을 화면 안 사물로 그리는 경향이 있다 (헬리콥터 촬영 → 헬리콥터가 프레임에 등장, 소프트박스 조명 → 소프트박스가 프레임에 등장).
짧은 영문 문구는 정확하고, 한글은 자소 단위 오류가 남으며, 문단 길이 텍스트는 완전히 무너진다.
프롬프트에 없는 소품을 추가하는 경우가 있다 (열쇠, 유리돔).
구도 지시를 부분적으로 무시할 수 있다 (오버헤드 요청을 사선으로 렌더링).
여섯 장은 통과, 다섯 장은 부분/완전 실패로 별도 슬라이드에 기록했습니다.
재질은 충실했고, 카메라 위치는 무시됐다.
LIMITS · HONEST QA
김·무 반투명·쪽파·김치와 밥 배치 등 요청 요소는 모두 반영. 그러나 "오버헤드(위에서 내려다본) 촬영" 지시를 사선 앵글로 렌더링해 구도 지시를 지키지 않았다
시사점 — 재질과 소재 묘사는 충실하지만 카메라 위치 지시는 무시될 수 있다. 구도가 중요한 컷은 생성 후 확인이 필요하다
이 이미지가 배치 전체 피크(60,820 MiB · 59.4 GiB)를 기록했습니다 — 파이프라인 슬라이드의 배치 최대치는 이 컷입니다
- TIME
- 73.5 s
- PEAK
- 60,820 MiB
현재 슬라이드 1 / 21: RTX PRO 6000 / 96GB LOCAL AI SHOWCASE