# H3 i2v / ia2v 스모크 — 실행 기록

> CEO 발주 2026-08-08. **동일 이미지·동일 seed·동일 length 로 오디오 유무만 가른 A/B.**
> 원 수치 출처 = dockaiq `jobs.started_at`/`finished_at`(DB 가 정본 · 이 표는 조건과 함께 읽으라고 모은 것).
> 조회: `psql -d dockaiq -c "select id,state,finished_at-started_at from jobs where id in (26686,26688)"`

## 고정 조건 (두 잡 공통)
- 워크플로 `i2v-minimax-h3-ref2va-spark` · 머신 spark · **DiT = int8_convrot**(NVFP4 미적용 · 프로덕션 워크플로 현행)
- 가속 = 터보 LoRA 4step + SageAttention 패치 + EasyCache@0.2 + TurboSampler
- 출력 768×1280 고정 · `length 124f` = **5.167s** @24fps
- 입력 이미지 = `dockaiq-ui/2026-07-18/job-023688/anima-semireal-turbo-fast-sd-spark_j023688_00001_.png`(512×896)
- seed 230688 · 참조 이미지 1장 · 대사 텍스트(`<d>`) **미사용**

## 결과

| 잡 | 축 | 오디오 ref | wall-clock | 산출 |
|---|---|---|---|---|
| **#26686** | **i2v** | 없음(모델 생성 오디오가 붙는다) | **668s** | `dockaiq-ui/2026-08-08/job-026686/…_j026686_00001_.mp4` |
| **#26688** | **ia2v** | `v2-yumin-5s.wav`(5.034s · v2 원본 6.16s 를 CEO 지시로 트림) | **1068s** | `dockaiq-ui/2026-08-08/job-026688/…_j026688_00001_.mp4` |

★**오디오 레퍼런스 1개가 +400s (+59.9%)** — 이미지·seed·length(124f)·해상도가 전부 같고 **오디오 슬롯 하나만** 늘었다.
⇒ **참조 슬롯은 프레임만큼 비싼 축이다.** 같은 패턴이 다른 잡에서도 보인다:
  · #26500(192f · 이미지 2) **858s** vs #26680(192f · 이미지 3 + 오디오 3) **1783s** = **+108%**
★비용 모델을 프레임만으로 세우면 틀린다 — `t ∝ frames^1.55` 는 **참조 수 고정**일 때의 관계다.

★**#26687 은 취소분**이다 — 트림 전 6.16s 오디오에 맞춰 `length 158f` 로 냈다가, CEO 의 5초 트림 지시로
124f 재제출(#26688)했다. 158f 였으면 i2v 와 길이가 달라 A/B 가 흐려졌다.

## 읽을 때 주의
- ★**warm/cold 를 섞지 마라** — NVFP4 축에서 cold 605s vs warm 431s 로 결론이 뒤집힌 실사고가 있다
  (`02-architecture/minimax-h3-spark-feasibility.md` §튜닝 축 ③). 위 값의 warm/cold 는 미기록이다.
- ★비용은 프레임에 **초선형**(`t ∝ frames^1.55`)이고 **참조 슬롯 수에도 는다** — 다른 잡과 비교할 땐
  length 와 참조 개수를 함께 볼 것(예: 192f·참조 2장 #26500 = 858s).
