09_vLLM 기본 추론 최적화 노하우 1건
· 약 1분
뭐 하려는 거냐: Real-ESRGAN이라는 AI 초해상도 모델을 쓰려는 겁니다. ffmpeg 스케일링은 픽셀을 늘려서 보간할 뿐이라 흐릿하게 커지기만 하는데, 이 모델은 저화질·압축된 영상에서 잃어버린 윤곽과 질감을 복원하도록 학습된 모델이라 결과가 확연히 다릅니다. 파이프라인은 이렇습니다:
MODEL_QWEN3_ASR = MODEL_ROOT / "Qwen3-ASR-1.7B"
MODEL_QWEN3_ALIGNER = MODEL_ROOT / "Qwen3-ForcedAligner-0.6B"