게임 Hacker News · 5일 전

엔비디아 DLSS 5 신경망 렌더링을 바이트 단위까지 똑같이 뚫어버린 오픈소스 공개됨

핵심 요약
  • 한 개발자가 엔비디아의 차세대 'DLSS 5 신경망 렌더링' 네트워크를 불칸(Vulkan)으로 원본과 비트 단위까지 일치하게 재구현한 OpenDLSS 프로젝트를 공개했습니다.
  • 해상도를 늘리는 기존 업스케일러와 달리 렌더링된 프레임에 디테일을 생성해 덧입히는 구조로, RTX 4070 SUPER 기준 4K 해상도에서 29.3ms의 성능을 기록했습니다.
  • 텐서 코어 없이 브라우저에서 실행 가능한 WebGPU 포트와 필라멘트 렌더러 기반의 실시간 3D 데모도 함께 포함되었습니다.
요약 한 오픈소스 개발자가 엔비디아(NVIDIA)의 차세대 기술로 알려진 'DLSS 5 신경망 렌더링(Neural Rendering)' 네트워크를 불칸(Vulkan) API 기반으로 원본과 비트 단위까지 완벽하게 일치하도록 재구현한 프로젝트 'OpenDLSS-NR'을 깃허브(GitHub)에 공개했습니다. 해당 프로젝트는 DLSS-NR 빌드 310.8.0과 동일한 71개 블록의 Swin / ViT(Vision Transformer) 네트워크 구조를 사용하며, 텐서 코어에서 FP8(E4M3) 활성화 및 FP16 누적 연산을 수행합니다. 최종 출력 이미지뿐만 아니라 75개 블록 경계의 모든 중간 연산 결과값까지 원본과 바이트 단위로 정확하게 일치하는 것이 특징입니다. 가중치 용량은 약 141MB 수준이며, 사용자가 직접 모델 가중치 디렉터리를 제공해야 합니다. 주목할 점은 이 기술이 일반적인 해상도 업스케일러(DLSS-SR)가 아니라는 점입니다. 이미 렌더링된 프레임에 노이즈를 주입하고 스타일 설정에 따라 톤, 구조, 디테일을 생성해 다시 그려내는 '생성형 신경망 렌더링' 방식으로 작동하며, 입력과 출력 해상도가 동일합니다. 개발자가 공개한 성능 측정에 따르면 RTX 4070 SUPER 그래픽카드 기준 768x768 해상도에서는 2.8ms, FHD(1920x1080)는 7.8ms, QHD(2560x1440)는 12.6ms, 4K(3840x2160)에서는 29.3ms의 렌더링 소요 시간을 기록했습니다. 또한 텐서 코어나 FP8 지원 없이 웹 브라우저 환경에서 동일한 연산을 검증할 수 있는 독립적인 WebGPU 포트 버전도 함께 포함되었습니다. WebGPU 버전의 경우 512x512 해상도 기준 72ms가 소요되어 하드웨어 최적화 버전(2.7ms)보다는 느리지만, 규격상 완벽한 비트 일치성을 증명해 보였습니다. 윈도우 환경과 엔비디아 Ada 아키텍처 이상의 GPU가 요구되며, 구글 필라멘트(Filament) 렌더러를 기반으로 한 3D 데모 실행 파일도 함께 제공됩니다.
Sponsored · 광고