엔비디아, RTX GPU에 FLUX.2 이미지 생성 모델 최적화로 AI 접근성 확대

AI 컴퓨팅 분야 선두주자 엔비디아가 블랙 포레스트 랩스, 컴피UI와 협력하여 최첨단 이미지 생성 모델 FLUX.2를 RTX GPU에 최적화했다. 이 모델은 320억 파라미터의 고사양을 요구하지만, FP8 양자화와 VRAM 최적화를 통해 성능을 40% 향상시키고 VRAM 요구량을 40% 절감하는 혁신을 달성했다. 이로써 FLUX.2의 사진 같은 품질, 다이렉트 포즈 컨트롤, 멀티 레퍼런스 기능을 일반 소비자용 GeForce RTX GPU에서도 효과적으로 활용할 수 있게 되어 고품질 생성형 AI의 접근성이 크게 확대되었다.

FP8 양자화 및 VRAM 최적화 통해 성능 40% 향상, 90GB 요구 모델을 일반 소비자 환경으로

엔비디아, RTX GPU에 FLUX.2 이미지 생성 모델 최적화로 AI 접근성 확대
FLUX.2 모델은 놀라울 만큼 사실적인 디테일을 제공한다 (image. 블랙 포레스트 랩스)

AI 컴퓨팅 기술 선두주자인 엔비디아(NVIDIA)가 블랙 포레스트 랩스(Black Forest Labs), 컴피UI(ComfyUI)와 협력하여 FLUX.2 이미지 생성 AI 모델을 엔비디아 RTX GPU에 최적화했다고 밝혔다. 비주얼 생성형 AI 모델을 개발하는 블랙 포레스트 랩스가 출시한 첨단 이미지 생성 모델 FLUX.2 제품군은 사진처럼 사실적인 디테일과 깔끔한 글꼴을 유지하며 대규모 작업에서도 일관된 품질을 제공하는 멀티 레퍼런스(multi-reference) 기능을 포함한 새로운 툴과 기능을 제공한다.

FLUX.2의 최첨단 비주얼 인텔리전스

FLUX.2로 생성된 이미지는 최대 4메가픽셀 해상도와 실제와 같은 조명, 물리 효과를 구현하며, 시각적 완성도를 떨어뜨리는 ‘AI 특유의 느낌’을 제거하여 대규모 작업에서도 사진 수준의 품질을 제공한다.

이 모델에는 피사체나 캐릭터의 포즈를 명확하게 지정할 수 있는 다이렉트 포즈 컨트롤(direct pose control) 기능이 추가되었으며, 인포그래픽, UI 화면, 다국어 콘텐츠에서도 깔끔하고 가독성 높은 텍스트를 제공하는 것이 특징이다. 또한 새로운 멀티 레퍼런스 기능을 통해 스타일과 주제가 일관된 최대 6개의 참조 이미지를 선택할 수 있어, 모델의 광범위한 미세 조정이 필요하지 않다.

RTX 최적화: VRAM 절감 및 성능 향상

FLUX.2 모델은 320억 개의 파라미터를 가진 대규모 모델로, 완전히 로드하기 위해서는 90GB의 VRAM이 필요하며, 활성 모델만 로드하는 lowVRAM 모드를 사용하더라도 64GB의 VRAM이 요구되어 일반 소비자용 그래픽 카드로는 효과적인 실행이 불가능한 수준이다.

모델의 접근성을 넓히기 위해 엔비디아와 블랙 포레스트 랩스는 협력하여 FLUX.2 모델을 FP8 양자화했으며, 이는 비교 가능한 품질을 유지하면서도 VRAM 요구사항을 40% 절감시킨다.

엔비디아는 모델 출시와 동시에 FP8 양자화와 RTX GPU 성능 최적화를 지원하여, 모델 구동에 필요한 VRAM을 40% 절감하는 동시에 성능을 40% 향상시키는 성과를 거두었다.

추가적으로, 엔비디아는 컴피UI와 협력하여 웨이트 스트리밍(weight streaming) 기술을 통해 앱의 RAM 오프로드 기능을 개선했다. 사용자는 이 기능을 통해 모델의 일부를 시스템 메모리로 오프로드하여 GPU 사용 메모리를 확장할 수 있으며, 해당 모델은 별도의 소프트웨어 패키지 없이 컴피UI에서 바로 사용 가능하다.

뉴스레터 구독하기

아이씨엔매거진은 AIoT, IIoT 및 피지컬 AI, 디지털트윈을 통한 제조업 디지털전환 애널리틱스를 제공합니다.
테크리포트: 자율제조, 전력전자, 모빌리티, 로보틱스, 스마트농업

AW2026 expo
ACHEMA 2027
전시회 세미나 선물 준비는 기프트랩스
오승모 기자
오승모 기자http://icnweb.kr
기술로 이야기를 만드는 "테크 스토리텔러". 아이씨엔 미래기술센터 수석연구위원이며, 아이씨엔매거진 편집장을 맡고 있습니다. 디지털 전환을 위한 데이터에 기반한 혁신 기술들을 국내 엔지니어들에게 쉽게 전파하는데 노력하는 중입니다.
fastech EtherCAT
as-interface
GiftLabs

Related Articles

Stay Connected

440FansLike
407FollowersFollow
224FollowersFollow
120FollowersFollow
372FollowersFollow
152SubscribersSubscribe
GiftLabs
spot_img
InterPACK
spot_img
SPS 2026
automotion
Power Electronics Mag

Latest Articles

Related Articles

PENGUIN Solutions
WindEnergy
InterPACK

Related Articles

fastech EtherCAT
as-interface
생성형 AI가 홈 자동화 속으로… 마우저, 미디어텍 6nm 기반 ‘지니오 420’ 공급 개시

생성형 AI가 홈 자동화 속으로… 마우저, 미디어텍 6nm 기반 ‘지니오 420’...

0
마우저가 미디어텍의 6nm 기반 '지니오 420' 플랫폼 공급을 시작하며 인터넷 연결 없이 가정 및 상업용 기기 자체에서 생성형 AI를 가동할 수 있는 환경을 제공하고 있다
TI, 업계 최초 상용 CAN XL 트랜시버 출시로 산업 네트워크 대역폭 한계 깬다

TI, 업계 최초 상용 CAN XL 트랜시버 출시로 산업 네트워크 대역폭...

0
텍사스 인스트루먼트(TI)가 업계 최초로 상용 CAN XL 트랜시버를 출시하여 로봇과 산업 장비의 데이터 전송 속도를 대폭 향상시켰다
클라우드 접속 없이 내 PC에서 AI 코딩을? 엔비디아, RTX GPU 기반 ‘큐원3.8-27B’ 로컬 에이전트 지원

클라우드 접속 없이 내 PC에서 AI 코딩을? 엔비디아, RTX GPU 기반...

0
엔비디아가 최신 RTX GPU에서 클라우드 연결 없이도 개인 PC에서 안전하고 빠르게 AI 코딩을 도와주는 270억 파라미터 규모의 '큐원3.8-27B' 모델을 공식 지원한다
노르딕, 스카일로 인증 nRF9151로 위성 및 셀룰러 통신 전격 지원

노르딕, 스카일로 인증 nRF9151로 위성 및 셀룰러 통신 전격 지원

0
노르딕 세미컨덕터가 지상 기지국이 없는 오지에서도 위성과 지상 이동통신망을 자동으로 오가며 연결을 유지하는 초소형 사물인터넷 통신 모듈을 공개했다
콩가텍, 별도 가속기 없는 초고성능 AI 모듈 ‘conga-HPC/cRX1’ 출시

콩가텍, 별도 가속기 없는 초고성능 AI 모듈 ‘conga-HPC/cRX1’ 출시

0
콩가텍이 별도의 인공지능 가속기 카드를 추가하지 않고도 로봇과 자율주행 장비의 복잡한 인공지능 연산을 단일 보드로 처리하는 고성능 임베디드 컴퓨터 모듈을 상용화했다
AI가 반도체 직접 설계 엔비디아 신기술 공개

AI가 반도체 직접 설계 엔비디아 신기술 공개

0
엔비디아가 AI 물리학과 가속 수학 라이브러리를 결합한 에이전트 툴킷을 출시하여 반도체와 복잡한 기계 설계를 AI가 스스로 수행하는 자율형 엔지니어링 시대를 열었다
- Our Youtube Channel -Engineers Youtube Channel

Latest Articles