블랙포레스트랩스, 멀티모달 Flux 3와 로봇용 Flux-mimic 공개
독일 AI 기업 블랙포레스트랩스(BFL)가 이미지·영상·오디오를 함께 다루는 멀티모달 모델 'Flux 3'와 로보틱스용 'Flux-mimic'를 공개했다. 생성형 AI에서 로보틱스용 물리 AI로 두 모델을 동시에 내놓으며 활동 범위를 넓힌 사례다.

한 모델이 이미지·영상·오디오를 함께 처리
Flux 3는 이미지·영상·오디오를 함께 학습하는 멀티모달 파운데이션 모델이다. 멀티모달 파운데이션 모델은 이미지·영상·오디오 등 여러 종류의 데이터를 한 모델이 함께 학습하는 대규모 인공지능이다.
같은 매체에 따르면 Flux 3는 네이티브 오디오를 포함해 최대 20초 길이의 영상을 만든다. 네이티브 오디오는 영상과 오디오를 함께 생성하는 기능을 가리킨다.
이 모델은 텍스트 기반 영상 생성, 이미지·영상 기반 영상 생성, 키프레임 전환, 다국어 대화, 클립 연결 기능을 지원한다고 BFL은 Flux 3가 생성과 이해를 한 모델에 함께 학습시키는 자체 방식인 ‘셀프-플로우(Self-Flow)‘에 기반한다고 설명했다.
로봇으로 넓히는 물리 AI


함께 공개된 Flux-mimic는 로보틱스용 비디오-액션 모델이다. 비디오-액션 모델은 BFL 설명에 따르면 모델이 이해한 환경을 토대로 행동을 예측하는 로보틱스용 모델이다.
Flux-mimic는 미믹 로보틱스와 협력해 개발됐으며 아우디(Audi)의 생산 작업에서 테스트되고 있다. BFL은 Flux 3를 물리적·디지털 환경을 인지하고 예측하며 행동하는 ‘실세계 시각 지능’을 향한 단계로 규정했다.
출시 계획과 남은 검증
BFL은 단계적 출시를 계획하고 있으며, 멀티모달 백본의 가중치를 ‘Flux 3 Dev’라는 이름으로 공개할 예정이다. 오픈웨이트는 학습된 모델 가중치를 외부에 공개하는 방식이다.
2026년 7월 23일 보도 기준 Flux 3 Video는 이용할 수 있고, Flux 3 Image는 이후 몇 주 안에 얼리액세스로 제공될 예정이라고 BFL 자체 초기 평가에서 720p·10초 클립을 비교한 결과, Flux 3의 선호도는 루마 레이 3.2 대비 93%, 런웨이 젠-4.5 대비 77%, 그록 이매진 비디오 대비 69%로 보고됐다. 다만 BFL은 이 결과가 예비적이며 아직 독립적인 시험 결과가 없다고 밝혔다.


자료사진 출처
총 3건- 소련 방송용 KT-190 카메라 · 자료사진
- 촬영 현장의 슬레이트 · 자료사진
- 블랙뷰 A60 스마트폰 앞면 화면 · 자료사진
원문 출처
총 2건- Techmeme Germany's Black Forest Labs launches Flux 3 and Flux-mimic, its first models for robotics, as it expands from generative AI into physical AI (Yazhou Sun/Bloomberg)
- The Decoder Flux 3 generates videos with native audio up to 20 seconds long, a first for Black Forest Labs
이 기사는 위 원문들에서 사실만 교차 확인해 재구성했으며, 원문 문장·사진을 전재하지 않았습니다. 집필 단계의 AI는 원문을 열람하지 않고, 별도 검증을 통과한 사실만 사용했습니다. 사실관계에 오류가 있다면 정정을 요청해 주세요(nickpark77@gmail.com).
AI 다른 기사
AI 스트레이트 뉴스 ✓ 4개 출처 교차
머스크 측, 애플 상대 청구 취하…오픈AI 상대로는 계속
AI 해설 ✓ 2개 출처 교차
앤스로픽, 금융 자문가용 클로드 출시…투자 분석·리서치 도구와 연결
AI 스트레이트 뉴스 ✓ 3개 출처 교차


