-
FLUX 3 모델 공개
FLUX 3 모델 공개 | GeekNews
<ul> <li>이미지·비디오·오디오를 하나의 아키텍처에서 함께 학습해 생성·이해·행동 예측을 통합하려는 <strong>멀티모달 기반 모델</strong>이며, FLUX 3 Video부터 Early Access로 제공됨</li> <li>이미지의 공간 구조, 비디오의 시간·물리 역학, 오디오의 사건·소리 관계를 상호 제약으…
-
Qwen-Image-3.0 - 풍부한 콘텐츠, 사실적 디테일, 깊이 있는 지식
Qwen-Image-3.0 - 풍부한 콘텐츠, 사실적 디테일, 깊이 있는 지식 | GeekNews
<ul> <li>Qwen-Image 시리즈의 3세대 기반 이미지 생성 모델로, 보기 좋은 이미지를 넘어 생산성 작업에 활용할 수 있는 ‘<strong>Real(实)</strong>’을 핵심 목표로 삼음</li> <li>최대 <strong>4.5k 토큰 입력</strong>을 처리해 신문·스토리보드·시험지처럼 정보량이 많은…
-
Nano Banana 2 Lite
Nano Banana 2 Lite | GeekNews
<ul> <li>Google DeepMind의 Gemini Image 계열에 추가된 <strong>Nano Banana 2 Lite</strong>는 이미지 생성·편집을 더 빠르고 저렴하게 돌리려는 모델로, 반복이 많은 시각 작업의 비용 부담을 낮추는 데 초점을 둠</li> <li>핵심 축은 <strong>낮은 지연시간<…
-
Krea 2: 오픈 가중치 12B 이미지 모델 기술 보고서
Krea 2: 오픈 가중치 12B 이미지 모델 기술 보고서 | GeekNews
<ul> <li>Krea 2는 하나의 polished default보다 <strong>창작 탐색</strong>을 중시하는 이미지 생성 파운데이션 모델로, 모델 가중치와 추론을 permissive license로 공개함</li> <li>학습 과정은 <strong>pretraining → midtraining → SFT →…