구글, 이미지 모델 ‘나노 바나나 2.1’ 정식 출시…글자 표현 개선

[지디넷코리아]

구글이 현지 시각 10월 6일 제미나이 API 릴리스 노트를 통해 이미지 생성·편집 모델 ‘제미나이 나노 바나나 2.1(gemini-nano-banana-2.1)’을 정식 출시했다. 나노 바나나 2(제미나이 3.1 플래시 이미지)의 후속 모델로, 플래시급 속도와 비용을 유지하면서 화질과 프롬프트 반영 정확도, 여러 차례 대화를 이어 가며 편집할 때의 캐릭터 일관성, 이미지 속 글자 표현을 높였다. 상위 모델인 나노 바나나 프로(제미나이 3 프로 이미지)보다 효율에 초점을 맞춘 모델이다.

출력 해상도는 1K·2K·4K 중에서 선택하며, 구글은 이전 모델에서 2K·4K 해상도로 가로나 세로로 긴 비율(1:4, 4:1, 1:8, 8:1) 이미지를 생성할 때 발생하던 타일 이음새 문제를 수정했다. 타일 이음새는 큰 이미지를 여러 조각으로 나눠 생성할 때 조각 사이 경계선이 보이는 현상이다. 인포그래픽의 배치 정확도도 개선했다.

참조 이미지는 최대 14장까지 입력할 수 있어, 인물은 최대 4명까지 같은 모습을 유지하고, 사물은 최대 10개까지 원본 형태를 반영한다. 구글 웹 검색과 이미지 검색 결과를 근거로 이미지를 생성하는 검색 그라운딩도 지원한다. 그라운딩은 AI가 외부에서 확인한 정보를 바탕으로 결과물을 작성하게 하는 기능이다. 생성 전에 추론하는 정도인 사고 수준은 최소·중간·높음 중에서 고르며, 기본값은 중간이다.

나노 바나나 2.1은 텍스트와 이미지, 동영상, PDF를 입력받으며, 입력 토큰 한도는 13만 1,072개, 출력 토큰 한도는 3만 2,768개다. 대량 작업을 한꺼번에 처리하는 배치 API를 지원하고, 함수 호출과 구조화된 출력, 코드 실행 기능은 지원하지 않는다.

기존 모델인 제미나이 3.1 플래시 이미지(gemini-3.1-flash-image)는 지원 중단 대상으로 지정됐고 10월 29일 서비스를 종료한다. 구글은 개발자들에게 나노 바나나 2.1로 전환하라고 안내했다. 새 모델은 구글 AI 스튜디오에서 바로 시험해 볼 수 있다.

자세한 내용은 구글 AI 포 디벨로퍼스(Google AI for Developers)에서 확인할 수 있다.

이미지 출처: 구글

■ 이 기사는 AI 전문 매체 ‘AI 매터스’와 제휴를 통해 제공됩니다. 기사는 클로드 3.5 소네트와 챗GPT를 활용해 작성되었습니다. (☞ 기사 원문 바로가기)

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다