구글이 몰래 만든 신비한 모델 ‘나노-바나나’? 실측: 엄청나게 강력하지만 3가지 치명적 결함 존재
신비한 AI 모델 '나노-바나나'가 화제가 되면서 가짜 웹사이트가 우후죽순 생겨나, 진짜와 가짜를 구분하기 어려워졌다.
최근 AI 커뮤니티에 '나노-바나나'라는 신비로운 이미지 생성 및 편집 모델이 등장했다.
처음에는 LMArena 플랫폼의 ‘배틀’ 모드에서 발견되었지만, 공개 랭킹에는 등재되지 않았고 공식 개발자가 소유권을 명확히 밝히지도 않았다.
하지만 많은 네티즌들이 단서를 추적하며 이 모델이 구글의 연구 모델일 수 있다고 추측했다.
지난 화요일, 구글 AI Studio 제품 책임자 로건 킬패트릭(Logan Kilpatrick)이 X(구 트위터)에 바나나 이모티콘을 게시했다.
구글 DeepMind 제품 매니저 나이나 라이싱하니(Naina Raisinghani) 역시 이탈리아 예술가 마우리치오 카텔란(Maurizio Cattelan)이 2019년 제작한 테이프 붙인 바나나 예술 작품과 유사한 이미지를 게시했습니다.

여기에 더해 구글이 과거 소형 모델을 '나노(Nano)'라 명명한 점, 생성 이미지의 질감이 구글의 이미젠(Imagen)이나 제미니(Gemini) 시리즈와 유사하다는 점 등이 더해졌다.
이 모든 정황은 이 모델이 구글의 작품임을 암시하는 듯하다.
이 모델은 텍스트 편집, 스타일 융합, 장면 이해 등에서 우수한 성능을 보일 뿐만 아니라, 두 장의 이미지를 업로드하고 프롬프트를 입력해 그 요소들을 융합할 수도 있다.
예를 들어, 책 더미와 침실 침대 옆 탁자 사진을 업로드한 후 프롬프트 “Flip stack of books to be upright and put on table between two bookends.”를 입력하면
복잡한 텍스트 프롬프트를 정확히 이해해 가로로 놓인 세 권의 책을 세워 책받침을 꽂아 탁자 위에 배치합니다.

모델 사진 한 장과 야구 모자 이미지 한 장을 업로드한 후 프롬프트 「Put the baseball hat on the woman.」을 입력하면
야구 모자에 새겨진 복잡한 문자와 패턴 자수를 Nano-Banana가 편집한 이미지가 완벽히 재현하며, 조명, 시점, 구도까지 일관성을 유지합니다.
제품 사진, 세트 구성도, 광고 등 상업적 상황에서 Nano-Banana의 성능은 매우 안정적입니다.
물론 완벽하지는 않습니다. 특정 상황에서 Nano-Banana가 생성한 이미지는 반사, 조명 논리 또는 물체 위치 불일치 등의 시각적 문제가 발생할 수 있으며, 인물의 손가락이 가끔 변형되기도 합니다.

상단 이미지에서 생성된 책을 자세히 보면 결함을 발견할 수 있습니다: 책 제목이 '난해한 글자'로 표시되었습니다.
아직 공식 API나 정식 웹사이트 링크가 없어, 우리는 LMArena를 통해 무작위로 체험해야만 했습니다.
다시 말해, 매번 운에 의존해야 Nano Banana를 만날 수 있어 체험이 매우 불안정했습니다.

더 웃긴 것은, 온라인에 Nano Banana 서비스를 제공한다고 주장하는 가짜 웹사이트들이 우글거리며 많은 네티즌들이 진짜와 가짜를 구분하지 못하는 상황입니다.
Nano-Banana 직접 체험기
저희도 직접 체험해 보았습니다.
lmarena 공식 웹사이트를 열고 Battle 모드를 선택하면, 직접 프롬프트를 입력해 텍스트에서 이미지를 생성하거나, 이미지를 업로드한 후 프롬프트를 입력해 AI 편집을 진행할 수 있습니다.
공식 링크: https://lmarena.ai/
페이지에는 두 개의 익명 모델이 동시에 이미지를 생성하며, 우리가 생성된 이미지 중 가장 품질이 좋은 한 장을 선택해야만 플랫폼이 대결 양측의 정체를 공개합니다.

먼저 텍스트 기반 이미지 생성 효과를 시험해 봅니다.
동일한 프롬프트를 입력합니다: “폴라로이드 사진 촬영 스타일의 초상화 형식 이미지를 제시하세요. 사진 속에는 긴 곱슬머리에 오버사이즈 의상을 입은 메이크업 아티스트가 있습니다. 섬세한 얼굴에 캐주얼한 분위기를 풍기며 카메라를 향해 평화 사인을 취하고 있어 초자유로운 분위기를 연출합니다. 이미지는 약간의 그레인 질감과 생동감 넘치며 매혹적인 색감을 지닙니다. 1:1 비율.”
첫 번째는 Nano Banana의 「작품」이고, 두 번째는 ChatGPT가 생성한 효과입니다. 전자는 배경에 어지럽게 놓인 아이섀도 팔레트, 매니큐어 등이 있어 프롬프트의 ‘메이크업 아티스트’ 정체성에 더 부합하며, 인물의 동작과 의상 디테일이 더 자연스럽고 손 부분에도 뚜렷한 결함이 없습니다. 반면 후자는 배경이 다소 단조롭고 엄지손가락이 약간 흐릿하게 처리되었습니다.
좌우로 스와이프하여 더 보기
이제 이미지 편집 기능을 시험해 보겠습니다.
샌프란시스코 알라모 광장에서 찍은 피크닉 사진을 업로드하고 프롬프트를 입력했습니다: 공원에 휴머노이드 로봇을 추가하고 환경과 자연스럽게 어우러지게 하세요.
처음엔 Nano Banana가 ‘작업을 거부한’ 줄 알았는데, 화면 오른쪽에서 걷고 있는 휴머노이드 로봇을 발견했습니다. 완전히 환경에 녹아들어 전혀 어색함이 없었습니다.
좌우로 슬라이드하여 더 보기
인물 사진 한 장을 업로드해 Nano Banana로 역공학하여 창작 과정을 그려보게 했습니다.
프롬프트: 촬영 전 세팅 중인 세트장, 모델이 앉아 휴대폰을 스크롤하는 모습, 모델 뒤에서 머리를 정리하는 여성, 사다리 위에서 배경에 커튼을 걸며 그 뒤 스튜디오를 드러내는 남성.
네티즌이 Nano Banana로 빌리 아일랜드와 마이클 잭슨의 초월적 셀카를 만들었습니다:
우리도 시도해 보았습니다. 머스크와 오트만의 사진을 업로드하고 프롬프트를 입력했습니다: 두 사람이 행복하게 셀카를 찍고 있습니다.
Nano Banana는 실제로 셀카 한 장을 생성했는데, 머스크의 모습과 동작은 거의 문제될 게 없었지만 오트만은 완전히 달라져 있었습니다.
그것을 ‘억울하게’ 하지 않기 위해, 우리는 또 한 번 기회를 줬지만 Nano Banana는 여전히 실패했다.
난이도를 계속 높였습니다. 저커버그와 머스크의 초상 사진과 풍경 사진 한 장을 업로드하고, Nano Banana가 두 사람을 세 번째 사진에 자연스럽게 배치하도록 했습니다.
Gemini 2.0 flash가 생성한 결과물은 두 유명인을 전혀 알아볼 수 없었지만, Nano Banana는 두 사람을 세 번째 사진 환경에 완벽하게 녹아들게 했습니다. 다만 손가락 같은 세부 부분에는 여전히 결함이 있었습니다.
고급 활용법
Nano-Banana와 구글의 Veo3를 결합하면 어떤 시너지가 발생할까?
@a16z 파트너 저스틴 무어(Justine Moore)가 긴 영상 제작을 위한 새로운 워크플로우를 선보였다.
아래 영상은 게임이나 영화 속 잠입 미션 장면으로, 어두운 박물관에서 명화를 훔치던 캐릭터가 레이저 경보를 작동시키는 장면이다.
그녀는 제작 튜토리얼도 공개했습니다. 첫 번째 영상 클립의 마지막 프레임을 추출해 lmarena의 Nano Banana에 업로드한 후, “캐릭터가 복도로 방향을 돌린다”와 같은 다음 장면 생성을 요청합니다. 이후 새로 생성된 프레임을 Veo 3로 애니메이션화합니다.
X 사용자 @ZHO_ZHO_ZHO는 Nano-Banana의 또 다른 재미있는 활용법을 발견했는데, 일러스트를 피규어로 변환하는 것입니다.
사진 한 장을 업로드하고 프롬프트를 입력합니다: “이 사진을 캐릭터 피규어로 변환하세요. 뒤쪽에는 캐릭터 이미지가 인쇄된 박스와 화면에 Blender 모델링 과정이 표시된 컴퓨터를 배치하세요. 박스 앞쪽에는 캐릭터 피규어가 서 있는 둥근 플라스틱 받침대를 추가하세요. PVC 재질을 투명하게 표현하고 가능하면 실내 장면으로 설정하세요.”
해당 블로거의 평가에 따르면, Nano-Banana가 생성한 이미지는 AI 특유의 느낌이 거의 없으며, 얼굴 생김새와 디테일이 잘 보존되어 현실감이 매우 뛰어납니다.
그런 다음 Veo3를 사용해 이를 8초짜리 영상으로 제작했습니다. 프롬프트: 양손으로 피규어를 들어 올리고 모든 각도에서 보여주세요.
댓글란에는 많은 네티즌들이 위 작업 흐름을 따라 재미를 본 사례가 있습니다. 예를 들어 나타가 양손을 모은 모습:
또 도라에몽의 경우, 정면에서 보면 꼬리가 정상적이지만 돌아서면 완전히 달라집니다:
저희도 재현해 보았습니다. 큐판 일러스트 이미지를 업로드하고 위 프롬프트를 입력했습니다.
결과는 다음과 같습니다:
마지막으로 Gemini 2.5 Pro를 열고 Video를 선택한 후 생성된 이미지를 업로드하고 프롬프트를 입력한 뒤 약 1분 정도 기다리면 8초짜리 동영상을 얻을 수 있습니다.
지난 주말, 구글 Veo 3가 모든 Gemini 사용자에게 무료로 개방되어 AI 동영상 생성 기능을 체험할 수 있게 되었습니다.
다만 이 무료 체험은 태평양 표준시 기준 8월 24일 밤 10시(한국 시간 8월 25일 오전 1시)까지만 가능합니다. 이 기간 동안 무료 사용자는 하루 최대 3개의 8초 동영상 클립을 생성할 수 있으며, 각 동영상에는 자동 생성된 오디오가 포함됩니다.
일반적으로 Veo 3의 동영상 생성 기능은 Google AI Pro 또는 Ultra 구독자만 이용할 수 있습니다. Pro 사용자는 하루에 3개, Ultra 사용자는 10개의 동영상을 생성할 수 있습니다.
관심 있는 분들도 한번 경험해 보세요.
https://x.com/ginacostag_/status/1959234207127134340
https://x.com/venturetwins/status/1957155767888548160
https://x.com/techhalla/status/1959186906115354692
https://x.com/ZHO_ZHO_ZHO/status/1958550998815023573