
GPT Image 2.5 역대급 이미지 생성 모델 (후방주의)
요약
GPT Image 2.5가 출시되면서 이미지 생성 모델의 성능이 크게 향상되었습니다. 특히 객체와 인물의 위치 유지(포징), 일관성 있는 규격 유지, 그리고 영상화 과정에서의 안정성이 혁신적으로 개선된 점이 주목됩니다. 이는 디자인 및 콘텐츠 제작 워크플로우에 큰 변화를 가져올 것으로 기대됩니다.
핵심 포인트
- 객체/인물 포지션과 규격 유지가 매우 정확해짐.
- 영상으로 변환해도 위치 변경이나 왜곡 현상이 거의 없음.
- 텍스트, 로고 등 세부 요소의 수정 및 삽입이 용이함.
- 전반적인 이미지 생성 품질과 일관성이 대폭 향상됨.
Video: GPT Image 2.5 역대급 이미지 생성 모델 (후방주의)
Channel: 코드팩토리
Duration: 14m 26s
Source: subtitle (auto, ko)
Transcript:
아, 좋은데. 쏘as지. 자, 예상외로 재미나이가 이미지 모델을 내기 전에 GPT가 먼저 신규 모델을 냈어요. 그래서 제가 한번 테스트를 해 봤는데 어, 여러분들한테 다양한 형태를 조금 보여 드리기 위해서 이번에 두 개 모델이 나왔거든요. 제가 한번 전부 다 테스트를 한번 해 봤습니다. 자, 이거를 리뷰를 해 드리기 전에 일단은 오픈해야에서 무슨 얘기를 하는지 한번 봐 보도록 할게요. 자, 웹사이트 아주 기가 막히게 하나 만들어 줬고요. 자, 디테일이 더 좋아졌고 훨씬 더 빨리 생성됐고 그리고 훨씬 더 정확하게 수정이 된다. 저는 전부 동의합니다. 이따 결과물에서도 보여 드릴 건데. 자, 이게 입력한 거고. 자, 이게 2.5가 보정을 해 준 거예요. 얼굴 보세요. 얼굴과 몸이 거의 그대로 그 위치에 있는 거를 볼 수가 있죠. 자, 이게 GPT2에서는 GPT 이미지 2에서는 잘 안 되던 요소인데 어떤 이미지를 그대로 줬을 때 약간 약간씩이 사물과 사람의 포지션이 바뀌던 문제가 있었어요. 그거 좀 있다 또 보여 드릴 건데.
자, 여기도 보면은 정확하게 똑같은 거 볼 수 있죠. 어마어마하죠? 자, 여기도 마찬가지요. 엄청 크롭 잘됐죠? 그냥 완전 똑같은 사람이에요. 자, 그리고이 세 명의 사람을 2006년에 찍은 사진처럼 자, 이렇게 만들어 달라고 했는데 아주 잘 나왔고요. 자, 침대. 자, 인테리어. 자, 저도 이거를 되게 테스트를 많이 해 봤었는데 투 때도 이거는 잘 됐지만 확실히 문제가 있었던게 위치가 계속 바뀌었어요. 규격도 바뀌었고요. 그런데 그게 진짜 거의 없어졌다. 지금 보면은 알 수 있듯이 완전 규격이 똑같아요. 근데 실제로 그렇습니다. 우리가 써 보면은. 자, 제가 방금 말씀드린 거를 증명하는 건데 왼쪽이 이미지 2로 만든 거고요. 오른쪽은 이미지 2.5로 만든 겁니다. 자, 똑같은 이미지를 넣고서 다르게 에디팅을 하라고 우리가 여러 개의 이미지들을 생성을 한 다음에 영상으로 돌린 건데 자, 이미지 2는 조금씩 이렇게 계속 움직이는 걸로 볼 수가 있잖아요. 그죠? 그래서 우리가 이게 문제가 어떤 때 문제가 생기냐면은 그냥 이미지만 쓸 때는 큰 문제가 없는데 얘를 지금이 영상에서처럼 영상으로 돌려서 카툰 같은 거를 만들고 싶다 예를 들어서 그러면은 자꾸 위치가 변경이 되니까 굉장히 에디팅이 귀찮아지거든요.
자, 근데 이제는 그런 문제가 전혀 없다라는 엄청난 혁신이 생겨 버렸고요. 자, 멀티시티 티켓. 자,이 안에 있는 글자와 사진들만 딱 정확하게 변경되는 거 보이죠? 어마어마합니다. 자, 큐브 로테이션도 자, 마찬가지로 우리가 조금씩 돌리면서 몇도 돌리고 이미지 하나 만들어. 어, 몇도 돌리고 또 이미지 하나 만들어라고 한 건데. 자, 이미지 2 같은 경우에는 엄청나게 왔다 갔다 하는 걸 볼 수가 있어. 규격도 달라지고 있고. 근데 이미지 2.5는 거의 자연스러울 정도로 완전 똑같이 만들어지고 있다. 약간 개선할 여지는 분명히 조금 있어 보이긴 합니다. 이거는 각도가 돌아가는 것 때문에 어쩔 수가 없는 거 같아요. 자, 글자를 표현하는 능력치. 자, 이거 그냥 이미지로 만들어 버린 겁니다. 자, 뭐 삭제하고 뭐 변경해라 이런 것들이 전부 이제 우리가 그냥 직접 디자인을 할 필요 없이 그냥 이미지로 찍어내 버리면 되는 상황이 된다는 겁니다. 자, 생일 촛불 켜는 거 완전 똑같죠? 위치가 말도 안 됩니다. 2에선 진짜 우리가 상상도 할 수 없었던 일이죠.
자, 그래서 이런 식으로 포스터도 결과물들 이렇게 보여 주고 있는데 정말 똑같이 이렇게 여덟 개가 완전 100% 일치하게 만들어지는 거 볼 수가 있고요. 파워포인트 같은 걸 우리가 생성을 한다라고 하면은 훨씬 더 정확하게 우리가 할 수도 있겠죠. 자, 이렇게 그림을 대충 그려 가지고 생성을 해 달라고 하는 것도 굉장히 잘 되고요. 자, 그럼 제가 만들어 본 거 한번가 볼 건데 제가 지금 생성한 거는 자,이 이미지부터 전부 다 2.5예요. 제가 뭘 했냐면은요.이 이미지를 넣고요. 프롬프트는이 이미지는 서울 야경이야. 이 똑같은 구도 똑같은 위치가 치밀 때 모습을 그려 줘라고 했습니다. 자,이 이미지를 이렇게 그린 거예요. 자, 여기서 여러분이 아셔야 되는 거는 GPT 이미지 2.5가 선버스트 모델이 있고 플리어 모델이 있습니다. 자, 선버스트 모델은 고급 모델이고 플리어 모델은 속도가 더 빨라진 모델이에요. 기존 GPT2랑 똑같은 퀄리티를 자랑을 하는데 속도는 두 배 빨라졌다라고 이야기를 해요. 자, 그래서 지금 선버스트 모델로 만들어 낸 거고 계속 돌리면서 보더라도 정말이 끝에 있는 디테일까지 잘 살린 거를 볼 수가 있어요.이 이 산도 그죠?
자,이 산 이렇게 들어가 있는 거 정말 잘 살렸죠. 그냥 완전 똑같은 이미지 같아요. 자, 다리 같은 경우도 디테일 정말 잘 살렸고요. 그죠? 그래서 진짜 아침에 찍은 거 같은 느낌이 듭니다. 자, 그리고이 왼쪽 코너에 있는 자,이 건물이 건물 디테일도 정말 잘 살렸죠? 자, 그렇게 제가 이제네 개를 생성을 해 봤고 자, 여기는 해가 뜨는 모습을 또 이렇게 했네요. 자, 여기에서 이제 섀도우까지 잘 들어간 거 볼 수가 있어요. 자, 이게 이제 선버스의 작품이고 자, 이거는 플레이어 한번 봐 볼게요. 자, 플레어 같은 경우에는 퀄리티는 GPT 이미지 2랑 똑같은데 자, 보면 이제 플레이어 썼죠. 자, 그런데 속도가 되게 빠르다. 자, 이따 속도도 보여 드릴 건데 진짜 속도가 어마어마하게 빠르긴 합니다. 자, GPT2랑 같은 퍼포먼스이기 때문에 보면은 제 여기 마크가 조금 깨진 거 볼 수가 있죠. 그죠? 자, 원본 이미지를 보면은 여기에 그냥 한 일자로 돼 있는 뭐가 이제 들어가 있는 거 같은데. 자, 여기는 확실히 뭐가 잘못 들어갔어요.
그죠? 뭔가 살짝 깨졌습니다. 자, 그런데 우리가 선버스트로가 보면은 그냥 정확하게 표현이 된 거를 볼 수가 있습니다. 네모나게. 그래서 확실히이 정확도에 대한 차이가 있다라는 걸 볼 수가 있고요. 자, 이거는 이제 저의이 따봉 사진을 넣고서이 사람으로 멋지게 배우 프로필 사진을 만들어 줘라고 했는데 지금 이렇게 나왔고요. 자, 보면은 제 사진을 이렇게 딱 넣더라도 제 얼굴 그냥 주름까지 전부 다 그대로 표현을 했고 머리 스타일의이 웨이브까지 완전 똑같이 잘 표현이 된 거를 볼 수가 있어요. 자, 심지어 여기저기 조금 여드름 나 있는 것까지 다 디테일을 살려 줬거든요. 뭐 그것까지 할 필요는 없는 거 같은데. 어쨌든 이제 선버스트 모델 사용해 가지고 자, 이렇게 만들어졌다. 자, 그리고 선버스트 모델을 또 써 가지고 자,이 되게 유명한 사진이죠. 자, 이걸 컬러로 복원해 줘라고 했는데 컬러로 이렇게 복원이 됐고요. 원금강까지 자, 이렇게 아웃포커싱 되는 것까지 정말 잘 표현이 된 거를 볼 수가 있습니다.
자, 마찬가지로 선버스트 모델 사용을 했고요. 자, 이거는 이거는 레퍼런스 안 줬어요. 그냥 어, 필라테스 하고 있는 한국인 여자만 들어줘라고 했는데 아, GPT가 한국에서 필라테스 하면은 어떻게 해야 되는지를 정확하게 알고 있는 거 같아요. 자,이 친구도 똑같은 친구죠. 자, 이렇게 생성이 됐고요. 자, 똑같은 사람은 아닙니다. 왜냐면 이제 독립적으로 생성을 했기 때문에 최근에 되게 핫했던 이슈가 있었죠. 다른 사람의 웨딩 사진인데 그거를 넣고서 남의 웨딩 사진에다가 얼굴만 나랑 내 와이프 사진으로 편집을 해 버려서 걸려 가지고 막 이슈가 됐던 적이 있는데 자, 그래서 저도 한번 해 봤어요. 자, 제가 이미지를 자,이 친구랑이 가상의이 친구랑 자, 저를 이제 프로필 사진으로 만들었던이 사진으로 넣어 가지고이 두 사람의 웨딩 사진 만들어 줘. 가장 흔한 형태로라고 한 다음에 선버스트로 한번 만들어 봤거든요. 자, 그러니까 이렇게 만들어줬고요. 자, 심지어이 아웃포커싱까지 다 표현이 잘 됐죠. 근데 뭔가 저는 여기에서 살짝 아직은 이질감이 드는게 얼굴은 되게 많이 왔는데 자이 얼굴이 지금 여자가 어색해 보이는 거는 너무 인조적으로 그려서 그렇기는 하거든요.
이거는 조금 다듬으면 사실 GPT2 때도 굉장히 자연스럽게 가져갈 수가 있기는 해요. 생긴 거 자체가 조금 살짝 부자연스러워서 그런데 저는 그것보다도 지금이 제 옷에 붙어 있는이 꽃 있죠? 자, 이게 디테일이 너무 강한 거 같은 느낌이에요. 그니까 너무 현실보다도 더 현실 같은 느낌이랄까요? 그래서 조금 AI 느낌이 더 나지 않나? 이것만 만약에 뺐으면은 어 굉장히 좀 설득력 있는 생성된 얼굴 같다라는 것만 제외하면은 설득력 있는 사진이지 않을까라는 생각이 들고요.이 사진을 넣고서 남자 헤어스타일만 바꿔 줘라고 했는데 자희가 아까 오픈해 봤던 것처럼 지금 이게 전이고 이게 후거든요. 지금 모든 요소들이 원래 있었던 그 자리에 그대로 있는 거 볼 수가 있어요. 그렇죠? 완전 똑같죠? 수정하는 능력이 정말 뛰어나졌다라고 여러분들이 확실하게 판단할 수 있을 것 같고. 음. 감사하게도 살도 좀 빼줬네. 그리고 여기는 오히려 꽃이 괜찮은 거 같아요. 살짝 포커스가 너무 뚜렷한 느낌이 아니라서 좀 더 설득력이 있는 거 같습니다.
자, 그다음에 뭐 해 봤냐면요. 제가 이렇게 그림을 그냥 그려 봤어요. 자, 이렇게 그림을 그려 가지고 실제 서울에 한 건물의 실사 정면샷 만들어 줘라고 하고서 제가 선버스트 사용해 가지고 요청을 했더니 자, 이렇게 디테일이 나왔고요. 자, 이렇게 차 오른쪽에 해떠 있는 거. 그리고 창문 두 개에다가 문 하나 이렇게 있는 거 잘 그려진 거 볼 수 있죠? 자, 여기다 제가 사람을 그렸었는데 네, 이렇게 제대로 들어간 걸 볼 수가 있습니다. 자, 심지어 근데이 위에 있는 창문은 정사각형에 가까운데 밑에는 조금 길게 그렸죠? 자, 그 디테일까지 다 살려줬어요. 자, 그렇게 제가 이제 선버스트로 두 개를 이거랑 생성을 해 봤고 자, 이것도 플레이어를 사용을 했을 때 어떨까 생각이 들어서 플레어로 이렇게 하나 그리고 자, 이렇게 생성을 해 봤습니다. 자,이 부분에서는 사실 자, 건물 관점에서는 사실 큰 문제가 없었는데 자, 여기 뒤에 보면은 서올이라고 써져. 자, 한국어가 제대로 안 들어간 거를 볼 수가 있고요.이 선버스트가 한 작업을 우리가 보면은요.
자, 이거거든요. 자, 확대를 해 보면은 엄청나게 확대를 했는데도 자, 이렇게 숫자가 정확하게 들어간 거를 볼 수가 있어요. 자, 그리고 일부러 의도를 한 건지 모르겠지만 자, 확실히 서울이라고 써져 있는게 보이긴 하거든요. 자, 여기 페인트가 좀 나간 거 같은 어자가 페인트가 좀 나간 거 같이 이렇게 표현이 됐는데 아까 전에 플레어가 생성을 했던 이미지에서 한글이 조금 상대적으로 굉장히 부족했던 거에 비해서 거의 비슷한 사이즈인 거 같은데 선버스는 굉장히 잘 표현한 걸로 볼 수가 있습니다. 자, 그다음에 뭐 해 보냐면은 또 플레이어를 사용을 해 가지고요. 제가 이미 만들어 놨던이 이미지에다가 자, 첫 번째 이미지의 오른쪽 차니까 자, 이거죠. 자,이 검정색 차를 두 번째 첨부한 빨간 포르쉐 911로 변경해 줘. 자,이 차를 제가 넣고서이 두 개의 이미지를 넣고서 차만 변경해 달라고 했더니 변경이 돼서 들어간 거를 볼 수가 있습니다. 자, 심지어 번호판도 완전 깔끔하게 들어갔고요. 전혀 어색함이 없죠.
자, 커피라는 글자도 이렇게 정확하게 작성이 된 거를 볼 수가 있어요. 자, 그런데 역시나이 글자가 조금 뭔가 너무 쨍한 거 같은 느낌. 이렇게까지 쨍하게 나오면 이제 너무 현실적이지 않은데 너무 쨍한 거 같은 느낌. 그런 느낌이 조금 있는 거 같아요. 자, 그래서 플레이어로 자, 이렇게 두 개 생성해 봤고 선버스트로도 자, 이렇게 생성을 해 봤습니다. 선버스트, 선버스트. 자, 그다음에 여긴 뭐 해 봤냐면요. 자,이 건물을 사옥으로 한번 꾸며 보려고 제 로고를 넣어 주고요. 이렇게이 선버스트로 저희가 생성을 했던이 건물을 그대로 넣었습니다. 그랬더니 자, 이렇게 만들어줬고 자, 원본 사진. 자, 지금 새로운 사진. 오픈에 주장을 했던 대로 건물 진짜 하나도 안 움직였죠? 자, 왼쪽 사람도 봐 보세요. 사람 하나도 안 움직였죠? 자, 차 봐 보세요. 차 하나도 안 움시겠죠? 약간 변경된 디테일은요. 좀 밝아졌잖아요, 여기가. 자, 살짝 이것도 좀 쨍한이 느낌이 좀 부자연스럽긴 한데 자,이 빛 때문에 빛을 표현하면서 살짝 조금 더이 주변이 밝아진 거 같은 느낌이 드는 거 빼고는 진짜 완전히 다른 요소들은 그대로 지켜졌습니다.
놀라울 정도로요.이 나무 디테일을 봐 보세요. 나무가 나뭇잎 하나도 안 바뀌 있어요. 정말 신기하지 않나요? 어마어마한 능력치를 갖고 있는 이미지 제너레이션 모델은 맞다라고 평가를 할 수가 있을 것 같습니다. 자, 다음으로론 제가 제가 항상 이미지 제너레이션 모델이 새로 나올 때마다 테스트를 하는 건데 한글로 쓴 책 제가 한번 표현을 해 보라고 했고요.이 조금 재밌는게 기존 모델에서선 없던 건데이 책에 조금 울음 있죠? 뭔가 좀 많이 만지면은 살짝 부분부분 살짝 우는 느낌 그게 들어가 있거든요. 이게 고위인지 아니면은 실수인지 모르겠는데 제가 생성한네 개 이미지에 모두 다 들어가 있어요. 자, 여기도 들어가 있죠. 자, 여기도 들어가 있죠. 그죠? 자, 이런 느낌이 조금 이제 들어가 있고요. 자,이 책도 제가 선버스트랑 플레어랑 따로 써 봤는데 자, 오른쪽 두 개가 선버스트고요. 왼쪽 두 개가 플레어입니다. 자, 플레어부터 볼게요. 자, 플레어 같은 경우에는 저기 바라보고에서 이제 라가 엄청 크게 표현됐죠.
여기서 뭔가 잘못된 거 같은 느낌이요. 그죠? 이것보다 작게 돼야 될 거 같은데. 자, 그리고 너를 좋아해서 원래는이 조화의 젖이이 히이 원래 잘 표현이 안 되는 현상이 되게 컸었는데 자, 이거는 좀 그래도 잘 표현이 된 거 같습니다. 자, 그런데 여기 흘러내리는니 조금 홀러내리는처럼 작성이 된 거 같고요. 자, 그리고 역시나 이제 플레이어로 생성된 거 하나 다 보면은이 바라보았다의 보호 밑에 이상한 밑줄이 꺼져 있죠. 자, 이런 조금 문제가 있고. 자, 늦었지도 치받침이 아니라 지읍받침이어야 되는데 치받침이 들어간 거 볼 수가 있죠. 자, 근데 안 왔다. 자, 이런 거 원래 잘 안 됐었는데 이번에 잘 들어간 거를 볼 수가 있어요. 자, 그러면 선버스트. 자, 최상이 모델의 표현을 한번 봐 볼 건데 그냥 딱 봐도 훨씬 더 잘 되긴 했습니다. 자, 여기서 소중한지가 약간 이제 종인지 중인지 모르겠는 느낌으로 작성이 된 거 있지만 자, 여기 빛이라는 글자 정말 잘 나왔고요. 괜찮을 해서 찬 정말 잘 나왔고요.
자, 두 번째 보면은 상쾌했다. 자, 상쾌했다. AI한테 정말 어려운 글자거든요. 근데 잘 나왔고요. 자, 젖은 약간 치으신지 지으인지 모르겠 조금 나왔습니다. 자, 그래서 역시나 아직 한국어는 조금 선버스트까지 쓰더라도 아쉬운 점이 분명히 있긴 있어요. 크기를 줄이면 줄일수록 표현하기 조금 어려워하는 거 같고 충분히 큰 글자들은 이제는 거의 구분하기 힘들 정도로 정말 잘 써내는 거 같다라는게 이제 저의 판단입니다. 자, 그리고 오늘은 이미지 갖고서 작업을 하지만 우리 익스필드에서는 이제 바로 영상까지 만들 수 있거든요. 자, 그래서이 이미지를 제가 영상으로 한번 만들어 봤어요. 재생 한번 해 볼게요. 네. 이런 식으로 들어갔습니다. 자, 그래서 제가 이렇게 다양한 모델을 한번 테스트를 해 봤고요. 어, 제 생각에는 이제 한 세대 정도만 올라가게 되면 여기서 메이저 버전이 만약에 바뀐다. GPT 이미지 3가 나온다라고 하면 제 생각에는 그때는 정말 현실이랑 거의 아예 구분할 수 없을 정도의 이미지 생선 기술이 나오지 않을까라는 생각이 듭니다.
자, 그때 제 생각에 해결해야 될 거는 조금 너무 쨍한 거. 그니까 너무 현실보다 더 현실 같이 너무 포커스가 완벽한 거 같은 느낌이랄까요? 자, 그런 것만 조금 없앨 수가 있다면은 예를 들어서 지금이 얼굴의 포커스와이 발의 포커스가 똑같은 거 같은 느낌이거든요. 근데 그게 조금 차이가 있어야 되는데 그런게 잘 표현이 덜 되는 거 같아요. 그래서 그런 것들이 만약에 해결이 되면은 진짜 엄청나지 않을까라는 생각이 듭니다. 자, 제가 지금 작업하고 있는 영상이 정말 많아요. 아스트라한테 게임도 시켜보고 있고 최근 나온 다양한 이슈들도 제가 이제 편집을 진행하고 있는데 AI 관련 영상 받아보고 싶으시면은 구독과 좋아요 알림 설정 그리고 하이까지 해 주시면은 앞으로 더 좋은 영상 올리도록 하겠습니다. 쏘as지.
AI 자동 생성 콘텐츠
본 콘텐츠는 코드팩토리의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기