AI 기반 텍스트-이미지 생성 모델은 어디에나 있으며 매일 더 쉽게 접근할 수 있습니다. 웹사이트를 방문하여 원하는 이미지를 생성하는 것은 쉽지만, 생성 프로세스를 더 많이 제어하고 싶다면 오픈소스 텍스트-이미지 생성기가 최선의 선택입니다.
인터넷에는 특정 종류의 이미지를 전문으로 하는 수십 개의 무료 오픈소스 AI 텍스트-이미지 생성기가 있습니다. 그래서 우리는 더미를 걸러서 지금 당장 시도할 수 있는 최고의 오픈소스 AI 텍스트-이미지 생성기를 찾았습니다.
1크레용
Craiyon은 가장 쉽게 접근할 수 있는 오픈소스 AI 이미지 생성기 중 하나입니다. DALL-E Mini를 기반으로 하며 Github 저장소를 복제하여 컴퓨터에 로컬로 모델을 설치할 수 있지만 Craiyon은 웹사이트를 선호하여 이 접근 방식을 포기한 것으로 보입니다.
공식 Github 저장소는 2022년 6월 이후로 업데이트되지 않았지만 최신 모델은 공식 Craiyon 사이트에서 여전히 무료로 제공됩니다. Android나 iOS 앱도 없습니다.
기능 면에서는 AI 이미지 생성기에서 기대하는 모든 일반적인 옵션이 표시됩니다. 프롬프트를 입력하고 이미지를 받으면 업스케일 기능을 사용하여 더 높은 해상도의 사본을 얻을 수 있습니다. 선택할 수 있는 스타일은 아트, 사진, 드로잉의 세 가지가 있습니다. 모델이 결정하도록 하려면 “없음” 옵션을 선택할 수도 있습니다.

또한, “전문가 모드”를 사용하면 부정적인 단어를 포함할 수 있으며, 이는 모델이 특정 항목을 피하도록 알려줍니다. 또한 ChatGPT를 사용하여 사용자가 가능한 가장 좋고 자세한 프롬프트를 작성하도록 돕는 프롬프트 예측 기능도 있습니다. 마지막으로, AI 기반 배경 제거 기능을 사용하면 이미지에서 배경을 잘라내는 데 드는 시간과 노력을 절약할 수 있습니다.
그리고 그게 Craiyon이 하는 전부입니다. 가장 정교한 AI 이미지 생성 모델은 아니지만, 세부적이거나 현실적인 것을 원하지 않는다면 기본 모델로는 잘 됩니다.
이 모델은 무료로 사용할 수 있지만, 무료 사용자는 1분 이내에 한 번에 9개의 무료 이미지로 제한됩니다. Supporter 또는 Professional 티어(각각 월 $5 및 $20, 연간 청구)에 가입하면 광고나 워터마크가 없고, 더 빠르게 생성되며, 생성된 이미지를 비공개로 유지할 수 있는 옵션을 얻을 수 있습니다. Custom 구독 티어는 또한 사용자 정의 모델, 통합, 전담 지원 및 개인 서버를 허용합니다.
2안정 확산 1.5
Stable Diffusion은 아마도 가장 인기 있는 오픈소스 텍스트-이미지 생성 모델 중 하나일 것입니다. 또한 아래에 언급된 세 가지 이미지 생성기를 포함한 다른 모델에도 동력을 제공합니다. 2022년에 출시되었으며 그 이후로 많은 구현이 있었습니다.

모델이 어떻게 작동하는지에 대한 지나치게 기술적인 세부 사항은 생략하겠습니다(공식 Github 저장소에서 확인할 수 있음). 하지만 이 모델은 완전한 초보자라도 설치하기 쉽고 최소 4GB 메모리가 있는 전용 GPU가 있는 한 잘 작동합니다. 또한 Stable Diffusion을 온라인에서 액세스할 수 있으며, Mac에서 Stable Diffusion을 실행하려는 경우 저희가 도와드리겠습니다.
Stable Diffusion에 사용할 수 있는 체크포인트(버전이라고 생각하세요)가 여러 개 있습니다. 버전 1.5를 테스트했지만 버전 2.1도 활발하게 개발 중이며 더 정확합니다.

모델을 실행하는 것도 꽤 쉽습니다. AUTOMATIC1111 Stable Diffusion 웹 사용자 인터페이스로 테스트했고, 모든 컨트롤과 매개변수가 잘 작동합니다. 또한 모델이 학습한 LAION-5B 데이터베이스 덕분에 NSFW에 상당히 안전합니다(물론 완벽하지는 않지만요). 생성 시간 자체는 하드웨어에 따라 다르지만, 기본 프롬프트를 사용하더라도 이미지가 자세하고 사실적일 것으로 기대할 수 있습니다.
3드림셰이퍼
DreamShaper는 Stable Diffusion을 기반으로 하는 이미지 생성 모델입니다. MidJourney의 오픈 소스 대안으로 의도되었으며 생성된 이미지의 포토리얼리즘에 초점을 맞추지만 약간의 조정으로 애니메이션과 페인팅 스타일도 마찬가지로 잘 처리할 수 있습니다.
이 모델은 Stable Diffusion보다 더 유능하여 사용자에게 최종 출력에 대한 자유도를 더 많이 허용하는데, 번개 개선에서 더 느슨한 NSFW 제한에 이르기까지 다양합니다. 모델 실행도 간편하며, 로컬 액세스를 위해 온라인에서 다운로드 가능한 사전 학습된 버전과 Sinkin.ai, RandomSeed, Mage.space(기본 구독 필요)를 포함한 여러 웹사이트에서 GPU 가속으로 모델을 실행할 수 있습니다.

아마 지금쯤은 짐작하셨겠지만, DreamShaper에서 생성된 이미지는 Stable Diffusion에 비해 더 사실적으로 보입니다. 두 모델에서 동일한 프롬프트를 실행하더라도 DreamShaper 모델이 더 사실적이고, 세부적이며, 더 밝을 가능성이 높습니다.
특히 초상화나 캐릭터의 경우, 저는 Stable Diffusion이 같은 프롬프트에 비해 부족하다고 생각했습니다. 이미지가 너무 사실적으로 보인다면 AI가 생성한 이미지를 식별하는 네 가지 방법이 있습니다.
모델을 실행하려면 거대한 PC가 필요하지 않습니다. 4GB VRAM이 장착된 저의 GTX 1650Ti가 모델을 완벽하게 실행했습니다. 생성 시간은 약간 더 길었지만 실제 출력에는 영향을 미치지 않는 듯했습니다. 그러나 Stable Diffusion XL 모델을 기반으로 하는 DreamShaper XL을 실행하려면 더 많은 VRAM이 장착된 GPU가 필요할 수 있습니다.
4인보크AI
Invoke AI는 Stable Diffusion을 기반으로 한 또 다른 AI 기반 이미지 생성 모델로, Stable Diffusion XL을 기반으로 한 XL 버전이 있습니다. 또한 자체 웹 및 명령줄 사용자 인터페이스가 있어 Stable Diffusion 웹 UI와 같은 것들로 고생할 필요가 없습니다.

이 모델은 사용자가 사용자 지정 워크플로를 통해 지적 재산을 기반으로 비주얼을 만들 수 있도록 하는 데 중점을 둡니다. InvokeAI는 사용자 지정 모델을 훈련하고 지적 재산을 다루는 데 가장 적합한 오픈소스 AI 이미지 생성 모델 중 하나입니다.
공식 Github 저장소에는 두 가지 설치 방법이 나열되어 있습니다. InvokeAI 설치 프로그램을 통해 설치하는 방법과 터미널과 Python에 익숙하고 모델과 함께 설치되는 패키지를 보다 세부적으로 제어하고 싶은 경우 PyPI를 사용하는 방법입니다.
그러나 추가 제어는 몇 가지 제한을 가져오는데, 가장 두드러지게는 더 엄격한 하드웨어 요구 사항입니다. InvokeAI는 최소 4GB의 메모리가 있는 전용 GPU를 권장하며, XL 변형을 실행하려면 6~8GB가 권장됩니다. VRAM 요구 사항은 AMD와 Nvidia GPU에 모두 적용됩니다. 또한 모델, 종속성 및 Python을 위해 최소 12GB의 RAM과 12GB의 여유 디스크 공간이 필요합니다.

설명서에는 비디오 메모리가 부족해서 Nvidia의 GTX 10 시리즈와 16 시리즈 GPU를 권장하지 않지만 제공된 설치 프로그램은 잘 실행되었습니다. 마일리지는 다를 수 있지만 하위 GPU를 사용하는 경우 프롬프트가 이미지로 바뀌는 것을 보려면 더 오래 기다려야 합니다. 마지막으로 Windows를 사용하는 경우 현재 AMD GPU를 지원하지 않으므로 Nvidia GPU만 사용할 수 있습니다.
이미지 생성 부분에서 모델은 포토리얼리즘보다는 예술적 스타일에 더 기울어지는 경향이 있습니다. 물론, 데이터 세트에서 모델을 훈련시키고 원하는 것에 더 가까운 이미지를 생성하도록 할 수 있습니다. 특히 제품 디자인, 건축 또는 리테일 공간에서 작업하는 경우 포토리얼리즘 이미지가 포함되더라도 말입니다. 그러나 염두에 두어야 할 중요한 사항 하나는 InvokeAI가 기본적으로 이미지 생성 엔진이라는 것입니다. 즉, 기본 모델이 Stable Diffusion 자체와 매우 유사하기 때문에 최상의 결과를 얻으려면 자체 모델을 사용해야 할 가능성이 높습니다(웹 인터페이스에서 제공하는 모델 관리자를 통해 쉽게 찾을 수 있음).
5오픈저니
Openjourney는 다시 한번 Stable Diffusion을 기반으로 하는 무료 오픈소스 AI 이미지 생성 모델입니다. 왜 모델이 Openjourney라고 불리는지 궁금하시다면, Midjourney 이미지에서 학습되었고 생성하는 이미지에서 Midjourney 스타일을 모방할 수 있기 때문입니다.
Openjourney를 만든 회사인 PromptHero는 Stable Diffusion(버전 1.5 및 2), DreamShaper, Realistic Vision을 포함한 다른 모델과 함께 모델을 테스트할 수 있도록 합니다. 가입 시 25개의 무료 크레딧(생성된 이미지당 1개의 크레딧)을 받고, 그 후에는 월 9달러의 비용이 드는 Pro 구독 계층에 가입해야 하며, 다른 독점 기능과 함께 매달 300개의 크레딧에 액세스할 수 있습니다.

하지만 로컬에서 무료로 실행하려면 HuggingFace에서 모델 파일을 다운로드하고 Stable Diffusion 웹 UI를 사용하여 실행할 수 있습니다. Openjourney는 Stable Diffusion 바로 뒤를 이어 HuggingFace에서 두 번째로 많이 다운로드된 AI 이미지 생성 모델이기도 합니다.
Openjourney는 웹사이트에 모델을 로컬로 실행하기 위한 특정 하드웨어 요구 사항을 나열하지 않았지만, Stable Diffusion과 유사한 하드웨어 요구 사항을 기대할 수 있습니다. 즉, 모델과 종속성을 저장하기 위해 4GB VRAM, 16GB RAM, 컴퓨터에 약 12~15GB의 여유 공간이 있는 전용 GPU가 필요합니다.

Openjourney에서 생성된 이미지는 달리 명시되지 않는 한 포토리얼리즘과 아트 사이에서 균형을 이루는 경향이 있습니다. 전반적인 모델을 찾고 구독료를 내지 않고 Midjourney의 모양과 느낌을 선호한다면 Openjourney는 최고의 옵션 중 하나입니다.
우리의 활동을 지원해주세요 ❤️
이 글이 마음에 드셨다면, 앞으로도 좋은 콘텐츠를 계속 발행할 수 있도록 팁을 남겨주세요.






















