알리바바 클라우드, 기업의 창의성과 생산성 향상을 지원하는 AI 이미지 생성 모델 통이완샹 공개

알리바바 클라우드, 기업의 창의성과 생산성 향상을 지원하는 AI 이미지 생성 모델 통이완샹 공개

사용자가 복잡한 AI 작업을 수행할 수 있도록 지원하는 모델스코프GPT도 출시되었습니다.

중국 상하이, 2023년 7월 7일 – 알리바바 그룹의 디지털 기술 및 인텔리전스 중추인 알리바바 클라우드가 오늘 세계 인공지능 컨퍼런스 2023에서 최신 AI 이미지 생성 모델인 통이 완샹(‘완샹’은 ‘수만 개의 이미지’라는 뜻)을 공개했습니다. 이 최첨단 생성 AI 모델은 현재 중국 내 기업 고객을 대상으로 베타 테스트가 진행 중입니다.

또한 클라우드 선구자는 사용자가 모델스코프의 다양한 AI 모델을 활용하여 언어, 시각, 음성 영역에서 복잡하고 전문적인 AI 작업을 수행할 수 있도록 설계된 다목적 프레임워크인 모델스코프GPT(ModelScopeGPT)의 출시를 발표했습니다. 모델스코프는 알리바바 클라우드가 작년에 도입한 오픈소스 서비스형 모델(MaaS) 플랫폼으로, 900개 이상의 AI 모델을 보유하고 있습니다.

“통이 완샹은 기업과 커뮤니티가 더 큰 창의성과 생산성을 발휘할 수 있도록 지원하는 패러다임 전환 기술을 지속적으로 탐색하는 과정에서 고급 생성 AI 모델을 추구하는 또 다른 중요한 이정표입니다.”라고 알리바바 클라우드 인텔리전스의 CTO인 징런 저우(Jingren Zhou)는 말합니다.

“통이 완샹의 출시로 고품질 생성 AI 이미지에 대한 접근성이 높아져 전자상거래, 게임, 디자인, 광고 등 다양한 분야의 비즈니스에서 혁신적인 AI 아트와 창의적인 표현을 개발할 수 있게 될 것입니다.”

이미지 생성을 위한 통이 완샹 소개

이 생성 AI 모델은 다양한 작업을 능숙하게 처리하며 중국어와 영어로 된 텍스트 프롬프트에 응답하여 수채화, 유화, 중국화부터 애니메이션, 스케치, 평면 일러스트레이션, 3D 만화까지 다양한 스타일의 세부 이미지를 생성할 수 있습니다. 또한 이 모델은 어떤 이미지든 유사한 스타일의 새로운 이미지로 변환할 수 있으며, 원본 이미지의 내용을 유지하면서 다른 그림의 시각적 스타일을 적용하는 스타일 전송을 통해 이미지를 스타일화할 수 있습니다.

지식 배열, 시각적 AI, 자연어 처리(NLP) 분야에서 선도적인 기술을 보유한 알리바바 클라우드의 기술을 기반으로 하는 이 모델은 다국어 자료를 활용하여 학습을 강화합니다. 이 모델은 강력한 의미 이해 능력을 자랑하며, 그 결과 보다 정확하고 맥락에 맞는 이미지를 생성할 수 있습니다.

또한 신호 대 잡음비를 기반으로 고해상도 확산 프로세스를 최적화하여 구도 정확도와 디테일 선명도 간의 균형을 맞추는 동시에 배경이 깔끔한 고대비의 시각적으로 멋진 이미지를 생성하는 기능을 향상시킬 수 있습니다.

통이 완샹은 이미지 합성 품질과 창의성을 유지하면서 공간 레이아웃과 팔레트 등 최종 이미지 출력을 보다 효과적으로 제어할 수 있는 알리바바 클라우드의 독점적인 대형 모델인 Composer를 사용하여 개발되었습니다.

통이 완샹의 텍스트-이미지 생성 예시

알리바바 클라우드, 기업의 창의성과 생산성 향상을 지원하는 AI 이미지 생성 모델 통이완샹 공개
Prompt: Picture a cityscape at twilight, a world merging modern architecture with the evocative aesthetics of anime.

O1CN01JbAB7M1odB0yEh0Dc_!!6000000005247-
Prompt: Beautiful nature superimposed into an infinite loop sign with bright colours

O1CN01tBx6cp22HYwcwZUGM_!!6000000007095-
Prompt: Immersive, captivating, grayscale coloring, featuring a tiger in the tranquil mandala forest. The image is composed of lines and brushstrokes.

O1CN01jv4lg41UhUQYBlJyg_!!6000000002549-
Prompt: A six-year-old girl’s beautiful and exquisite Chinese-style Hanfu is displayed in front of a clothes rack, medium close-up, 85mm lens

통이완샹의 데모 영상은 여기에서 확인할 수 있습니다: alizila.com/video/wach-how-alibaba-tongyi-wanxiang-creates-generative-ai-image/. 중국의 기업 고객은 다음 링크에서 통이 완샹의 베타 테스트를 신청할 수 있습니다: https://wanxiang.aliyun.com/.

Similar Posts

  • ChatGPT 플러스에 인터넷 접속 기능(베타)이 추가됩니다:

    금요일 OpenAI는 다음 주에 모든 ChatGPT 플러스 사용자에게 실시간 웹을 탐색하고 2021년 9월 이후의 정보에 액세스할 수 있는 기능을 포함한 70개 이상의 타사 플러그인을 배포할 계획이라고 트위터에 올렸습니다. 이러한 기능은 3월 말에 알파 버전으로 출시되었으며, Microsoft의 Bing AI와 Google의 Bard는 이미 한동안 인터넷에 접속하여 ‘불안정한 행동‘부터 1,000억 달러의 주가 폭락을 초래한 사실 오류에 이르기까지 다양한…

  • 500명 해고하는 Dropbox

    Dropbox는 AI 개발에 집중하기 위해 전체 직원의 약 16%에 해당하는 500명의 직원을 해고하는 등 운영 효율화를 추진하고 있습니다. CEO Drew Houston은 이번 결정이 고통스럽지만 회사의 미래를 위해, 그리고 AI 시대의 선두를 유지하기 위해 필요하다고 말합니다. 이러한 전환이 영향을 받는 사람들에게는 고통스러울 수 있지만, 점점 더 AI가 주도하는 세상에서 장기적인 성공을 거두는 데 도움이 될 수…

  • The DALL·E 2 Prompt Book. 달리 프롬프트

    DALL-E는 OpenAI에서 개발한 인공지능 프로그램으로, 텍스트 프롬프트에서 이미지를 생성할 수 있습니다. 82페이지 분량의 DALL-E 프롬프트 북 서비스를 통해 사용자는 프롬프트를 제출하고 이에 대한 응답으로 DALL-E가 생성한 이미지가 포함된 실제 책을 받을 수 있습니다. 이 서비스를 사용하려면 사용자가 ‘기타를 연주하는 고양이’와 같이 원하는 프롬프트를 제출하기만 하면 DALL-E가 이에 대한 응답으로 고유한 이미지를 생성합니다. 그런 다음 사용자는…

  • 슈퍼 히어로: stable diffusion

    ‘슈퍼히어로’라는 성별 없는 프롬프트를 넣었는데, 100장의 사진 중 80장은 여성 히어로가 나오는 신기한 경험을 했어요! priompt: clear portrait of a superhero concept, ice, background hyper detailed, character concept, full body, dynamic pose, intricate, highly detailed, digital painting, artstation, concept art, smooth, sharp focus, illustration, art by artgerm and greg rutkowski negative prompt: 2 heads, 2…

  • Snapchat의 인앱 챗봇이 예상보다 잘 작동하지 않습니다.

    지난 번에 스냅챗은 AI를 전격 도입했습니다. 스냅챗이 약간 실패한 것 같습니다. 몇 달 전에 자체 챗봇인 My AI를 Snap 앱에 도입했지만 별점 평가가 35%에서 75%까지 올라가고 챗봇에 대한 불만도 많이 제기되는 등 별다른 성과를 거두지 못하고 있습니다. 가장 큰 불만 중 하나는 실제 친구가 있어야 할 공간을 성가신 작은 봇이 차지하고 있다는 것입니다. 제 생각에…

  • 미드저니는 어떻게 시작하나요?

    미드저니 배우기 미드저니, 무료 체험판 중단 미드저니를 위한 최고의 리소스 미드저니, 최고의 프롬프트 사이트 추천 미드저니와 달리, 상위 50개 텍스트-이미지 변환 프롬프트 미드저니에서 기존 이미지를 약간 수정하도록 요청하는 방법 미드저니에서 여러 이미지에 일관된 문자를 사용하려면 어떻게 해야 하나요? 미드저니에서 기존 이미지 몇 개를 하나로 병합하는 방법은 무엇인가요? 미드저니 명령어 목록 미드저니의 소스로 내 이미지를 사용하려면…