AI 모델 · 영상

OmniHuman

ByteDance의 OmniHuman은 레퍼런스 이미지 한 장과 오디오로 싱크된 영상을 만듭니다.

  • 말하는 인물 사진
  • 오디오 기반
  • 프레젠테이션
  • 영상
제공업체 ByteDance

OmniHuman

영상Havincy
제공업체
ByteDance
유형
영상
비용
155 크레딧부터

개요

OmniHuman 모델은 무엇인가요?

ByteDance의 OmniHuman은 레퍼런스 이미지 한 장과 오디오로 싱크된 영상을 만듭니다. 18,700시간의 인간 동작 데이터로 학습해 오디오를 주된 제어 신호로 삼으며, 입, 표정, 움직임이 목소리를 따릅니다.

Havincy에서 인물 사진과 목소리를 올리면 모션 캡처 장비 없이 사람이 말하는 영상을 얻습니다. 길이는 오디오를 따릅니다.

주요 특징

  • 말하는 인물 사진
  • 오디오 기반
  • 프레젠테이션

사양

OmniHuman 사양

개발사
ByteDance
생성 방식
말하는 아바타(이미지 + 음성)
출시일
2025년 07월 27일
라이선스
상업적 이용 가능
Havincy 이용 비용
155 크레딧부터

개발사 공개 모델 페이지의 사양입니다. fal.ai에서 문서 보기

활용 사례

OmniHuman(으)로 만들 수 있는 것

토킹 헤드

사진 속 인물이 카메라를 보며 말합니다.

교육 영상

가상 진행자가 설명하는 영상.

소셜 미디어

TikTok과 릴스용 카메라 토크 형식.

프레젠테이션

제품 페이지나 데모를 위한 애니메이션 발표자.

프롬프트 예시

OmniHuman에서 써 볼 프롬프트

예시를 Havincy에 붙여 넣고 주제, 스타일, 형식을 프로젝트에 맞게 바꿔 보세요.

  • 이 인물 사진이 20초 보이스오버로 말하게 해 줘.

  • 상담사 사진을 움직여 우리 서비스를 설명하게 해 줘.

  • 이 이미지와 오디오 대본으로 가상 진행자를 만들어 줘.

활용 아이디어

호환 스킬

다음 Havincy 스킬과 함께 이 모델을 사용하세요.

사용 방법

이 모델로 만드는 방법

  1. Havincy 대화에서 원하는 결과물을 설명하세요.
  2. 스타일, 제품, 캐릭터를 유지해야 한다면 참고 자료를 추가하세요.
  3. 생성 후 처음부터 다시 시작할 필요 없이 다른 버전이나 개선을 요청하세요.

자주 묻는 질문

OmniHuman 자주 묻는 질문

OmniHuman 비용은 얼마인가요?

fal 기준 영상 초당 0.14달러입니다. Havincy에서는 8초에 약 155크레딧입니다.

OmniHuman과 OmniHuman 1.5 중 무엇을 쓸까요?

OmniHuman 1.5가 더 표현력이 풍부하고 1080p를 지원합니다. 일반적인 토킹 헤드에는 조금 더 저렴한 OmniHuman도 좋습니다.

생성한 이미지를 써도 되나요?

네. 얼굴이 잘 보인다면 사진이나 Havincy에서 만든 인물 이미지 모두 가능합니다.

OmniHuman으로 창작할 준비가 되셨나요?

Havincy에서 아이디어를 설명하고 대화를 통해 결과를 다듬어 보세요.

Havincy에서 만들기