텍스트 또는 사용 권한이 있는 이미지로 일관된 AI 발표자, 가상 모델 또는 말하는 캐릭터를 만드세요. 보유한 원본 자료에 따라 텍스트 투 비디오, 이미지 투 비디오 또는 토킹 비디오를 선택할 수 있습니다.
1단계: 공개 모델 열기 및 비디오 작업 선택
문제: APOB에는 여러 비디오 모드가 포함되어 있어, 기능 이름만 보고 선택하면 잘못된 입력 워크플로가 열릴 수 있습니다.
APOB 홈 페이지에서 사용 권한이 있는 모델을 선택합니다. 이 가이드에서는 비공개 개인 모델이 아닌 공개 커뮤니티 모델인 Miranda를 선택했습니다. 비디오를 열고 이미 가지고 있는 소스에 따라 '텍스트-비디오', '이미지-비디오' 또는 '말하는 비디오'를 선택합니다.
실제 예시: 소스 초상화가 없는 얼굴 없는 크리에이터는 '텍스트-비디오'로 시작할 수 있습니다. 이미 승인된 캐릭터 이미지를 보유한 마케터는 '이미지-비디오'를 선택해야 합니다.


2단계: 소스 이미지가 없을 때 텍스트-비디오(Text-to-Video) 기능 사용하기
문제점: "제품을 소개하는 여성"과 같이 짧은 프롬프트는 정체성, 행동, 배경, 카메라 움직임 등을 미해결 상태로 남겨둡니다.
살펴본 텍스트-비디오 작업 공간은 설명 필드에 Miranda를 계속 연결해 두었으며 네이티브 오디오, 음성 모델, 아트 스타일, 카메라 움직임, 의상, 건축, 풍경, 날씨, 요소, 템플릿 및 샷 추가 컨트롤을 표시했습니다. 캐릭터, 한 가지 행동, 배경, 프레임, 조명, 그리고 안정적으로 유지되어야 하는 요소를 설명하세요. 출력이 무음일 것이라 가정하지 말고 네이티브 오디오를 확인하세요.
실제 예시: 과학 크리에이터는 고정 진행자에게 카메라를 향하고, 가벼운 소개 제스처를 취한 뒤 아담한 스튜디오에서 잠시 멈추도록 요청할 수 있습니다. 첫 번째 정체성 및 프레임 테스트가 성공한 후에만 두 번째 샷을 추가하세요.
3단계: 이미 승인된 인물인 경우 Image-to-Video 사용하기
문제점: 잘렸거나 가려졌거나 권한이 없는 참조 이미지는 움직임을 약화시키고 저작권 또는 개인정보 보호 위험을 초래할 수 있습니다.
권한을 부여받은 APOB 미디어를 재사용하려면 '콘텐츠 선택'을 고르고, 사용할 권리가 있는 소스인 경우 '이미지 업로드'를 선택하세요. 얼굴이 선명하게 나오고, 해당하는 경우 손이 보이며, 몸 주변에 여유 공간이 있으면 모델에 더 많은 모션 컨텍스트를 제공할 수 있습니다. 이미 보이는 모든 세부 사항을 다시 설명하기보다 움직임을 직접 지시하세요.
테스트된 프롬프트: 피사체가 카메라를 향해 한 걸음 다가와 어깨를 으쓱하고 자연스러운 미소를 지어 보입니다. 얼굴, 머리 스타일, 의상, 배경을 일관되게 유지합니다. 흔들림 없는 손과 갑작스러운 움직임 없이 느리고 미묘한 카메라 푸시인을 사용하세요.
현실적인 예시: 링크드인의 사상적 리더십(Thought-leadership) 인트로 영상의 경우, 사무실을 가로질러 걸어가는 동작 대신 고개를 가볍게 돌리고 안정적인 미디엄 클로즈업 샷을 요청하세요.


4단계: 음성으로 말하는 아바타 또는 립싱크 선택하기
문제점: 정지 이미지와 기존 비디오는 서로 다른 음성 워크플로우를 필요로 합니다.
말하는 아바타는 하나의 참조 이미지와 생성되거나 업로드된 오디오로 시작합니다. 립싱크는 기존 참조 비디오와 생성되거나 업로드된 오디오로 시작합니다. 조사해 본 말하는 아바타 인터페이스에서는 오디오 생성 기능이 보이스 모델과 최대 2,000자까지 입력 가능한 스크립트 필드를 제공했습니다.
APOB의 공식 가이드 문서에 따르면 말하는 아바타의 오디오 길이는 1초에서 3분까지 지원됩니다: https://help.apob.ai/en/articles/15699750-talking-video . 립싱크 가이드 문서에 따르면 참조 비디오 및 오디오의 길이는 1초에서 15분까지 지원됩니다: https://help.apob.ai/en/articles/15699765-lip-sync .
실제 적용 예시: SaaS 팀이 가상의 강사 소개 영상을 12초 동안 보여준 다음, 실제 화면 녹화 영상으로 전환하여 정확한 설명이 전달되도록 구성합니다.
단계 5: 재생 시간, 화질, 공개 여부 및 크레딧 확인
문제점: 모든 모드의 비용이나 프라이버시 상태가 동일하다고 가정할 경우, 팀에서 크레딧을 낭비하거나 미공개 자산을 노출할 수 있습니다.
이전의 이미지 투 비디오(Image-to-Video) 테스트에서 선택한 구성은 5초, 720P, Fast/Ultra/UltraS 옵션, 초당 200 크레딧, 예상 소모 크레딧 1,000개를 보여주었습니다. 이는 특정 계정 및 세션에서의 관찰 결과이며, 고정된 가격 책정이나 요금제 권한이 아닙니다. 생성하기 전에 네이티브 오디오, 선택한 음성 및 공개 여부 상태를 확인하세요.
실제 예시: 패션 판매자는 여러 의상이 등장하는 룩북을 제작하기 전에 5초 분량의 절제된 턴을 먼저 테스트합니다. 이를 통해 더 큰 크레딧을 사용하기 전에 구도와 아이덴티티를 확인합니다.

6단계: 생성하고 공개 범위를 확인한 뒤 모든 프레임 검토
문제점: 클립을 일반 속도로 볼 때는 그럴듯해 보이지만 왜곡된 손, 계속 변하는 제품 라벨, 일관되지 않은 얼굴 또는 오해의 소지가 있는 시연이 포함되어 있을 수 있습니다.
5초 분량의 이미지-동영상 테스트는 완료하는 데 약 2분이 소요되었으며, '공개' 라벨이 지정되어 생성 메뉴에 표시되었습니다. 소요 시간은 모델, 품질 및 대기열에 따라 달라집니다. 얼굴 및 머리카락의 연속성, 시선 방향, 치아, 어깨, 손, 물체와의 접촉, 배경 안정성, 카메라의 움직임, 첫 프레임과 마지막 프레임을 검토하세요.
실제 적용 예시: 발표자가 스킨케어 펌프를 누르는 것처럼 보이지만 디스펜서의 모양이 변하는 경우, 발표자는 음성 훅(시선 집중용)으로 유지하되 도포 장면은 정확한 제품 영상으로 편집하여 전환하세요. 인위적인 상호 작용을 제품의 증거로 사용하지 마세요.
AI 사람 영상을 위한 전문가 프롬프트
이커머스 발표자 — 목적: 제공된 제품을 변경하지 않고 수직형 제품 후크 구현. 프롬프트: 가상의 정리정돈 전문가가 밝은 아파트 주방에 상반신 모습으로 서서 제공된 소형 서랍 정리함을 가슴 높이로 들고 있습니다. 그녀는 그것을 한 번 들어 올리고, 절제된 한 번의 제스처로 조절 가능한 칸막이를 가리킨 다음, 양손을 안정적인 위치로 되돌립니다. 부드러운 일광, 사실적인 손, 미세한 푸시인이 있는 고정된 9:16 카메라. 얼굴, 머리카락, 크림색 니트 상의, 제품 형태, 라벨, 색상 및 칸막이 위치를 유지하십시오. 불필요한 손가락, 라벨 변경 또는 빠른 움직임은 없어야 합니다. 예상 결과물: 집중도 높은 5초 분량의 TikTok 또는 Reels 오프닝.
반복 출연 과학 호스트 — 목적: Shorts에 반복적으로 사용할 수 있는 호스트 샷. 프롬프트: 동일한 가상의 20대 후반 남성 과학 호스트, 짧은 어두운 곱슬머리, 둥근 안경, 네이비 오버셔츠를 입고 은은한 조명이 켜진 분자 모형이 있는 아담한 스튜디오에서 상반신이 보입니다. 그는 카메라를 바라보고 한 손을 가볍게 올렸다가 다시 중립 위치로 돌아옵니다. 고정된 9:16 카메라. 얼굴, 안경, 머리카락, 의상, 조명 및 배경을 유지하십시오. 제스처는 한 번만 해야 합니다. 예상 결과물: 인지도가 높은 후크 또는 브릿지 샷.
온보딩 설명 발표자 — 목적: 승인된 강사 인물 사진을 음성이 포함된 소개 영상으로 변환. 대본: 대시보드에 오신 것을 환영합니다. 이번 단원에서는 캠페인을 하나 생성하고 담당자를 지정한 후, 게시하기 전에 승인 상태를 확인해 보겠습니다. 이 창을 열어두고 화면에 강조 표시된 단계를 따르십시오. 예상 결과물: 정확한 화면 녹화로 전환되는 발표자의 짧은 소개.
패션 룩북 턴 — 목적: 절제된 움직임으로 실루엣 표시. 프롬프트: 제공된 차콜 재킷과 블랙 스트레이트 핏 팬츠를 입은 가상의 전신 패션 모델, 중립적인 갤러리 배경, 부드러운 방향성 조명. 그녀는 천천히 한 걸음 내딛고 왼쪽으로 30도 돌린 다음 양손이 보이는 상태에서 멈춥니다. 정적인 미디엄 와이드 9:16 카메라. 의상 색상, 솔기, 단추, 비율, 얼굴 및 머리카락을 유지하십시오. 예상 결과물: 통제된 콘셉트 룩북 클립, 전체 회전 대신 별도의 뒷모습을 생성하십시오.
관련 콘텐츠 전반에서 식별 가능한 한 명의 인물을 일관되게 유지하세요. 반복해서 등장하는 여행 호스트는 매 프롬프트마다 정체성을 재정의할 필요 없이 공항 이용 팁, 호텔 설명, 여행지 클립에 등장할 수 있습니다. 일관성은 여전히 레퍼런스 품질, 각도, 조명, 모델 및 모션의 복잡성에 따라 달라집니다.
연결된 워크플로에서 정체성 설정 단계를 거쳐 모션 및 음성 단계로 이동하세요. 애니메이션, 대사 전달 또는 캠페인 변형 버전에 크레딧을 사용하기 전에 가상의 인물을 먼저 승인하세요.
실제 촬영을 반복하지 않고 하나의 크리에이티브 변수를 테스트해 보세요. 프레젠터와 제안 내용은 고정해 둔 상태에서 문제 제시형, 제품 우선형 또는 시연 중심형 훅(hook)을 비교해 보세요. 이 워크플로를 고객 경험이나 추천 보증을 지어내는 데 사용하지 마십시오.
생성하기 전에 예상 소모량을 확인하세요. 테스트된 인터페이스에서는 '생성(Generate)' 버튼 옆에 초당 요금 및 총 예상 소모량이 표시되었습니다. 항상 현재 앱의 예상치를 참고하세요.
눈에 보이는 한계 내에서 작업하세요. 모션, 품질, 카메라, 오디오 및 추가 샷 제어 기능이 있더라도 손 모양, 사물 접촉, 정체성, 권리, 공개 고지 및 제품 정확성에 대한 검토는 여전히 필요합니다.
가상의 발표자 한 명을 활용해 세 가지 TikTok Shop 후크를 테스트해 보세요. 첫 번째 대사나 제스처만 변경하면서 발표자, 혜택, 제품 푸티지는 일정하게 유지합니다. HubSpot의 2025년 연구에 따르면 숏폼 동영상은 마케터가 가장 많이 사용하는 콘텐츠 형식이자 가장 높은 ROI와 가장 자주 연관되는 형식으로 식별되었습니다: https://blog.hubspot.com/news-trends/content-trends-global-preferences
제품에 대한 허위 인증 없이 이커머스 제품을 소개하세요. 후크와 전환 부분에는 AI 인물을 사용하고, 색상, 치수, 핏, 조립, 성능에 대해서는 정확한 제품 이미지나 푸티지로 컷을 전환합니다.
정기적으로 연재되는 가상의 크리에이터 시리즈를 빌드해 보세요. 얼굴, 헤어, 의상, 어조, 공개 범위, 제한된 주장에 대한 페르소나 가이드를 유지합니다. IAB는 2025년 미국의 크리에이터 이코노미 광고 지출액을 370억 달러로 전망했으며, 브랜드 4곳 중 3곳이 크리에이터 마케팅 작업에 AI를 사용하고 있거나 사용할 계획이라고 보고했습니다: https://www.iab.com/insights/2025-creator-economy-ad-spend-strategy-report/
인물이 등장하지 않는 YouTube Shorts에 호스트를 추가해 보세요. 오프닝과 엔딩에는 가상의 호스트를 활용하고, 대사 사이에는 라이선스 비롤(B-roll), 도표 또는 실제 시연을 배치합니다. YouTube에 따르면 Shorts의 일일 평균 조회수는 2,000억 회 이상입니다: https://blog.youtube/press/
통제된 패션 콘셉트 룩북을 제작해 보세요. 클립당 한 번의 스텝이나 부분 회전을 애니메이션화하고 의류의 가장자리, 손, 실루엣, 색상을 검토합니다. 핏이나 소재가 구매에 영향을 미치는 경우 정확한 제품 이미지를 대체하지 마십시오.
가상의 트레이너와 함께 제품 온보딩을 현지화해 보세요. 승인된 화면 녹화는 그대로 유지하고, 서로 다른 언어에 대한 짧은 트레이너 소개를 생성합니다. 기술, 규제 또는 안전 관련 문구의 경우 자격을 갖춘 검토자를 활용하십시오.
촬영 의존도 감소 — 사실적인 물리적 증명이 필요하지 않은 개념, 반복되는 도입부, 훅 및 크리에이티브 변형에 유용합니다.
재사용 가능한 아이덴티티 — 승인된 가상 페르소나 하나로 여러 장면과 형식에 걸쳐 시리즈를 연결할 수 있습니다.
통제된 테스트 — 훅, 제스처, 배경 또는 프레이밍 선택을 한 번에 하나씩 변경할 수 있습니다.
플랫폼을 고려한 구성 — 생성 전에 세로형, 정사각형, 포트레이트 피드 또는 가로형 샷을 계획할 수 있습니다.
연결된 음성 옵션 — Talking Avatar는 스틸 이미지에서 시작하며, Lip Sync는 기존 영상 및 새로운 오디오와 함께 작동합니다.
손, 치아, 시선 방향, 머리카락, 옷차림, 물체와의 접촉 등 사람의 세부 묘사에서 오류가 발생할 수 있으므로 면밀한 검토가 필요합니다.
일관성이 보장되지 않습니다. 새로운 각도, 조명, 모델 및 복잡한 동작으로 인해 인물의 모습이 달라질 수 있습니다.
긴 연출은 제어하기가 더 어렵습니다. 대본과 동작은 일반적으로 개별적인 짧은 샷으로 구성할 때 더 잘 작동합니다.
크레딧 및 제한 사항은 변경될 수 있습니다. 비용, 기간, 품질 및 제어 기능은 현재 계정과 모드에 따라 달라집니다.
게시자는 동의, 청구, 저작권, 공개, 개인 정보 보호 및 플랫폼 준수에 대한 책임을 집니다.
신용카드가 필요하지 않습니다
작업 흐름, 품질, 크레딧, 개인정보 보호, 상업적 이용 및 플랫폼 호환성
AI가 사람 동영상을 만들 수 있나요?
네, 가능합니다. AI는 설명을 바탕으로 가상의 인물을 생성하거나 권한이 있는 이미지를 애니메이션화할 수 있습니다. 결과물은 무음 라이프스타일 클립, 가상 발표자, 말하는 아바타 또는 반복해서 나타나는 디지털 캐릭터가 될 수 있습니다. 게시하기 전에 모든 출력물을 검토하세요.
사진으로 사람 동영상을 만들려면 어떻게 해야 하나요?
소유하고 있거나 사용 권한이 있는 선명한 이미지를 업로드하고, '이미지 투 비디오(Image-to-Video)'를 선택한 다음, 하나의 제한된 동작과 하나의 카메라 움직임을 설명하세요. 정면을 응시하는 포트레이트 사진은 얼굴 움직임에 적합하며, 전신 이미지는 걷거나 옷을 갈아입는 동작에 더 많은 맥락을 제공합니다.
사진 없이도 시작할 수 있나요?
네, 가능합니다. 가상의 APOB 페르소나를 만들거나 텍스트 기반 비디오 워크플로우를 사용해 보세요. 인물의 역할, 외모, 배경, 동작, 프레이밍 및 형식을 정의한 다음, 시리즈를 제작하기 전에 ID 참조를 저장하세요.
AI 인물이 말하도록 만들 수 있나요?
네, 가능합니다. 단일 얼굴 이미지에는 '말하는 아바타(Talking Avatar)'를 사용하고, 기존 동영상에는 '립싱크(Lip Sync)'를 사용하세요. 검토된 '말하는 아바타' 인터페이스는 음성 모델과 최대 2,000자까지 지원되는 대본 입력 필드, 그리고 생성되거나 업로드된 오디오를 제공합니다.
'말하는 아바타'와 '립싱크'의 차이점은 무엇인가요?
'말하는 아바타'는 오디오를 기반으로 정지 이미지에 애니메이션 효과를 부여합니다. '립싱크'는 기존 동영상을 그대로 유지하면서 입 모양을 새로운 오디오에 맞춰 다시 동기화합니다. 자세한 내용은 https://help.apob.ai/en/articles/15699750-talking-video 및 https://help.apob.ai/en/articles/15699765-lip-sync 를 참조하세요.
텍스트 투 비디오 또는 이미지 투 비디오에 오디오를 포함할 수 있나요?
저희가 점검한 공개 모델 작업 공간에는 원본 오디오(Native audio) 토글 스위치가 표시되었으며, 텍스트 투 비디오에서는 음성 모델 제어 기능도 제공되었습니다. 사용 가능 여부는 선택한 모델 및 설정에 따라 다릅니다. 생성하기 전에 토글 스위치를 확인하세요.
가장 뛰어난 무료 AI 사람 동영상 생성기는 무엇인가요?
가장 뛰어난 프로그램은 소스 에셋, 신원 일관성, 음성 워크플로우, 결과물에 대한 권리, 가시성, 해상도 및 총 크레딧 비용에 따라 달라집니다. 홈페이지의 홍보 문구만 비교하지 말고, 권한이 부여된 에셋을 사용하여 정확한 작업을 직접 테스트해 보세요.
APOB는 100% 무료 AI 사람 동영상 생성기인가요?
APOB는 콘텐츠 생성 시 크레딧을 사용하며, 전체 프로덕션 패키지를 구매하지 않고도 시작할 수 있는 방법을 제공합니다. 무제한 또는 영구 무료로 설명되어서는 안 됩니다. https://app.apob.ai/subscription 및 '생성(Generate)' 버튼 옆의 실시간 추정치를 확인하세요.
ChatGPT로 AI 사람 동영상을 만들 수 있나요?
ChatGPT는 제품 및 요금제에 따라 컨셉, 대본, 스토리보드(샷 리스트) 또는 동작 프롬프트의 초안을 작성하는 데 도움을 줄 수 있습니다. APOB는 이 페이지에 설명된 신원, 이미지, 모션, 음성 대화 및 립싱크 워크플로우를 제공합니다. 각 제품의 현재 기능을 확인해 보세요.
여러 동영상에 동일한 인물을 사용할 수 있나요?
네, 가능합니다. 동일한 APOB 페르소나 또는 승인된 참조 대상을 재사용하고 프롬프트에 일관된 신원 블록을 유지하세요. 각도, 조명, 모델 선택 및 동작 복잡성에 따라 결과가 달라질 수 있으므로 모든 클립을 꼼꼼히 검토하십시오.
동영상 크레딧은 어떻게 계산되나요?
앱은 생성 전 초당 요율과 총 예상 비용을 표시합니다. '말하는 아바타'와 '립싱크'는 오디오 길이에 따라 요금이 부과되며, 동영상 생성 요율은 선택한 모드, 길이, 화질, 계정 및 구성에 따라 다릅니다.
'생성(Generate)' 버튼을 사용할 수 없는 이유는 무엇인가요?
'생성' 버튼은 해당 모드에 필요한 입력값이 채워질 때까지 비활성화 상태로 유지됩니다. 이미지 투 비디오에는 참조 이미지와 동작 설명이 필요합니다. 말하는 아바타에는 이미지와 대본 또는 오디오가 필요합니다. 립싱크에는 참조 동영상과 오디오가 필요합니다. 업로드가 실패하거나 완료되지 않은 경우에도 생성이 제한될 수 있습니다.
APOB로 생성한 동영상을 상업적으로 사용할 수 있나요?
상업적 이용은 APOB의 현재 약관 및 모든 입력 요소와 묘사된 요소에 부여된 권리에 따라 달라집니다. 초상권, 목소리, 음악, 상표, 제품 및 원본 미디어 권리는 https://public.apob.ai/tos/index.html 에서 검토하세요.
제가 만든 사람 동영상은 비공개로 유지되나요?
당연히 비공개일 것이라고 단정하지 마십시오. 선택한 모델 및 완료된 출력물의 공개 여부 표시를 확인하세요. 당사의 공개 커뮤니티 모델 테스트에서는 '공개(Public)' 표시가 나타났습니다. 민감한 자료를 업로드하기 전에 https://public.apob.ai/privacy/index.html 을 검토하세요.
결과물을 더 사실적으로 보이게 하려면 어떻게 해야 하나요?
선명한 참조 대상을 사용하고, 하나의 동작만 요청하며, 카메라 움직임을 억제하고, 고정되어야 하는 부분을 설명한 후 프레임별로 검토하세요. 사람과 사물 간의 상호작용 및 빠른 전신 움직임은 단순한 발표자 샷보다 제어하기가 더 어렵습니다.
어떤 화면비를 선택해야 하나요?
TikTok, Reels, Shorts의 경우 9:16 비율을, 일반 YouTube, 웹사이트, 교육용의 경우 16:9 비율을 사용하고, 지원되는 피드 배치의 경우 1:1 또는 4:5 비율을 사용하세요. 생성하기 전에 업로드할 플랫폼의 사양을 확인하십시오.
APOB는 TikTok, Instagram, YouTube에서 작동하나요?
네, 해당 워크플로우를 통해 해당 플랫폼에 사용할 소스 클립을 제작할 수 있습니다. 각 플랫폼의 현재 화면비, 길이, 자막, 광고, 음악 및 인공 합성 미디어 규정에 따라 내보내기 및 편집을 진행하세요.
해당 인물이 AI로 생성되었다는 사실을 밝혀야 하나요?
공개 여부는 사실성, 주제, 플랫폼, 관할 구역 및 상업적 맥락에 따라 달라집니다. 최신 YouTube, TikTok 및 Meta 규정을 준수하고, 플랫폼의 공개 제어 기능을 사용하며, 가상의 캐릭터를 실제 고객, 직원 또는 전문가처럼 제시해서는 절대 안 됩니다.
