Elser AI로 말하는 애니메이션 캐릭터를 만드는 방법
믿을 수 있는 말하는 애니메이션 캐릭터는 동기화된 입술만으로는 부족합니다. 시청자들은 눈, 턱, 멈춤, 호흡, 머리 안정성, 감정적 의도를 봅니다. 캐릭터의 정체성이 흔들리거나 연기에 숨은 의미가 없다면, 기술적으로 정확한 입 움직임도 여전히 인위적으로 느껴질 것입니다.
**Elser AI**는 캐릭터 생성 및 재사용과 이미지/비디오 생성, 음성 워크플로우 및 립싱크를 결합합니다. 신뢰할 수 있는 순서는 다음과 같습니다: 아이덴티티 첫 번째, 대사 두 번째, 음성 세 번째, 시각적 모션 네 번째, 립싱크 다섯 번째, 편집 마지막.
대사로 캐릭터가 무엇을 하고 있는지 정의하기
음성 스타일로 시작하지 마세요. 의도로 시작하세요.
줄:
“돌아왔구나.”
가능한 의도:
- 약속을 어긴 사람을 비난하다;
- 릴리프 숨기기;
- 두려운 예측을 확인하다;
- 친구를 환영하세요;
- 침입자를 지연시키다.
단어는 동일하지만, 연기, 표정, 멈춤, 카메라 거리가 달라집니다. 한 줄 요약을 작성하세요:
- 이전 이벤트;
- 리스너와 관계;
- 즉각적인 목표;
- 숨겨진 감정;
- 감정적 전환;
- 최대 지속 시간.
예시:
그녀는 밤새 기다렸지만 안도감을 드러내지 않는다. 그녀의 오빠에게 조용히 말을 건넨다. "왔"이라는 말을 할 때는 침착함을 유지하고, "돌아"에서 작은 숨을 내쉰다. 총 2.2~2.8초.
안정적인 캐릭터 생성 및 저장
Elser AI의 캐릭터 워크플로우를 사용하여 대화 샷을 생성하기 전에 스피커를 디자인하세요. 다음을 정의하세요:
- 얼굴형과 특징적인 표시;
- 헤어 실루엣 및 액세서리 배치;
- 눈 색깔과 정상적인 눈꺼풀 모양;
- 의상 구성 및 칼라 높이;
- 중립적인 입 디자인;
- 신체 비율;
- 팔레트 및 선/음영 스타일.
명확한 얼굴과 단순한 조명이 있는 승인된 참조를 선택하세요. 캐릭터를 재사용을 위해 저장하세요. 중립, 행복, 걱정, 분노 표정을 테스트하세요; 극단적인 표정은 디자인이 인식 가능한 상태로 유지되는지 드러낼 수 있습니다.
통제된 발화 테스트 하나 만들기: Elser AI에 캐릭터를 등록하고, 짧은 문장 하나를 사용하여 대화나 에피소드를 제작하기 전에 안정적인 클로즈업을 승인하세요.
립싱크에 적합한 샷 설계하기
프레이밍
중간 클로즈업이나 클로즈업은 보통 모든 결점을 확대하지 않으면서도 충분한 얼굴 정보를 제공합니다. 극단적인 클로즈업은 입과 라인의 더 높은 안정성을 요구합니다.
머리 위치
정면이나 3/4 각도가 빠른 프로필 회전보다 쉽습니다. 중요한 라인 동안 머리를 대부분 안정적으로 유지하세요.
조명
얼굴에 밝은 조명을 사용하세요. 입 주변으로 그림자가 움직이면 형태 오류처럼 보일 수 있습니다.
폐색
입술을 가로지르는 손, 머리카락, 컵 또는 소품은 그 동작이 필수적이지 않는 한 피하십시오.
기간
짧은 도입부와 반응 꼬리를 포함하세요. 첫 음소에서 시작해 마지막 음소에서 끝나는 클립은 기계적으로 느껴지며 편집하기 어렵습니다.
대화문 작성하기
원하는 에너지로 대사를 말하세요. 측정하세요. 서두의 구절과 반복된 생각을 제거하세요.
작성:
“그냥 무슨 일이 있었는지 이해하기 전에는 문을 열지 말아야 한다고 말씀드리고 싶었어요.”
말하는:
“문을 열지 마세요. 무슨 일이 일어났는지 알기 전까지는요.”
수정본은 실행 가능한 첫 문장, 일시 정지, 그리고 감정적 강조를 만듭니다. 또한 두 개의 편집 지점을 제공합니다.
애니메이션의 경우:
- 한 문장에 하나의 생각을 담는 것을 선호하십시오;
- 자연스러울 때 축약형을 사용하세요;
- 음성 워크플로를 위해 특이한 이름은 발음대로 음역하세요;
- 캐릭터 특성이 아닌 이상 혀 꼬이는 자음군을 피하세요;
- 방해를 의도적으로 유지하세요;
- 얼굴이 거의 드러나지 않을 때는 설명을 화면 밖으로 이동하세요.
음성을 재사용 가능한 퍼포먼스 에셋으로 생성하기
Elser AI의 공개 오디오 페이지는 음성 디자인, 감정 톤, 속도 조절 및 음성 복제를 설명합니다. 음성 카드를 만드세요:
| 속성 | 승인된 규칙 | |---|---| | 등록 | 중간, 가벼운 질감 | | 속도 | 중립적인 발화에서 분당 145–155 단어 | | 에너지 | 절제되어 있고, 평평하지 않음 | | 일시 중지 | 입학 전 간략 설명 | | 이름 | 고정 발음 목록 | | 극단 | 분노는 통제된 상태를 유지하며, 기본적으로 고함을 지르지 않음 |
한 번에 하나의 차원만 변경하여 여러 성능을 생성하세요. 피치, 속도, 감정 및 구두점을 함께 변경하면 결과를 개선한 요소가 무엇인지 알 수 없습니다.
음성 복제는 명확한 허가를 받은 경우에만 사용하세요. 승인된 목적과 제한 사항을 음성 자산과 함께 저장하세요. 기만적인 발언을 생성하거나 지지를 암시하지 마세요.
입 움직임과 몸 움직임 분리하기
안정적인 시각적 클립을 먼저 생성하세요. 절제된 움직임을 사용하십시오:
캐릭터는 눈을 마주치고, 1초 후에 한 번 깜빡이며, 작게 숨을 들이쉬고 마지막에 턱을 살짝 내립니다. 머리카락 끝이 살짝 움직입니다. 카메라 고정. 얼굴, 머리핀, 눈 모양, 칼라, 셀 셰이딩 스타일을 정확히 유지합니다. 입은 중립 상태를 유지하여 추후 립싱크에 대비합니다. 회전 없음, 손이 얼굴을 가리지 않음, 조명 변화 없음.
그런 다음 승인된 음성과 립싱크를 적용합니다. 이 계층적 접근 방식은 동시에 변하는 변수의 수를 줄여줍니다.
일부 워크플로우는 음성과 싱크를 함께 수행할 수 있지만, 리뷰 로직은 여전히 동일합니다: 실패가 소스 이미지, 기본 모션, 오디오 성능 또는 동기화 중 어디에서 발생했는지 분리하는 것입니다.
애니메이터처럼 립 싱크 검토하기
먼저 정상 속도로 시청하세요. 성능이 이상하게 느껴진다면, 그 순간을 찾아내세요. 그런 다음 확인하세요:
- 입이 멈춤과 양순음에서 닫힙니다;
- 턱 움직임이 에너지와 일치합니다;
- 모음이 과도한 입 모양을 만들지 않습니다;
- 눈은 감정을 지지한다;
- 깜빡임은 핵심 단어에서 무작위로 발생하지 않습니다;
- 머리 움직임이 얼굴 표류를 유발하지 않습니다;
- 이와 혀는 깜빡이지 않는다;
- 중립적인 입 모양이 라인 이후에 돌아옵니다.
전체적인 연기가 어색하다면 완벽한 프레임 단위의 음소를 쫓지 마세요. 대부분의 시청자에게는 입 움직임의 최대화보다 연기 타이밍이 더 중요합니다.
두 캐릭터 간의 대화를 커버리지로 구축하기
두 캐릭터가 모두 말하는 하나의 긴 투샷을 생성하지 마세요. 대신 다음과 같이 구성하세요:
- 투샷 설정;
- 캐릭터 A가 클로즈업으로 말하는 장면;
- 캐릭터 B의 듣는 반응;
- 캐릭터 B가 클로즈업으로 말하는 장면;
- 캐릭터 A의 반응;
- 삽입 또는 환경 전환;
- 마무리 투샷.
활성 발언자는 립싱크를 받습니다. 청자는 미묘한 비언어적 움직임을 사용할 수 있습니다. 반응 전반에 걸쳐 오디오를 전달하여 대화가 연결된 느낌을 줍니다.
시선과 화면 위치를 추적하세요. A가 오른쪽을 보면, 지형이 눈에 띄게 변하지 않는 한 B는 일반적으로 왼쪽을 봅니다.
오프스크린 대화를 전략적으로 활용하세요
화면 밖의 대사는 다음과 같은 경우에 유용합니다:
- 청취자의 반응이 더 중요합니다;
- 복잡한 작업이 수행되어야 합니다;
- 현재 얼굴 각도가 립싱크에 적합하지 않습니다;
- 말하는 머리 부분을 줄여야 합니다;
- 장면이 증거를 드러내는 동안 설명이 계속됩니다.
이것은 타협이 아닌 표준 편집 언어입니다. 장면이 연출된 느낌을 줍니다.
음성 가리지 않고 사운드와 음악 추가하기
낮고 연속적인 앰비언스를 사용하여 장면을 연결하세요. 라인 위가 아닌 주변에 동기화된 효과를 배치하세요. 대화 중에는 음악 밀도를 줄이세요.
“돌아왔구나”의 경우:
- 비가 계속 내리는 침대;
- 문이 줄 앞에서 닫힙니다;
- 음악이 하나의 지속음을 유지한다;
- 캐릭터가 말한다;
- 숨과 코트의 움직임이 따라온다;
- 음악은 청자가 반응한 후에야 해소된다.
대사 후의 멈춤은 연기가 전달되도록 한다.
일반적인 고장 및 수리
| 실패 | 예상 원인 | 수리 | | 침묵 중에 입이 떠드는 소리 | 편집되지 않은/잡음이 있는 오디오 | 깨끗한 오디오와 의도적인 멈춤 유지 | | 얼굴 형태 변화 | 과도한 머리 또는 카메라 움직임 | 더 안정적인 베이스 클립 사용 | | 음성이 평범하게 느껴짐 | 의도나 함축적 의미 없음 | 연출 브리프 재작성 | | 대사가 샷을 넘어감 | 대사가 너무 김 | 문구를 줄이거나 범위를 확장하세요 | 두 명의 화자가 혼란스러워 보임 | 연속적인 투샷 | 화자와 반응 샷을 분리하여 컷 | | 캐릭터 음성이 나중에 달라짐 | 음성 카드 없음 | 승인된 음성 설정 및 발음 재사용 |
자주 묻는 질문
Elser AI가 애니메이션 캐릭터를 말하게 할 수 있나요?
Elser AI의 공개 페이지에서는 캐릭터 생성, 음성 워크플로우, 그리고 대화, 내레이션 또는 노래를 위한 립싱크에 대해 설명합니다.
기존 애니메이션 이미지가 필요한가요?
아니요. 먼저 캐릭터를 만들거나 승인된 기존 디자인을 기반으로 작업할 수 있습니다. 말하는 장면 전에 깔끔한 레퍼런스를 승인하세요.
첫 번째 립싱크 테스트는 얼마나 길어야 하나요?
약 2~5초 길이의 한 문장을 사용하세요. 짧은 테스트는 정체성, 음성 및 동기화 문제가 확대되기 전에 이를 분리해냅니다.
내 목소리를 복제할 수 있나요?
공개 오디오 페이지에는 음성 복제 목록이 표시됩니다. 복제할 권한이 있는 음성만 사용하고 관련 공개, 플랫폼 및 법적 요구 사항을 준수하십시오.
왜 입이 부자연스러워 보일까요?
가능한 원인으로는 시끄러운 오디오, 과도한 기본 동작, 불명확한 얼굴, 빠른 말투 또는 안정적인 멈춤이 없는 대사가 포함됩니다. 가장 먼저 실패한 레이어를 수정하세요.
결론
말하는 애니메이션 캐릭터는 정체성, 의도, 타이밍이 일치해야 설득력이 생깁니다. 디자인을 확정하고, 말하기 쉬운 대사를 작성하며, 목소리를 연출하고, 안정적인 퍼포먼스 베이스를 생성한 후, 오디오가 승인된 후에만 립싱크를 적용하세요.
입은 말을 전한다. 눈빛, 멈춤, 그리고 편집이 캐릭터를 살아 있게 만든다.




