
인공지능 커버 영상 유튜버와의 페이스북 화상 채팅 대화 중 일부 발췌.
두서없이 질문 내역 바로 가겠습니다.
1. 소문처럼 그냥 시나리오[프롬프트라고 불리는] 만을 입력하면 인공지능이 다 알아서 만드는가?
= 아니다! 인공지능은 그저 도마나 식칼 따위에 불과하다! 칼로 썰지만 어떤 모양으로 어떻게 썰지는 사람이 해야 한다.
2. 시나리오를 입력하면 한 번에 뽑히나?
= 아니다! 보컬의 음정이 한번에 들어가기는 한다! 하지만 떨리는 호흡 소리, 감정의 고조는 없다. 전화에서 들려오는 여성 녹음 인공지능이 음정만 맞게 노래를 한다고, 감정의 고조나 호흡의 변화 없이 그게 잘 불렀다고 볼 수 있나?
3. 그럼 인공지능 보컬을 평균 몇 번을 돌리나?
= 서른 번 정도는 돌리는 것 같다. [심신의 오직 하나 뿐인 그대]의 경우 심신이 노래 부르는게 아닌 말하는 말투도 학습 시켰다. 말하는 말투/노래 부름에서 어디서 들숨과 날숨이 들리는지, 감정이 고조되는지를 다 따와야 한다.
4. 악기는 본인이 연주하나? 백그라운드 사운드 역시?
= 악기는 내가 해야 한다. 백그라운드 사운드는 인공지능이 하기는 하지만 사운드 검색에 불과하다. 소리를 어디에 어떻게 배치할지도 내가 해야 한다.
1. 소문처럼 그냥 시나리오[프롬프트라고 불리는] 만을 입력하면 인공지능이 다 알아서 만드는가?
= 아니다! 인공지능은 그저 도마나 식칼 따위에 불과하다! 칼로 썰지만 어떤 모양으로 어떻게 썰지는 사람이 해야 한다.
2. 시나리오를 입력하면 한 번에 뽑히나?
= 아니다! 보컬의 음정이 한번에 들어가기는 한다! 하지만 떨리는 호흡 소리, 감정의 고조는 없다. 전화에서 들려오는 여성 녹음 인공지능이 음정만 맞게 노래를 한다고, 감정의 고조나 호흡의 변화 없이 그게 잘 불렀다고 볼 수 있나?
3. 그럼 인공지능 보컬을 평균 몇 번을 돌리나?
= 서른 번 정도는 돌리는 것 같다. [심신의 오직 하나 뿐인 그대]의 경우 심신이 노래 부르는게 아닌 말하는 말투도 학습 시켰다. 말하는 말투/노래 부름에서 어디서 들숨과 날숨이 들리는지, 감정이 고조되는지를 다 따와야 한다.
4. 악기는 본인이 연주하나? 백그라운드 사운드 역시?
= 악기는 내가 해야 한다. 백그라운드 사운드는 인공지능이 하기는 하지만 사운드 검색에 불과하다. 소리를 어디에 어떻게 배치할지도 내가 해야 한다.
악기도 직접 연주해야 되는 거군요. | ||
▶ 인공지능 커버 영상 유튜버와의 페이스북 화상 채팅 대화 중 일부 발췌. [1]
2026-06-07
1065
View all posts (195)









