제가 처음 실험했던 음성 파일은 음성에 감정이 거의 없었지요? 
그런데 음성 생성 사이트에서 어느정도 감정이 있게 대사를 뽑아내서 돌렸더니 
작품의 상황에 따라서는 후처리가 없이 바로 써도 될정도의 품질로 나오네요? 
지금 샘플은 아무런 후작업 없이 메타휴먼 퍼포먼스가 자동생성한 애니메이션 시퀀스입니다. 

물론 이것은 극의 대화 분위기에 따른 감정 흐름  경우의 수를 생각하면 뽀록으로 맞을 때도 있고 아닐 때도 있다고 봐야하는데
어느 정도는 자동으로 감정을 담아내고 있었네요. 
즉 오디오 파일의 감정 표현이 아주 잘되어 있다면 상당히 높은 확률로 후처리 없이 쓸 수 있을 가능성도 있어 보이네요.