리스너 vs 루마

두 AI 도구의 기능, 가격, 특징을 상세하게 비교합니다.

리스너

900여 개의 목소리로 텍스트를 고품질 오디오와 비디오로 변환하는 AI 팟캐스트 및 콘텐츠 제작 툴

상세 리뷰 보기

루마

텍스트와 이미지로 고품질 영상을 만들고 촬영만으로 실사 같은 3D 에셋을 생성하는 AI 플랫폼

상세 리뷰 보기
특성리스너루마
가격 유형무료 + 유료 ($0.05/월부터)무료 + 유료 ($7.9/월부터)
한국어 지원부분 지원미지원
플랫폼Desktop, MobileMobile
오픈소스미지원미지원
API 제공제공제공
SDK-제공
LLM 기반--
멀티모달지원지원
AI 모델-Dream Machine
GitHub Stars--
개발사ListnrLuma AI
카테고리오디오/비디오AI 비디오 생성
상세보기보기 보기

리스너 장단점

  • 1,000개 넘는 음성과 142개 언어로 다국어 콘텐츠 폭이 넓음
  • 오디오 생성부터 RSS 배포까지 한 도구 안에서 끝나는 워크플로우
  • 초보자도 헤매지 않는 비교적 단순한 편집 화면
  • TTS 외에 보이스 클로닝과 AI 영상 제작까지 한 번에 처리
  • 무료 버전의 경우 변환 가능한 글자 수 제한이 엄격함
  • 일부 언어나 목소리에서 다소 기계적인 억양이 느껴질 수 있음
  • 고급 기능을 모두 활용하려면 높은 등급의 요금제가 필요함

루마 장단점

  • 물리 거동을 반영한 영상 품질 — 움직임과 반사가 어색하게 깨지는 경우가 적음
  • 모바일 앱만으로 3D 스캔이 가능해 별도 촬영 장비 없이 워크플로우를 시작할 수 있음
  • Turbo 모드로 초안을 빠르게 뽑고 수정하는 반복 작업에 유리함
  • 반사되는 물체나 복잡한 질감도 비교적 정확하게 렌더링함
  • 복잡한 인물의 움직임에서 드물게 발생하는 형태 왜곡
  • 고해상도 결과물 및 상업적 이용을 위한 유료 구독 필요
  • 무료 플랜의 제한적인 크레딧과 워터마크 노출

리스너 주요 기능

  • 1,000개 이상의 AI 음성과 142개 언어 지원
  • RSS 피드 기반 팟캐스트 호스팅과 Spotify·Apple Podcasts 자동 배포
  • 10초 샘플로 특정 화자 목소리를 복제하는 보이스 클로닝
  • Multi-Voice로 여러 화자가 주고받는 대화형 오디오 제작
  • Speech Styles·Voice Inflections로 감정·강조·멈춤 단위 조절
  • Custom Pronunciations로 브랜드명·전문 용어 발음 직접 지정

루마 주요 기능

  • Ray3.2 영상 생성: 네이티브 1080p, 최대 16개 멀티 키프레임, HDR 출력, 20초 클립, 8인 얼굴 추적 지원
  • Dream Machine 2.0: 영상 생성과 편집을 한 화면에서 다루는 제작 스튜디오
  • 카메라 컨트롤: 줌·팬·틸트·팔로우·오빗 등 카메라 움직임과 키프레임을 직접 지정
  • 3D 스캔: 스마트폰 촬영 영상을 NeRF와 가우시안 스플래팅으로 3D 자산화
  • Genie: 텍스트 프롬프트로 3D 에셋 생성
  • 개발자 API: 영상·3D 생성을 코드로 호출해 자동화