큐웬 3 vs 리스너
두 AI 도구의 기능, 가격, 특징을 상세하게 비교합니다.
| 특성 | 큐웬 3 | 리스너 |
|---|---|---|
| 가격 유형 | 무료 | 무료 + 유료 ($0.05/월부터) |
| 한국어 지원 | 미지원 | 부분 지원 |
| 플랫폼 | Web, Hugging Face, ModelScope, API, On-Premise | Desktop, Mobile |
| 오픈소스 | 지원 | 미지원 |
| API 제공 | 제공 | 제공 |
| SDK | 제공 | - |
| LLM 기반 | 지원 | - |
| 멀티모달 | - | 지원 |
| AI 모델 | Qwen | - |
| GitHub Stars | 27.6K | - |
| 개발사 | Alibaba Cloud (Alibaba Group) | Listnr |
| 카테고리 | 챗봇 | 오디오/비디오 |
| 상세보기 | 보기 | 보기 |
큐웬 3 장단점
- 코딩과 수학 벤치마크에서 GPT-4o와 견줄 만한 점수를 내고, 119개 언어가 학습 데이터에 포함되어 한국어 등 비영어권 처리도 무난한 편입니다.
- MoE(Mixture-of-Experts) 구조라 235B 모델도 한 번에 활성화되는 파라미터가 22B 수준에 그쳐, 전체 크기 대비 추론 비용 부담이 작습니다.
- 0.6B부터 235B까지 라인업이 갖춰져 있어 모바일·엣지 기기부터 대규모 서버까지 환경에 맞춰 골라 쓸 수 있습니다.
- Apache 2.0 라이선스로 가중치가 공개되어 로컬 배포와 파인튜닝을 자유롭게 할 수 있습니다.
- 고난도 논리 문제에서는 여전히 간헐적인 환각 현상이 보고됩니다.
- 특정 지식의 암기력이나 정밀도 면에서는 딥시크(DeepSeek) 모델보다 다소 떨어진다는 사용자 평가가 있습니다.
- Omni 모델로 비디오·오디오를 실시간 처리하려면 상당한 VRAM(GPU 메모리)이 필요해, 개인용 PC에서 전체 성능을 끌어내기에는 진입 장벽이 있는 편입니다.
리스너 장단점
- 1,000개 넘는 음성과 142개 언어로 다국어 콘텐츠 폭이 넓음
- 오디오 생성부터 RSS 배포까지 한 도구 안에서 끝나는 워크플로우
- 초보자도 헤매지 않는 비교적 단순한 편집 화면
- TTS 외에 보이스 클로닝과 AI 영상 제작까지 한 번에 처리
- 무료 버전의 경우 변환 가능한 글자 수 제한이 엄격함
- 일부 언어나 목소리에서 다소 기계적인 억양이 느껴질 수 있음
- 고급 기능을 모두 활용하려면 높은 등급의 요금제가 필요함
큐웬 3 주요 기능
- 하이브리드 추론 모드 (사고/비사고 동적 전환)
- 0.6B~235B 다양한 크기의 밀집·MoE 모델 제공
- 36조 토큰·119개 언어 학습 데이터
- 코딩·수학·논리 추론 벤치마크 최상위권
- Apache 2.0 라이선스 상업적 무료 사용 가능
리스너 주요 기능
- 1,000개 이상의 AI 음성과 142개 언어 지원
- RSS 피드 기반 팟캐스트 호스팅과 Spotify·Apple Podcasts 자동 배포
- 10초 샘플로 특정 화자 목소리를 복제하는 보이스 클로닝
- Multi-Voice로 여러 화자가 주고받는 대화형 오디오 제작
- Speech Styles·Voice Inflections로 감정·강조·멈춤 단위 조절
- Custom Pronunciations로 브랜드명·전문 용어 발음 직접 지정