AirLLM vs vLLM
2つのAIツールの機能・価格・特徴を詳しく比較します。
| 項目 | AirLLM | vLLM |
|---|---|---|
| 料金タイプ | 無料 | 無料 |
| 韓国語対応 | 非対応 | 対応 |
| プラットフォーム | Linux, macOS, CUDA-enabled NVIDIA GPUs, Apple Silicon | Linux, Docker, API, CLI |
| オープンソース | 対応 | 対応 |
| API 提供 | - | 提供 |
| SDK | - | 提供 |
| LLMベース | - | - |
| マルチモーダル | - | 対応 |
| AIモデル | Llama, Qwen, DeepSeek, Mistral, Mixtral, Phi, Gemma | - |
| GitHub Stars | 33.8K | 80.8K |
| 開発元 | Anima AI LLC | vLLM Project |
| カテゴリ | 開発ツール | 開発ツール |
| 詳細 | 見る | 見る |
AirLLM の主な機能
- 레이어 단위 모델 스트리밍으로 GPU 메모리 사용량 절감
- 단일 4GB GPU에서 70B급 모델 추론 지원
- Hugging Face 모델 ID 기반 AutoModel 인터페이스
- 4비트·8비트 블록 단위 모델 압축
- CPU 추론 및 Apple Silicon macOS 지원
- Llama, Qwen, DeepSeek, Mistral 등 다양한 모델 계열 지원
vLLM の主な機能
- PagedAttention 기반 KV 캐시 메모리 최적화
- 비동기 스케줄러로 TTFT(첫 토큰 지연) 감소
- 지속적 배칭(Continuous Batching)으로 처리량 극대화
- FP8·INT8 양자화 및 Speculative Decoding 지원
- NVIDIA·AMD·Google TPU·Intel Gaudi 멀티 하드웨어 지원
- OpenAI API 호환 서버 제공