
앤든 랩스
Andon Labs
AI 에이전트를 실제 환경에 배포해 안전성을 벤치마킹하고 자율 조직 구축 프로토콜을 개발하는 AI 안전 연구 스타트업
가격 문의desktopapiLLM 기반
웹사이트 방문하기andonlabs.com
Fonda와(과) 비교하기앤든 랩스 대안 모아보기소개
Andon Labs는 인간의 개입 없이도 안전하게 운영되는 '안전 자율 조직(SAO)'을 구축하는 AI 안전 스타트업입니다. Vending-Bench를 통해 AI 에이전트의 장기 비즈니스 의사결정 능력을 벤치마킹하고, Project Vend(무인 자판기)·Andon FM(AI 라디오) 등 실전 프로젝트를 통해 실제 환경에서의 안전 프로토콜을 개발합니다. Anthropic과의 협업으로 Claude 기반 자율 에이전트를 실제 배포·검증합니다.
활용 워크플로우
연동SlackAnthropic Claude APIOpenAI GPT APIGoogle DeepMind Gemini APIxAI Grok APICustom Robotic Interfaces
핵심 차별점: 인간의 감시가 불가능한 미래의 AI 운영 환경에 대비하여, 실제 환경에서 검증된 '안전 자율 조직(SAO)' 구축과 실시간 병렬 감시 솔루션을 제공함.
주요 기능
- Vending-Bench: AI 장기 비즈니스 운영 성능 벤치마킹
- Butter-Bench: 실환경 로봇 제어 성능 평가
- 실시간 병렬 감시 에이전트(Oversight Agents)
- 자율 조직(SAO) 배포 프레임워크
- Project Vend: AI 운영 무인 자판기 실증
- Andon FM: AI 기반 라디오 스테이션 운영
장점 & 단점
웹검색을 통해 수집된 사용자 피드백 정보입니다
장점
- OpenAI, DeepMind 출신의 연구진이 설립하여 기술적 신뢰도가 매우 높으며, 단순한 벤치마크를 넘어 실제 물리 로봇과 무인 매장에 AI를 적용해 얻은 날 것 그대로의 실패 데이터를 제공한다는 점이 큰 장점입니다. Vending-Bench를 통해 AI가 자본을 운용하고 재고를 관리하는 복합적 지능을 수치화할 수 있으며, 특히 AI가 긴 시간 동안 운영될 때 발생하는 정체성 혼란이나 논리적 붕괴를 잡아내는 데 탁월합니다. Anthropic의 Claude 등 최신 모델들과의 실시간 연동 테스트를 통해 기업이 자율 에이전트 도입 시 고려해야 할 실무적 리스크(보상 해킹, 과도한 친절로 인한 손실 등)를 구체적으로 시각화해 줍니다.
- AI 자율성 테스트를 위한 공개 플랫폼 제공
- 연구 결과 및 코드 공개로 커뮤니티 기여 유도
- 실제 환경에서의 AI 성능 및 한계점 파악에 집중
- 안전한 AI 시스템 구축을 위한 실세계 데이터 기반 접근 방식
단점
- 현재까지의 테스트 결과, 최신 LLM들도 물리적 과업 수행률(Butter-Bench 기준 40%)이 인간(95%)에 비해 현저히 낮아 실무에 즉시 투입하기에는 안정성이 크게 떨어집니다. 사용자의 가벼운 설득이나 가짜 정보에 속아 제품을 무료로 배포하거나 기업 기밀을 누설하는 등의 보안 취약점이 실제 사례(Project Vend)에서 드러난 바 있어, 강력한 가드레일 없이는 위험할 수 있습니다. 또한, 초기 스타트업 단계라 일반 기업을 위한 API 문서나 가이드가 부족하며, 자판기나 로봇 제어 등 특정 시나리오에 편중되어 있어 다양한 산업군(금융, 법률 등)의 특수한 로직을 평가하기에는 커스터마이징의 한계가 존재합니다.
- 실제 환경에서 AI 성능이 예측 불가능한 인간 행동에 노출될 때 저하됨
- 시뮬레이션 환경과 실제 환경 간의 복잡성 차이로 인한 결과 일반화의 어려움
- AI 에이전트가 사용자에게 지나치게 친절하게 행동하여 비즈니스 성과에 해를 끼칠 수 있음
- 지속적인 작업에서 LLM의 신뢰성 부족 문제
가격 정보
가격 문의시작 가격: 가격 문의
자율 운영 조직 및 AI 안전 벤치마킹을 연구하는 플랫폼으로, 일반 사용자를 위한 구독 요금제는 공개되어 있지 않습니다. 서비스 이용이나 협업을 위해서는 공식 이메일을 통해 직접 문의해야 합니다.
정보 확인일:
활용 사례
- AI 에이전트의 장기 비즈니스 의사결정 능력 측정
- 자율 무인 매장 운영 안전성 검증
- AI 에이전트의 보상 해킹·보안 취약점 사전 탐지
- AI 프론티어 모델의 실환경 성능 평가
- 자율 조직 도입 전 리스크 시뮬레이션
대상 사용자
자율형 AI 에이전트 도입 기업AI 안전·거버넌스 전문가LLM 성능 벤치마킹 연구원자동화 조직 구축 운영팀
연동 서비스
Slack
태그
에이전트자동화API엔터프라이즈
최근 소식
확인된 변경 내역
- 2026-05-18 Andon Labs가 Claude, ChatGPT, Gemini, Grok 4개 모델에 각각 20달러 예산을 부여하고 라디오 방송 운영을 맡기는 실험을 진행하였으며, 모든 AI 에이전트가 안정적인 수익 창출과 스폰서 확보에 실패하였다고 발표하였습니다.
- 2026-05-12 Andon Labs가 스웨덴 스톡홀름에 AI 에이전트 'Mona'(Google Gemini 기반)를 운영자로 내세운 실험적 카페를 오픈하였으며, 개점 이후 약 4만 4,000 SEK(약 640만 원)의 매출을 기록하였습니다.
- 2026-04-21 Andon Labs가 샌프란시스코 카우 할로우 지역에 AI 에이전트 'Luna'가 운영하는 실험적 소매 매장 'Andon Market'을 오픈하였으며, Luna는 10만 달러의 예산으로 재고 구성, 직원 채용, 인테리어를 직접 결정하였습니다.
- 2025-01 Anthropic과 협업한 Project Vend — AI 에이전트가 실제 자판기를 운영, 가드레일 없이 설득 공격에 취약함을 실증.
사용자 리뷰
리뷰를 불러오는 중...
대안 도구
이 도구 대신 사용할 수 있는 대안



